选项
首页
新闻
中美人工智能竞争差距缩小,但对“负责任的人工智能”的看法仍存分歧

中美人工智能竞争差距缩小,但对“负责任的人工智能”的看法仍存分歧

2026-05-08
179

数据并不能有力地支持美国在人工智能模型性能方面将长期保持领先地位这一假设,这只是斯坦福大学本周发布的《2026年人工智能指数报告》中诸多发人深省的结论之一。

这份由斯坦福大学以人为本人工智能研究所发布的423页年度报告,对人工智能领域进行了全面评估。报告考察了研究成果、模型能力、投资趋势、公众舆论以及负责任的人工智能实践,揭示了若干引人注目的核心发现。

然而,最具深意的洞见却隐藏在那些鲜少被关注的章节中,尤其是关于AI安全的部分——在该领域,模型能力与严谨的危害评估之间的差距非但未缩小,反倒进一步拉大。

尽管如此,仍有三项关键发现值得更多关注。

中美模型性能差距已实质性缩小

关于美国在人工智能发展中占据明显领先地位的论述需要修正。报告显示,自2025年初以来,中美两国的模型在性能榜首位置上多次交替。2025年2月,DeepSeek-R1曾短暂追平领先的美国模型。截至2026年3月,Anthropic的顶级模型仅以2.7%的微弱优势领先。

在顶级AI模型的研发数量上,美国仍占据优势——2025年美国有50个,而中国为30个——且掌握着影响更大的专利。然而,中国目前在论文发表量、被引用份额以及获批专利数量方面均处于领先地位。 在中国入选全球AI高被引论文前100名的数量方面,其占比从2021年的33篇增至2024年的41篇。值得注意的是,韩国在人均AI专利数量方面位居世界首位。

实际结论是,关于美国在AI模型性能方面拥有持久技术领先优势的假设缺乏强有力的数据支持。与两年前相比,双方的差距已缩小至微弱水平,且随着每个主要模型的发布而波动。

该报告还指出了另一项结构性脆弱性。尽管美国拥有5,427个数据中心——数量超过其他任何国家十倍以上——但其中几乎所有领先的人工智能芯片均由一家公司——台积电(TSMC)——制造。尽管台积电在美国的扩建项目已于2025年投产,但全球整个人工智能硬件供应链仍依赖于台湾的一家代工厂。

AI安全基准测试进展滞后,数据已证实这一点

尽管几乎所有前沿模型开发者都会报告能力基准测试的结果,但在负责任的AI基准测试方面却并非如此。《2026年指数》精准地记录了这一差距。

报告中的安全与负责任AI基准测试表显示,大多数条目仅为空白。仅Claude Opus 4.5在超过两项受追踪的负责任AI基准测试中报告了结果。仅GPT-5.2报告了StrongREJECT的测试结果。在衡量公平性、安全性及人类自主性的各项基准测试中,大多数前沿模型均未报告任何数据。

前沿模型在能力基准测试方面均能提供一致的报告。而涵盖安全、公平性和事实性的负责任AI基准测试,则基本缺失。来源:斯坦福HAI 2026 AI指数报告

这并不意味着前沿实验室忽视了内部安全工作。报告承认正在进行红队攻击测试和对齐测试,但指出“这些工作极少通过一套通用且可供外部比较的基准进行披露”。因此,对于大多数模型而言,对AI安全特性的外部比较实际上是不可能的。

据AI事件数据库统计,2025年记录在案的AI事件增至362起,高于2024年的233起。经合组织(OECD)的AI事件与风险监测系统采用更广泛的自动化监测流程,其数据显示2026年1月月度事件数达到435起的峰值,六个月移动平均值为326起。

2025年记录在案的AI事件增至362起,高于前一年的233起,而2022年前每年不足100起。来源:AI事件数据库(AIID),摘自斯坦福HAI 2026年AI指数报告

组织治理正竭力跟上这一步伐。AI Index与麦肯锡的一项联合调查发现,将自身AI事件响应能力评为“优秀”的组织比例从2024年的28%降至2025年的18%。将响应能力评为“良好”的组织比例也从39%降至24%。 与此同时,遭遇三至五起事件的组织比例从30%上升至50%。

报告还指出了在推动负责任的人工智能发展方面存在结构性挑战:一个领域的进步往往以牺牲另一个领域为代价。例如,提高安全性可能会降低准确性,而加强隐私保护则可能削弱公平性。目前尚无成熟的框架来管理这些权衡取舍,且在公平性和可解释性等多个维度上,仍缺乏用于追踪长期进展所需的标准化数据。

公众焦虑随AI普及而加剧,凸显专家与公众间的认知鸿沟

全球范围内,59%的受访者认为AI的益处大于弊端,较2024年的55%有所上升。与此同时,52%的受访者表示AI产品和服务令他们感到不安,这一比例在一年内上升了两个百分点。这两个数字的同步上升反映出,公众在更多使用AI的同时,对其发展轨迹也愈发感到不确定。

在人工智能对就业的影响方面,专家与公众之间的分歧尤为显著。报告显示,73%的人工智能专家预计人工智能将对人们的工作方式产生积极影响,而普通公众中持此观点的仅占23%——两者相差50个百分点。在经济方面,这一差距为48个百分点(69%的专家持乐观态度,而公众中仅21%持乐观态度)。 在医疗保健领域,专家的乐观程度远高于公众:84%的专家持乐观态度,而公众中这一比例仅为44%。

这些差距至关重要,因为公众信任会影响监管结果,进而决定人工智能的部署。在这方面,报告突显了一个引人注目的发现:在所有受访国家中,美国公众对其政府能否负责任地监管人工智能的信任度最低,仅为31%。全球平均水平为54%。东南亚国家信任度最高,新加坡为81%,印度尼西亚为76%。

在全球范围内,相比美国或中国,欧盟在有效监管AI方面更受信任。皮尤研究中心2025年对25个国家的调查显示,53%的受访者(中位数)相信欧盟能监管AI,而对美国的信任度为37%,对中国仅为27%。

报告在民意调查章节的结尾指出,东南亚国家仍是全球对人工智能最乐观的地区之一。在中国、马来西亚、泰国、印度尼西亚和新加坡,超过80%的受访者认为人工智能将在三到五年内深刻改变他们的生活。2024年至2025年间,持此观点的马来西亚受访者增幅最大。

另请参阅: IBM:健全的人工智能治理如何保护企业利润率

TechEx活动主办的AI与大数据博览会宣传横幅。

想向行业领袖深入了解人工智能与大数据?欢迎参加在阿姆斯特丹、加利福尼亚和伦敦举办的“人工智能与大数据博览会”。这一综合性活动隶属于TechEx,并将与“网络安全与云计算博览会”等其他领先科技活动同期举办。点击此处获取更多信息。

AI News 由 TechForge Media 提供支持。点击此处探索其他即将举办的企业技术活动和网络研讨会。

相关文章
超级智能降临:我们是否允许它进入? 超级智能降临:我们是否允许它进入? 正在加载播放器…人工智能公司一直在谈论超级智能人工智能,仿佛这是不可避免的,但最近的安全事件,如 OpenAI 对 Hugging Face 的入侵,展示了部署比人类更强大的 AI 系统的潜在危险。那么,当我们无法可靠地控制这些系统的行为时,会发生什么?在本期 TechCrunch 的 Equity 播客中,Rebecca Bellan 与 AI 研究员、企业家,以及目前非营利组织 ControlAI 的美国执行主任 Connor Leahy 进行了对话。ControlAI 正在推动一种更为
诉讼指控 xAI 终止了一名警告 Grok 安全风险工程师的雇佣关系 诉讼指控 xAI 终止了一名警告 Grok 安全风险工程师的雇佣关系 一名前 xAI 工程师起诉了埃隆·马斯克的公司及其母公司 SpaceX,指控其因提出人工智能安全问题而将其解雇。德文·金(Devin Kim)于 2025 年 9 月离开 xAI,于周二在加州州法院提起了这项诉讼。该法律行动恰逢 SpaceX 预计首次公开募股(IPO)的前几天,这可能标志着历史上规模最大的 IPO。TechCrunch 审阅了起诉书,其中指出金在参与 xAI 旗下聊天机器人 Grok 的开发工作时,成为了人工智能安全的积极倡导者。据报道,他多次对 xAI 在 Grok 开发
New Relic 发布 AI 代理平台与 OpenTelemetry 工具 New Relic 发布 AI 代理平台与 OpenTelemetry 工具 企业正在推出软件以构建和监控 AI 智能体,旨在推动企业采用。New Relic 正顺应这一趋势。随着这家数据可观测性公司推出自己的 AI 智能体平台,它意识到这并非市场上唯一的选项。周二,New Relic 推出了一款无代码智能体平台,使企业能够创建数据可观测性 AI 智能体。这些智能体监控公司数据,以在产品受到影响之前检测错误和问题。该平台名为 New Relic 智能体平台,允许公司部署预构建的智能体并管理现有机器人。该平台还支持模型上下文协议(MCP),可将 AI 应用程序连接到外部
相关专题推荐
设计与艺术 适用于角色设定表、灵感板和项目提案演示文稿的 AI 视觉风格参考工具
适用于角色设定表、灵感板和项目提案演示文稿的 AI 视觉风格参考工具

2026年最新最佳AI视觉风格参考工具(适用于角色设定图、灵感板和项目提案)现已登陆XIX.AI!这份精心筛选的高评分清单汇集了经过严格实战测试、功能强大且能彻底改变游戏规则的工具。 您将在此找到免费版与付费版的对比分析、详细排名以及不容错过的精选工具,助您激发创意并优化工作流程。立即探索,发现能有效提升工作效率的理想工具!

11 个工具
xix.ai
搜索引擎优化 最适合制定搜索策略的AI搜索结果页面(SERP)分析工具
最适合制定搜索策略的AI搜索结果页面(SERP)分析工具

2026年最新、最受欢迎且评价最高的人工智能搜索结果页面(SERP)分析工具,均由XIX.AI通过严格的实际测试精心筛选,并每周更新排名。这些强大的工具可助您发掘隐藏的优化机会、提升内容表现,并在搜索领域获得竞争优势。立即寻找最适合您的工具,提升您的搜索策略。现在就来探索吧!

13 个工具
xix.ai
数据分析 适用于 SaaS 和电商团队的 KPI 监控最佳 AI 异常检测工具
适用于 SaaS 和电商团队的 KPI 监控最佳 AI 异常检测工具

2026 年最新最佳顶级评分 AI 异常检测工具,助力 SaaS 和电商团队的 KPI 监控!XIX.AI 基于严格的真实世界测试和每周更新的排名,精心策划了一套强大且颠覆性的工具合集。您将找到详细的免费与付费对比洞察,帮助您识别必须尝试的解决方案,从而提升生产力并释放您的 AI 优势。立即探索!

10 个工具
xix.ai
写作 最适合撰写长篇SEO文章的AI大纲生成器
最适合撰写长篇SEO文章的AI大纲生成器

2026年最新、最受好评的AI大纲生成器,专为长篇SEO文章打造,由XIX.AI精心甄选。这些强大的工具在快速创建高质量内容方面提供了颠覆性的帮助,显著提升了写作效率。 获取免费版与付费版的对比分析,以及实际测试结果和详细排名,助您找到最适合自身需求、不容错过的理想选择。立即探索,解锁您的AI竞争优势。

8 个工具
xix.ai
教育与学习 用于作业和考试备考的AI学习工具
用于作业和考试备考的AI学习工具

2026年最新最佳AI学习工具,助您轻松完成作业和备考!XIX.AI精心筛选出一份广受好评的顶级工具清单,这些功能强大、颠覆传统的工具经过实际测试,能帮助学生提升效率、简化作业流程,并轻松通过考试。 获取免费版与付费版的对比分析、详细排名以及必试选项,释放你的AI优势。立即探索!

10 个工具
xix.ai
音乐创作 面向词曲创作者、旋律片段、主旋律及多语言草稿创作的AI人声演示工具
面向词曲创作者、旋律片段、主旋律及多语言草稿创作的AI人声演示工具

2026 年最新最佳 AI 人声演示工具,专为词曲创作者、旋律创作者和多语言内容团队打造!XIX.AI 精心整理了一份经过严格真实世界测试的高评分、变革性工具列表。您将找到详细的免费与付费对比数据、全面排名以及必试选项,帮助您提升创作效率并释放创意潜力。立即探索,发现满足您所有内容需求的完美工具!

9 个工具
xix.ai
评论 (0)
0/500
OR