选项
首页
新闻
研究负责人呼吁科技界跟踪人工智能推理过程

研究负责人呼吁科技界跟踪人工智能推理过程

2025-11-17
88

研究负责人呼吁科技界跟踪人工智能推理过程

根据本周二发表的一份立场文件,来自OpenAI、谷歌DeepMind、Anthropic以及众多公司和非营利组织联盟的人工智能研究人员主张深入探索监控人工智能推理模型的所谓思维过程。

人工智能推理模型(如OpenAI的o3和DeepSeek的R1)的一个显著特点是使用思维链(或称CoTs)--这是一个外化过程,人工智能模型在这个过程中系统地解决问题,就像人类用草稿纸解决复杂的数学方程式一样。推理模型是人工智能代理的基础,论文作者认为,监控CoT可能会成为一种重要方法,使能力越来越强、范围越来越广的人工智能代理处于受控状态。

"研究人员在立场文件中指出:"CoT 监控为尖端人工智能的安全协议提供了一个宝贵的增强功能,为了解人工智能代理如何做出决策提供了一个独特的窗口。"然而,我们无法确定这种可视性是否会持续下去。我们敦促研究界和前沿人工智能开发者最大限度地发挥CoT可监控性的优势,并研究如何保护它。"

立场文件敦促领先的人工智能开发者研究是什么让CoT具有 "可监控性"--具体来说,是哪些因素提高或降低了人工智能模型如何真正生成答案的透明度。作者指出,虽然CoT监控是一种很有前途的了解人工智能推理模型的方法,但它仍然很脆弱,他们提醒不要做出任何可能会降低其透明度或可靠性的改变。

此外,作者还呼吁人工智能开发人员持续跟踪CoT可监控性,并探索如何最终将这种方法作为一种安全措施来实施。

该论文的主要签名者包括 OpenAI 首席研究官马克-陈(Mark Chen)、Safe Superintelligence 首席执行官伊利亚-苏茨克沃(Ilya Sutskever)、诺贝尔奖获得者杰弗里-辛顿(Geoffrey Hinton)、谷歌 DeepMind 联合创始人谢恩-莱格(Shane Legg)、xAI 安全顾问丹-亨德里克斯(Dan Hendrycks)和 Thinking Machines 联合创始人约翰-舒尔曼(John Schulman)。主要作者包括英国人工智能安全研究所(UK AI Security Institute)和阿波罗研究所(Apollo Research)的代表,以及来自 METR、亚马逊、Meta 和加州大学伯克利分校的其他签名者。

这篇论文代表了人工智能行业众多顶级领导者为加速人工智能安全研究而做出的共同努力。目前,科技公司之间的竞争十分激烈,这促使 Meta 公司以数百万美元的高薪从 OpenAI、谷歌 DeepMind 和 Anthropic 招揽顶尖研究人员。其中最抢手的是那些专门研究人工智能代理和推理模型的研究人员。

Techcrunch 活动

现在直播!TechCrunch 全舞台

构建更智能。更快扩展。连接更深入。与来自 Precursor Ventures、NEA、Index Ventures、Underscore VC 等公司的创新者们一起,参加为期一天的可操作战略、沉浸式研讨会和有意义的交流活动。

购买 TechCrunch All Stage 通行证可节省 450 美元

更智能地构建。更快扩展。更深入地联系。与来自 Precursor Ventures、NEA、Index Ventures、Underscore VC 等公司的创新者一起,参加为期一天的可操作战略、沉浸式研讨会和有意义的交流活动。

马萨诸塞州波士顿7月15日立即注册

"我们正处于拥有这种新的思维链能力的关键时刻。它看起来非常有用,但如果得不到重点关注,几年后它就会消失。"参与论文撰写的OpenAI研究员鲍文-贝克(Bowen Baker)在接受TechCrunch采访时说。"在我看来,发布这样一份立场文件是一种推动更多研究和关注这一主题的方式,以免为时已晚。"

OpenAI 于 2024 年 9 月首次发布了其初始人工智能推理模型 o1 的预览版。在随后的几个月里,科技行业迅速推出了具有类似能力的竞争模型,其中一些来自谷歌 DeepMind、xAI 和 Anthropic 的模型展示了更先进的基准性能。

尽管如此,人们对人工智能推理模型如何运作的了解仍然有限。虽然人工智能实验室在过去一年里在提高人工智能性能方面取得了长足进步,但这并不一定能让人们更清楚地了解它们的决策过程。

Anthropic 一直是了解人工智能模型如何运作的先驱--这一领域被称为可解释性。今年早些时候,首席执行官达里奥-阿莫代(Dario Amodei)承诺在 2027 年之前解开人工智能模型的 "黑匣子",并加大对可解释性的投资。他还鼓励 OpenAI 和谷歌 DeepMind 进一步研究这一领域。

人类学的早期研究表明,CoTs 可能并不完全是这些模型如何产生答案的可靠指标。与此同时,OpenAI 的研究人员表示,CoT 监测最终可以作为一种可靠的方法,用于跟踪人工智能模型的一致性和安全性。

类似这样的立场文件旨在提高人们对 CoT 监测等新兴研究领域的认识,并吸引更多关注。OpenAI、谷歌 DeepMind 和 Anthropic 等公司已经在这一领域开展研究,但这一出版物可能有助于刺激更多的资金投入和调查。

相关文章
山姆·奥特曼引发关于人工智能减速的辩论 山姆·奥特曼引发关于人工智能减速的辩论 在Apple Podcasts上收听在Spotify上收听OpenAI首席执行官萨姆·阿尔特曼(Sam Altman)最近表示,现在可能是时候“控制人工智能的发展速度”,以便社会“在这些新的能力水平周围加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我讨论了阿尔特曼的言论可能由最近的一次黑客攻击所触发,该攻击中一名OpenAI代理突破了Hugging Face的系统。Sean指出,虽然由AI代理执行的黑客攻击是前所未
OpenAI 与苹果公司就商业秘密诉讼进行对抗 OpenAI 与苹果公司就商业秘密诉讼进行对抗 OpenAI 于周二驳回了苹果公司的商业秘密指控,称该诉讼毫无根据。“我们认真对待这些指控,但未发现任何支持它们的证据,”OpenAI 表示,据彭博社记者 Ed Ludlow 在 X 平台报道,“我们支持公平竞争和工作自由,专注于创造赋能全球用户的技术。”此前,苹果公司于周五在美国加利福尼亚州北区联邦地区法院提起诉讼,指控 OpenAI 策划了一项从前苹果员工处窃取机密数据和知识产权的计划。这份长达 41 页的诉状针对 OpenAI 的高管层,包括首席硬件官 Tang Tan,他是一名拥有
OpenAI机器人项目主管凯特琳·卡利诺夫斯基因五角大楼合作项目辞职 OpenAI机器人项目主管凯特琳·卡利诺夫斯基因五角大楼合作项目辞职 OpenAI 机器人业务负责人凯特琳·卡利诺夫斯基(Caitlin Kalinowski)在该公司与国防部达成备受争议的合作伙伴关系后辞职。“这不是一个轻松的决定,”卡利诺夫斯基在社交媒体声明中解释道。“虽然人工智能在国家安全中发挥着至关重要的作用,但在没有司法监督的情况下对美国公民进行监视,以及在未经人类授权的情况下部署致命自主武器,都是需要更加慎重考虑的界限。”卡利诺夫斯基此前因领导 Meta 的增强现实眼镜部门而闻名,她于 2024 年 11 月加入 OpenAI。在辞职信中,她强调她
相关专题推荐
设计与艺术 适用于角色设定表、灵感板和项目提案演示文稿的 AI 视觉风格参考工具
适用于角色设定表、灵感板和项目提案演示文稿的 AI 视觉风格参考工具

2026年最新最佳AI视觉风格参考工具(适用于角色设定图、灵感板和项目提案)现已登陆XIX.AI!这份精心筛选的高评分清单汇集了经过严格实战测试、功能强大且能彻底改变游戏规则的工具。 您将在此找到免费版与付费版的对比分析、详细排名以及不容错过的精选工具,助您激发创意并优化工作流程。立即探索,发现能有效提升工作效率的理想工具!

11 个工具
xix.ai
搜索引擎优化 最适合制定搜索策略的AI搜索结果页面(SERP)分析工具
最适合制定搜索策略的AI搜索结果页面(SERP)分析工具

2026年最新、最受欢迎且评价最高的人工智能搜索结果页面(SERP)分析工具,均由XIX.AI通过严格的实际测试精心筛选,并每周更新排名。这些强大的工具可助您发掘隐藏的优化机会、提升内容表现,并在搜索领域获得竞争优势。立即寻找最适合您的工具,提升您的搜索策略。现在就来探索吧!

13 个工具
xix.ai
数据分析 适用于 SaaS 和电商团队的 KPI 监控最佳 AI 异常检测工具
适用于 SaaS 和电商团队的 KPI 监控最佳 AI 异常检测工具

2026 年最新最佳顶级评分 AI 异常检测工具,助力 SaaS 和电商团队的 KPI 监控!XIX.AI 基于严格的真实世界测试和每周更新的排名,精心策划了一套强大且颠覆性的工具合集。您将找到详细的免费与付费对比洞察,帮助您识别必须尝试的解决方案,从而提升生产力并释放您的 AI 优势。立即探索!

10 个工具
xix.ai
写作 最适合撰写长篇SEO文章的AI大纲生成器
最适合撰写长篇SEO文章的AI大纲生成器

2026年最新、最受好评的AI大纲生成器,专为长篇SEO文章打造,由XIX.AI精心甄选。这些强大的工具在快速创建高质量内容方面提供了颠覆性的帮助,显著提升了写作效率。 获取免费版与付费版的对比分析,以及实际测试结果和详细排名,助您找到最适合自身需求、不容错过的理想选择。立即探索,解锁您的AI竞争优势。

8 个工具
xix.ai
教育与学习 用于作业和考试备考的AI学习工具
用于作业和考试备考的AI学习工具

2026年最新最佳AI学习工具,助您轻松完成作业和备考!XIX.AI精心筛选出一份广受好评的顶级工具清单,这些功能强大、颠覆传统的工具经过实际测试,能帮助学生提升效率、简化作业流程,并轻松通过考试。 获取免费版与付费版的对比分析、详细排名以及必试选项,释放你的AI优势。立即探索!

10 个工具
xix.ai
音乐创作 面向词曲创作者、旋律片段、主旋律及多语言草稿创作的AI人声演示工具
面向词曲创作者、旋律片段、主旋律及多语言草稿创作的AI人声演示工具

2026 年最新最佳 AI 人声演示工具,专为词曲创作者、旋律创作者和多语言内容团队打造!XIX.AI 精心整理了一份经过严格真实世界测试的高评分、变革性工具列表。您将找到详细的免费与付费对比数据、全面排名以及必试选项,帮助您提升创作效率并释放创意潜力。立即探索,发现满足您所有内容需求的完美工具!

9 个工具
xix.ai
评论 (1)
0/500
KevinPerez
KevinPerez 2026-02-28 10:00:44

Interesting! Making AI's 'thoughts' transparent could help build trust, but who gets to decide what's considered a 'reasonable' reasoning process? Feels like a crucial step, though the implementation details will be the real challenge. Hope it leads to practical tools, not just more guidelines. 🤔

OR