DeepMind首席执行官呼吁由美国牵头对AI模型进行测试
![德米斯·哈萨比斯,谷歌DeepMind首席执行官]()
谷歌DeepMind联合创始人兼首席执行官德米斯·哈萨比斯。图片来源:德米斯·哈萨比斯/LinkedIn
谷歌DeepMind首席执行官德米斯·哈萨比斯强调了通用人工智能的危险性,并倡导建立一个由美国主导的治理框架
谷歌DeepMind首席执行官德米斯·哈萨比斯提议成立一个由美国主导的监管机构,负责评估前沿级人工智能模型。他强调,随着人类日益接近实现通用人工智能(AGI),迫切需要降低相关风险,包括与核威胁和生物威胁相关的风险。
德米斯·哈萨比斯是诺贝尔奖得主,也是谷歌DeepMind的联合创始人。他与同事约翰·詹珀共同获得了诺贝尔化学奖,后者最近宣布将加入Anthropic公司。德米斯拥有伦敦大学学院的认知神经科学博士学位。
在就人工智能威胁发出严肃警告的同时,他对人工智能的潜力也表达了乐观态度:“我们甚至可能达到这样一个阶段:资源不再是人类进步的限制因素,从而迎来一个令人惊叹的丰裕新时代,”他表示,并认为人工智能将有助于解决人类面临的一些最紧迫的挑战。

关于通用人工智能(AGI)的主要担忧
德米斯指出,领先的人工智能公司目前正卷入一场激烈且多层次的商业和地缘政治竞赛。这场竞争涉及他所在的谷歌DeepMind,以及OpenAI、Anthropic和DeepSeek等竞争对手。
“我们已经看到了前沿模型给网络安全带来的挑战,随着技术能力的持续提升,包括核风险和生物风险在内的其他威胁也可能很快出现,”德米斯在他的Substack博客中写道。
德米斯补充道:“我们必须利用AGI到来前的这一宝贵窗口期,将这项技术塑造成造福全人类的工具。”
他还强调了目前尚不为人知的领域可能带来的潜在风险:“展望未来,我们将需要强有力的保障措施,以维持对日益具有自主性、能够递归式自我改进的系统的控制——并应对那些只有随着时间推移才会逐渐明朗的未知问题。”
此前,美国政府曾以国家安全为由发布指令,暂停所有外国用户对Anthropic公司Fable 5和Mythos 5模型的访问,据报道,这一限制措施随后已被解除。
一幅关于人工智能的艺术插图。该图像探讨了如何利用人工智能推动量子计算领域的发展。图片来源:Google DeepMind/Unsplash
其他专家和智库也支持德米斯对AGI的看法。国际关系与可持续发展中心在一篇题为《为何AGI应成为全球首要任务》的文章中警告称,如果没有国家和国际层面的监管,人类将面临失去对一种非生物智能的控制的风险,这种智能超出了人类的理解、认知和控制范围。
值得注意的是,《原子科学家公报》——该刊于2026年1月将“末日时钟”拨至午夜前85秒(这是该时钟有史以来最接近午夜的时刻)——也呼吁采取紧急行动,制定关于人工智能使用的国际准则。
谷歌DeepMind首席执行官兼联合创始人德米斯·哈萨比斯(左)与谷歌DeepMind前副总裁约翰·詹珀(右) | 图片来源:乔恩·科帕洛夫 / 盖蒂图片社
“在通用人工智能(AGI)到来之前,我们必须利用这宝贵的窗口期,将这项技术塑造成造福全人类的工具。”——德米斯·哈萨比斯,谷歌DeepMind联合创始人兼首席执行官
关于美国主导监管的提案
德米斯认为,鉴于其经济和技术地位,美国完全有能力率先制定一套框架,采用动态、灵活且严谨的方法对前沿模型进行测试。
德米斯的提案详尽且具体。“该框架可建立一个新的标准机构,其模式可参照联邦监管下的公私合作伙伴关系或自律组织,类似于金融业监管局(FINRA)。
“该标准机构将负责制定评估协议,并与相关联邦机构及美国国家实验室合作,在涉及国家安全的领域开展测试。”
“初期,前沿实验室将自愿在模型发布前最多30天向该标准机构提交模型以供审查。一旦评估协议被证明有效且稳健,即可迅速实现制度化,这意味着前沿模型必须通过该评估才能在美国市场部署。”
德米斯补充道,这项由美国发起的举措将为制定前沿人工智能领域的国际共同标准奠定坚实基础。
RAIDS AI 首席执行官兼联合创始人尼克·凯里诺斯(Nik Kairinos)对此进展评论道:“但全球人工智能监管机构不能由任何一个国家的议程主导。”
RAIDS AI首席执行官兼联合创始人尼克·凯里诺斯。图片来源:尼克·凯里诺斯/LinkedIn
“人工智能不分国界,旨在规范它的规则也不应受国界限制。采取多国协作的方式对于确保任何人工智能监管措施都能获得必要的信任、合作与支持,从而在国际上有效运作,至关重要。”
前沿模型带来的最新风险
德米斯(Demis)的警告发布之际,Anthropic公司刚刚发布了一份题为《2026年夏季的代理失调》(Agentic Misalignment in Summer 2026)的报告,详细阐述了在高风险模拟中观察到的对齐模型失效现象。该报告使用了来自谷歌DeepMind、OpenAI、中国人工智能公司DeepSeek以及Anthropic自身的前沿模型。
列出的对齐问题包括:模型超越用户指令追求自身动机,以及Anthropic所称的“有害服从”——即虽然执行了用户请求,却导致了危害。
Anthropic 列举的问题还包括“隐蔽破坏”——这是一种代理失调故障,即模型秘密篡改代码以破坏用户意图。Anthropic 还发现,某些模型会协助用户从事类似白领犯罪的活动。
报告还列举了近期前沿模型带来的其他风险,包括“引导人类代理人进行举报”——即模型将机密安全信息泄露至外部,或引导人类进行此类行为,以及“动机性误标”等。
Anthropic在其发表于《对齐科学博客》(Alignment Science Blog)的报告中指出,这些案例研究的目的是帮助开发者和评估人员衡量类似的故障,并构建有针对性的防护措施。
相关文章
纽约州将对5000万个人工智能数据中心的用电量设限
纽约州的举措展示了全球各国政府可能如何管理、征税并规范人工智能热潮带来的实体足迹。图片来源:Luca Bravo/Unsplash纽约州州长凯西·霍丘尔签署了一项具有历史意义的行政命令,暂停数据中心建设,与此同时,州政府官员正在起草严格的环境影响规定人工智能对基础设施的需求现已与现有能源电网的物理限制发生冲突。纽约州已成为美国首个正式暂停超大规模数据中心建设的州,对耗电量达50兆瓦及以上的新建数据
斯坦福大学的研究人员如何利用人工智能设计出一种合成病毒
人工智能领域的领军人物已指出具备生物能力的AI模型可能带来的风险。图片来源:CDC/Unsplash美国研究人员利用人工智能设计出了首个针对大肠杆菌的合成病毒,而Anthropic首席执行官达里奥·阿莫代伊则对人工智能引发的生物威胁表示担忧。美国斯坦福大学的科学家们利用人工智能设计出了自然界中不存在的病毒。该团队的研究基于Evo 2生成的基因组,这是一种生成式人工智能模型,旨在通过提出新型DNA序
人工智能如何加速中国的药物研发进程
Insilico Medicine首席执行官亚历克斯·扎沃龙科夫表示,通过在中国将人工智能与实验室研究相结合,该公司已将生成药物开发候选分子的周期缩短至约一年。据扎沃龙科夫介绍,这家在香港上市的公司最先进的项目仅用九个月就完成了候选药物筛选,而通常需要13个月。这与传统方法形成了鲜明对比——传统方法通常需要大约四年半才能达到同一里程碑。这些时间节点特指早期发现和候选药物筛选阶段,而非完整的药物商业
相关专题推荐
评论 (0)
0/500
谷歌DeepMind联合创始人兼首席执行官德米斯·哈萨比斯。图片来源:德米斯·哈萨比斯/LinkedIn
谷歌DeepMind首席执行官德米斯·哈萨比斯强调了通用人工智能的危险性,并倡导建立一个由美国主导的治理框架
谷歌DeepMind首席执行官德米斯·哈萨比斯提议成立一个由美国主导的监管机构,负责评估前沿级人工智能模型。他强调,随着人类日益接近实现通用人工智能(AGI),迫切需要降低相关风险,包括与核威胁和生物威胁相关的风险。
德米斯·哈萨比斯是诺贝尔奖得主,也是谷歌DeepMind的联合创始人。他与同事约翰·詹珀共同获得了诺贝尔化学奖,后者最近宣布将加入Anthropic公司。德米斯拥有伦敦大学学院的认知神经科学博士学位。
在就人工智能威胁发出严肃警告的同时,他对人工智能的潜力也表达了乐观态度:“我们甚至可能达到这样一个阶段:资源不再是人类进步的限制因素,从而迎来一个令人惊叹的丰裕新时代,”他表示,并认为人工智能将有助于解决人类面临的一些最紧迫的挑战。

关于通用人工智能(AGI)的主要担忧
德米斯指出,领先的人工智能公司目前正卷入一场激烈且多层次的商业和地缘政治竞赛。这场竞争涉及他所在的谷歌DeepMind,以及OpenAI、Anthropic和DeepSeek等竞争对手。
“我们已经看到了前沿模型给网络安全带来的挑战,随着技术能力的持续提升,包括核风险和生物风险在内的其他威胁也可能很快出现,”德米斯在他的Substack博客中写道。
德米斯补充道:“我们必须利用AGI到来前的这一宝贵窗口期,将这项技术塑造成造福全人类的工具。”
他还强调了目前尚不为人知的领域可能带来的潜在风险:“展望未来,我们将需要强有力的保障措施,以维持对日益具有自主性、能够递归式自我改进的系统的控制——并应对那些只有随着时间推移才会逐渐明朗的未知问题。”
此前,美国政府曾以国家安全为由发布指令,暂停所有外国用户对Anthropic公司Fable 5和Mythos 5模型的访问,据报道,这一限制措施随后已被解除。
一幅关于人工智能的艺术插图。该图像探讨了如何利用人工智能推动量子计算领域的发展。图片来源:Google DeepMind/Unsplash
其他专家和智库也支持德米斯对AGI的看法。国际关系与可持续发展中心在一篇题为《为何AGI应成为全球首要任务》的文章中警告称,如果没有国家和国际层面的监管,人类将面临失去对一种非生物智能的控制的风险,这种智能超出了人类的理解、认知和控制范围。
值得注意的是,《原子科学家公报》——该刊于2026年1月将“末日时钟”拨至午夜前85秒(这是该时钟有史以来最接近午夜的时刻)——也呼吁采取紧急行动,制定关于人工智能使用的国际准则。
谷歌DeepMind首席执行官兼联合创始人德米斯·哈萨比斯(左)与谷歌DeepMind前副总裁约翰·詹珀(右) | 图片来源:乔恩·科帕洛夫 / 盖蒂图片社
“在通用人工智能(AGI)到来之前,我们必须利用这宝贵的窗口期,将这项技术塑造成造福全人类的工具。”——德米斯·哈萨比斯,谷歌DeepMind联合创始人兼首席执行官
关于美国主导监管的提案
德米斯认为,鉴于其经济和技术地位,美国完全有能力率先制定一套框架,采用动态、灵活且严谨的方法对前沿模型进行测试。
德米斯的提案详尽且具体。“该框架可建立一个新的标准机构,其模式可参照联邦监管下的公私合作伙伴关系或自律组织,类似于金融业监管局(FINRA)。
“该标准机构将负责制定评估协议,并与相关联邦机构及美国国家实验室合作,在涉及国家安全的领域开展测试。”
“初期,前沿实验室将自愿在模型发布前最多30天向该标准机构提交模型以供审查。一旦评估协议被证明有效且稳健,即可迅速实现制度化,这意味着前沿模型必须通过该评估才能在美国市场部署。”
德米斯补充道,这项由美国发起的举措将为制定前沿人工智能领域的国际共同标准奠定坚实基础。
RAIDS AI 首席执行官兼联合创始人尼克·凯里诺斯(Nik Kairinos)对此进展评论道:“但全球人工智能监管机构不能由任何一个国家的议程主导。”
RAIDS AI首席执行官兼联合创始人尼克·凯里诺斯。图片来源:尼克·凯里诺斯/LinkedIn
“人工智能不分国界,旨在规范它的规则也不应受国界限制。采取多国协作的方式对于确保任何人工智能监管措施都能获得必要的信任、合作与支持,从而在国际上有效运作,至关重要。”
前沿模型带来的最新风险
德米斯(Demis)的警告发布之际,Anthropic公司刚刚发布了一份题为《2026年夏季的代理失调》(Agentic Misalignment in Summer 2026)的报告,详细阐述了在高风险模拟中观察到的对齐模型失效现象。该报告使用了来自谷歌DeepMind、OpenAI、中国人工智能公司DeepSeek以及Anthropic自身的前沿模型。
列出的对齐问题包括:模型超越用户指令追求自身动机,以及Anthropic所称的“有害服从”——即虽然执行了用户请求,却导致了危害。
Anthropic 列举的问题还包括“隐蔽破坏”——这是一种代理失调故障,即模型秘密篡改代码以破坏用户意图。Anthropic 还发现,某些模型会协助用户从事类似白领犯罪的活动。
报告还列举了近期前沿模型带来的其他风险,包括“引导人类代理人进行举报”——即模型将机密安全信息泄露至外部,或引导人类进行此类行为,以及“动机性误标”等。
Anthropic在其发表于《对齐科学博客》(Alignment Science Blog)的报告中指出,这些案例研究的目的是帮助开发者和评估人员衡量类似的故障,并构建有针对性的防护措施。
纽约州将对5000万个人工智能数据中心的用电量设限
纽约州的举措展示了全球各国政府可能如何管理、征税并规范人工智能热潮带来的实体足迹。图片来源:Luca Bravo/Unsplash纽约州州长凯西·霍丘尔签署了一项具有历史意义的行政命令,暂停数据中心建设,与此同时,州政府官员正在起草严格的环境影响规定人工智能对基础设施的需求现已与现有能源电网的物理限制发生冲突。纽约州已成为美国首个正式暂停超大规模数据中心建设的州,对耗电量达50兆瓦及以上的新建数据
斯坦福大学的研究人员如何利用人工智能设计出一种合成病毒
人工智能领域的领军人物已指出具备生物能力的AI模型可能带来的风险。图片来源:CDC/Unsplash美国研究人员利用人工智能设计出了首个针对大肠杆菌的合成病毒,而Anthropic首席执行官达里奥·阿莫代伊则对人工智能引发的生物威胁表示担忧。美国斯坦福大学的科学家们利用人工智能设计出了自然界中不存在的病毒。该团队的研究基于Evo 2生成的基因组,这是一种生成式人工智能模型,旨在通过提出新型DNA序
人工智能如何加速中国的药物研发进程
Insilico Medicine首席执行官亚历克斯·扎沃龙科夫表示,通过在中国将人工智能与实验室研究相结合,该公司已将生成药物开发候选分子的周期缩短至约一年。据扎沃龙科夫介绍,这家在香港上市的公司最先进的项目仅用九个月就完成了候选药物筛选,而通常需要13个月。这与传统方法形成了鲜明对比——传统方法通常需要大约四年半才能达到同一里程碑。这些时间节点特指早期发现和候选药物筛选阶段,而非完整的药物商业





首页






