選項
首頁
新聞
DeepMind 執行長呼籲由美國主導對 AI 模型進行測試

DeepMind 執行長呼籲由美國主導對 AI 模型進行測試

2026-09-30
67
德米斯·哈薩比斯,Google DeepMind 執行長

Google DeepMind 共同創辦人暨執行長 Demis Hassabis。圖片來源:Demis Hassabis/LinkedIn

Google DeepMind 執行長德米斯·哈薩比斯強調通用人工智慧的危險性,並倡導建立由美國主導的治理框架

Google DeepMind 執行長德米斯·哈薩比斯(Demis Hassabis)提議成立一個由美國主導的監管機構,用以評估前沿級人工智慧模型。他強調,隨著人類逐步邁向人工通用智慧(AGI),迫切需要減輕相關風險,包括與核武及生物威脅有關的風險。

德米斯·哈薩比斯是諾貝爾獎得主,也是 Google DeepMind 的共同創辦人。他與同事約翰·詹珀(John Jumper)共同獲得諾貝爾化學獎,而約翰·詹珀最近宣布將轉職至 Anthropic。德米斯擁有倫敦大學學院(University College London)認知神經科學博士學位。

儘管針對人工智慧的威脅發出嚴正警告,他對人工智慧的潛力仍抱持樂觀態度:「我們甚至可能達到一個階段,屆時資源將不再是人類進步的限制因素,從而開啟一個令人驚嘆的新豐裕時代,」他如此表示,並主張人工智慧將有助於解決人類面臨的一些最迫切挑戰。

Google DeepMind

關於通用人工智慧(AGI)的主要隱憂

德米斯指出,領先的人工智慧企業目前正陷入一場激烈且多層次的商業與地緣政治競賽。這場競爭涉及他所屬的 Google DeepMind,以及 OpenAI、Anthropic 和 DeepSeek 等競爭對手。

「我們已經看到前沿模型對網路安全構成的挑戰,而隨著技術能力持續進步,包括核武與生物風險在內的其他威脅也可能很快浮現,」德米斯在他的 Substack 部落格中寫道。

德米斯補充道:「我們必須善用 AGI 問世前的這段寶貴時間,將這項技術塑造成造福全人類的工具。」

他還強調了來自目前尚不為人知領域的潛在風險:「展望未來,我們將需要強有力的保障措施,以維持對日益具有自主性、能遞迴自我改進的系統的控制——並應對那些只有隨著時間推移才會逐漸明朗的未知問題。」

這項警告源於美國政府近期的一項指令,該指令以國家安全為由,暫停所有外國對 Anthropic 公司 Fable 5 和 Mythos 5 模型的存取權限;據報導,這項限制已於事後解除。

一幅關於人工智慧的藝術概念圖。這張圖片探討了如何運用人工智慧來推動量子運算領域的發展。圖片來源:Google DeepMind/Unsplash

德米斯(Demis)對 AGI 的觀點獲得其他專家及智庫的支持。國際關係與永續發展中心(Center for International Relations and Sustainable Development)在一篇題為《為何 AGI 應成為全球首要任務》的文章中警告,若缺乏國家及國際層面的監管,人類將面臨失去對某種超越人類理解、認知與控制範圍的非生物智能的控制權之風險。

值得注意的是,《原子科學家公報》——該刊於2026年1月將「末日時鐘」設定為午夜前85秒(這是該時鐘有史以來最接近午夜的一次)——也呼籲採取緊急行動,制定關於人工智慧應用的國際準則。

Google DeepMind 執行長暨共同創辦人德米斯·哈薩比斯(左)與 Google DeepMind 前副總裁約翰·詹珀(右) | 圖片來源:Jon Kopaloff / Getty Images

「我們必須在通用人工智慧(AGI)問世前的這段寶貴時間內,將這項技術塑造成造福全人類的工具。」——德米斯·哈薩比斯,Google DeepMind 共同創辦人暨執行長

由美國主導的監管提案

德米斯認為,鑑於美國在經濟與技術上的地位,該國具備絕佳條件,可率先制定一套框架,採用動態、靈活且嚴謹的方法來測試前沿模型。

德米斯的提案詳盡且具體。「該提案可建立一個以聯邦監督的公私合作夥伴關係或自律組織為藍本的新標準制定機構,類似於金融業監管局(FINRA)。

「該標準制定機構將負責制定評估協議,並與相關聯邦機構及美國國家實驗室合作,在涉及國家安全的領域進行測試。」

「初期,前沿實驗室(Frontier Labs)將在模型發布前最多 30 天,自願將模型提交給標準制定機構進行審查。一旦評估協議被證明有效且穩健,即可迅速正式化,這意味著前沿模型必須通過該評估,方能在美國市場部署。」

德米斯補充道,這項由美國發起的舉措,將為制定前沿人工智慧的國際共同標準奠定堅實基礎。

RAIDS AI 執行長暨共同創辦人尼克·凱里諾斯(Nik Kairinos)針對此發展評論道:「但全球人工智慧監管機構不能由任何單一國家的議程主導。

RAIDS AI 執行長暨共同創辦人 尼克·凱里諾斯。圖片來源:尼克·凱里諾斯/LinkedIn

「人工智慧不分國界,用來規範它的規則也不應受國界限制。採取多國合作的方式至關重要,才能確保任何人工智慧法規都能獲得必要的信任、合作與認同,從而發揮國際效用。」

前沿模型帶來的近期風險

德米斯(Demis)的警告,源於 Anthropic 發表一份名為《2026 年夏季的代理失調》(Agentic Misalignment in Summer 2026)的報告,該報告詳述了在高風險模擬中觀察到的對齊模型失效現象。該報告採用了 Google DeepMind、OpenAI、中國 AI 公司 DeepSeek 以及 Anthropic 自身開發的前沿模型。

報告列出的對齊失調問題包括:模型超越使用者指令追求自身動機,以及 Anthropic 所稱的「有害遵從」——即模型雖遵循使用者請求,卻導致危害發生。

Anthropic 所列舉的問題還包括「隱蔽破壞」——這是一種代理失調失效情形,即模型會秘密干擾程式碼以破壞使用者意圖。Anthropic 還發現,部分模型會協助使用者進行類似白領犯罪的活動。

報告中提及的近期前沿模型所衍生的其他風險還包括:指導人類代理人進行吹哨行為——即模型將機密安全資訊外洩,或引導人類進行此類行為;以及出於特定動機的錯誤標記。

Anthropic 在《對齊科學部落格》(Alignment Science Blog)的報告中指出,這些案例研究的目的是協助開發者和評估人員衡量類似的失誤,並建立針對性的防護措施。

相關文章
紐約州將對 5,000 萬個 AI 資料中心實施用電上限 紐約州將對 5,000 萬個 AI 資料中心實施用電上限 紐約州的舉措展現了全球各國政府可能如何管理、課稅及規範人工智慧熱潮所帶來的實體足跡。圖片來源:Luca Bravo/Unsplash紐約州州長凱西·霍丘爾簽署了一項具有歷史意義的行政命令,暫停資料中心的建設,同時州政府官員正起草嚴格的環境影響規範人工智慧對基礎設施的需求,如今已與現有電力網的實體限制產生衝突。紐約州已成為美國首個正式暫停超大規模數據中心開發的州,對耗電量達50兆瓦或以上的新建數據中
史丹佛大學研究人員如何運用人工智慧設計出人工病毒 史丹佛大學研究人員如何運用人工智慧設計出人工病毒 人工智慧領域的領導者們已指出,具備生物學能力的AI模型可能帶來的潛在風險。圖片來源:CDC/Unsplash美國研究人員利用人工智慧設計出首種針對大腸桿菌的合成病毒,而 Anthropic 執行長達里奧·阿莫迪(Dario Amodei)則對人工智慧引發的生物威脅表示擔憂。美國史丹佛大學的科學家利用人工智慧,設計出自然界中不存在的病毒。該團隊的研究基於「Evo 2」生成的基因組,這是一種旨在透過提
人工智慧如何加速中國的藥物研發進程 人工智慧如何加速中國的藥物研發進程 Insilico Medicine 執行長 Alex Zhavoronkov 表示,該公司透過在中國將人工智慧與實驗室研究相結合,已將生成藥物開發候選分子的時程縮短至約一年。據扎沃隆科夫表示,這家在香港上市的公司最先進的研發計畫僅用九個月便完成了候選藥物遴選,而通常需時13個月。這與傳統方法形成鮮明對比,後者通常需要約四年半才能達到同一里程碑。這些時程特別指早期發現與候選藥物篩選階段,而非完整的藥
相關專題推薦
音樂創作 用於音樂創作的 AI 歌詞構思工具
用於音樂創作的 AI 歌詞構思工具

2026 年最新、最受好評的 AI 歌詞構思工具,盡在 XIX.AI!這份精心挑選的清單收錄了多款強大且具革命性的工具,這些工具均經過實際測試,能快速提供高品質的歌詞構思,協助使用者激發創意並簡化音樂創作流程。 您還可獲取免費版與付費版的比較概覽。立即探索,發掘最適合您的工具!

16 個工具
xix.ai
漫畫創作 用於漫畫世界構建的AI角色設定表工具
用於漫畫世界構建的AI角色設定表工具

2026 年最新最佳頂級評分 AI 角色表工具,助力漫畫世界構建,現已登陸 XIX.AI!本精選列表收錄了經過嚴格現實測試的強大且具顛覆性的選項。您將看到免費與付費版本的對比,以及每週更新的排行榜,助您發掘那些能激發創意並簡化世界構建任務的必備工具。立即探索,解鎖您的 AI 優勢!

13 個工具
xix.ai
自動化 n8n AI 自動化工具,適用於內部營運、資料同步及多步驟代理流程
n8n AI 自動化工具,適用於內部營運、資料同步及多步驟代理流程

2026 年最新最佳 n8n AI 自動化工具,適用於內部營運、資料同步及多步驟代理流程,現已登場!XIX.AI 精心精選了一系列廣受好評、功能強大且能徹底改變遊戲規則的工具,可提升各項工作任務的生產力。 每項工具均經過嚴格的實際環境測試以確保可靠性,並提供詳盡的免費版與付費版比較,以及每週更新的排行榜。這些必試選項能助您發揮 AI 優勢,並輕鬆優化工作流程。立即探索,找出最適合您的工具!

11 個工具
xix.ai
迅速的 最適合多模型團隊的最佳提示管理工具
最適合多模型團隊的最佳提示管理工具

2026 年最新、最受好評的多模型團隊必備提示語管理工具! XIX.AI 精心精選了一系列強大且顛覆遊戲規則的必試工具,提供免費與付費版本的比較、實際應用測試以及詳細排名。這些頂級解決方案能透過簡化工作流程、消除重複作業,並在所有團隊專案中激發創意,從而顯著提升生產力。立即探索,找到最適合您的工具,並從今天開始創作吧!

9 個工具
xix.ai
會議助理 適用於遠端團隊的 AI 會議摘要工具
適用於遠端團隊的 AI 會議摘要工具

2026 年最新、最受好評的遠端團隊 AI 會議摘要工具!XIX.AI 精心精選了一系列強大且顛覆業界的必試工具,這些工具均經過實測驗證,能提供精準的會議記錄與可付諸行動的洞察。 您將在此找到免費與付費版本的比較數據及詳細排名,助您挑選最理想的方案,從而提升生產力並優化團隊溝通。立即探索,釋放您的 AI 優勢!

13 個工具
xix.ai
軟件開發 最佳 AI DevOps 輔助工具:監控部署、日誌及故障事件
最佳 AI DevOps 輔助工具:監控部署、日誌及故障事件

2026年最新、最優秀、評分最高的AI DevOps輔助工具彙總,專為監控部署流程、日誌記錄及故障處理而設計。XIX.AI透過實際應用測試與嚴格的評分體系,提供了極具突破性的強大工具,能夠顯著提升工作效率。您可以檢視免費版與付費版的對比資訊,找到最適合您工作流程的理想解決方案。立即探索,讓AI優勢助力您的業務發展。

7 個工具
xix.ai
評論 (0)
0/500
OR