選項
首頁
新聞
專家說,Google的最新AI模型報告缺乏關鍵安全細節。

專家說,Google的最新AI模型報告缺乏關鍵安全細節。

2025-04-28
178

週四,Google 在推出其最新且最先進的 AI 模型 Gemini 2.5 Pro 數週後,發布了一份技術報告,詳細說明其內部安全評估結果。然而,專家批評該報告缺乏細節,難以全面了解模型潛在風險。

技術報告在 AI 領域至關重要,提供洞察——即使有時不盡理想——企業通常不會公開分享。AI 社群普遍認為這些報告是促進獨立研究和增強安全評估的真誠努力。

Google 的安全報告方式與部分競爭對手不同。該公司僅在模型超越「實驗」階段後發布技術報告。此外,Google 在這些報告中省略某些「危險能力」評估結果,留待另行審計。

儘管如此,多位專家對 TechCrunch 表示對 Gemini 2.5 Pro 報告失望,指出其對 Google 提出的 Frontier Safety Framework (FSF) 覆蓋不足。Google 去年公布 FSF,旨在識別可能導致「嚴重傷害」的未來 AI 能力。

「這份報告非常簡略,資訊極少,且在模型公開數週後才發布,」AI 政策與策略研究所共同創辦人 Peter Wildeford 對 TechCrunch 說。「無法驗證 Google 是否兌現公開承諾,因此無法評估其模型的安全性和保障。」

Secure AI Project 共同創辦人 Thomas Woodside 承認 Gemini 2.5 Pro 報告的發布,但質疑 Google 提供及時補充安全評估的承諾。他指出,Google 最後一次發布危險能力測試結果是在 2024 年 6 月,針對當年 2 月宣布的模型。

此外,Google 尚未發布 Gemini 2.5 Flash 的報告,這是一款上週宣布的更小、更高效的模型。一位發言人向 TechCrunch 表示,Flash 的報告「即將發布」。

「我希望這是 Google 承諾開始更頻繁更新的訊號,」Woodside 對 TechCrunch 說。「這些更新應包括尚未公開部署模型的評估結果,因為這些模型也可能帶來嚴重風險。」

雖然 Google 是首批提出模型標準化報告的 AI 實驗室之一,但其透明度不足也受到批評。Meta 對其新 Llama 4 開放模型發布了同樣簡短的安全評估,而 OpenAI 則選擇不為其 GPT-4.1 系列發布任何報告。

Google 對監管機構保證維持 AI 安全測試和報告的高標準,增加了壓力。兩年前,Google 向美國政府承諾為所有「重要」公開 AI 模型「範圍內」發布安全報告,隨後對其他國家做出類似承諾,承諾圍繞 AI 產品實現「公開透明」。

民主與技術中心 AI 治理高級顧問 Kevin Bankston 將零星且模糊的報告趨勢描述為 AI 安全的「向下競爭」。

「結合競爭實驗室如 OpenAI 將安全測試時間從數月縮減至數天的報導,Google 頂級 AI 模型的薄弱文件顯示出企業急於將模型推向市場時,AI 安全與透明度的向下競爭令人不安,」他對 TechCrunch 說。

Google 表示,雖然技術報告未詳述,但其在模型發布前進行了安全測試和「對抗性紅隊測試」。

更新於 4/22 下午 12:58 太平洋時間:修改了技術報告中關於 Google FSF 的措辭。

相關文章
Gemini Spark 現在管理 Google Photos 相簿 Gemini Spark 現在管理 Google Photos 相簿 Google 正在透過啟用 Gemini Spark 來管理 Google Photos 相簿,從而擴大其人工智慧整合範圍。使用者現在可以指示該代理編輯圖片、整理相簿、從精選照片中生成共享合集、將演唱會傳單轉換為日曆事件,並自動化其他工作流程。Google Photos 負責人 Shimrit Ben-Yair 在 X 平臺上宣佈了這些新功能,表示符合條件的美國 Gemini AI Pro 和 Ultra 訂閱使用者將在未來幾周內獲得英語支援。該公司尚未明確說明這些功能是否會擴充套件至國際市場,以及
Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙 Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙 Google 週二宣布,Android 將推出「虛假來電偵測」功能,以防範利用人工智慧深度偽造技術進行的冒充詐騙。此功能將於本月透過「Phone by Google」在全球範圍內逐步推送至 Android 12 及以上版本的裝置,首先從 Pixel 裝置開始。隨著人們越來越不願接聽未知號碼的來電,詐騙者正改變策略,透過偽造可信賴的電話號碼,並利用 AI 深度偽造技術,讓聲音聽起來像是權威人士、家人
Frontier AI Labs 拒絕透露針對失控模型的管控策略 Frontier AI Labs 拒絕透露針對失控模型的管控策略 近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
相關專題推薦
寫作 最適合撰寫長篇 SEO 文章的 AI 大綱生成工具
最適合撰寫長篇 SEO 文章的 AI 大綱生成工具

2026 年最新最佳、評價最高的 AI 大綱生成器,專為長篇 SEO 文章打造,由 XIX.AI 精心精選。這些強大的工具能為快速創作高品質內容提供革命性的協助,大幅提升寫作效率。 透過免費版與付費版的比較、實際測試結果及詳細排名,協助您找出最符合需求且不容錯過的選項。立即探索,釋放您的 AI 優勢。

8 個工具
xix.ai
教育與學習 適用於作業與考試準備的人工智慧學習工具
適用於作業與考試準備的人工智慧學習工具

2026 年最新最佳 AI 學習工具,助您完成作業與備考!XIX.AI 精心整理了一份備受好評的清單,收錄了這些強大且具革命性、經實測驗證的工具,能幫助學生提升效率、簡化作業流程,並在考試中取得優異成績。 獲取免費版與付費版的比較、詳細排名,以及必試選項,以釋放您的 AI 優勢。立即探索!

10 個工具
xix.ai
音樂創作 面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具
面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具

2026 年最新最佳 AI 人聲演示工具,專為詞曲創作者、旋律創作者和多語言內容團隊打造!XIX.AI 精心整理了一份經過嚴格真實世界測試的高評分、變革性工具列表。您將找到詳細的免費與付費對比資料、全面排名以及必試選項,幫助您提升創作效率並釋放創意潛力。立即探索,發現滿足您所有內容需求的完美工具!

9 個工具
xix.ai
商業 最適合小型企業的頂尖 AI 競爭情勢分析工具
最適合小型企業的頂尖 AI 競爭情勢分析工具

2026 年最新、最佳且評價最高的中小企業 AI 競爭研究工具!XIX.AI 精心精選了一系列極具威力且能改變遊戲規則的工具,並透過嚴謹的實測與詳細排名,每週更新內容。您可在此找到詳盡的免費版與付費版比較,協助您找出必試的工具,以提升工作效率並獲得競爭優勢。 立即探索,找出最適合您的工具!

9 個工具
xix.ai
圖像編輯 用於電商服裝、皮膚清潔和色彩一致性的 Photoshop AI 修圖工具
用於電商服裝、皮膚清潔和色彩一致性的 Photoshop AI 修圖工具

2026 年最新最佳 Photoshop AI 修圖工具,適用於電商服裝、皮膚清潔和色彩一致性!這份頂級精選列表包含強大的變革性解決方案,可幫助您提升寫作效率、簡化內容創作並輕鬆實現完美的視覺效果。每個工具都經過實際測試,並透過每週更新的排名進行驗證,同時提供免費與付費版本的詳細對比。由 XIX.AI 支援,這是任何希望發揮 AI 優勢的人必試指南。立即探索!

10 個工具
xix.ai
迅速的 適用於 ChatGPT 工作流程的最佳 AI 提示詞庫
適用於 ChatGPT 工作流程的最佳 AI 提示詞庫

2026 年最新、最受好評的 AI 提示詞庫,可優化各類 ChatGPT 工作流程。XIX.AI 精心蒐羅了一套強大且具革命性的精選集合,並經過嚴格的實際測試,以確保其表現卓越。 您可查閱詳盡的免費版與付費版比較分析,以及專家評比,助您挑選必試工具,從而提升工作效率並釋放您的 AI 優勢。立即探索!

11 個工具
xix.ai
評論 (6)
0/500
MarkSanchez
MarkSanchez 2025-08-01 21:47:34

Google's AI safety report sounds like a half-baked cake – looks good but lacks substance. 😕 Why skimp on the details? Transparency matters when stakes are this high.

WalterKing
WalterKing 2025-04-29 23:19:22

Der Bericht von Google über Gemini 2.5 Pro ist ein bisschen enttäuschend. Ich hatte mehr Details zu den Sicherheitsbewertungen erwartet, aber es scheint, als würden sie Informationen zurückhalten. Ohne die ganze Geschichte ist es schwer, der KI vollständig zu vertrauen. Vielleicht beim nächsten Mal, Google? 🤔

CharlesThomas
CharlesThomas 2025-04-29 09:17:55

ジェミニ2.5プロのレポート、ちょっとがっかりですね。安全評価の詳細をもっと知りたかったのに、情報が少なすぎる。AIを完全に信頼するのは難しいです。次回はもっと詳しくお願いします!😅

AlbertWalker
AlbertWalker 2025-04-29 07:15:07

Google's report on Gemini 2.5 Pro is a bit of a letdown. I was expecting more juicy details about the safety assessments, but it feels like they're holding back. It's hard to trust the AI fully without knowing the full story. Maybe next time, Google? 🤔

JimmyGarcia
JimmyGarcia 2025-04-29 04:01:42

O relatório do Google sobre o Gemini 2.5 Pro é um pouco decepcionante. Esperava mais detalhes sobre as avaliações de segurança, mas parece que eles estão escondendo algo. É difícil confiar totalmente na IA sem saber toda a história. Talvez na próxima, Google? 🤔

BillyThomas
BillyThomas 2025-04-28 07:41:33

El informe de Google sobre Gemini 2.5 Pro es decepcionante. Esperaba más detalles sobre las evaluaciones de seguridad, pero parece que están ocultando información. Es difícil confiar en la IA sin conocer toda la historia. ¿Tal vez la próxima vez, Google? 🤔

OR