選項
首頁
新聞
在AI安全報告延誤的情況下,Google加速了雙子座型號的型號

在AI安全報告延誤的情況下,Google加速了雙子座型號的型號

2025-04-10
192

在AI安全報告延誤的情況下,Google加速了雙子座型號的型號

在被OpenAI的ChatGPT突襲兩年多後,Google已大幅提升競爭力。三月底,他們推出Gemini 2.5 Pro,一款在程式設計與數學基準測試中領先的AI推理模型。就在三個月前,他們還推出了當時表現頂尖的Gemini 2.0 Flash。Google的Gemini產品總監Tulsee Doshi對TechCrunch表示,這種快速發布計劃是為了跟上快速變化的AI世界。

「我們仍在探索最佳的模型發布與回饋收集方式,」Doshi解釋道。但這種快速推出似乎有其缺點。Google尚未為其最新模型(如Gemini 2.5 Pro與Gemini 2.0 Flash)發布安全報告,這讓人擔憂他們過於倉促,缺乏足夠透明度。

如今,像OpenAI、Anthropic和Meta這樣的大型AI實驗室通常會在推出新模型時分享安全測試、性能檢查和使用案例。這些報告,有時被稱為「系統卡」或「模型卡」,多年前由業界與學術界研究人員提出。事實上,Google在2019年的一篇論文中率先提出模型卡,認為這是負責任且透明的機器學習實踐的關鍵。

Doshi對TechCrunch表示,他們尚未為Gemini 2.5 Pro發布模型卡,因為這是「實驗性」發布。計劃是以有限方式推出,收集回饋並改進,然後再全面發布。她說,Google計劃在Gemini 2.5 Pro廣泛可用時發布其模型卡,且已進行了一些安全測試和對抗性紅隊測試。

Google發言人補充說,安全仍是「首要任務」,他們將很快發布更多關於AI模型的資料,包括Gemini 2.0 Flash。儘管Gemini 2.0 Flash已對所有人開放,但仍未有其模型卡。Google最近一次發布的模型卡是超過一年前的Gemini 1.5 Pro。

系統卡和模型卡提供有用資訊,有時是公司可能不願公開的內容。例如,OpenAI的o1模型系統卡顯示其有「謀劃」對抗人類並秘密追求自身目標的傾向。AI社群普遍認為這些報告有助於獨立研究和安全檢查,但最近它們變得更加重要。正如Transformer指出,Google在2023年向美國政府承諾為所有「重大」公開AI模型發布安全報告,並對其他政府做出了類似的透明承諾。

美國聯邦和州級都曾試圖為AI開發者制定安全報告標準,但尚未成功。加州SB 1047法案是一大嘗試,但遭到科技行業強烈反對並被否決。此外,還討論過立法讓美國AI安全研究所制定模型發布指南,但該研究所可能在川普政府下縮減預算。

看來Google在模型測試報告承諾上落後,同時卻比以往更快推出模型。許多專家認為,這為日益先進和強大的模型樹立了不良範例。

相關文章
Gemini Spark 現在管理 Google Photos 相簿 Gemini Spark 現在管理 Google Photos 相簿 Google 正在透過啟用 Gemini Spark 來管理 Google Photos 相簿,從而擴大其人工智慧整合範圍。使用者現在可以指示該代理編輯圖片、整理相簿、從精選照片中生成共享合集、將演唱會傳單轉換為日曆事件,並自動化其他工作流程。Google Photos 負責人 Shimrit Ben-Yair 在 X 平臺上宣佈了這些新功能,表示符合條件的美國 Gemini AI Pro 和 Ultra 訂閱使用者將在未來幾周內獲得英語支援。該公司尚未明確說明這些功能是否會擴充套件至國際市場,以及
Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙 Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙 Google 週二宣布,Android 將推出「虛假來電偵測」功能,以防範利用人工智慧深度偽造技術進行的冒充詐騙。此功能將於本月透過「Phone by Google」在全球範圍內逐步推送至 Android 12 及以上版本的裝置,首先從 Pixel 裝置開始。隨著人們越來越不願接聽未知號碼的來電,詐騙者正改變策略,透過偽造可信賴的電話號碼,並利用 AI 深度偽造技術,讓聲音聽起來像是權威人士、家人
Frontier AI Labs 拒絕透露針對失控模型的管控策略 Frontier AI Labs 拒絕透露針對失控模型的管控策略 近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
相關專題推薦
數據分析 適用於 SaaS 和電商團隊的 KPI 監控最佳 AI 異常檢測工具
適用於 SaaS 和電商團隊的 KPI 監控最佳 AI 異常檢測工具

2026 年最新最佳頂級評分 AI 異常檢測工具,助力 SaaS 和電商團隊的 KPI 監控!XIX.AI 基於嚴格的真實世界測試和每週更新的排名,精心策劃了一套強大且顛覆性的工具合集。您將找到詳細的免費與付費對比洞察,幫助您識別必須嘗試的解決方案,從而提升生產力並釋放您的 AI 優勢。立即探索!

10 個工具
xix.ai
寫作 最適合撰寫長篇 SEO 文章的 AI 大綱生成工具
最適合撰寫長篇 SEO 文章的 AI 大綱生成工具

2026 年最新最佳、評價最高的 AI 大綱生成器,專為長篇 SEO 文章打造,由 XIX.AI 精心精選。這些強大的工具能為快速創作高品質內容提供革命性的協助,大幅提升寫作效率。 透過免費版與付費版的比較、實際測試結果及詳細排名,協助您找出最符合需求且不容錯過的選項。立即探索,釋放您的 AI 優勢。

8 個工具
xix.ai
教育與學習 適用於作業與考試準備的人工智慧學習工具
適用於作業與考試準備的人工智慧學習工具

2026 年最新最佳 AI 學習工具,助您完成作業與備考!XIX.AI 精心整理了一份備受好評的清單,收錄了這些強大且具革命性、經實測驗證的工具,能幫助學生提升效率、簡化作業流程,並在考試中取得優異成績。 獲取免費版與付費版的比較、詳細排名,以及必試選項,以釋放您的 AI 優勢。立即探索!

10 個工具
xix.ai
音樂創作 面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具
面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具

2026 年最新最佳 AI 人聲演示工具,專為詞曲創作者、旋律創作者和多語言內容團隊打造!XIX.AI 精心整理了一份經過嚴格真實世界測試的高評分、變革性工具列表。您將找到詳細的免費與付費對比資料、全面排名以及必試選項,幫助您提升創作效率並釋放創意潛力。立即探索,發現滿足您所有內容需求的完美工具!

9 個工具
xix.ai
商業 最適合小型企業的頂尖 AI 競爭情勢分析工具
最適合小型企業的頂尖 AI 競爭情勢分析工具

2026 年最新、最佳且評價最高的中小企業 AI 競爭研究工具!XIX.AI 精心精選了一系列極具威力且能改變遊戲規則的工具,並透過嚴謹的實測與詳細排名,每週更新內容。您可在此找到詳盡的免費版與付費版比較,協助您找出必試的工具,以提升工作效率並獲得競爭優勢。 立即探索,找出最適合您的工具!

9 個工具
xix.ai
圖像編輯 用於電商服裝、皮膚清潔和色彩一致性的 Photoshop AI 修圖工具
用於電商服裝、皮膚清潔和色彩一致性的 Photoshop AI 修圖工具

2026 年最新最佳 Photoshop AI 修圖工具,適用於電商服裝、皮膚清潔和色彩一致性!這份頂級精選列表包含強大的變革性解決方案,可幫助您提升寫作效率、簡化內容創作並輕鬆實現完美的視覺效果。每個工具都經過實際測試,並透過每週更新的排名進行驗證,同時提供免費與付費版本的詳細對比。由 XIX.AI 支援,這是任何希望發揮 AI 優勢的人必試指南。立即探索!

10 個工具
xix.ai
評論 (63)
0/500
BillyRoberts
BillyRoberts 2026-07-29 02:00:18

So Google's finally catching up, but the safety report delays feel like a red flag 🚩. They're shipping models faster than they can audit them? That's how we get surprise biases or worse. I mean, Gemini 2.5 Pro sounds impressive on benchmarks, but real-world usage is a different beast. Hope they're not repeating the same mistakes as other rushed launches.

RoyLopez
RoyLopez 2025-10-03 10:30:38

Google이 Gemini 모델 배포를 서두르는 모습이 좀 우습네요. OpenAI한테 뒤쳐지지 않으려고 안간힘을 쓰는 거 같은데...AI 안전성 보고서는 뒤로 미루고 성능 경쟁만 하는 건 아닌지 걱정이 됩니다 😅

AlbertJones
AlbertJones 2025-08-26 13:59:22

Google's pushing hard with Gemini, huh? That 2.5 Pro sounds like a beast for coding and math! 😎 Wonder how it stacks up against ChatGPT in real-world tasks.

FredJones
FredJones 2025-04-24 21:49:30

गूगल के जेमिनी मॉडल वास्तव में सीमाओं को बढ़ा रहे हैं! जेमिनी 2.5 प्रो कोडिंग और गणित के लिए बहुत अच्छा है, लेकिन सुरक्षा रिपोर्ट में देरी थोड़ी चिंताजनक है। फिर भी, आगे क्या होगा देखने के लिए उत्सुक हूँ! 🤓

BrianWalker
BrianWalker 2025-04-24 18:04:20

GoogleのGeminiモデルは素晴らしいですが、安全性レポートの遅れが少し心配です。コーディングや数学のベンチマークは最高ですが、安全性についてもっと透明性が欲しいです。それでも、開発者にとっては強力なツールです。Google、限界を超え続けてください!💪

AnthonyHernández
AnthonyHernández 2025-04-22 16:56:18

구글의 Gemini 2.5 Pro는 인상적이야, 특히 코딩과 수학에서. 하지만 안전성 보고서 지연은 좀 실망스럽네. 복잡한 문제를 다룰 모델이 필요하면, 이거야! 💻

OR