選項
首頁
新聞
Google 推出 Gemini Deep Think AI,用於平行推理和想法測試

Google 推出 Gemini Deep Think AI,用於平行推理和想法測試

2025-11-12
128

Google DeepMind 推出 Gemini 2.5 Deep Think,這是他們迄今為止最精密的 AI 推理模型。這個創新的系統可以同時分析多個思考路徑,然後再選出最佳解決方案。

自本週五起,Google 每月 250 美元的 Ultra 高級方案訂閱者將可透過 Gemini 應用程式,獨享 Gemini 2.5 Deep Think 的使用權。

Gemini 2.5 Deep Think 於 2025 年 Google I/O 週年大會上首次亮相,代表 Google 首次公開多代理模式。該系統同時部署多個 AI 代理來處理複雜的查詢,需要更強大的運算能力,但卻能產生更優異的結果。

Gemini 2.5 Deep Think 的專用版本在今年的國際數學奧林匹克比賽中獲得金牌。

Google 在開發 Gemini 2.5 Deep Think 的同時,也與數學家和學者分享 IMO 獲獎模型。有別於傳統 AI 模型的即時反應,這個以研究為重點的版本需要數小時的推理時間。該公司的目標是透過這項計畫,精進學術應用的多重代理技術。

Google 強調 Gemini 2.5 Deep Think 自首次 I/O 公佈以來的重大進展,包括優化模型推理能力的新型強化學習技術。

"Google 在 TechCrunch 獨家部落格文章中表示:「Deep Think 擅於解決需要創意思維、策略規劃與迭代精進的問題。

科技與創投重量級人物加入 Disrupt 2025 議程

包括 Netflix、ElevenLabs、Wayve 和 Sequoia Capital 在內的業界領導者將成為 TechCrunch Disrupt 2025 的主角。在我們里程碑式的 20 週年活動中,獲得轉型的洞察力,以推動您的創業公司成長。立即購買門票,即可在價格上漲前享有高達 675 美元的獨家優惠。

科技與創投重量級人物加入 Disrupt 2025 議程

包括 Netflix、ElevenLabs、Wayve 和 Sequoia Capital 在內的業界領導者將擔任 TechCrunch Disrupt 2025 的主講嘉賓。在我們里程碑式的 20 週年活動中,獲得轉型的洞察力,以推動您的創業公司成長。立即購買門票,即可在價格上漲前享有高達 675 美元的獨家優惠。

Gemini 2.5 Deep Think 在人類最後一次考試 (Humanity's Last Exam, HLE) 中設立新標準,這是一項跨學科測試人工智能的綜合評估。Google 報告在不使用外部工具的情況下,準確率達 34.8%,超越競爭對手 Grok 4 (25.4%) 與 OpenAI 的 o3 (20.3%)。

在競爭激烈的程式設計任務中,該模型也以 87.6% 的優異成績稱霸 LiveCodeBench 6,超越 Grok 4 (79%) 和 OpenAI 的 o3 (72%)。

基準分數圖片來源:Google

Gemini 2.5 Deep Think 可與程式設計環境和搜尋工具無縫整合,同時產生比傳統 AI 系統更廣泛的輸出。

Google 的內部測試顯示,該模型能產生異常詳細的網頁開發解決方案,有可能加速科學突破。

由 Google 的 AII 製作的藝術場景圖片資料來源:Google

領先的人工智能研究人員越來越多地採用多代理體架構。

xAI 的 Grok 4 Heavy 和 OpenAI 未發佈的 IMO 模型都採用了多代理系統,Anthropic 的研究型 AI 也是如此。雖然這些系統展現出優異的效能,但其營運成本卻使其必須以較高的價格階層來訂價。

Google 計劃在未來幾週內限制 Gemini 2.5 Deep Think 的 API 存取權限,以探索企業與開發人員的應用。

相關文章
Gemini Spark 現在管理 Google Photos 相簿 Gemini Spark 現在管理 Google Photos 相簿 Google 正在透過啟用 Gemini Spark 來管理 Google Photos 相簿,從而擴大其人工智慧整合範圍。使用者現在可以指示該代理編輯圖片、整理相簿、從精選照片中生成共享合集、將演唱會傳單轉換為日曆事件,並自動化其他工作流程。Google Photos 負責人 Shimrit Ben-Yair 在 X 平臺上宣佈了這些新功能,表示符合條件的美國 Gemini AI Pro 和 Ultra 訂閱使用者將在未來幾周內獲得英語支援。該公司尚未明確說明這些功能是否會擴充套件至國際市場,以及
Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙 Google 推出虛假來電偵測功能,以防範人工智慧深度偽造(deepfake)冒充詐騙 Google 週二宣布,Android 將推出「虛假來電偵測」功能,以防範利用人工智慧深度偽造技術進行的冒充詐騙。此功能將於本月透過「Phone by Google」在全球範圍內逐步推送至 Android 12 及以上版本的裝置,首先從 Pixel 裝置開始。隨著人們越來越不願接聽未知號碼的來電,詐騙者正改變策略,透過偽造可信賴的電話號碼,並利用 AI 深度偽造技術,讓聲音聽起來像是權威人士、家人
Frontier AI Labs 拒絕透露針對失控模型的管控策略 Frontier AI Labs 拒絕透露針對失控模型的管控策略 近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
相關專題推薦
教育與學習 適用於作業與考試準備的人工智慧學習工具
適用於作業與考試準備的人工智慧學習工具

2026 年最新最佳 AI 學習工具,助您完成作業與備考!XIX.AI 精心整理了一份備受好評的清單,收錄了這些強大且具革命性、經實測驗證的工具,能幫助學生提升效率、簡化作業流程,並在考試中取得優異成績。 獲取免費版與付費版的比較、詳細排名,以及必試選項,以釋放您的 AI 優勢。立即探索!

10 個工具
xix.ai
音樂創作 面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具
面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具

2026 年最新最佳 AI 人聲演示工具,專為詞曲創作者、旋律創作者和多語言內容團隊打造!XIX.AI 精心整理了一份經過嚴格真實世界測試的高評分、變革性工具列表。您將找到詳細的免費與付費對比資料、全面排名以及必試選項,幫助您提升創作效率並釋放創意潛力。立即探索,發現滿足您所有內容需求的完美工具!

9 個工具
xix.ai
商業 最適合小型企業的頂尖 AI 競爭情勢分析工具
最適合小型企業的頂尖 AI 競爭情勢分析工具

2026 年最新、最佳且評價最高的中小企業 AI 競爭研究工具!XIX.AI 精心精選了一系列極具威力且能改變遊戲規則的工具,並透過嚴謹的實測與詳細排名,每週更新內容。您可在此找到詳盡的免費版與付費版比較,協助您找出必試的工具,以提升工作效率並獲得競爭優勢。 立即探索,找出最適合您的工具!

9 個工具
xix.ai
圖像編輯 用於電商服裝、皮膚清潔和色彩一致性的 Photoshop AI 修圖工具
用於電商服裝、皮膚清潔和色彩一致性的 Photoshop AI 修圖工具

2026 年最新最佳 Photoshop AI 修圖工具,適用於電商服裝、皮膚清潔和色彩一致性!這份頂級精選列表包含強大的變革性解決方案,可幫助您提升寫作效率、簡化內容創作並輕鬆實現完美的視覺效果。每個工具都經過實際測試,並透過每週更新的排名進行驗證,同時提供免費與付費版本的詳細對比。由 XIX.AI 支援,這是任何希望發揮 AI 優勢的人必試指南。立即探索!

10 個工具
xix.ai
迅速的 適用於 ChatGPT 工作流程的最佳 AI 提示詞庫
適用於 ChatGPT 工作流程的最佳 AI 提示詞庫

2026 年最新、最受好評的 AI 提示詞庫,可優化各類 ChatGPT 工作流程。XIX.AI 精心蒐羅了一套強大且具革命性的精選集合,並經過嚴格的實際測試,以確保其表現卓越。 您可查閱詳盡的免費版與付費版比較分析,以及專家評比,助您挑選必試工具,從而提升工作效率並釋放您的 AI 優勢。立即探索!

11 個工具
xix.ai
教育與學習 面向教師、輔導老師和基於群體的學習專案的 AI 測驗構建平臺
面向教師、輔導老師和基於群體的學習專案的 AI 測驗構建平臺

2026年最新最佳AI測驗構建平臺,適用於教師、輔導老師和基於群體的學習專案!XIX.AI精心整理了一份頂級評分列表,包含經過現實世界測試的強力變革性工具,以提供準確的排名。這些必試平臺有助於提高寫作效率、簡化內容創作,並簡化各種學習場景中的測驗設計。立即探索,發現您解鎖教學AI優勢的理想工具!

13 個工具
xix.ai
評論 (1)
0/500
FrankMartínez
FrankMartínez 2026-05-25 10:00:35

Interesting approach! Parallel reasoning could really speed up complex problem-solving, but I wonder how they ensure the 'optimal' solution isn't just the most predictable one? The testing feature sounds useful for prototyping ideas quickly. Hope it's accessible beyond just high-tier subscribers soon. 🤔

OR