選項
首頁
新聞
擬人化的AI模型具有可自定義的思維持續時間

擬人化的AI模型具有可自定義的思維持續時間

2025-04-10
307

Anthropic的最新AI模型Claude 3.7 Sonnet正在AI領域掀起波瀾。被譽為業界首款「混合AI推理模型」,它的設計能根據您的需求提供快速答案或更深思熟慮的回應。您甚至可以選擇讓Claude「思考」您問題的時間長短——是不是很酷?

Claude 3.7 Sonnet的理念是讓使用AI變得更簡單。Anthropic希望一個模型就能處理所有需求,而無需從眾多不同模型中選擇。從週一開始,每個人都可以體驗Claude 3.7 Sonnet,但若想使用其高級推理功能,需註冊Anthropic的付費計劃。免費用戶仍可使用該模型的基礎版本,Anthropic表示這比之前的Claude 3.5 Sonnet更優秀。

關於費用——Claude 3.7 Sonnet的價格為每百萬輸入token 3美元,每百萬輸出token 15美元。這比其他模型如OpenAI的o3-mini和DeepSeek的R1略貴,但請記住,那些只是推理模型,而非像Claude這樣的混合模型。

Anthropic的新思考模式 圖片來源:Anthropic
Claude 3.7 Sonnet是Anthropic首款具備「推理」能力的模型,這在AI領域是一大突破。推理模型需要更多時間和運算能力來回答問題,會將問題分解為更小的步驟以獲得更準確的答案。它不完全等同於人類推理,但以此為原型。

Anthropic對Claude有遠大計劃。他們希望Claude最終能自行判斷問題需要「思考」多久,而無需用戶設定。Anthropic的產品與研究負責人Dianne Penn對TechCrunch表示,他們認為推理只是前沿模型應具備的多項功能之一,全部整合於一身。

使用Claude 3.7 Sonnet,您甚至可以通過「可見筆記板」看到它如何規劃答案。大多數時候,您可以看到整個過程,但出於安全考量,Anthropic可能會對部分內容進行隱藏。

Claude在claude應用程式中的思考過程 圖片來源:Anthropic
Anthropic表示,他們已針對現實世界的任務對Claude的思考模式進行了微調,例如棘手的編碼問題或需要一定自主性的任務。如果您是使用Anthropic API的開發者,您甚至可以控制Claude的「思考」程度,在速度、成本與答案品質之間取得平衡。

在一些測試中,Claude 3.7 Sonnet表現出色。在SWE-Bench(一項針對現實世界編碼任務的測試)中,它得分62.3%,擊敗了OpenAI的o3-mini(得分49.3%)。在TAU-Bench(衡量AI在模擬零售環境中與用戶和外部API互動能力的測試)中,Claude 3.7 Sonnet得分81.2%,相較於OpenAI的o1模型(得分73.5%)更勝一籌。

Anthropic還表示,Claude 3.7 Sonnet將更少拒絕回答問題,對有害與無害提示作出更細緻的區分。與Claude 3.5 Sonnet相比,其不必要的拒答率降低了45%。

除了Claude 3.7 Sonnet,Anthropic還推出了一款名為Claude Code的新工具。這是一款研究預覽版,允許開發者直接從終端機通過Claude執行特定任務。在演示中,Anthropic展示了Claude Code如何通過簡單指令(如「解釋這個項目結構」)分析編碼項目。您甚至可以用純粹的英文修改程式碼庫,Claude Code會在修改過程中描述其編輯內容,測試錯誤,並將項目推送到GitHub倉庫。

Claude Code將以「先到先得」的方式提供給有限的用戶。

Anthropic在AI實驗室頻繁推出新模型的時刻發布Claude 3.7 Sonnet。雖然Anthropic通常採取更謹慎、以安全為重的策略,但這次他們希望領跑業界。然而,他們能領先多久尚無定論——特別是OpenAI的CEO Sam Altman表示,他們的混合AI模型也將在「數月內」推出。

相關文章
Anthropic 進入 AI 法律科技市場,競爭日益激烈 Anthropic 進入 AI 法律科技市場,競爭日益激烈 Anthropic 於週二釋出了一系列新的聊天機器人功能,旨在為法律實務提供自動化支援。這些增強功能在年初推出的特定律所平臺 Claude for Legal 基礎上進行了擴充套件,增加了針對不同法律領域的專用法律外掛和 MCP 聯結器。隨著法律人工智慧領域競爭的加劇,這些工具應運而生。今年三月,利用代理式人工智慧簡化法律工作流的 AI 法律初創公司 Harvey 以 110 億美元的估值獲得了 2 億美元融資。上個月,競爭對手 Legora 完成了 6 億美元的 D 輪融資,並啟動了一場由裘德·
Anthropic 推出 Opus 4.8,搭載全新的動態工作流程工具 Anthropic 推出 Opus 4.8,搭載全新的動態工作流程工具 Anthropic 於週四正式推出 Opus 4.8,這是其旗艦級公開模型的最新版本。此版本定價與前一版本相同,現已於所有平台上線。距離 Opus 4.7 發布僅隔 41 天,Anthropic 顯著加快了開發週期,遠快於近期 Sonnet 和 Haiku 版本所見的三個月及七個月間隔。此次快速更新很可能是為了回應 Opus 4.7 所獲得的冷淡反響,該版本曾讓許多使用者感到失望。與此同時,Ope
Anthropic 推出 Claude Fable 5,這是 Mythos 的公開版本 Anthropic 推出 Claude Fable 5,這是 Mythos 的公開版本 Anthropic 首次向大眾開放其最強大的 AI 模型——但同時也採取了安全措施。週二,該公司推出了「Claude Fable 5」,這是其 Mythos 模型的首個公開版本。 據 Anthropic 表示,Fable 5 在軟體工程、知識工作及視覺任務方面表現優異,但設有嚴格的安全限制。在網路安全、生物學、化學及蒸餾等高風險領域,該模型將拒絕回答問題,並轉而交由 Claude Opus 4.
相關專題推薦
數據分析 適用於 SaaS 和電商團隊的 KPI 監控最佳 AI 異常檢測工具
適用於 SaaS 和電商團隊的 KPI 監控最佳 AI 異常檢測工具

2026 年最新最佳頂級評分 AI 異常檢測工具,助力 SaaS 和電商團隊的 KPI 監控!XIX.AI 基於嚴格的真實世界測試和每週更新的排名,精心策劃了一套強大且顛覆性的工具合集。您將找到詳細的免費與付費對比洞察,幫助您識別必須嘗試的解決方案,從而提升生產力並釋放您的 AI 優勢。立即探索!

10 個工具
xix.ai
寫作 最適合撰寫長篇 SEO 文章的 AI 大綱生成工具
最適合撰寫長篇 SEO 文章的 AI 大綱生成工具

2026 年最新最佳、評價最高的 AI 大綱生成器,專為長篇 SEO 文章打造,由 XIX.AI 精心精選。這些強大的工具能為快速創作高品質內容提供革命性的協助,大幅提升寫作效率。 透過免費版與付費版的比較、實際測試結果及詳細排名,協助您找出最符合需求且不容錯過的選項。立即探索,釋放您的 AI 優勢。

8 個工具
xix.ai
教育與學習 適用於作業與考試準備的人工智慧學習工具
適用於作業與考試準備的人工智慧學習工具

2026 年最新最佳 AI 學習工具,助您完成作業與備考!XIX.AI 精心整理了一份備受好評的清單,收錄了這些強大且具革命性、經實測驗證的工具,能幫助學生提升效率、簡化作業流程,並在考試中取得優異成績。 獲取免費版與付費版的比較、詳細排名,以及必試選項,以釋放您的 AI 優勢。立即探索!

10 個工具
xix.ai
音樂創作 面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具
面向詞曲創作者、旋律片段、主旋律及多語言草稿創作的AI人聲演示工具

2026 年最新最佳 AI 人聲演示工具,專為詞曲創作者、旋律創作者和多語言內容團隊打造!XIX.AI 精心整理了一份經過嚴格真實世界測試的高評分、變革性工具列表。您將找到詳細的免費與付費對比資料、全面排名以及必試選項,幫助您提升創作效率並釋放創意潛力。立即探索,發現滿足您所有內容需求的完美工具!

9 個工具
xix.ai
商業 最適合小型企業的頂尖 AI 競爭情勢分析工具
最適合小型企業的頂尖 AI 競爭情勢分析工具

2026 年最新、最佳且評價最高的中小企業 AI 競爭研究工具!XIX.AI 精心精選了一系列極具威力且能改變遊戲規則的工具,並透過嚴謹的實測與詳細排名,每週更新內容。您可在此找到詳盡的免費版與付費版比較,協助您找出必試的工具,以提升工作效率並獲得競爭優勢。 立即探索,找出最適合您的工具!

9 個工具
xix.ai
圖像編輯 用於電商服裝、皮膚清潔和色彩一致性的 Photoshop AI 修圖工具
用於電商服裝、皮膚清潔和色彩一致性的 Photoshop AI 修圖工具

2026 年最新最佳 Photoshop AI 修圖工具,適用於電商服裝、皮膚清潔和色彩一致性!這份頂級精選列表包含強大的變革性解決方案,可幫助您提升寫作效率、簡化內容創作並輕鬆實現完美的視覺效果。每個工具都經過實際測試,並透過每週更新的排名進行驗證,同時提供免費與付費版本的詳細對比。由 XIX.AI 支援,這是任何希望發揮 AI 優勢的人必試指南。立即探索!

10 個工具
xix.ai
評論 (54)
0/500
RaymondAdams
RaymondAdams 2025-08-11 13:00:59

This hybrid AI model sounds like a game-changer! Being able to tweak how long Claude thinks is super cool, like choosing between a quick coffee chat or a deep dive convo. Excited to see how this stacks up against other AI out there! 😎

ChristopherDavis
ChristopherDavis 2025-08-06 03:00:59

Claude 3.7 Sonnet a l'air incroyable ! Pouvoir choisir la durée de réflexion, c'est comme demander à un chef de cuisiner vite ou de prendre son temps pour un plat parfait. J'ai hâte de voir comment ça marche en pratique ! 😄

WillieAdams
WillieAdams 2025-08-01 14:08:50

Claude's customizable thinking duration sounds like a game-changer! I wonder how it balances speed and depth in real-world tasks. Excited to try it out! 😄

ScarlettWhite
ScarlettWhite 2025-07-23 12:59:47

Wow, Claude 3.7 sounds like a game-changer! Being able to tweak how long it thinks is such a cool feature. I’m curious how this will stack up against other AI models in real-world tasks. Anyone tried it yet? 😄

CharlesRoberts
CharlesRoberts 2025-04-23 22:11:54

O Claude 3.7 Sonnet é incrível! Adoro poder escolher a duração do pensamento. Às vezes preciso de respostas rápidas, outras vezes quero respostas mais pensadas. É como ter um amigo AI personalizável! Só desejo que fosse um pouco mais rápido às vezes. 😎

RyanAnderson
RyanAnderson 2025-04-22 22:04:41

Claude 3.7 Sonnet is a game-changer! I love how I can choose the thinking duration. Sometimes I need quick answers, and other times I want a more thoughtful response. It's like having a customizable AI buddy! Only wish it was a bit faster at times. 🤓

OR