Anthropic 推出 Opus 4.8,搭載全新的動態工作流程工具

Anthropic 於週四正式推出 Opus 4.8,這是其旗艦級公開模型的最新版本。此版本定價與前一版本相同,現已於所有平台上線。
距離 Opus 4.7 發布僅隔 41 天,Anthropic 顯著加快了開發週期,遠快於近期 Sonnet 和 Haiku 版本所見的三個月及七個月間隔。此次快速更新很可能是為了回應 Opus 4.7 所獲得的冷淡反響,該版本曾讓許多使用者感到失望。
與此同時,OpenAI 的 Codex 和 Google 的 Gemini Flash 皆推出了重大更新,這使得 Anthropic 面臨更強烈的競爭壓力,必須維持其技術優勢。
儘管 Opus 4.8 展現了頂級的基準測試表現,但它特別著重於處理模稜兩可或有缺陷的資料。早期測試者指出,該模型現在更傾向於標示不確定性,且較少做出缺乏依據的斷言。
Bridgewater Associates 對此表示認同,並特別強調該模型能主動標記輸入與輸出的異常情況——這項功能往往被其他系統忽略,通常需由使用者自行判斷。
隨著模型的推出,Anthropic 同時推出了「動態工作流程」(Dynamic Workflows),目前處於研究預覽階段。此功能使 Opus 等大型模型能夠協調數百個並行子代理執行複雜任務。
根據公告,將 Claude Code 與 Opus 4.8 結合使用,可實現涵蓋數十萬行程式的代碼庫級遷移,並透過現有測試套件從啟動到合併的整個過程進行驗證。
鑑於上個月預覽期間引發的網路安全疑慮,Anthropic 目前仍暫不釋出其先進的 Mythos 模型。不過,該公司表示,一旦實施適當的防護措施,Mythos 的預覽階段可能會很快結束。
「我們正在加速開發安全防護措施,並預期將在未來幾週內向所有客戶部署 Mythos 級別的模型,」該公司表示。
相關文章
Anthropic 進入 AI 法律科技市場,競爭日益激烈
Anthropic 於週二釋出了一系列新的聊天機器人功能,旨在為法律實務提供自動化支援。這些增強功能在年初推出的特定律所平臺 Claude for Legal 基礎上進行了擴充套件,增加了針對不同法律領域的專用法律外掛和 MCP 聯結器。隨著法律人工智慧領域競爭的加劇,這些工具應運而生。今年三月,利用代理式人工智慧簡化法律工作流的 AI 法律初創公司 Harvey 以 110 億美元的估值獲得了 2 億美元融資。上個月,競爭對手 Legora 完成了 6 億美元的 D 輪融資,並啟動了一場由裘德·
OpenAI 在企業使用者中與 Anthropic 的差距縮小,新資料顯示
在 OpenAI 和 Anthropic 距離預期的首次公開募股(IPO)以及詳細財務報告的釋出仍有距離的情況下,我們必須轉向其他指標來評估它們的業務表現。企業信用卡和費用管理平臺 Ramp 最近釋出了令人信服的資料,顯示 OpenAI 正在迅速縮小與美國企業使用者中 Anthropic 的差距。OpenAI 此前在消費者和企業客戶中都佔據主導地位,但在今年 5 月,它失去了在 Ramp 付費企業使用者中的領先地位。當時,Anthropic 佔據了 41% 的市場份額,而 OpenAI 為 39%
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
相關專題推薦
評論 (0)
0/500

Anthropic 於週四正式推出 Opus 4.8,這是其旗艦級公開模型的最新版本。此版本定價與前一版本相同,現已於所有平台上線。
距離 Opus 4.7 發布僅隔 41 天,Anthropic 顯著加快了開發週期,遠快於近期 Sonnet 和 Haiku 版本所見的三個月及七個月間隔。此次快速更新很可能是為了回應 Opus 4.7 所獲得的冷淡反響,該版本曾讓許多使用者感到失望。
與此同時,OpenAI 的 Codex 和 Google 的 Gemini Flash 皆推出了重大更新,這使得 Anthropic 面臨更強烈的競爭壓力,必須維持其技術優勢。
儘管 Opus 4.8 展現了頂級的基準測試表現,但它特別著重於處理模稜兩可或有缺陷的資料。早期測試者指出,該模型現在更傾向於標示不確定性,且較少做出缺乏依據的斷言。
Bridgewater Associates 對此表示認同,並特別強調該模型能主動標記輸入與輸出的異常情況——這項功能往往被其他系統忽略,通常需由使用者自行判斷。
隨著模型的推出,Anthropic 同時推出了「動態工作流程」(Dynamic Workflows),目前處於研究預覽階段。此功能使 Opus 等大型模型能夠協調數百個並行子代理執行複雜任務。
根據公告,將 Claude Code 與 Opus 4.8 結合使用,可實現涵蓋數十萬行程式的代碼庫級遷移,並透過現有測試套件從啟動到合併的整個過程進行驗證。
鑑於上個月預覽期間引發的網路安全疑慮,Anthropic 目前仍暫不釋出其先進的 Mythos 模型。不過,該公司表示,一旦實施適當的防護措施,Mythos 的預覽階段可能會很快結束。
「我們正在加速開發安全防護措施,並預期將在未來幾週內向所有客戶部署 Mythos 級別的模型,」該公司表示。
Anthropic 進入 AI 法律科技市場,競爭日益激烈
Anthropic 於週二釋出了一系列新的聊天機器人功能,旨在為法律實務提供自動化支援。這些增強功能在年初推出的特定律所平臺 Claude for Legal 基礎上進行了擴充套件,增加了針對不同法律領域的專用法律外掛和 MCP 聯結器。隨著法律人工智慧領域競爭的加劇,這些工具應運而生。今年三月,利用代理式人工智慧簡化法律工作流的 AI 法律初創公司 Harvey 以 110 億美元的估值獲得了 2 億美元融資。上個月,競爭對手 Legora 完成了 6 億美元的 D 輪融資,並啟動了一場由裘德·
OpenAI 在企業使用者中與 Anthropic 的差距縮小,新資料顯示
在 OpenAI 和 Anthropic 距離預期的首次公開募股(IPO)以及詳細財務報告的釋出仍有距離的情況下,我們必須轉向其他指標來評估它們的業務表現。企業信用卡和費用管理平臺 Ramp 最近釋出了令人信服的資料,顯示 OpenAI 正在迅速縮小與美國企業使用者中 Anthropic 的差距。OpenAI 此前在消費者和企業客戶中都佔據主導地位,但在今年 5 月,它失去了在 Ramp 付費企業使用者中的領先地位。當時,Anthropic 佔據了 41% 的市場份額,而 OpenAI 為 39%
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr





首頁






