Anthropic 推出 Claude Fable 5,這是 Mythos 的公開版本

Anthropic 首次向大眾開放其最強大的 AI 模型——但同時也採取了安全措施。
週二,該公司推出了「Claude Fable 5」,這是其 Mythos 模型的首個公開版本。 據 Anthropic 表示,Fable 5 在軟體工程、知識工作及視覺任務方面表現優異,但設有嚴格的安全限制。在網路安全、生物學、化學及蒸餾等高風險領域,該模型將拒絕回答問題,並轉而交由 Claude Opus 4.8 處理。
Mythos 最初於四月以預覽版形式發布,但基於網路安全考量,當時僅限少數合作夥伴使用。上週,Anthropic 將使用權擴展至 15 個國家的數百家組織,並再次優先考慮那些負責管理關鍵基礎設施的機構。
如今,透過 Anthropic 的 Claude API 及按用量計費的企業方案,所有人皆可使用該技術的某個版本。訂閱權限將分階段推出:截至 6 月 22 日,Fable 5 將包含在 Pro、Max、Team 以及按席位計費的企業方案中,且無需額外付費。 6 月 23 日起,Anthropic 將從上述方案中移除 Fable 5,此後使用該功能需消耗使用額度,但公司計畫盡快將其恢復為標準訂閱功能。
Anthropic 同時也將向已獲准使用該進階模型的組織推出 Mythos 的新版本,名為 Mythos 5。
Fable 的推出正值 Anthropic 準備進軍公開市場之際,與 OpenAI 及伊隆·馬斯克(Elon Musk)的 SpaceX 同步。此舉亦緊隨該公司呼籲全球主要 AI 實驗室共同建立一套協調的「煞車踏板」,以規範前沿 AI 發展之後。 Anthropic 警告稱,AI 系統的發展速度如此之快,可能很快就會實現遞迴自我改進(RSI),使其能夠在無需人類介入的情況下自主提升。
鑑於擔心「Mythos」級別模型若落入不法之徒手中可能造成的後果,Anthropic 表示在發布 Fable 5 之前,已透過模擬越獄攻擊對其分類器進行了壓力測試。
「在內部,我們執行了一項外部漏洞懸賞計畫,在超過 1,000 小時的測試中未發現任何通用越獄方法。隨後,我們與外部紅隊組織合作,對方同樣未能找出任何通用越獄方法。」
儘管如此,新型攻擊仍有可能發生。因此,隨著 Fable 5 和 Mythos 5 的推出,Anthropic 表示將要求所有流量必須保留 30 天,即使企業先前簽訂的是零保留協議亦然。 該公司聲明不會將資料用於訓練,僅用於「防禦複雜且新穎的攻擊(包括新的越獄手段)」,以及「識別並減少誤報」。這項政策可能為業界樹立先例,即使用日益強大的模型將伴隨以安全措施為名、強制實施的資料保留政策。
對於持續使用該模型的用戶而言,並非每個問題都會獲得 Fable 5 的回答。Anthropic 表示,Fable 必須轉而採用 Opus 4.8 的情況相當罕見,早期數據顯示,至少 95% 的 Fable 會話完全依賴模型自身的回應。
在第三方測試中,分析公司 Hex 指出,Fable 是首個在其核心分析基準測試中獲得 90% 得分的人工智慧模型,該測試涉及複雜且長時間運行的分析任務。
「面對最棘手的問題時,它展現出強大的判斷力,並能細膩地捕捉語義差異,」Hex 表示。
情緒編碼平台 Base44 在一份聲明中指出,Fable 在「一次完成完整應用程式開發」方面更為出色,且具備卓越的工具調用能力。由 AI 驅動的工作空間與代理平台 Genspark 表示,Fable 在其評估中表現優於所有其他模型,並在 UI 設計和遊戲編碼等任務上表現顯著更佳。
Fable 5 與 Mythos 5 的定價均設定為每百萬輸入代幣 10 美元、每百萬輸出代幣 50 美元,是 Opus 4.8 成本的兩倍。僅就價格而言,這可能阻礙其廣泛採用。
許多企業在看到帳單或提前耗盡年度 AI 預算後,對 AI 成本的批評聲浪日益高漲。像 Opus 4.8 這樣的高階模型可能會加劇這些問題,因為其精密的推理能力會將單一請求拆解成多個任務。
Anthropic 表示,預期對 Fable 5 的需求將非常高且難以預測。事實上,部分企業(例如購物回饋平台樂天)可能會認為其帶來的好處值得這筆成本。
樂天在聲明中表示:「在最高工作強度下,Fable 會對自身的工作進行反思與驗證。對我們而言,這正是實現高度自主運作的關鍵——這份額外的思考所帶來的效益,足以彌補其成本。」
相關文章
Anthropic 進入 AI 法律科技市場,競爭日益激烈
Anthropic 於週二釋出了一系列新的聊天機器人功能,旨在為法律實務提供自動化支援。這些增強功能在年初推出的特定律所平臺 Claude for Legal 基礎上進行了擴充套件,增加了針對不同法律領域的專用法律外掛和 MCP 聯結器。隨著法律人工智慧領域競爭的加劇,這些工具應運而生。今年三月,利用代理式人工智慧簡化法律工作流的 AI 法律初創公司 Harvey 以 110 億美元的估值獲得了 2 億美元融資。上個月,競爭對手 Legora 完成了 6 億美元的 D 輪融資,並啟動了一場由裘德·
OpenAI 在企業使用者中與 Anthropic 的差距縮小,新資料顯示
在 OpenAI 和 Anthropic 距離預期的首次公開募股(IPO)以及詳細財務報告的釋出仍有距離的情況下,我們必須轉向其他指標來評估它們的業務表現。企業信用卡和費用管理平臺 Ramp 最近釋出了令人信服的資料,顯示 OpenAI 正在迅速縮小與美國企業使用者中 Anthropic 的差距。OpenAI 此前在消費者和企業客戶中都佔據主導地位,但在今年 5 月,它失去了在 Ramp 付費企業使用者中的領先地位。當時,Anthropic 佔據了 41% 的市場份額,而 OpenAI 為 39%
Anthropic 推出 Opus 4.8,搭載全新的動態工作流程工具
Anthropic 於週四正式推出 Opus 4.8,這是其旗艦級公開模型的最新版本。此版本定價與前一版本相同,現已於所有平台上線。距離 Opus 4.7 發布僅隔 41 天,Anthropic 顯著加快了開發週期,遠快於近期 Sonnet 和 Haiku 版本所見的三個月及七個月間隔。此次快速更新很可能是為了回應 Opus 4.7 所獲得的冷淡反響,該版本曾讓許多使用者感到失望。與此同時,Ope
相關專題推薦
評論 (0)
0/500

Anthropic 首次向大眾開放其最強大的 AI 模型——但同時也採取了安全措施。
週二,該公司推出了「Claude Fable 5」,這是其 Mythos 模型的首個公開版本。 據 Anthropic 表示,Fable 5 在軟體工程、知識工作及視覺任務方面表現優異,但設有嚴格的安全限制。在網路安全、生物學、化學及蒸餾等高風險領域,該模型將拒絕回答問題,並轉而交由 Claude Opus 4.8 處理。
Mythos 最初於四月以預覽版形式發布,但基於網路安全考量,當時僅限少數合作夥伴使用。上週,Anthropic 將使用權擴展至 15 個國家的數百家組織,並再次優先考慮那些負責管理關鍵基礎設施的機構。
如今,透過 Anthropic 的 Claude API 及按用量計費的企業方案,所有人皆可使用該技術的某個版本。訂閱權限將分階段推出:截至 6 月 22 日,Fable 5 將包含在 Pro、Max、Team 以及按席位計費的企業方案中,且無需額外付費。 6 月 23 日起,Anthropic 將從上述方案中移除 Fable 5,此後使用該功能需消耗使用額度,但公司計畫盡快將其恢復為標準訂閱功能。
Anthropic 同時也將向已獲准使用該進階模型的組織推出 Mythos 的新版本,名為 Mythos 5。
Fable 的推出正值 Anthropic 準備進軍公開市場之際,與 OpenAI 及伊隆·馬斯克(Elon Musk)的 SpaceX 同步。此舉亦緊隨該公司呼籲全球主要 AI 實驗室共同建立一套協調的「煞車踏板」,以規範前沿 AI 發展之後。 Anthropic 警告稱,AI 系統的發展速度如此之快,可能很快就會實現遞迴自我改進(RSI),使其能夠在無需人類介入的情況下自主提升。
鑑於擔心「Mythos」級別模型若落入不法之徒手中可能造成的後果,Anthropic 表示在發布 Fable 5 之前,已透過模擬越獄攻擊對其分類器進行了壓力測試。
「在內部,我們執行了一項外部漏洞懸賞計畫,在超過 1,000 小時的測試中未發現任何通用越獄方法。隨後,我們與外部紅隊組織合作,對方同樣未能找出任何通用越獄方法。」
儘管如此,新型攻擊仍有可能發生。因此,隨著 Fable 5 和 Mythos 5 的推出,Anthropic 表示將要求所有流量必須保留 30 天,即使企業先前簽訂的是零保留協議亦然。 該公司聲明不會將資料用於訓練,僅用於「防禦複雜且新穎的攻擊(包括新的越獄手段)」,以及「識別並減少誤報」。這項政策可能為業界樹立先例,即使用日益強大的模型將伴隨以安全措施為名、強制實施的資料保留政策。
對於持續使用該模型的用戶而言,並非每個問題都會獲得 Fable 5 的回答。Anthropic 表示,Fable 必須轉而採用 Opus 4.8 的情況相當罕見,早期數據顯示,至少 95% 的 Fable 會話完全依賴模型自身的回應。
在第三方測試中,分析公司 Hex 指出,Fable 是首個在其核心分析基準測試中獲得 90% 得分的人工智慧模型,該測試涉及複雜且長時間運行的分析任務。
「面對最棘手的問題時,它展現出強大的判斷力,並能細膩地捕捉語義差異,」Hex 表示。
情緒編碼平台 Base44 在一份聲明中指出,Fable 在「一次完成完整應用程式開發」方面更為出色,且具備卓越的工具調用能力。由 AI 驅動的工作空間與代理平台 Genspark 表示,Fable 在其評估中表現優於所有其他模型,並在 UI 設計和遊戲編碼等任務上表現顯著更佳。
Fable 5 與 Mythos 5 的定價均設定為每百萬輸入代幣 10 美元、每百萬輸出代幣 50 美元,是 Opus 4.8 成本的兩倍。僅就價格而言,這可能阻礙其廣泛採用。
許多企業在看到帳單或提前耗盡年度 AI 預算後,對 AI 成本的批評聲浪日益高漲。像 Opus 4.8 這樣的高階模型可能會加劇這些問題,因為其精密的推理能力會將單一請求拆解成多個任務。
Anthropic 表示,預期對 Fable 5 的需求將非常高且難以預測。事實上,部分企業(例如購物回饋平台樂天)可能會認為其帶來的好處值得這筆成本。
樂天在聲明中表示:「在最高工作強度下,Fable 會對自身的工作進行反思與驗證。對我們而言,這正是實現高度自主運作的關鍵——這份額外的思考所帶來的效益,足以彌補其成本。」
Anthropic 進入 AI 法律科技市場,競爭日益激烈
Anthropic 於週二釋出了一系列新的聊天機器人功能,旨在為法律實務提供自動化支援。這些增強功能在年初推出的特定律所平臺 Claude for Legal 基礎上進行了擴充套件,增加了針對不同法律領域的專用法律外掛和 MCP 聯結器。隨著法律人工智慧領域競爭的加劇,這些工具應運而生。今年三月,利用代理式人工智慧簡化法律工作流的 AI 法律初創公司 Harvey 以 110 億美元的估值獲得了 2 億美元融資。上個月,競爭對手 Legora 完成了 6 億美元的 D 輪融資,並啟動了一場由裘德·
OpenAI 在企業使用者中與 Anthropic 的差距縮小,新資料顯示
在 OpenAI 和 Anthropic 距離預期的首次公開募股(IPO)以及詳細財務報告的釋出仍有距離的情況下,我們必須轉向其他指標來評估它們的業務表現。企業信用卡和費用管理平臺 Ramp 最近釋出了令人信服的資料,顯示 OpenAI 正在迅速縮小與美國企業使用者中 Anthropic 的差距。OpenAI 此前在消費者和企業客戶中都佔據主導地位,但在今年 5 月,它失去了在 Ramp 付費企業使用者中的領先地位。當時,Anthropic 佔據了 41% 的市場份額,而 OpenAI 為 39%
Anthropic 推出 Opus 4.8,搭載全新的動態工作流程工具
Anthropic 於週四正式推出 Opus 4.8,這是其旗艦級公開模型的最新版本。此版本定價與前一版本相同,現已於所有平台上線。距離 Opus 4.7 發布僅隔 41 天,Anthropic 顯著加快了開發週期,遠快於近期 Sonnet 和 Haiku 版本所見的三個月及七個月間隔。此次快速更新很可能是為了回應 Opus 4.7 所獲得的冷淡反響,該版本曾讓許多使用者感到失望。與此同時,Ope





首頁






