Anthropicは、『Mythos』の一般公開版である『Claude Fable 5』をリリースした

Anthropicは、同社で最も高性能なAIモデルを初めて一般に公開した――ただし、安全対策が講じられている。
火曜日、同社はMythosモデルの初の一般公開版となる「Claude Fable 5」をリリースした。 Anthropicによると、「Fable 5」はソフトウェアエンジニアリング、ナレッジワーク、画像処理タスクにおいて優れた性能を発揮するが、厳格な安全制限が設けられている。サイバーセキュリティ、生物学、化学、蒸留といった高リスク分野では、このモデルは回答を拒否し、代わりに「Claude Opus 4.8」に処理を委ねる。
4月にプレビュー版として最初にリリースされたMythosは、サイバーセキュリティ上の懸念から、ごく少数のパートナーのみが利用可能でした。先週、Anthropicは15カ国の数百の組織にアクセス権を拡大し、今回も重要インフラを管理する組織を優先しました。
現在、この技術の一部は、AnthropicのClaude APIおよび従量課金型のEnterpriseプランを通じて、誰でも利用できるようになっています。サブスクリプションによるアクセスは段階的に展開されます。6月22日まで、「Fable 5」はPro、Max、Team、およびシートベースのEnterpriseプランに追加料金なしで含まれます。 6月23日、AnthropicはこれらのプランからFable 5を削除し、以降は利用クレジットが必要となりますが、できるだけ早く標準のサブスクリプション機能として復活させる予定です。
また、Anthropicは、高度なモデルへのアクセスがすでに承認されている組織向けに、「Mythos 5」と名付けられたMythosの新バージョンを展開しています。
Fableのリリースは、OpenAIやイーロン・マスク氏のSpaceXと並んで、Anthropicが株式公開に向けた準備を進めている時期と重なっています。また、これは同社が世界の主要なAI研究所に対し、最先端のAI開発に向けた協調的な「ブレーキペダル」を構築するよう呼びかけた動きに続くものです。 Anthropicは、AIシステムの進化が極めて急速であるため、まもなく再帰的自己改善(RSI)を達成し、人間の介入なしに自律的に性能を向上させる可能性があると警告した。
「Mythos」クラスのモデルが悪用された場合に何が起こり得るかを懸念し、Anthropicは『Fable 5』のリリースに先立ち、脱獄(jailbreak)の試みを用いて分類器のストレステストを実施したと述べている。
「社内で外部向けのバグ報奨金プログラムを実施しましたが、1,000時間以上にわたるテストにおいて、汎用的な脱獄手法は発見されませんでした。その後、外部のレッドチーム組織とも協力しましたが、彼らも汎用的な脱獄手法を特定することはできませんでした。」
とはいえ、新たな攻撃の可能性は依然として残っている。その結果、Fable 5およびMythos 5のリリースに伴い、Anthropicは、企業が以前にデータ保持期間ゼロの契約を結んでいた場合でも、すべてのトラフィックについて30日間の保持期間を義務付けると発表した。 同社は、このデータをトレーニングには使用せず、「新たな脱獄手法を含む複雑かつ新規の攻撃からの防御」および「誤検知の特定と低減」にのみ利用すると述べた。この方針は、ますます高性能化するモデルへのアクセスに、安全対策として位置づけられた強制的なデータ保持ポリシーが伴うという、業界の先例となる可能性がある。
このモデルを引き続き利用するユーザーにとって、すべての質問に対してFable 5が回答するわけではない。Anthropicによると、FableがOpus 4.8に判断を委ねなければならないケースは稀であり、初期データではFableセッションの少なくとも95%が、モデル自身の応答のみに依存していることが示されている。
第三者によるテストでは、分析企業のHexが、複雑で長時間かかる分析タスクを含む同社のコア分析ベンチマークにおいて、Fableが初めて90%のスコアを達成したと述べた。
「最も難しい質問に対しても、Fableは優れた判断力とニュアンスへの細やかな配慮を示している」とHexは述べた。
バイブコーディングプラットフォームのBase44は声明の中で、Fableは「アプリ全体を一発で構築する」能力に優れており、ツール呼び出し機能も優れていると指摘した。AI搭載のワークスペースおよびエージェントプラットフォームであるGensparkは、Fableが自社の評価において他のすべてのモデルを上回り、UIデザインやゲームコーディングなどのタスクで著しく優れたパフォーマンスを発揮したと述べた。
Fable 5とMythos 5の価格は、入力トークン100万単位あたり10ドル、出力トークン100万単位あたり50ドルに設定されており、Opus 4.8の2倍のコストとなる。この価格設定だけでも、普及を妨げる要因となり得る。
多くの企業は、請求額を確認したり、年間のAI予算を早期に使い果たしたりした経験から、AIのコストに対してますます厳しい目を向けるようになっている。Opus 4.8のような高度なモデルは、その洗練された推論能力によって1つのリクエストを複数のタスクに分割してしまうため、こうした問題をさらに悪化させる可能性がある。
Anthropic社は、『Fable 5』への需要が非常に高く、予測が難しいと見込んでいる。実際、ショッピングリワードプラットフォームの楽天のような企業の中には、そのメリットがコストに見合うと判断するところもあるだろう。
「最高レベルの処理において、Fableは自身の作業を振り返り、検証を行います」と楽天は声明で述べた。「当社にとって、それこそが高度に自律的な運用を可能にするものであり、その余分な思考はそれ自体で元を取れるのです。」
関連記事
Anthropic、AI法テック市場に参入、競争激化
Anthropicは火曜日、法律実務に自動化されたサポートを提供することを目的とした一連の新しいチャットボットの機能を公開した。これらの強化機能は、今年初めに導入された企業固有のプラットフォーム「Claude for Legal」を拡張し、異なる法律分野に特化した専門的な法律プラグインとMCPコネクタを追加するものである。これらのツールは、法律AI分野での競争が激化する中で登場した。3月、エージェント型AIを活用して法律ワークフローを効率化するAI法律スタートアップのHarveyは、110億ド
OpenAI、Anthropicとの差をビジネスユーザー間で縮める、新しいデータが示す
OpenAIとAnthropicがまだ予想されるIPOや詳細な財務報告から遠く離れているため、私たちはそれらのビジネスパフォーマンスを測定するために代替指標に頼らなければならない。企業向けクレジットカードおよび経費管理プラットフォームであるRampは、最近、OpenAIが米国の企業間でAnthropicとの格差を急速に縮めていることを示す説得力のあるデータを公開した。OpenAIは以前、消費者と企業の両方で支配的な立場を占めていたが、5月にRampの有料企業ユーザーの間での首位をAnthrop
Anthropic、新しいダイナミックワークフローツールを搭載した「Opus 4.8」をリリース
Anthropicは木曜日、同社の主力パブリックモデルである「Opus 4.8」を発表しました。価格は前バージョンと同額で、このアップデートは現在、すべてのプラットフォームで利用可能です。「Opus 4.7」のリリースからわずか41日後に公開された今回のアップデートにより、Anthropicは開発サイクルを大幅に加速させ、最近の「Sonnet」や「Haiku」のリリースで見られた3ヶ月や7ヶ月とい
関連特集おすすめ
コメント (0)
0/500

Anthropicは、同社で最も高性能なAIモデルを初めて一般に公開した――ただし、安全対策が講じられている。
火曜日、同社はMythosモデルの初の一般公開版となる「Claude Fable 5」をリリースした。 Anthropicによると、「Fable 5」はソフトウェアエンジニアリング、ナレッジワーク、画像処理タスクにおいて優れた性能を発揮するが、厳格な安全制限が設けられている。サイバーセキュリティ、生物学、化学、蒸留といった高リスク分野では、このモデルは回答を拒否し、代わりに「Claude Opus 4.8」に処理を委ねる。
4月にプレビュー版として最初にリリースされたMythosは、サイバーセキュリティ上の懸念から、ごく少数のパートナーのみが利用可能でした。先週、Anthropicは15カ国の数百の組織にアクセス権を拡大し、今回も重要インフラを管理する組織を優先しました。
現在、この技術の一部は、AnthropicのClaude APIおよび従量課金型のEnterpriseプランを通じて、誰でも利用できるようになっています。サブスクリプションによるアクセスは段階的に展開されます。6月22日まで、「Fable 5」はPro、Max、Team、およびシートベースのEnterpriseプランに追加料金なしで含まれます。 6月23日、AnthropicはこれらのプランからFable 5を削除し、以降は利用クレジットが必要となりますが、できるだけ早く標準のサブスクリプション機能として復活させる予定です。
また、Anthropicは、高度なモデルへのアクセスがすでに承認されている組織向けに、「Mythos 5」と名付けられたMythosの新バージョンを展開しています。
Fableのリリースは、OpenAIやイーロン・マスク氏のSpaceXと並んで、Anthropicが株式公開に向けた準備を進めている時期と重なっています。また、これは同社が世界の主要なAI研究所に対し、最先端のAI開発に向けた協調的な「ブレーキペダル」を構築するよう呼びかけた動きに続くものです。 Anthropicは、AIシステムの進化が極めて急速であるため、まもなく再帰的自己改善(RSI)を達成し、人間の介入なしに自律的に性能を向上させる可能性があると警告した。
「Mythos」クラスのモデルが悪用された場合に何が起こり得るかを懸念し、Anthropicは『Fable 5』のリリースに先立ち、脱獄(jailbreak)の試みを用いて分類器のストレステストを実施したと述べている。
「社内で外部向けのバグ報奨金プログラムを実施しましたが、1,000時間以上にわたるテストにおいて、汎用的な脱獄手法は発見されませんでした。その後、外部のレッドチーム組織とも協力しましたが、彼らも汎用的な脱獄手法を特定することはできませんでした。」
とはいえ、新たな攻撃の可能性は依然として残っている。その結果、Fable 5およびMythos 5のリリースに伴い、Anthropicは、企業が以前にデータ保持期間ゼロの契約を結んでいた場合でも、すべてのトラフィックについて30日間の保持期間を義務付けると発表した。 同社は、このデータをトレーニングには使用せず、「新たな脱獄手法を含む複雑かつ新規の攻撃からの防御」および「誤検知の特定と低減」にのみ利用すると述べた。この方針は、ますます高性能化するモデルへのアクセスに、安全対策として位置づけられた強制的なデータ保持ポリシーが伴うという、業界の先例となる可能性がある。
このモデルを引き続き利用するユーザーにとって、すべての質問に対してFable 5が回答するわけではない。Anthropicによると、FableがOpus 4.8に判断を委ねなければならないケースは稀であり、初期データではFableセッションの少なくとも95%が、モデル自身の応答のみに依存していることが示されている。
第三者によるテストでは、分析企業のHexが、複雑で長時間かかる分析タスクを含む同社のコア分析ベンチマークにおいて、Fableが初めて90%のスコアを達成したと述べた。
「最も難しい質問に対しても、Fableは優れた判断力とニュアンスへの細やかな配慮を示している」とHexは述べた。
バイブコーディングプラットフォームのBase44は声明の中で、Fableは「アプリ全体を一発で構築する」能力に優れており、ツール呼び出し機能も優れていると指摘した。AI搭載のワークスペースおよびエージェントプラットフォームであるGensparkは、Fableが自社の評価において他のすべてのモデルを上回り、UIデザインやゲームコーディングなどのタスクで著しく優れたパフォーマンスを発揮したと述べた。
Fable 5とMythos 5の価格は、入力トークン100万単位あたり10ドル、出力トークン100万単位あたり50ドルに設定されており、Opus 4.8の2倍のコストとなる。この価格設定だけでも、普及を妨げる要因となり得る。
多くの企業は、請求額を確認したり、年間のAI予算を早期に使い果たしたりした経験から、AIのコストに対してますます厳しい目を向けるようになっている。Opus 4.8のような高度なモデルは、その洗練された推論能力によって1つのリクエストを複数のタスクに分割してしまうため、こうした問題をさらに悪化させる可能性がある。
Anthropic社は、『Fable 5』への需要が非常に高く、予測が難しいと見込んでいる。実際、ショッピングリワードプラットフォームの楽天のような企業の中には、そのメリットがコストに見合うと判断するところもあるだろう。
「最高レベルの処理において、Fableは自身の作業を振り返り、検証を行います」と楽天は声明で述べた。「当社にとって、それこそが高度に自律的な運用を可能にするものであり、その余分な思考はそれ自体で元を取れるのです。」
Anthropic、AI法テック市場に参入、競争激化
Anthropicは火曜日、法律実務に自動化されたサポートを提供することを目的とした一連の新しいチャットボットの機能を公開した。これらの強化機能は、今年初めに導入された企業固有のプラットフォーム「Claude for Legal」を拡張し、異なる法律分野に特化した専門的な法律プラグインとMCPコネクタを追加するものである。これらのツールは、法律AI分野での競争が激化する中で登場した。3月、エージェント型AIを活用して法律ワークフローを効率化するAI法律スタートアップのHarveyは、110億ド
OpenAI、Anthropicとの差をビジネスユーザー間で縮める、新しいデータが示す
OpenAIとAnthropicがまだ予想されるIPOや詳細な財務報告から遠く離れているため、私たちはそれらのビジネスパフォーマンスを測定するために代替指標に頼らなければならない。企業向けクレジットカードおよび経費管理プラットフォームであるRampは、最近、OpenAIが米国の企業間でAnthropicとの格差を急速に縮めていることを示す説得力のあるデータを公開した。OpenAIは以前、消費者と企業の両方で支配的な立場を占めていたが、5月にRampの有料企業ユーザーの間での首位をAnthrop
Anthropic、新しいダイナミックワークフローツールを搭載した「Opus 4.8」をリリース
Anthropicは木曜日、同社の主力パブリックモデルである「Opus 4.8」を発表しました。価格は前バージョンと同額で、このアップデートは現在、すべてのプラットフォームで利用可能です。「Opus 4.7」のリリースからわずか41日後に公開された今回のアップデートにより、Anthropicは開発サイクルを大幅に加速させ、最近の「Sonnet」や「Haiku」のリリースで見られた3ヶ月や7ヶ月とい





家






