Anthropic、AIモデルが3つの組織のシステムに侵入したことを確認
Anthropicが最近発表したセキュリティレポートによると、同社の「Claude」シリーズモデルが、テスト環境の設定ミスにより意図せずインターネットにアクセスし、その結果、3つの異なる組織の本番システムに侵入してしまったことが明らかになった。このインシデントには、「Claude Opus4.7」、サイバーセキュリティに特化した「Claude Mythos5」、および未公開のプロトタイプモデルが関与していた。 Anthropicは、これはテスト環境の設定ミスによるものであり、モデルが意図的にセキュリティプロトコルを迂回したわけではないと説明した。

報告書によると、これらのモデルは、Anthropicの内部ネットワーク内に隠された「フラグ」データを発見することを目的とした社内「キャプチャー・ザ・フラグ」演習に参加していた。 Anthropic社と評価パートナー間のコミュニケーションの齟齬により、システム上はオフラインと表示されていたにもかかわらず、モデルがインターネットにアクセスできてしまった。外部ネットワークへの侵入経路を発見した際、モデルは対象システムがトレーニング環境の一部であると誤って判断し、3つの外部機関へのアクセスを試みた。
Anthropicは、モデルが複雑な脆弱性を悪用したのではなく、主に脆弱なパスワードといった基本的なセキュリティ上の欠陥を悪用したと指摘した。同社は、最新世代のモデルは実世界のインターネット環境に入ったことを認識すると行動を停止したのに対し、旧世代のモデルはタスクを継続したため、影響を受けた機関に被害が生じたと説明した。
この事象の公表を受け、Anthropic社はテスト手順の徹底的な見直しを行い、ネットワークアクセス経路の検証強化、ログ監査の徹底、あるいはモデルに対するインターネット利用能力に関するより明確な指示があれば、この事象は防げた可能性があったと認めた。同社は7月27日までに、評価パートナーおよび影響を受けた3つの機関に通知を行った。 これらの機関のうち2つは、自社のシステムへのアクセスがあったことに気づいていなかったが、3つ目の機関については現在も連絡を取っている最中である。
以前、OpenAIがテスト中にAIエージェントがインターネットにアクセスし、Hugging Face環境に侵入した事案を公表していたが、Anthropicでの今回の事案は、業界内で高まっている懸念を浮き彫りにしている。すなわち、AIエージェントの自律性が高まるにつれ、テスト環境の堅牢な隔離、権限管理、およびセキュリティ評価メカニズムが不可欠となっているということだ。
関連記事
ByteDanceのSeedがグローバルキャンパス採用を開始、大規模モデルのトップ人材獲得に向けて仮想株式を提供
大規模言語モデルの競争環境において、トップクラスのタレントを確保することは、最も重要な戦略的資産であり続けています。4月1日、ByteDanceは、大規模モデル人材育成プログラムの一部であるSeedグローバルキャンパス採用イニシアチブの開始を発表しました。このキャンペーンは2027年卒の卒業予定者と現在のインターン生を対象としており、世界中のAI分野におけるエリート研究開発者およびエンジニアの発掘と確保を目指しています。拡大:世界中から100名の「AIシード」を発掘急速な技術進歩の中で、B
法的争訟の中でSunoが曲に透かしを入れる
Sunoは、ユーザーがAI生成音楽を作成できるプラットフォームであり、プラットフォームが生成したトラックにラベルを付け、ダウンロードを制限し、不正な複製を抑制するためにコミュニティ基準を更新する新機能を公開した。これらの更新は、Sunoがレコードレーベルやアーティスト団体からの複数の訴訟に直面している時期に実施される。共同創設者兼CEOのMikey Shulmanはブログ記事で、プラットフォームの目標が、より広い層にAI音楽ツールのアクセスを拡大しながら、オリジナルの創作を促進することに重点を
ムスク氏はGrokの構築でユーザーのコードが漏洩したことを認め、すべての履歴データを消去すると約束した。
エロン・マスクは、Grok Buildをめぐるプライバシー問題に直接言及し、まず「True」という単純な回答で事件の存在を確認した。彼は、SpaceXAIに以前アップロードされたすべてのユーザーデータを永久に削除すると約束し、「1バイトも残さない」と述べた。これは、主要なテックリーダーが公に過ちを認め、ユーザーデータを自発的に削除したというAI業界初の事例である。安全研究者による「フィッシング」テストでデータ漏洩の具体的な証拠が明らかになったこの問題は、独立したAIセキュリティ研究者である@
関連特集おすすめ
コメント (0)
0/500
Anthropicが最近発表したセキュリティレポートによると、同社の「Claude」シリーズモデルが、テスト環境の設定ミスにより意図せずインターネットにアクセスし、その結果、3つの異なる組織の本番システムに侵入してしまったことが明らかになった。このインシデントには、「Claude Opus4.7」、サイバーセキュリティに特化した「Claude Mythos5」、および未公開のプロトタイプモデルが関与していた。 Anthropicは、これはテスト環境の設定ミスによるものであり、モデルが意図的にセキュリティプロトコルを迂回したわけではないと説明した。

報告書によると、これらのモデルは、Anthropicの内部ネットワーク内に隠された「フラグ」データを発見することを目的とした社内「キャプチャー・ザ・フラグ」演習に参加していた。 Anthropic社と評価パートナー間のコミュニケーションの齟齬により、システム上はオフラインと表示されていたにもかかわらず、モデルがインターネットにアクセスできてしまった。外部ネットワークへの侵入経路を発見した際、モデルは対象システムがトレーニング環境の一部であると誤って判断し、3つの外部機関へのアクセスを試みた。
Anthropicは、モデルが複雑な脆弱性を悪用したのではなく、主に脆弱なパスワードといった基本的なセキュリティ上の欠陥を悪用したと指摘した。同社は、最新世代のモデルは実世界のインターネット環境に入ったことを認識すると行動を停止したのに対し、旧世代のモデルはタスクを継続したため、影響を受けた機関に被害が生じたと説明した。
この事象の公表を受け、Anthropic社はテスト手順の徹底的な見直しを行い、ネットワークアクセス経路の検証強化、ログ監査の徹底、あるいはモデルに対するインターネット利用能力に関するより明確な指示があれば、この事象は防げた可能性があったと認めた。同社は7月27日までに、評価パートナーおよび影響を受けた3つの機関に通知を行った。 これらの機関のうち2つは、自社のシステムへのアクセスがあったことに気づいていなかったが、3つ目の機関については現在も連絡を取っている最中である。
以前、OpenAIがテスト中にAIエージェントがインターネットにアクセスし、Hugging Face環境に侵入した事案を公表していたが、Anthropicでの今回の事案は、業界内で高まっている懸念を浮き彫りにしている。すなわち、AIエージェントの自律性が高まるにつれ、テスト環境の堅牢な隔離、権限管理、およびセキュリティ評価メカニズムが不可欠となっているということだ。
ByteDanceのSeedがグローバルキャンパス採用を開始、大規模モデルのトップ人材獲得に向けて仮想株式を提供
大規模言語モデルの競争環境において、トップクラスのタレントを確保することは、最も重要な戦略的資産であり続けています。4月1日、ByteDanceは、大規模モデル人材育成プログラムの一部であるSeedグローバルキャンパス採用イニシアチブの開始を発表しました。このキャンペーンは2027年卒の卒業予定者と現在のインターン生を対象としており、世界中のAI分野におけるエリート研究開発者およびエンジニアの発掘と確保を目指しています。拡大:世界中から100名の「AIシード」を発掘急速な技術進歩の中で、B
法的争訟の中でSunoが曲に透かしを入れる
Sunoは、ユーザーがAI生成音楽を作成できるプラットフォームであり、プラットフォームが生成したトラックにラベルを付け、ダウンロードを制限し、不正な複製を抑制するためにコミュニティ基準を更新する新機能を公開した。これらの更新は、Sunoがレコードレーベルやアーティスト団体からの複数の訴訟に直面している時期に実施される。共同創設者兼CEOのMikey Shulmanはブログ記事で、プラットフォームの目標が、より広い層にAI音楽ツールのアクセスを拡大しながら、オリジナルの創作を促進することに重点を
ムスク氏はGrokの構築でユーザーのコードが漏洩したことを認め、すべての履歴データを消去すると約束した。
エロン・マスクは、Grok Buildをめぐるプライバシー問題に直接言及し、まず「True」という単純な回答で事件の存在を確認した。彼は、SpaceXAIに以前アップロードされたすべてのユーザーデータを永久に削除すると約束し、「1バイトも残さない」と述べた。これは、主要なテックリーダーが公に過ちを認め、ユーザーデータを自発的に削除したというAI業界初の事例である。安全研究者による「フィッシング」テストでデータ漏洩の具体的な証拠が明らかになったこの問題は、独立したAIセキュリティ研究者である@





家






