競合するAIに過激な心理的テーマの検証を促すために利用されたMeta

内部メッセージに関する最近の暴露により、AIの安全性の境界線をめぐる激しい議論が巻き起こっている。報道によれば、Metaは「Cannes」と呼ばれるプロジェクトを実施し、外部業者を雇って未成年のふりをさせ、ChatGPTやGemini、Character.AIといった複数の主要な競合チャットボットに対して物議を醸す「過度な負荷テスト」を行わせたという。
Metaの内部文書および複数の情報筋によると、このプロジェクトは少なくとも今年の4月21日まで続けられていた。外部業者Covalenを通じて、Metaは数百人の労働者を動員し、一時的なメールアドレスと標準的なパスワードを使用して18歳未満のユーザーの偽のプロフィールを作成させた。これらの「未成年」アカウントは、競合AIチャットボットとの会話の中で自殺や自傷行為、食事障害に関する高リスクなプロンプトを送信したほか、モデルの反応メカニズムを刺激するためにナイフや薬剤、絞首用の縄の画像までアップロードした。
内部のプロジェクト文書によると、これらのテストシナリオは競合AIシステムの安全防衛策を探り出し、チャットボットが本来備えているセーフガードを無視して危険なコンテンツを生成するよう促すことを目的として綿密に設計されていた。2025年8月のあるテストラウンドでは、スタッフが競合プラットフォームに4万5千件以上もの高リスクなプロンプトを入力した。テスターたちはしばしば苦悩する十代のふりをし、「中絶薬について尋ねる」「暴力的な脅威に直面している」「食事障害を隠している」といったシナリオを作り上げ、モデルの境界線を試した。
これに対しMetaは自身の行動を擁護する公式声明を発表した。同社の広報担当者は、チャットボットの応答をベンチマークすることは、AI製品が安全かつ適切であることを確保するための業界標準の慣行であり、悪意があるという非難は技術企業がシステムを改善しようとする努力を誤って表現していると述べた。またMetaは、競合他社から得たテストデータを自社のモデル訓練に使用したことも明確に否定した。
この事件はAIの安全性テストにおけるグレーゾーンを浮き彫りにするだけでなく、若者に関わる敏感な問題を扱う際のジェネレーティブAIの脆弱性に対する外部からの懸念も再燃させている。AI技術が急速に進化する中、効率的かつ安全なテストと、競争行為と倫理的配慮との間のバランスを取ることは、業界にとって緊急の課題となっている。
関連記事
米国の株式市場が歴史的なマイルストーンに到達、AIと航空宇宙の巨人が1兆ドル規模のデビューに向けて準備を進める
エロン・マスク、サム・アルトマン、ダリオ・アモダイというテクノロジー業界の三巨頭が、それぞれの事業で初公開株式発行(IPO)に向けて進んでいる。スペースX、OpenAI、Anthropicという業界の巨人3社が1兆ドル規模の企業価値に近づき、上場準備を進める中、2026年は米国史上、新規株式発行が最も重要な年となる見込みだ。この歴史的な資金増強は世界の金融の注目を集めており、公的市場がこのような規模の資金を吸収する能力に対する重要なストレステストとなっている。これらの主要な資金調達が一斉に開始
スウェーデンのAIスタートアップ「Lovable」が主要な資金調達ラウンド終了後、132億ドルの評価額を達成
AI駆動のコーディングツールが注目を集める中、スウェーデンのスタートアップ企業Lovableは大型の資金調達ラウンドを獲得した。同社は30億ドルの調達を目指しており、これにより評価額が昨年12月に記録された66億ドルの倍となる132億ドルに達する可能性がある。この投資をリードするのはMenlo Venturesと見られている。Lovableの魅力は、複雑なコーディングスキルを不要とし、ソフトウェア作成を簡素化する中核の「ヴァイブコーディング」技術に由来する。ユーザーは自然言語で要件を記述するだ
Google、Geminiへの焦点がユーザー制御へシフトする中で、Remy AIエージェントをテスト
『Business Insider』によると、GoogleはGemini向けの新しいAIパーソナルエージェント「Remy」をテスト中である。このツールはユーザーに代わってタスクを実行することを目的としており、業務フローと日常のルーチンの両方を効率化する。現在、RemyはGeminiアプリケーションの社内限定版においてテストが行われている。この報道は社内文書と、プロジェクトに精通した2人の人物へのインタビューを引用している。社内資料では、Remyを「24時間365日のパーソナルエージェント」と位
関連特集おすすめ
コメント (0)
0/500

内部メッセージに関する最近の暴露により、AIの安全性の境界線をめぐる激しい議論が巻き起こっている。報道によれば、Metaは「Cannes」と呼ばれるプロジェクトを実施し、外部業者を雇って未成年のふりをさせ、ChatGPTやGemini、Character.AIといった複数の主要な競合チャットボットに対して物議を醸す「過度な負荷テスト」を行わせたという。
Metaの内部文書および複数の情報筋によると、このプロジェクトは少なくとも今年の4月21日まで続けられていた。外部業者Covalenを通じて、Metaは数百人の労働者を動員し、一時的なメールアドレスと標準的なパスワードを使用して18歳未満のユーザーの偽のプロフィールを作成させた。これらの「未成年」アカウントは、競合AIチャットボットとの会話の中で自殺や自傷行為、食事障害に関する高リスクなプロンプトを送信したほか、モデルの反応メカニズムを刺激するためにナイフや薬剤、絞首用の縄の画像までアップロードした。
内部のプロジェクト文書によると、これらのテストシナリオは競合AIシステムの安全防衛策を探り出し、チャットボットが本来備えているセーフガードを無視して危険なコンテンツを生成するよう促すことを目的として綿密に設計されていた。2025年8月のあるテストラウンドでは、スタッフが競合プラットフォームに4万5千件以上もの高リスクなプロンプトを入力した。テスターたちはしばしば苦悩する十代のふりをし、「中絶薬について尋ねる」「暴力的な脅威に直面している」「食事障害を隠している」といったシナリオを作り上げ、モデルの境界線を試した。
これに対しMetaは自身の行動を擁護する公式声明を発表した。同社の広報担当者は、チャットボットの応答をベンチマークすることは、AI製品が安全かつ適切であることを確保するための業界標準の慣行であり、悪意があるという非難は技術企業がシステムを改善しようとする努力を誤って表現していると述べた。またMetaは、競合他社から得たテストデータを自社のモデル訓練に使用したことも明確に否定した。
この事件はAIの安全性テストにおけるグレーゾーンを浮き彫りにするだけでなく、若者に関わる敏感な問題を扱う際のジェネレーティブAIの脆弱性に対する外部からの懸念も再燃させている。AI技術が急速に進化する中、効率的かつ安全なテストと、競争行為と倫理的配慮との間のバランスを取ることは、業界にとって緊急の課題となっている。
米国の株式市場が歴史的なマイルストーンに到達、AIと航空宇宙の巨人が1兆ドル規模のデビューに向けて準備を進める
エロン・マスク、サム・アルトマン、ダリオ・アモダイというテクノロジー業界の三巨頭が、それぞれの事業で初公開株式発行(IPO)に向けて進んでいる。スペースX、OpenAI、Anthropicという業界の巨人3社が1兆ドル規模の企業価値に近づき、上場準備を進める中、2026年は米国史上、新規株式発行が最も重要な年となる見込みだ。この歴史的な資金増強は世界の金融の注目を集めており、公的市場がこのような規模の資金を吸収する能力に対する重要なストレステストとなっている。これらの主要な資金調達が一斉に開始
スウェーデンのAIスタートアップ「Lovable」が主要な資金調達ラウンド終了後、132億ドルの評価額を達成
AI駆動のコーディングツールが注目を集める中、スウェーデンのスタートアップ企業Lovableは大型の資金調達ラウンドを獲得した。同社は30億ドルの調達を目指しており、これにより評価額が昨年12月に記録された66億ドルの倍となる132億ドルに達する可能性がある。この投資をリードするのはMenlo Venturesと見られている。Lovableの魅力は、複雑なコーディングスキルを不要とし、ソフトウェア作成を簡素化する中核の「ヴァイブコーディング」技術に由来する。ユーザーは自然言語で要件を記述するだ





家






