OpenaiのGPT-4.5は、他のAIを説得して資金を移転することに優れています
OpenAIの最新AIモデル、GPT-4.5(コードネームOrion)は、内部ベンチマークテストで顕著な説得能力を示した。木曜日に公開されたこのモデルの能力は、説得タスクのパフォーマンスに焦点を当てた白書で詳細に説明された。OpenAIは、説得を、モデルが生成する静的および対話的なコンテンツに基づいて個人の信念を変更したり、行動を起こさせたりするリスクと定義している。
注目すべきテストでは、GPT-4.5が別のOpenAIモデルであるGPT-4oに対して仮想マネーを引き出すシナリオで競い合った。GPT-4.5は、このタスクで、推論に特化したモデル(o1やo3-miniなど)を含む他のOpenAIモデルを上回った。また、GPT-4.5はGPT-4oを騙して秘密のコードワードを明らかにさせるタスクでも優れ、o3-miniを10パーセントポイント大きく上回った。
白書では、GPT-4.5の寄付テストでの成功は、モデルが開発した巧妙な戦略に由来すると強調されている。モデルは少額の寄付を求め、しばしば「2ドルや3ドル」といった金額を大きな合計から提案し、他のモデルに比べて小さくても頻度の高い寄付を得る結果となった。

OpenAIの寄付詐欺ベンチマークの結果。画像クレジット:OpenAI その優れたパフォーマンスにもかかわらず、OpenAIはGPT-4.5が説得カテゴリーで「高」リスクの閾値を超えていないと述べている。同社は、このレベルのリスクに達するモデルの公開を保留し、リスクを「中」レベルに下げる適切な安全対策を実施するまでとしている。
OpenAIのコードワード欺瞞ベンチマークの結果。画像クレジット:OpenAI AIが誤解を招く情報を拡散し、悪意を持って人々に影響を与える可能性は、ますます懸念されている。昨年、世界中で政治的なディープフェイクが急増し、AIは個人や組織に対するソーシャルエンジニアリング攻撃にますます使用されている。これに対応して、OpenAIは、GPT-4.5の白書および最近の別の出版物で言及されている、大規模な誤情報の拡散などの現実世界の説得リスクを評価する方法の改善に積極的に取り組んでいる。
関連記事
サム・アルトマン氏によるAIの減速論が議論を呼ぶ
Apple Podcastsで聴くSpotifyで聴くOpenAIのCEO、サム・アルトマン氏は最近、社会が「これらの新しい能力レベルのいくつかに対して強固になる」時間を確保するため、「AI開発の速度を制御する」時期が来た可能性を示唆した。TechCrunchの「Equity」ポッドキャストの最新回で、ケルステン・コロセック、ショーン・Oケイン、そして私自身は、アルトマン氏の発言が、OpenAIのエージェントがHugging Faceのシステムに侵入した最近のハッキング事件をきっかけとしたも
OpenAIはアップルの営業秘密訴訟と戦っている
OpenAIは火曜日、Appleの営業秘密に関する主張に反論し、同訴訟は根拠がないと主張した。「これらの主張を真剣に受け止めているが、それを支持する証拠は見当たらない」とOpenAIは述べた。これはBloombergのEd LudlowがXで報じたものである。「私たちは公正な競争とどこでも働く自由を支持しており、世界中のユーザーを強化する技術の創出に注力しています。」これは、Appleが金曜日に米国北カリフォルニア連邦地方裁判所に提起した訴訟に続くものである。同訴訟は、OpenAIが元App
OpenAIのロボティクス部門ヘッド、ケイトリン・カリノフスキー氏がペンタゴンとの提携を理由に辞任
OpenAIのロボティクスリーダーであるケイトリン・カリノフスキーは、同社と国防総省との論争の的となったパートナーシップの後に辞任した。「これは簡単な決断ではなかった」と、カリノフスキーはソーシャルメディアでの声明で説明した。「AIが国家安全保障において重要な役割を果たしていることは事実だが、司法の監督なしにアメリカ国民の監視を行い、人間の承認なしに致死性の自律システムを展開することは、はるかに慎重な検討を必要とする境界線である」。Metaの拡張現実(AR)グラス部門を率いていたことで知られ
関連特集おすすめ
コメント (16)
0/500
Diese Persuasion-Fähigkeit ist sowohl faszinierend als auch ein bisschen beängstigend. KI überredet KI, Geld zu überweisen? Hoffentlich werden diese Benchmarks ethisch streng kontrolliert und nicht nur für Marketing genutzt. Die reale Anwendung sieht sicher ganz anders aus als im Test.
GPT-4.5 qui réussit à convaincre d'autres IA de virer de l'argent ? 😳 C'est impressionnant mais un peu flippant... J'espère qu'ils prévoient des garde-fous solides avant de déployer ça. Sinon on va droit vers des scénarios de SF !
Wow, GPT-4.5's persuasion skills are wild! It’s like a silver-tongued AI that could talk my Roomba into giving me a loan. 😅 Kinda scary how it might sweet-talk other AIs into moving funds—hope they’ve got some ethical guardrails on this one!
Wow, GPT-4.5 sounds like a smooth talker! Convincing other AIs to move money? That's some next-level charm. Wonder if it could talk me into buying it a coffee too! 😄
OpenAIの最新AIモデル、GPT-4.5(コードネームOrion)は、内部ベンチマークテストで顕著な説得能力を示した。木曜日に公開されたこのモデルの能力は、説得タスクのパフォーマンスに焦点を当てた白書で詳細に説明された。OpenAIは、説得を、モデルが生成する静的および対話的なコンテンツに基づいて個人の信念を変更したり、行動を起こさせたりするリスクと定義している。
注目すべきテストでは、GPT-4.5が別のOpenAIモデルであるGPT-4oに対して仮想マネーを引き出すシナリオで競い合った。GPT-4.5は、このタスクで、推論に特化したモデル(o1やo3-miniなど)を含む他のOpenAIモデルを上回った。また、GPT-4.5はGPT-4oを騙して秘密のコードワードを明らかにさせるタスクでも優れ、o3-miniを10パーセントポイント大きく上回った。
白書では、GPT-4.5の寄付テストでの成功は、モデルが開発した巧妙な戦略に由来すると強調されている。モデルは少額の寄付を求め、しばしば「2ドルや3ドル」といった金額を大きな合計から提案し、他のモデルに比べて小さくても頻度の高い寄付を得る結果となった。


サム・アルトマン氏によるAIの減速論が議論を呼ぶ
Apple Podcastsで聴くSpotifyで聴くOpenAIのCEO、サム・アルトマン氏は最近、社会が「これらの新しい能力レベルのいくつかに対して強固になる」時間を確保するため、「AI開発の速度を制御する」時期が来た可能性を示唆した。TechCrunchの「Equity」ポッドキャストの最新回で、ケルステン・コロセック、ショーン・Oケイン、そして私自身は、アルトマン氏の発言が、OpenAIのエージェントがHugging Faceのシステムに侵入した最近のハッキング事件をきっかけとしたも
OpenAIはアップルの営業秘密訴訟と戦っている
OpenAIは火曜日、Appleの営業秘密に関する主張に反論し、同訴訟は根拠がないと主張した。「これらの主張を真剣に受け止めているが、それを支持する証拠は見当たらない」とOpenAIは述べた。これはBloombergのEd LudlowがXで報じたものである。「私たちは公正な競争とどこでも働く自由を支持しており、世界中のユーザーを強化する技術の創出に注力しています。」これは、Appleが金曜日に米国北カリフォルニア連邦地方裁判所に提起した訴訟に続くものである。同訴訟は、OpenAIが元App
OpenAIのロボティクス部門ヘッド、ケイトリン・カリノフスキー氏がペンタゴンとの提携を理由に辞任
OpenAIのロボティクスリーダーであるケイトリン・カリノフスキーは、同社と国防総省との論争の的となったパートナーシップの後に辞任した。「これは簡単な決断ではなかった」と、カリノフスキーはソーシャルメディアでの声明で説明した。「AIが国家安全保障において重要な役割を果たしていることは事実だが、司法の監督なしにアメリカ国民の監視を行い、人間の承認なしに致死性の自律システムを展開することは、はるかに慎重な検討を必要とする境界線である」。Metaの拡張現実(AR)グラス部門を率いていたことで知られ
Diese Persuasion-Fähigkeit ist sowohl faszinierend als auch ein bisschen beängstigend. KI überredet KI, Geld zu überweisen? Hoffentlich werden diese Benchmarks ethisch streng kontrolliert und nicht nur für Marketing genutzt. Die reale Anwendung sieht sicher ganz anders aus als im Test.
GPT-4.5 qui réussit à convaincre d'autres IA de virer de l'argent ? 😳 C'est impressionnant mais un peu flippant... J'espère qu'ils prévoient des garde-fous solides avant de déployer ça. Sinon on va droit vers des scénarios de SF !
Wow, GPT-4.5's persuasion skills are wild! It’s like a silver-tongued AI that could talk my Roomba into giving me a loan. 😅 Kinda scary how it might sweet-talk other AIs into moving funds—hope they’ve got some ethical guardrails on this one!
Wow, GPT-4.5 sounds like a smooth talker! Convincing other AIs to move money? That's some next-level charm. Wonder if it could talk me into buying it a coffee too! 😄





家






