オプション
ニュース
OpenAIの共同創設者、業界全体でAIの安全性テストを行うよう要請

OpenAIの共同創設者、業界全体でAIの安全性テストを行うよう要請

2025年12月24日
138

OpenAIの共同創設者、業界全体でAIの安全性テストを行うよう要請

世界有数のAI研究所であるOpenAIとAnthropicの2社が、安全性の共同テストのために、各社の厳重に管理されたAIモデルへのアクセスを一時的に許可した。このイニシアチブは、各社の内部評価の盲点を明らかにし、AI先進企業が今後どのように安全性とアライメントの取り組みを共同で進めることができるかを説明するために設計されました。

TechCrunchのインタビューで、OpenAIの共同設立者であるWojciech Zaremba氏は、AIがより「結果的」な段階へと進み、毎日何百万人ものユーザーがAIモデルと相互作用するようになると、このようなコラボレーションがますます重要になると説明している。

ザレンバ氏は、「業界が直面しているより広範な課題は、数十億ドルが投資され、人材、ユーザー、傑出した製品をめぐる熾烈な戦いが繰り広げられる中でも、安全性とコラボレーションの基準をいかに確立するかということだ」と指摘する。

両社が水曜日に発表した安全性に関する共同研究は、OpenAIやAnthropicのようなAIのリーダーたちが技術的な軍拡競争を繰り広げる中で行われた。数十億ドル規模のデータセンターへの投資や、トップ研究者への1億ドルを超える報酬が常態化する中、最先端の製品を提供しなければならないというプレッシャーが、安全プロトコルの妥協につながりかねないと警告するアナリストもいる。

この研究を可能にするため、OpenAIとAnthropicは、より制限の少ないバージョンのモデルへの特別なAPIアクセス権を交換した(OpenAIは、GPT-5はまだ発売されていないため、テストされていないことを明らかにした)。しかし、調査が終了した直後、Anthropicは別のOpenAIチームのAPIアクセスを取り消した。Anthropicは、OpenAIがライバル製品を強化するためにクロードを使用することを禁止する利用規約に違反したと主張した。

ザレンバは、この2つの出来事は無関係であると主張し、AI安全チームが協力を追求するとしても、競争は依然として強いと予想している。Anthropic社の安全性研究者であるニコラス・カーリーニ氏はTechCrunchに対し、OpenAIの安全性チームに対し、今後もClaudeモデルへのアクセスを許可したいと語った。

「我々は、安全フロンティアを超えて可能な限り協力を拡大し、このようなパートナーシップをより日常的なものにすることを目指している」とカーリーニは述べた。

テックとVCの重鎮がDisrupt 2025のアジェンダに参加

Netflix、ElevenLabs、Wayve、Sequoia Capital、Elad Gil-これらはDisrupt 2025のアジェンダに参加する著名人のほんの一部に過ぎない。彼らはスタートアップの成長を促進し、競争力を磨くための洞察を共有するためにここにいる。20周年を迎えるTechCrunch Disruptをお見逃しなく。テック業界の第一人者から学ぶチャンスです。

テックとVCの重鎮がDisrupt 2025のアジェンダに参加

Netflix、ElevenLabs、Wayve、Sequoia Capital - Disrupt 2025のアジェンダに登場する影響力のあるリーダーのほんの一握りです。彼らは、スタートアップ企業が成長し、戦略を洗練させるための貴重な視点を提供する。20周年を迎えるTechCrunch Disruptにぜひご参加ください。

サンフランシスコ|2025年10月27日-29日 今すぐ登録

この研究で最も注目すべき発見のひとつは、幻覚テストに関するものだった。AnthropicのClaude Opus 4とSonnet 4モデルは、不確かな質問に対して70%もの回答を拒否し、"信頼できる情報がありません "といった回答を選んだ。対照的に、OpenAIのo3およびo4-miniモデルは、質問を拒否することははるかに少なかったが、情報が不十分でも回答を試みる、はるかに高い幻覚率を示した。

ザレンバは、理想的なアプローチはその中間にあると考えている:OpenAIのモデルはより不確実なクエリを拒否すべきであり、Anthropicのシステムはより頻繁に回答することを目指すべきである。

AIモデルが承認を得るために有害なユーザー行動を強化する傾向である「おべっか」は、安全性の重要な問題として浮上している。

Anthropic社は研究報告書の中で、GPT-4.1とClaude Opus 4における "極端な "おべっか使いの例を挙げている。OpenAIとAnthropicの他のモデルでは、研究者はより低いお人好しレベルを記録した。

火曜日、16歳のアダム・レインの両親は、GPT-4oを搭載したバージョンのChatGPTが、息子の有害な思考に挑戦する代わりに自殺を促したとして、OpenAIに対して訴訟を起こした。この訴訟は、これもAIのお人好しによる悲劇的なケースである可能性を提起している。

「ザレンバ氏は、この事件について尋ねられた際、「ご家族が耐えていることを想像すると、胸が張り裂けそうになります。「博士号レベルの問題を解決し、科学を発展させることができるAIを作りながら、精神衛生上の危機にも加担しているとしたら、非常に困ったことです。それは、私が関わりたくないディストピア的な結果だ」。

OpenAIはブログの中で、GPT-4oと比較してGPT-5ではお人好しを減らすために大きな改良を加えたと報告し、新しいモデルはメンタルヘルス危機においてより適切に対応すると主張している。

今後、ザレンバとカーリーニは、AnthropicとOpenAIが安全性テストの協力を深め、より多くのトピックを探求し、今後のモデルを評価することを望んでおり、他のAIラボが同様の協力的なアプローチを採用することを望んでいると表明した。

Updated 2:00pm PT: 本記事は、最初の発表前にTechCrunchが入手できなかったAnthropicの追加調査を含むように修正されました。


機密情報や機密文書をお持ちですか?私たちは、AI業界の進化を形作る組織から、その選択によって影響を受ける個人まで、AI業界の内情を調査しています。レベッカ・ベラン([email protected])、マックスウェル・ゼフ([email protected])までご連絡ください。安全な通信をご希望の方は、Signalで@rebeccabellan.491と@mzeff.88までご連絡ください。

関連記事
サム・アルトマン氏によるAIの減速論が議論を呼ぶ サム・アルトマン氏によるAIの減速論が議論を呼ぶ Apple Podcastsで聴くSpotifyで聴くOpenAIのCEO、サム・アルトマン氏は最近、社会が「これらの新しい能力レベルのいくつかに対して強固になる」時間を確保するため、「AI開発の速度を制御する」時期が来た可能性を示唆した。TechCrunchの「Equity」ポッドキャストの最新回で、ケルステン・コロセック、ショーン・Oケイン、そして私自身は、アルトマン氏の発言が、OpenAIのエージェントがHugging Faceのシステムに侵入した最近のハッキング事件をきっかけとしたも
OpenAIはアップルの営業秘密訴訟と戦っている OpenAIはアップルの営業秘密訴訟と戦っている OpenAIは火曜日、Appleの営業秘密に関する主張に反論し、同訴訟は根拠がないと主張した。「これらの主張を真剣に受け止めているが、それを支持する証拠は見当たらない」とOpenAIは述べた。これはBloombergのEd LudlowがXで報じたものである。「私たちは公正な競争とどこでも働く自由を支持しており、世界中のユーザーを強化する技術の創出に注力しています。」これは、Appleが金曜日に米国北カリフォルニア連邦地方裁判所に提起した訴訟に続くものである。同訴訟は、OpenAIが元App
Anthropic、AI法テック市場に参入、競争激化 Anthropic、AI法テック市場に参入、競争激化 Anthropicは火曜日、法律実務に自動化されたサポートを提供することを目的とした一連の新しいチャットボットの機能を公開した。これらの強化機能は、今年初めに導入された企業固有のプラットフォーム「Claude for Legal」を拡張し、異なる法律分野に特化した専門的な法律プラグインとMCPコネクタを追加するものである。これらのツールは、法律AI分野での競争が激化する中で登場した。3月、エージェント型AIを活用して法律ワークフローを効率化するAI法律スタートアップのHarveyは、110億ド
関連特集おすすめ
SEO 検索戦略に最適なAI SERP分析ツール
検索戦略に最適なAI SERP分析ツール

2026年版、検索戦略に最適な高評価のAI SERP分析ツールは、XIX.AIが実環境での厳格なテストを経て厳選し、毎週ランキングを更新しています。これらの強力なツールを活用すれば、隠れた最適化の機会を発見し、コンテンツのパフォーマンスを向上させ、検索分野で競争優位性を獲得することができます。今すぐ、検索戦略を強化するのに最適なツールを見つけてください。今すぐチェック!

13 ツール
xix.ai
データ分析 SaaSおよびEコマースチーム向けのKPIモニタリングにおけるベストなAI異常検知ツール
SaaSおよびEコマースチーム向けのKPIモニタリングにおけるベストなAI異常検知ツール

2026年最新版・最高評価のAI異常検知ツール【SaaSおよびEコマースチーム向けKPIモニタリング】!XIX.AIは、厳格な実世界テストと週次更新のランキングに基づき、革新的な強力なコレクションを厳選しました。生産性を向上させ、AIの優位性を引き出すために必須のソリューションを見極めるのに役立つ、無料版と有料版の詳細な比較インサイトが見つかります。今すぐチェックしましょう!

10 ツール
xix.ai
書き込み 長文SEO記事に最適なAIアウトライン生成ツール
長文SEO記事に最適なAIアウトライン生成ツール

XIX.AIが厳選した、2026年最新のロングフォームSEO記事向け高評価AIアウトライン生成ツール。これらの強力なツールは、高品質なコンテンツを迅速に作成するための画期的な支援を提供し、執筆効率を大幅に向上させます。 無料版と有料版の比較、実地テスト、詳細なランキングを参考に、ご自身のニーズに合った「ぜひ試すべき」ツールを見つけてください。今すぐチェックして、AIの力を最大限に活用しましょう。

8 ツール
xix.ai
教育と学習 宿題や試験対策に役立つAI学習ツール
宿題や試験対策に役立つAI学習ツール

2026年版 宿題や試験対策に最適な最新AI学習ツール!XIX.AIは、学生の生産性を高め、宿題の完了を効率化し、実際の試験で好成績を収めるのに役立つ、画期的な高評価ツールを厳選して紹介しています。 無料版と有料版の比較、詳細なランキング、そしてAIの力を最大限に引き出すためにぜひ試すべきツールをご紹介します。今すぐチェックしましょう!

10 ツール
xix.ai
作曲 ソングライター向けAIボーカルデモツール:フック、トップライン、多言語のドラフトセッション
ソングライター向けAIボーカルデモツール:フック、トップライン、多言語のドラフトセッション

2026年版 ソングライター、フッククリエイター、多言語コンテンツ制作チームのための最新・最高のAIボーカルデモツール!XIX.AIは、厳格な実地テストを経て、業界に革新をもたらす強力なツールを厳選し、高評価のランキングリストを作成しました。 無料版と有料版の詳細な比較データ、包括的なランキング、そして創作効率を高め、創造力を最大限に引き出すためにぜひ試すべきツールが満載です。今すぐチェックして、あらゆるコンテンツ制作ニーズに最適なツールを見つけましょう!

9 ツール
xix.ai
仕事 中小企業に最適なAI競合分析ツール
中小企業に最適なAI競合分析ツール

2026年版 中小企業向け最新・最高評価のAI競合分析ツール!XIX.AIは、実環境での厳格なテストと詳細なランキングに基づき、毎週更新される、極めて強力で業界に革命をもたらすツールを厳選しました。無料版と有料版の包括的な比較も掲載されており、生産性を向上させ、競争優位性をもたらす「ぜひ試すべき」ツールを見つけるのに役立ちます。 今すぐチェックして、あなたにぴったりのツールを見つけましょう!

9 ツール
xix.ai
コメント (3)
0/500
WillWalker
WillWalker 2026年7月22日 1:00:18 JST

Interesting to see competitors collaborate on safety. But is it just a PR stunt? 🤔

IsabellaLevis
IsabellaLevis 2026年3月4日 11:00:50 JST

AIの安全性テストを業界全体で実施する必要があるって主張、すごく共感します。競争が激しい中でOpenAIとAnthropicが協力したのは意外だけど、こういう連携がもっと増えると良いですね。ただ、本当に効果的なテストができるのか少し不安… 🤔

GeorgeWilliams
GeorgeWilliams 2026年2月20日 9:01:46 JST

So OpenAI and Anthropic are actually sharing their secret sauce for safety checks? That's pretty refreshing to see amidst all the cutthroat AI race. Hope this kind of collaboration becomes the norm, not just a rare exception. The real question is, will this testing be transparent enough for the public to trust the results? 🤔

OR