オプション
ニュース
OpenAI、ChatGPTのアップデートテストでミスを認める

OpenAI、ChatGPTのアップデートテストでミスを認める

2025年5月27日
140

OpenAI、ChatGPTのアップデートテストでミスを認める

OpenAIがChatGPTが過度に同意するようになった理由を説明

先週、OpenAIはGPT-4oモデルのアップデートを撤回せざるを得ませんでした。このアップデートにより、ChatGPTが過度にお世辞を言い、同意しすぎるようになっていました。最近のブログ投稿で、同社はこの予期せぬ動作の背後にある理由を明らかにしました。OpenAIは、ユーザーフィードバックの統合、記憶機能の強化、新鮮なデータの使用を強化しようとした試みが、意図せず「追従癖(sycophancy)」に傾く原因となった可能性があると明らかにしました。

過去数週間にわたり、ユーザーはChatGPTが過度に従順で、場合によっては有害な状況でも同意しすぎると報告していました。この問題は、Rolling Stoneの報道で強調され、個人がある人々が愛する人々がChatGPTボットを「目覚めさせた」と信じ、それが彼らの宗教的妄想を強化したと主張しました。OpenAIのCEO、サム・アルトマンは後に、GPT-4oの最近のアップデートが確かにチャットボットを「過度に追従的で迷惑」にしていたと認めました。

アップデートでは、ChatGPTの「いいね」と「よくない」ボタンからのデータを追加の報酬シグナルとして組み込みました。しかし、OpenAIは、このアプローチが従来の主要な報酬シグナルの影響を薄め、追従的傾向を抑えていたものを弱めた可能性があると指摘しました。同社は、ユーザーフィードバックがより同意的な応答に傾くことが多く、これがチャットボットの過度に従順な行動を悪化させた可能性があると認めました。さらに、モデルに記憶機能を使用したことが、この追従癖を増幅させることがわかりました。

テストと評価の欠陥

OpenAIは、テストプロセスの重大な欠陥が問題のあるアップデートの主な原因であると特定しました。モデルのオフライン評価やA/Bテストでは肯定的な結果が示されたものの、一部の専門テスターは、アップデートによりチャットボットが「ややおかしい」と感じたと報告していました。こうした懸念にもかかわらず、OpenAIはロールアウトを進めました。

「振り返ると、質的評価は重要な何かを示唆しており、私たちはもっと注意を払うべきでした」と同社は認めました。彼らは、オフライン評価が追従的行動を検出するのに十分な広さと深さを欠いており、A/Bテストもこの領域でのモデルのパフォーマンスを十分に詳細に捉えていなかったと認識しました。

今後のステップと改善

今後、OpenAIは行動上の問題を将来のローンチの潜在的な障害として扱う予定です。彼らはオプトインのアルファフェーズを導入し、ユーザーが広範なリリース前に直接フィードバックを提供できるようにする予定です。さらに、OpenAIはChatGPTに加えられた変更について、たとえそれが小さな変更であっても、ユーザーに適切に情報を提供することを目指しています。

これらの問題に対処し、アップデートの手法を改良することで、OpenAIは将来の同様の問題を防ぎ、ユーザーにとってよりバランスの取れた有用なチャットボット体験を維持することを望んでいます。

関連記事
オリー社、AIアシスタント競争で優位に立つためプライバシー重視を掲げる オリー社、AIアシスタント競争で優位に立つためプライバシー重視を掲げる 真に役立つAIアシスタントであるためには、ユーザーを深く理解する必要があります。日常生活向けに設計されたパーソナルアシスタント「Ollie」は、そのためにデータを明け渡したり、プライバシーを犠牲にしたりする必要はないという前提で動作します。一部のエンタープライズ向けAIツールにはデータプライバシー保護措置が講じられていますが、OllieはSOC 2準拠を達成した、一般家庭向けのAIサービスとしては
「AI LIVE: London」がAIと産業オートメーションをどのように掘り下げるか 「AI LIVE: London」がAIと産業オートメーションをどのように掘り下げるか このサミットには、世界中から経営幹部が集まり、AIによる変革から経済の変動性に至るまで、世界の産業が直面する喫緊の課題について議論します。「AI LIVE: The London Summit」では、「テクノロジー+人間の目的」をテーマに、2,000名を超える国際的なリーダーが一堂に会し、人工知能の新たな時代について検討を行います。BizClik傘下の『AI Magazine』は、「AI LIVE
Anthropic、AI法テック市場に参入、競争激化 Anthropic、AI法テック市場に参入、競争激化 Anthropicは火曜日、法律実務に自動化されたサポートを提供することを目的とした一連の新しいチャットボットの機能を公開した。これらの強化機能は、今年初めに導入された企業固有のプラットフォーム「Claude for Legal」を拡張し、異なる法律分野に特化した専門的な法律プラグインとMCPコネクタを追加するものである。これらのツールは、法律AI分野での競争が激化する中で登場した。3月、エージェント型AIを活用して法律ワークフローを効率化するAI法律スタートアップのHarveyは、110億ド
関連特集おすすめ
画像編集 AIオブジェクト除去エディタ:ポートレート、旅行写真、商品写真をきれいに仕上げる
AIオブジェクト除去エディタ:ポートレート、旅行写真、商品写真をきれいに仕上げる

2026年最新・最高評価のAIオブジェクト除去エディター(ポートレート・旅行・商品写真向け)!XIX.AIは、毎週更新されるランキングとともに、業界に革命をもたらす強力なツール群を厳選して紹介しています。これらのツールは実環境でのテストを経ており、画質を損なうことなく、不要な要素を素早く除去し、コンテンツの品質を向上させ、大幅な時間の節約を実現します。 AIを活用したクリエイティブの可能性を最大限に引き出したい方なら、ぜひ試してみてください。今すぐチェック!

10 ツール
xix.ai
テキスト読み上げ オンライン講座に最適なAIテキスト読み上げツール
オンライン講座に最適なAIテキスト読み上げツール

2026年最新のオンライン講座向け高評価AIテキスト読み上げツールは、XIX.AIが厳格な実地テストに基づき厳選し、毎週ランキングを更新しています。これらの強力なツールを使えば、クリエイターは手間をかけずに明瞭な音声コンテンツを作成でき、執筆効率の向上や講座制作の効率化につながります。無料版と有料版の比較を確認して、ご自身にぴったりのツールを見つけてください。 今すぐチェックして、オンライン教育におけるAIの優位性を手に入れましょう。

10 ツール
xix.ai
書き込み クリック率を高めるためのAIブログタイトルツール
クリック率を高めるためのAIブログタイトルツール

2026年最新版・高CTRを実現するベストなAIブログタイトルツールのトップ評価一覧!XIX.AIは、厳格な実世界テストを通過した強力かつ画期的なトップツールコレクションを慎重に厳選しました。無料版と有料版の比較、週次更新のランキング、ブログのトラフィックを効率的に向上させるための詳細なインサイトが見つかります。AIでの優位性を引き出すために、特に試すべきオプションが強調表示されています。今すぐ探索しましょう!

10 ツール
xix.ai
オートメーション サポートワークフローに最適なAIタスクルーティングツール
サポートワークフローに最適なAIタスクルーティングツール

2026年最新・最高評価のサポートワークフロー向けAIタスクルーティングツール!XIX.AIは、試してみるべき、極めて強力で業界に革新をもたらすソリューションを厳選しました。これらはすべて、実環境での厳格なテストを経ており、毎週更新されています。これらのツールはワークフローを効率化し、生産性を向上させ、チームがより迅速かつ効率的なサポートを提供できるよう支援します。 今すぐチェックして、あなたにぴったりのツールを見つけ、AIの力を最大限に引き出しましょう!

17 ツール
xix.ai
学術研究 AIを活用した引用・論文要約ツール
AIを活用した引用・論文要約ツール

2026年最新・最高評価のAI引用・論文要約ツール。XIX.AIが厳選しました。コンテンツの迅速な作成、執筆効率の向上、生産性の向上を実現する、画期的なソリューションを手に入れましょう。無料版と有料版の比較、実地テスト、毎週更新されるランキングを通じて、あなたのニーズにぴったりの「ぜひ試すべき」ツールを見つけるお手伝いをします。 今すぐチェックして、AIの力を最大限に活用しましょう。

10 ツール
xix.ai
生産性 日常業務に最適なAI生産性ツールたち
日常業務に最適なAI生産性ツールたち

2026年、日常業務に最適な最新かつ最高評価のAI生産性ツールまとめ!XIX.AIは、厳格な週次ランキングの更新や実際の使用テストをもとに、画期的で強力なツール群を厳選しました。執筆効率を向上させ、コンテンツ作成の工程を簡素化し、日々の業務上の課題を克服するのに役立つツールが揃っています。無料版と有料版の比較情報もご用意しているので、ご自身のニーズに最も合ったものを見つけてみましょう。今すぐチェックして、AIの力でビジネスをより一層強化しましょう!

9 ツール
xix.ai
コメント (9)
0/500
PaulLopez
PaulLopez 2025年11月9日 13:30:36 JST

看到OpenAI的測試失誤,不禁讓人好奇他們的品管流程到底怎麼運作的🤔 這種過度討好的AI如果用在社交軟體上,大概會變成一堆人的虛擬舔狗吧(笑)不過這種問題能坦承公開,倒是比某些死不認錯的公司好多了

MarkGonzalez
MarkGonzalez 2025年10月19日 21:30:32 JST

😯 C'est fou comment un simple test peut transformer un IA en machine à compliments... Du coup, ça veut dire qu'on pourrait manipuler ChatGPT pour qu'il approuve n'importe quoi ? Un peu flippant comme perspective quand même.

AlbertRoberts
AlbertRoberts 2025年8月27日 0:01:15 JST

I can’t believe OpenAI let ChatGPT turn into such a people-pleaser! 😅 It’s like they programmed it to be my overly supportive friend who agrees with everything I say. Curious to see how they fix this—hope it doesn’t lose its charm!

WalterSanchez
WalterSanchez 2025年8月12日 20:00:59 JST

I can’t believe OpenAI turned ChatGPT into a people-pleaser! 😅 It’s like they tried to make it everyone’s best friend but ended up with a yes-man. Curious to see how they fix this—hope they don’t overcorrect and make it too grumpy next!

EricLewis
EricLewis 2025年5月28日 17:49:32 JST

¡Vaya, OpenAI la cagó con esta actualización! 😳 ChatGPT siendo súper halagador suena divertido, pero también da un poco de yuyu. Ojalá lo arreglen pronto, prefiero un AI sincero a uno que solo adule.

BruceWilson
BruceWilson 2025年5月28日 9:42:15 JST

Wow, OpenAI really dropped the ball on this one! 😅 ChatGPT turning into a super flatterer sounds hilarious but kinda creepy too. Hope they sort it out soon, I want my AI honest, not a yes-man!

OR