OpenAI、GPT-5.4 ProおよびThinkingエディションを発表

木曜日、OpenAIは「プロフェッショナルな業務向けに開発された、当社で最も高性能かつ効率的な最先端モデル」と称される新しい基盤モデル「GPT-5.4」を発表した。標準版に加え、GPT-5.4には推論に特化したバージョン(GPT-5.4 Thinking)と、パフォーマンスを最適化したエディション(GPT-5.4 Pro)が用意されている。
このモデルのAPI版は、最大100万トークンのコンテキストウィンドウに対応しており、これはOpenAIがこれまでに提供した中で最大のコンテキスト容量となります。
OpenAIはまた、トークン効率の向上を強調し、GPT-5.4は前世代モデルに比べて大幅に少ないトークン数で同一の問題を解決できると述べています。
この新モデルはベンチマーク結果が大幅に改善され、コンピュータ利用ベンチマークであるOSWorld-VerifiedおよびWebArena Verifiedで過去最高のスコアを記録しました。また、知識労働タスクを対象としたOpenAIのGDPvalテストでも83%というスコアで新記録を樹立しました。
MercorのCEOであるBrendan Foody氏の声明によると、GPT-5.4は、法律および金融分野の専門スキルを評価するMercorのAPEX-Agentsベンチマークにおいてトップの成績を収めている。
「[GPT-5.4]は、スライド資料、財務モデル、法的分析といった長期的な成果物の作成に優れています」とフーディ氏は述べ、「競合する最先端モデルよりも高速かつ低コストで動作しながら、トップクラスのパフォーマンスを発揮します」と付け加えました。
GPT-5.4は、OpenAIが取り組んできた「幻覚」や事実誤認の低減をさらに推進するものです。同社によると、この新モデルはGPT-5.2と比較して、個々の主張における誤りの発生確率が33%低下し、回答全体における誤りの発生確率も18%低下しています。
今回のリリースに伴い、OpenAIはGPT-5.4 APIにおけるツール呼び出しの処理方法を再設計し、「Tool Search」という新システムを導入した。従来、システムプロンプトでは利用可能なすべてのツールを事前に定義する必要があり、ツールライブラリが拡大するにつれて、このプロセスにはかなりのトークンが消費されていた。新システムでは、モデルがオンデマンドでツールの定義を取得できるため、多数のツールが存在する環境において、リクエストの処理が高速化され、コスト効率も向上する。
またOpenAIは、モデルの「思考の連鎖(Chain-of-Thought)」を評価するための新たな安全性評価機能を追加しました。これは、多段階タスクの遂行中にモデルの推論プロセスを明らかにする「進行中の解説」のことです。AI安全性の研究者たちは、推論モデルが自身の思考の連鎖を誤って表現する可能性があることを長らく懸念してきましたが、テストの結果、特定の条件下ではこれが実際に起こり得ることが確認されました。
OpenAIの新たな評価によると、GPT-5.4の「Thinking」バージョンでは欺瞞の可能性が低いことが示されており、「このモデルには推論を隠蔽する能力が欠如しており、CoTモニタリングが依然として有効な安全対策ツールであることを示唆している」としています。
関連記事
サム・アルトマン氏によるAIの減速論が議論を呼ぶ
Apple Podcastsで聴くSpotifyで聴くOpenAIのCEO、サム・アルトマン氏は最近、社会が「これらの新しい能力レベルのいくつかに対して強固になる」時間を確保するため、「AI開発の速度を制御する」時期が来た可能性を示唆した。TechCrunchの「Equity」ポッドキャストの最新回で、ケルステン・コロセック、ショーン・Oケイン、そして私自身は、アルトマン氏の発言が、OpenAIのエージェントがHugging Faceのシステムに侵入した最近のハッキング事件をきっかけとしたも
OpenAIはアップルの営業秘密訴訟と戦っている
OpenAIは火曜日、Appleの営業秘密に関する主張に反論し、同訴訟は根拠がないと主張した。「これらの主張を真剣に受け止めているが、それを支持する証拠は見当たらない」とOpenAIは述べた。これはBloombergのEd LudlowがXで報じたものである。「私たちは公正な競争とどこでも働く自由を支持しており、世界中のユーザーを強化する技術の創出に注力しています。」これは、Appleが金曜日に米国北カリフォルニア連邦地方裁判所に提起した訴訟に続くものである。同訴訟は、OpenAIが元App
OpenAIのロボティクス部門ヘッド、ケイトリン・カリノフスキー氏がペンタゴンとの提携を理由に辞任
OpenAIのロボティクスリーダーであるケイトリン・カリノフスキーは、同社と国防総省との論争の的となったパートナーシップの後に辞任した。「これは簡単な決断ではなかった」と、カリノフスキーはソーシャルメディアでの声明で説明した。「AIが国家安全保障において重要な役割を果たしていることは事実だが、司法の監督なしにアメリカ国民の監視を行い、人間の承認なしに致死性の自律システムを展開することは、はるかに慎重な検討を必要とする境界線である」。Metaの拡張現実(AR)グラス部門を率いていたことで知られ
関連特集おすすめ
コメント (0)
0/500

木曜日、OpenAIは「プロフェッショナルな業務向けに開発された、当社で最も高性能かつ効率的な最先端モデル」と称される新しい基盤モデル「GPT-5.4」を発表した。標準版に加え、GPT-5.4には推論に特化したバージョン(GPT-5.4 Thinking)と、パフォーマンスを最適化したエディション(GPT-5.4 Pro)が用意されている。
このモデルのAPI版は、最大100万トークンのコンテキストウィンドウに対応しており、これはOpenAIがこれまでに提供した中で最大のコンテキスト容量となります。
OpenAIはまた、トークン効率の向上を強調し、GPT-5.4は前世代モデルに比べて大幅に少ないトークン数で同一の問題を解決できると述べています。
この新モデルはベンチマーク結果が大幅に改善され、コンピュータ利用ベンチマークであるOSWorld-VerifiedおよびWebArena Verifiedで過去最高のスコアを記録しました。また、知識労働タスクを対象としたOpenAIのGDPvalテストでも83%というスコアで新記録を樹立しました。
MercorのCEOであるBrendan Foody氏の声明によると、GPT-5.4は、法律および金融分野の専門スキルを評価するMercorのAPEX-Agentsベンチマークにおいてトップの成績を収めている。
「[GPT-5.4]は、スライド資料、財務モデル、法的分析といった長期的な成果物の作成に優れています」とフーディ氏は述べ、「競合する最先端モデルよりも高速かつ低コストで動作しながら、トップクラスのパフォーマンスを発揮します」と付け加えました。
GPT-5.4は、OpenAIが取り組んできた「幻覚」や事実誤認の低減をさらに推進するものです。同社によると、この新モデルはGPT-5.2と比較して、個々の主張における誤りの発生確率が33%低下し、回答全体における誤りの発生確率も18%低下しています。
今回のリリースに伴い、OpenAIはGPT-5.4 APIにおけるツール呼び出しの処理方法を再設計し、「Tool Search」という新システムを導入した。従来、システムプロンプトでは利用可能なすべてのツールを事前に定義する必要があり、ツールライブラリが拡大するにつれて、このプロセスにはかなりのトークンが消費されていた。新システムでは、モデルがオンデマンドでツールの定義を取得できるため、多数のツールが存在する環境において、リクエストの処理が高速化され、コスト効率も向上する。
またOpenAIは、モデルの「思考の連鎖(Chain-of-Thought)」を評価するための新たな安全性評価機能を追加しました。これは、多段階タスクの遂行中にモデルの推論プロセスを明らかにする「進行中の解説」のことです。AI安全性の研究者たちは、推論モデルが自身の思考の連鎖を誤って表現する可能性があることを長らく懸念してきましたが、テストの結果、特定の条件下ではこれが実際に起こり得ることが確認されました。
OpenAIの新たな評価によると、GPT-5.4の「Thinking」バージョンでは欺瞞の可能性が低いことが示されており、「このモデルには推論を隠蔽する能力が欠如しており、CoTモニタリングが依然として有効な安全対策ツールであることを示唆している」としています。
サム・アルトマン氏によるAIの減速論が議論を呼ぶ
Apple Podcastsで聴くSpotifyで聴くOpenAIのCEO、サム・アルトマン氏は最近、社会が「これらの新しい能力レベルのいくつかに対して強固になる」時間を確保するため、「AI開発の速度を制御する」時期が来た可能性を示唆した。TechCrunchの「Equity」ポッドキャストの最新回で、ケルステン・コロセック、ショーン・Oケイン、そして私自身は、アルトマン氏の発言が、OpenAIのエージェントがHugging Faceのシステムに侵入した最近のハッキング事件をきっかけとしたも
OpenAIはアップルの営業秘密訴訟と戦っている
OpenAIは火曜日、Appleの営業秘密に関する主張に反論し、同訴訟は根拠がないと主張した。「これらの主張を真剣に受け止めているが、それを支持する証拠は見当たらない」とOpenAIは述べた。これはBloombergのEd LudlowがXで報じたものである。「私たちは公正な競争とどこでも働く自由を支持しており、世界中のユーザーを強化する技術の創出に注力しています。」これは、Appleが金曜日に米国北カリフォルニア連邦地方裁判所に提起した訴訟に続くものである。同訴訟は、OpenAIが元App
OpenAIのロボティクス部門ヘッド、ケイトリン・カリノフスキー氏がペンタゴンとの提携を理由に辞任
OpenAIのロボティクスリーダーであるケイトリン・カリノフスキーは、同社と国防総省との論争の的となったパートナーシップの後に辞任した。「これは簡単な決断ではなかった」と、カリノフスキーはソーシャルメディアでの声明で説明した。「AIが国家安全保障において重要な役割を果たしていることは事実だが、司法の監督なしにアメリカ国民の監視を行い、人間の承認なしに致死性の自律システムを展開することは、はるかに慎重な検討を必要とする境界線である」。Metaの拡張現実(AR)グラス部門を率いていたことで知られ





家






