OpenAIのCodex、新たな自律型AIコーディング支援ツールの潮流に参入

OpenAIは先週金曜日に高度なコーディングシステム「Codex」を発表しました。これは自然言語による指示で複雑なプログラミングタスクを実行するもので、この革新によりOpenAIはソフトウェア開発を再構築する先駆的なエージェント型コーディングツールを提供する企業の仲間入りを果たしました。
GitHub Copilot、Cursor、Windsurfのような従来のAIコーディングアシスタントは、IDE内で高度なオートコンプリートとして機能しますが、これらの新興エージェント型ツールは、直接的なコード操作を排除します。現在の解決策は依然として自律的なタスク実行ではなく、開発者の監督を必要としています。
Devin、SWE-Agent、OpenHands、そしてOpenAI Codexによって開拓されたこの新世代は、背後で動作します。それらはエンジニアリングマネージャーのように機能します:AsanaやSlackなどのプラットフォームを通じてタスクを受け取り、生のコードを公開することなく完成したソリューションを届けるのです。
AI楽観主義者にとって、これはますます高度化するソフトウェアエンジニアリングのワークフローを自動化するという、必然的な進歩を意味します。
「プログラミングは、手動でのキーストロークからGitHub Copilotのインテリジェントなオートコンプリートへと進化しました」と、プリンストン大学およびSWE-AgentのKilian Lieretは指摘します。「私達は今、第3段階に入ろうとしています – コーディングエージェントが問題の記述を受け取った後、タスク全体を独立して処理する段階です」
エージェント型システムは、開発者環境を完全に迂回することを目指しています。「ワークフローを管理レベルに引き上げているのです」とLieretは説明します。「単にバグレポートを提出するだけで、自律エージェントが人間の介入なしに解決を試みます」
このビジョンにもかかわらず、実装上の課題は残されています。
TechCrunch Sessions: AIにご参加ください
OpenAI、Anthropic、Cohereの専門家が登場するプレミアAIカンファレンスへのパスを予約しましょう。限定オファー:基調講演、ワークショップ、ネットワーキングへの終日アクセスがたったの292ドルです。
TechCrunch Sessions: AIに出展しましょう
1,200人以上の業界リーダーが集まるTC Sessions: AIであなたのイノベーションを紹介しましょう。手頃な価格の展示スペースは、5月9日まで、または完売次第受付終了です。
Devinの2024年のローンチは、厳しいYouTubeでの批判とAnswer.AIからの慎重なフィードバックに直面し、一般的な懸念 – エラー率が自動化のメリットをしばしば帳消しにしてしまうこと – を echo しました。(ローンチの課題にもかかわらず、Cognition AIは40億ドルの評価額で4億ドルの資金調達に成功しました。)
業界の提唱者たちは人間による監督を重視し、コーディングエージェントを代替手段ではなく、監督下のワークフロー内の構成要素として位置付けています。
「現在のシステムには人間によるコードレビューが必要です」とAll Hands AIのRobert Brennanは述べています。「エージェントが生成したコードを盲目的に承認すると、技術的負債が急速に蓄積します」
幻覚(Hallucination)は依然として問題です。Brennanは、エージェントがその学習データを超えたAPI仕様をでっち上げた事例を引用しています。防止システムは開発中ですが、解決策は容易ではありません。
SWE-Benchリーダーボードは進捗を追跡し、実際のGitHubイシューに対してモデルを評価しています。OpenHandsが検証済み提出物で首位(65.8%解決)に立つ一方、OpenAIはCodexが72.1%を達成していると主張しています – 独立した検証は待たれます。
業界の懐疑論は、ベンチマークでのパフォーマンスが実用的な自律性に繋がるかどうかに集中しています。75%の成功率でも、特に多段階システムでは、相当量の人間の監督を依然として必要とします。
あらゆるAIツールと同様に、モデルの漸進的改善が、いつか信頼性の高いエージェント型システムをもたらすかもしれません。幻覚と信頼性のハードルを克服することが、採用には極めて重要です。
「我々は信頼の障壁に近づいています」とBrennanは観察します。「根本的な問いは、品質管理を維持しながら、どれだけのワークロードを安全に委任できるかということです」
関連記事
Linux財団を支援する6つのテックジャイアント、AI脆弱性のノイズに対処するために1,250万ドルを拠出
AI自動化ツールによって生成される低品質なセキュリティレポートの洪水に対処するため、Anthropic、Amazon(AWS)、GitHub、Google、Microsoft、OpenAIの6大テック企業が、Linux Foundationのイニシアチブに対して総額1250万ドルの資金を提供しました。この投資は、オープンソースソフトウェア(FOSS)のメンテナーが手動でのスクリーニングという負担から解放され、本格的なセキュリティ脅威に集中できることを目的としています。AI技術が脆弱性発見のハー
アルトマン証言の中で、マスクはOpenAIを子供たちに譲ることを検討した
今朝、OpenAIのCEOサム・アルトマン氏は、同社の企業構造に異議を唱える元共同創設者エロン・マスク氏の訴訟に対応するため証言台に立った。「営利子会社を設立してAI搭載製品を市場に出すことで、他の創設者たちが『慈善団体を盗んだ』」というマスク氏の主張について問われると、アルトマン氏は明らかなためらいを示して応答した。「その枠組みを処理するのは難しい」と、アルトマン氏は一時の間を置いて語った。「私たちは世界最大の慈善団体の一つを設立した。財団は素晴らしい活動を行っており、今後もさらに多くのこ
サム・アルトマン氏によるAIの減速論が議論を呼ぶ
Apple Podcastsで聴くSpotifyで聴くOpenAIのCEO、サム・アルトマン氏は最近、社会が「これらの新しい能力レベルのいくつかに対して強固になる」時間を確保するため、「AI開発の速度を制御する」時期が来た可能性を示唆した。TechCrunchの「Equity」ポッドキャストの最新回で、ケルステン・コロセック、ショーン・Oケイン、そして私自身は、アルトマン氏の発言が、OpenAIのエージェントがHugging Faceのシステムに侵入した最近のハッキング事件をきっかけとしたも
関連特集おすすめ
コメント (1)
0/500

OpenAIは先週金曜日に高度なコーディングシステム「Codex」を発表しました。これは自然言語による指示で複雑なプログラミングタスクを実行するもので、この革新によりOpenAIはソフトウェア開発を再構築する先駆的なエージェント型コーディングツールを提供する企業の仲間入りを果たしました。
GitHub Copilot、Cursor、Windsurfのような従来のAIコーディングアシスタントは、IDE内で高度なオートコンプリートとして機能しますが、これらの新興エージェント型ツールは、直接的なコード操作を排除します。現在の解決策は依然として自律的なタスク実行ではなく、開発者の監督を必要としています。
Devin、SWE-Agent、OpenHands、そしてOpenAI Codexによって開拓されたこの新世代は、背後で動作します。それらはエンジニアリングマネージャーのように機能します:AsanaやSlackなどのプラットフォームを通じてタスクを受け取り、生のコードを公開することなく完成したソリューションを届けるのです。
AI楽観主義者にとって、これはますます高度化するソフトウェアエンジニアリングのワークフローを自動化するという、必然的な進歩を意味します。
「プログラミングは、手動でのキーストロークからGitHub Copilotのインテリジェントなオートコンプリートへと進化しました」と、プリンストン大学およびSWE-AgentのKilian Lieretは指摘します。「私達は今、第3段階に入ろうとしています – コーディングエージェントが問題の記述を受け取った後、タスク全体を独立して処理する段階です」
エージェント型システムは、開発者環境を完全に迂回することを目指しています。「ワークフローを管理レベルに引き上げているのです」とLieretは説明します。「単にバグレポートを提出するだけで、自律エージェントが人間の介入なしに解決を試みます」
このビジョンにもかかわらず、実装上の課題は残されています。
TechCrunch Sessions: AIにご参加ください
OpenAI、Anthropic、Cohereの専門家が登場するプレミアAIカンファレンスへのパスを予約しましょう。限定オファー:基調講演、ワークショップ、ネットワーキングへの終日アクセスがたったの292ドルです。
TechCrunch Sessions: AIに出展しましょう
1,200人以上の業界リーダーが集まるTC Sessions: AIであなたのイノベーションを紹介しましょう。手頃な価格の展示スペースは、5月9日まで、または完売次第受付終了です。
Devinの2024年のローンチは、厳しいYouTubeでの批判とAnswer.AIからの慎重なフィードバックに直面し、一般的な懸念 – エラー率が自動化のメリットをしばしば帳消しにしてしまうこと – を echo しました。(ローンチの課題にもかかわらず、Cognition AIは40億ドルの評価額で4億ドルの資金調達に成功しました。)
業界の提唱者たちは人間による監督を重視し、コーディングエージェントを代替手段ではなく、監督下のワークフロー内の構成要素として位置付けています。
「現在のシステムには人間によるコードレビューが必要です」とAll Hands AIのRobert Brennanは述べています。「エージェントが生成したコードを盲目的に承認すると、技術的負債が急速に蓄積します」
幻覚(Hallucination)は依然として問題です。Brennanは、エージェントがその学習データを超えたAPI仕様をでっち上げた事例を引用しています。防止システムは開発中ですが、解決策は容易ではありません。
SWE-Benchリーダーボードは進捗を追跡し、実際のGitHubイシューに対してモデルを評価しています。OpenHandsが検証済み提出物で首位(65.8%解決)に立つ一方、OpenAIはCodexが72.1%を達成していると主張しています – 独立した検証は待たれます。
業界の懐疑論は、ベンチマークでのパフォーマンスが実用的な自律性に繋がるかどうかに集中しています。75%の成功率でも、特に多段階システムでは、相当量の人間の監督を依然として必要とします。
あらゆるAIツールと同様に、モデルの漸進的改善が、いつか信頼性の高いエージェント型システムをもたらすかもしれません。幻覚と信頼性のハードルを克服することが、採用には極めて重要です。
「我々は信頼の障壁に近づいています」とBrennanは観察します。「根本的な問いは、品質管理を維持しながら、どれだけのワークロードを安全に委任できるかということです」
Linux財団を支援する6つのテックジャイアント、AI脆弱性のノイズに対処するために1,250万ドルを拠出
AI自動化ツールによって生成される低品質なセキュリティレポートの洪水に対処するため、Anthropic、Amazon(AWS)、GitHub、Google、Microsoft、OpenAIの6大テック企業が、Linux Foundationのイニシアチブに対して総額1250万ドルの資金を提供しました。この投資は、オープンソースソフトウェア(FOSS)のメンテナーが手動でのスクリーニングという負担から解放され、本格的なセキュリティ脅威に集中できることを目的としています。AI技術が脆弱性発見のハー
アルトマン証言の中で、マスクはOpenAIを子供たちに譲ることを検討した
今朝、OpenAIのCEOサム・アルトマン氏は、同社の企業構造に異議を唱える元共同創設者エロン・マスク氏の訴訟に対応するため証言台に立った。「営利子会社を設立してAI搭載製品を市場に出すことで、他の創設者たちが『慈善団体を盗んだ』」というマスク氏の主張について問われると、アルトマン氏は明らかなためらいを示して応答した。「その枠組みを処理するのは難しい」と、アルトマン氏は一時の間を置いて語った。「私たちは世界最大の慈善団体の一つを設立した。財団は素晴らしい活動を行っており、今後もさらに多くのこ
サム・アルトマン氏によるAIの減速論が議論を呼ぶ
Apple Podcastsで聴くSpotifyで聴くOpenAIのCEO、サム・アルトマン氏は最近、社会が「これらの新しい能力レベルのいくつかに対して強固になる」時間を確保するため、「AI開発の速度を制御する」時期が来た可能性を示唆した。TechCrunchの「Equity」ポッドキャストの最新回で、ケルステン・コロセック、ショーン・Oケイン、そして私自身は、アルトマン氏の発言が、OpenAIのエージェントがHugging Faceのシステムに侵入した最近のハッキング事件をきっかけとしたも





家






