OpenAI 的 Codex 加入自主編程 AI 助手新浪潮

OpenAI 上週五發布了 Codex,這是一款先進的編程系統,可透過自然語言指令執行複雜的程式設計任務。這項創新使 OpenAI 躋身於重塑軟體開發的開創性智能編程工具之列。
與 GitHub Copilot、Cursor 或 Windsurf 等傳統 AI 編程助手不同——這些工具僅在整合開發環境中擔任進階自動完成功能——這些新興的智能工具消除了直接代碼互動。現行解決方案仍需要開發人員監督,而非自主執行任務。
由 Devin、SWE-Agent、OpenHands 和 OpenAI Codex 引領的這新一代系統在後台運作。它們就像工程經理:透過 Asana 或 Slack 等平台接收任務,並交付完整解決方案而不暴露原始代碼。
對 AI 樂觀主義者而言,這代表著自動化日益複雜的軟體工程工作流程已成必然趨勢。
「編程從手動輸入演進到 GitHub Copilot 的智能自動完成」,普林斯頓大學與 SWE-Agent 的 Kilian Lieret 指出。「我們正進入第三階段——編程智能體在接收問題描述後能獨立處理完整任務。」
智能系統旨在完全繞開開發環境。「我們將工作流程提升至管理層級」,Lieret 解釋道。「只需提交錯誤報告,自主智能體便會嘗試自行解決而不需介入。」
儘管有此願景,實際應用仍存在挑戰。
加入我們參加 TechCrunch Sessions: AI
立即預訂您參與我們頂級 AI 大會的通行證,大會匯集 OpenAI、Anthropic 與 Cohere 的專家。限時優惠:全日參加主題演講、工作坊與交流活動,僅需 292 美元。
在 TechCrunch Sessions: AI 參展
向超過 1,200 位產業領袖展示您的創新成果。實惠的展位供應至 5 月 9 日或售完為止。
Devin 於 2024 年推出時面臨嚴厲的 YouTube 批評與 Answer.AI 的審慎反饋,呼應了常見疑慮:錯誤率往往抵消了自動化優勢。(儘管推出過程遭遇挑戰,Cognition AI 仍獲得 4 億美元融資,估值達 40 億美元。)
產業倡導者強調人類監督的重要性,將編程智能體定位為受監管工作流程中的組成部分,而非完全取代人力。
「現行系統需要人類進行代碼審查」,All Hands AI 的 Robert Brennan 表示。「盲目核准智能體生成的代碼會迅速產生技術債務。」
幻覺問題依然存在。Brennan 舉例說明智能體曾創造超出其訓練資料範圍的 API 規格。預防系統正在開發中,但解決方案並非易事。
SWE-Bench 排行榜追蹤進展,針對真實 GitHub 問題評估模型。OpenHands 在經過驗證的提交中領先(65.8% 解決率),而 OpenAI 聲稱 Codex 達到 72.1%——尚待獨立驗證。
產業疑慮核心在於基準測試表現是否能轉化為實際自主能力。75% 的成功率仍需要大量人工監督,特別是在多階段系統中。
與所有 AI 工具相同,逐步的模型改进最終可能產生可靠的智能系統。克服幻覺與可靠性障礙仍是應用的關鍵。
「我們正逼近信任門檻」,Brennan 觀察到。「根本問題在於:在維持品質管控的前提下,我們能安全地委派多少工作量?」
相關文章
六大科技巨頭向 Linux 基金會捐贈 1250 萬美元,以應對人工智慧漏洞噪音
為應對由人工智慧自動化工具產生的大量低質量安全報告,六家主要科技公司——Anthropic、亞馬遜(AWS)、GitHub、Google、Microsoft 和 OpenAI——共同向 Linux 基金會專案提供了 1250 萬美元 的資金支援。這項投資旨在減輕開源軟體(FOSS)維護者手動篩選的工作負擔,使他們能夠專注於真正的安全威脅。隨著人工智慧技術降低了漏洞發現的門檻,開源社羣正面臨前所未有的挑戰:無效報告:自動生成的 AI 報告使維護者應接不暇。雖然數量龐大,但這些提交往往缺乏深度,
馬斯克曾考慮將OpenAI留給他的孩子,而奧特曼正在作證
今早,OpenAI 執行長山姆·阿爾特曼出庭作證,回應前聯合創始人埃隆·馬斯克針對該公司企業結構提起的訴訟。當被問及馬斯克聲稱其他聯合創始人透過成立一家以營利為目的的子公司來推廣基於人工智慧的產品,從而“竊取了一家慈善機構”的說法時,阿爾特曼表現出明顯的猶豫。“這種說法甚至讓人難以理解,”阿爾特曼在停頓後說道,“我們成立的是全球最大的慈善機構之一。該基金會正在開展令人難以置信的工作,並將繼續做更多事情。”馬斯克的律師團隊指出,OpenAI 基金會目前持有的資產價值約為 2000 億美元
山姆·奧特曼引發關於人工智慧減速的辯論
在Apple Podcasts上收聽在Spotify上收聽OpenAI執行長薩姆·阿爾特曼(Sam Altman)最近表示,現在可能是時候“控制人工智慧的發展速度”,以便社會“在這些新的能力水平周圍加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我討論了阿爾特曼的言論可能由最近的一次駭客攻擊所觸發,該攻擊中一名OpenAI代理突破了Hugging Face的系統。Sean指出,雖然由AI代理執行的駭客攻擊是前所未
相關專題推薦
評論 (1)
0/500

OpenAI 上週五發布了 Codex,這是一款先進的編程系統,可透過自然語言指令執行複雜的程式設計任務。這項創新使 OpenAI 躋身於重塑軟體開發的開創性智能編程工具之列。
與 GitHub Copilot、Cursor 或 Windsurf 等傳統 AI 編程助手不同——這些工具僅在整合開發環境中擔任進階自動完成功能——這些新興的智能工具消除了直接代碼互動。現行解決方案仍需要開發人員監督,而非自主執行任務。
由 Devin、SWE-Agent、OpenHands 和 OpenAI Codex 引領的這新一代系統在後台運作。它們就像工程經理:透過 Asana 或 Slack 等平台接收任務,並交付完整解決方案而不暴露原始代碼。
對 AI 樂觀主義者而言,這代表著自動化日益複雜的軟體工程工作流程已成必然趨勢。
「編程從手動輸入演進到 GitHub Copilot 的智能自動完成」,普林斯頓大學與 SWE-Agent 的 Kilian Lieret 指出。「我們正進入第三階段——編程智能體在接收問題描述後能獨立處理完整任務。」
智能系統旨在完全繞開開發環境。「我們將工作流程提升至管理層級」,Lieret 解釋道。「只需提交錯誤報告,自主智能體便會嘗試自行解決而不需介入。」
儘管有此願景,實際應用仍存在挑戰。
加入我們參加 TechCrunch Sessions: AI
立即預訂您參與我們頂級 AI 大會的通行證,大會匯集 OpenAI、Anthropic 與 Cohere 的專家。限時優惠:全日參加主題演講、工作坊與交流活動,僅需 292 美元。
在 TechCrunch Sessions: AI 參展
向超過 1,200 位產業領袖展示您的創新成果。實惠的展位供應至 5 月 9 日或售完為止。
Devin 於 2024 年推出時面臨嚴厲的 YouTube 批評與 Answer.AI 的審慎反饋,呼應了常見疑慮:錯誤率往往抵消了自動化優勢。(儘管推出過程遭遇挑戰,Cognition AI 仍獲得 4 億美元融資,估值達 40 億美元。)
產業倡導者強調人類監督的重要性,將編程智能體定位為受監管工作流程中的組成部分,而非完全取代人力。
「現行系統需要人類進行代碼審查」,All Hands AI 的 Robert Brennan 表示。「盲目核准智能體生成的代碼會迅速產生技術債務。」
幻覺問題依然存在。Brennan 舉例說明智能體曾創造超出其訓練資料範圍的 API 規格。預防系統正在開發中,但解決方案並非易事。
SWE-Bench 排行榜追蹤進展,針對真實 GitHub 問題評估模型。OpenHands 在經過驗證的提交中領先(65.8% 解決率),而 OpenAI 聲稱 Codex 達到 72.1%——尚待獨立驗證。
產業疑慮核心在於基準測試表現是否能轉化為實際自主能力。75% 的成功率仍需要大量人工監督,特別是在多階段系統中。
與所有 AI 工具相同,逐步的模型改进最終可能產生可靠的智能系統。克服幻覺與可靠性障礙仍是應用的關鍵。
「我們正逼近信任門檻」,Brennan 觀察到。「根本問題在於:在維持品質管控的前提下,我們能安全地委派多少工作量?」
六大科技巨頭向 Linux 基金會捐贈 1250 萬美元,以應對人工智慧漏洞噪音
為應對由人工智慧自動化工具產生的大量低質量安全報告,六家主要科技公司——Anthropic、亞馬遜(AWS)、GitHub、Google、Microsoft 和 OpenAI——共同向 Linux 基金會專案提供了 1250 萬美元 的資金支援。這項投資旨在減輕開源軟體(FOSS)維護者手動篩選的工作負擔,使他們能夠專注於真正的安全威脅。隨著人工智慧技術降低了漏洞發現的門檻,開源社羣正面臨前所未有的挑戰:無效報告:自動生成的 AI 報告使維護者應接不暇。雖然數量龐大,但這些提交往往缺乏深度,
馬斯克曾考慮將OpenAI留給他的孩子,而奧特曼正在作證
今早,OpenAI 執行長山姆·阿爾特曼出庭作證,回應前聯合創始人埃隆·馬斯克針對該公司企業結構提起的訴訟。當被問及馬斯克聲稱其他聯合創始人透過成立一家以營利為目的的子公司來推廣基於人工智慧的產品,從而“竊取了一家慈善機構”的說法時,阿爾特曼表現出明顯的猶豫。“這種說法甚至讓人難以理解,”阿爾特曼在停頓後說道,“我們成立的是全球最大的慈善機構之一。該基金會正在開展令人難以置信的工作,並將繼續做更多事情。”馬斯克的律師團隊指出,OpenAI 基金會目前持有的資產價值約為 2000 億美元
山姆·奧特曼引發關於人工智慧減速的辯論
在Apple Podcasts上收聽在Spotify上收聽OpenAI執行長薩姆·阿爾特曼(Sam Altman)最近表示,現在可能是時候“控制人工智慧的發展速度”,以便社會“在這些新的能力水平周圍加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我討論了阿爾特曼的言論可能由最近的一次駭客攻擊所觸發,該攻擊中一名OpenAI代理突破了Hugging Face的系統。Sean指出,雖然由AI代理執行的駭客攻擊是前所未





首頁






