OpenAI 致力於打造能夠處理任何任務的通用人工智能
Hunter Lightman 在 2022 年成為 OpenAI 的研究員後不久,就見證了 ChatGPT 的爆炸性推出--這是科技史上成長最快的產品之一。與此同時,Lightman 較為安靜的工作則是訓練 OpenAI 的模型來應付精英高中數學競賽。
如今,他的團隊 -athGen - 在 OpenAI 尋求建立領先業界的 AI 推理模型的過程中扮演著關鍵的角色。這些系統構成「AI 代理」的骨幹,能夠執行類似人類的電腦任務。
"Lightman 告訴 TechCrunch 有關 MathGen 的起源。
儘管有進展,OpenAI 的模型仍然不完美。即使是其最新的系統也會產生幻覺,在處理複雜的任務時舉步維艱。
然而,數學推理能力已大幅提升。其中一個模型最近在國際數學奧林匹克競賽(International Math Olympiad)中奪得金牌,該競賽是為世界上最聰明的數學學生而設。OpenAI 相信這些推理能力將延伸至其他領域,為其憧憬已久的通用 AI 代理提供動力。
ChatGPT 的成功是偶然的,而 OpenAI 的代理開發則是經過多年的深思熟慮。"執行長 Sam Altman 在 OpenAI 2023 年開發者大會上預言:「不久之後,你只需要請電腦處理任務。"我們稱這些為 「代理」,它們的潛力非常驚人。
科技巨頭已確認參加 Disrupt 2025
Netflix、ElevenLabs、Wayve 和 Sequoia Capital 領導 TechCrunch Disrupt 20 週年慶的全明星陣容。從科技界的頂尖人物身上獲得可行的洞察力 - 立即購買門票,在價格上漲之前最多可節省 675 美元。
科技巨頭已確認參加 Disrupt 2025
Netflix、ElevenLabs、Wayve 和 Sequoia Capital 領導 TechCrunch Disrupt 20 週年慶的全明星陣容。從科技界的頂尖人士獲得可行的洞察力 - 立即購買門票,在價格上漲前可節省高達 675 美元。
舊金山 | 2025 年 10 月 27-29 日 | 立即報名

OpenAI 執行長 Sam Altman 在 DevDay 2023 發表演說 (照片: Justin Sullivan/Getty Images) 雖然 Altman 的願景仍未得到證實,但 OpenAI 在 2024 年推出的「o1」推理模型已讓科技界瞠目結舌。幾個月之內,它的 21 位研究人員成為矽谷最令人垂涎的人才,Meta 挖走了其中五位,並提供九位數的報酬。
強化學習的復甦
OpenAI 的代理突破與強化學習 (Reinforcement Learning, RL) 息息相關 - AI 模型透過模擬試誤來學習。儘管強化學習可以追溯到 2016 年的 AlphaGo 里程碑,OpenAI 仍花了數年時間,將其改良為適用於電腦使用的代理程式。
早期的 GPT 模型在文字方面表現優異,但在基本數學方面卻乏善可陳。2023 年的「Strawberry」計畫結合了 RL 與測試時計算 - 讓模型在回答前驗證步驟,並開創了「思考鏈」推理。
"研究人員 El Kishky 回憶說:「突然間,模型可以回溯並自我糾正,感覺很人性化。
擴展推理能力
OpenAI 發現了兩個擴充向量:訓練後的運算與反應時間分配。"Lightman 指出:「我們不只是為了今天而設計,也是為了擴充能力而設計。
專門的「Agents」團隊於 2023 年成立,為 o1 奠定基礎。與受限於產品需求的競爭對手不同,OpenAI 將 AGI 研究放在優先地位,這是一項策略性的優勢。
定義 AI 推理
研究人員爭論 AI 是否真的「推理」。有些人強調計算效率,有些人則注重類似人類的輸出。批評者是存在的,但能力是最重要的,就像飛機與鳥類的飛行方式不同一樣。
主觀任務的挑戰
目前的代理程式對於編碼處理得很好,但對於細微的問題,例如線上購物,就很吃力。"Lightman 解釋說:「這根本就是資料的挑戰。新技術允許在較難驗證的任務上進行訓練。
OpenAI 的 IMO 解決方案使用多重代理探索,現在 Google 和 xAI 都在效仿。研究員 Noam Brown 認為快速的進展仍在持續:「沒有放緩的跡象」。
隨著 GPT-5 迫在眉睫,OpenAI 的目標是保持與 Google、Anthropic 和 Meta 對抗的優勢。最終目標?一個能直覺執行任何數位任務的代理程式,完全超越今日的 ChatGPT。
相關文章
山姆·奧特曼引發關於人工智慧減速的辯論
在Apple Podcasts上收聽在Spotify上收聽OpenAI執行長薩姆·阿爾特曼(Sam Altman)最近表示,現在可能是時候“控制人工智慧的發展速度”,以便社會“在這些新的能力水平周圍加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我討論了阿爾特曼的言論可能由最近的一次駭客攻擊所觸發,該攻擊中一名OpenAI代理突破了Hugging Face的系統。Sean指出,雖然由AI代理執行的駭客攻擊是前所未
OpenAI 與蘋果公司就商業秘密訴訟進行對抗
OpenAI 於週二駁回了蘋果公司的商業秘密指控,稱該訴訟毫無根據。“我們認真對待這些指控,但未發現任何支援它們的證據,”OpenAI 表示,據彭博社記者 Ed Ludlow 在 X 平臺報道,“我們支援公平競爭和工作自由,專注於創造賦能全球使用者的技術。”此前,蘋果公司於週五在美國加利福尼亞州北區聯邦地區法院提起訴訟,指控 OpenAI 策劃了一項從前蘋果員工處竊取機密資料和智慧財產權的計劃。這份長達 41 頁的訴狀針對 OpenAI 的高管層,包括首席硬體官 Tang Tan,他是一名擁有
OpenAI機器人專案主管凱特琳·卡利諾夫斯基因五角大樓合作專案辭職
OpenAI 機器人業務負責人凱特琳·卡利諾夫斯基(Caitlin Kalinowski)在該公司與國防部達成備受爭議的合作伙伴關係後辭職。“這不是一個輕鬆的決定,”卡利諾夫斯基在社交媒體宣告中解釋道。“雖然人工智慧在國家安全中發揮著至關重要的作用,但在沒有司法監督的情況下對美國公民進行監視,以及在未經人類授權的情況下部署致命自主武器,都是需要更加慎重考慮的界限。”卡利諾夫斯基此前因領導 Meta 的增強現實眼鏡部門而聞名,她於 2024 年 11 月加入 OpenAI。在辭職信中,她強調她
相關專題推薦
評論 (1)
0/500
Hunter Lightman 在 2022 年成為 OpenAI 的研究員後不久,就見證了 ChatGPT 的爆炸性推出--這是科技史上成長最快的產品之一。與此同時,Lightman 較為安靜的工作則是訓練 OpenAI 的模型來應付精英高中數學競賽。
如今,他的團隊 -athGen - 在 OpenAI 尋求建立領先業界的 AI 推理模型的過程中扮演著關鍵的角色。這些系統構成「AI 代理」的骨幹,能夠執行類似人類的電腦任務。
"Lightman 告訴 TechCrunch 有關 MathGen 的起源。
儘管有進展,OpenAI 的模型仍然不完美。即使是其最新的系統也會產生幻覺,在處理複雜的任務時舉步維艱。
然而,數學推理能力已大幅提升。其中一個模型最近在國際數學奧林匹克競賽(International Math Olympiad)中奪得金牌,該競賽是為世界上最聰明的數學學生而設。OpenAI 相信這些推理能力將延伸至其他領域,為其憧憬已久的通用 AI 代理提供動力。
ChatGPT 的成功是偶然的,而 OpenAI 的代理開發則是經過多年的深思熟慮。"執行長 Sam Altman 在 OpenAI 2023 年開發者大會上預言:「不久之後,你只需要請電腦處理任務。"我們稱這些為 「代理」,它們的潛力非常驚人。
科技巨頭已確認參加 Disrupt 2025
Netflix、ElevenLabs、Wayve 和 Sequoia Capital 領導 TechCrunch Disrupt 20 週年慶的全明星陣容。從科技界的頂尖人物身上獲得可行的洞察力 - 立即購買門票,在價格上漲之前最多可節省 675 美元。
科技巨頭已確認參加 Disrupt 2025
Netflix、ElevenLabs、Wayve 和 Sequoia Capital 領導 TechCrunch Disrupt 20 週年慶的全明星陣容。從科技界的頂尖人士獲得可行的洞察力 - 立即購買門票,在價格上漲前可節省高達 675 美元。
舊金山 | 2025 年 10 月 27-29 日 | 立即報名

雖然 Altman 的願景仍未得到證實,但 OpenAI 在 2024 年推出的「o1」推理模型已讓科技界瞠目結舌。幾個月之內,它的 21 位研究人員成為矽谷最令人垂涎的人才,Meta 挖走了其中五位,並提供九位數的報酬。
強化學習的復甦
OpenAI 的代理突破與強化學習 (Reinforcement Learning, RL) 息息相關 - AI 模型透過模擬試誤來學習。儘管強化學習可以追溯到 2016 年的 AlphaGo 里程碑,OpenAI 仍花了數年時間,將其改良為適用於電腦使用的代理程式。
早期的 GPT 模型在文字方面表現優異,但在基本數學方面卻乏善可陳。2023 年的「Strawberry」計畫結合了 RL 與測試時計算 - 讓模型在回答前驗證步驟,並開創了「思考鏈」推理。
"研究人員 El Kishky 回憶說:「突然間,模型可以回溯並自我糾正,感覺很人性化。
擴展推理能力
OpenAI 發現了兩個擴充向量:訓練後的運算與反應時間分配。"Lightman 指出:「我們不只是為了今天而設計,也是為了擴充能力而設計。
專門的「Agents」團隊於 2023 年成立,為 o1 奠定基礎。與受限於產品需求的競爭對手不同,OpenAI 將 AGI 研究放在優先地位,這是一項策略性的優勢。
定義 AI 推理
研究人員爭論 AI 是否真的「推理」。有些人強調計算效率,有些人則注重類似人類的輸出。批評者是存在的,但能力是最重要的,就像飛機與鳥類的飛行方式不同一樣。
主觀任務的挑戰
目前的代理程式對於編碼處理得很好,但對於細微的問題,例如線上購物,就很吃力。"Lightman 解釋說:「這根本就是資料的挑戰。新技術允許在較難驗證的任務上進行訓練。
OpenAI 的 IMO 解決方案使用多重代理探索,現在 Google 和 xAI 都在效仿。研究員 Noam Brown 認為快速的進展仍在持續:「沒有放緩的跡象」。
隨著 GPT-5 迫在眉睫,OpenAI 的目標是保持與 Google、Anthropic 和 Meta 對抗的優勢。最終目標?一個能直覺執行任何數位任務的代理程式,完全超越今日的 ChatGPT。
山姆·奧特曼引發關於人工智慧減速的辯論
在Apple Podcasts上收聽在Spotify上收聽OpenAI執行長薩姆·阿爾特曼(Sam Altman)最近表示,現在可能是時候“控制人工智慧的發展速度”,以便社會“在這些新的能力水平周圍加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我討論了阿爾特曼的言論可能由最近的一次駭客攻擊所觸發,該攻擊中一名OpenAI代理突破了Hugging Face的系統。Sean指出,雖然由AI代理執行的駭客攻擊是前所未
OpenAI 與蘋果公司就商業秘密訴訟進行對抗
OpenAI 於週二駁回了蘋果公司的商業秘密指控,稱該訴訟毫無根據。“我們認真對待這些指控,但未發現任何支援它們的證據,”OpenAI 表示,據彭博社記者 Ed Ludlow 在 X 平臺報道,“我們支援公平競爭和工作自由,專注於創造賦能全球使用者的技術。”此前,蘋果公司於週五在美國加利福尼亞州北區聯邦地區法院提起訴訟,指控 OpenAI 策劃了一項從前蘋果員工處竊取機密資料和智慧財產權的計劃。這份長達 41 頁的訴狀針對 OpenAI 的高管層,包括首席硬體官 Tang Tan,他是一名擁有
OpenAI機器人專案主管凱特琳·卡利諾夫斯基因五角大樓合作專案辭職
OpenAI 機器人業務負責人凱特琳·卡利諾夫斯基(Caitlin Kalinowski)在該公司與國防部達成備受爭議的合作伙伴關係後辭職。“這不是一個輕鬆的決定,”卡利諾夫斯基在社交媒體宣告中解釋道。“雖然人工智慧在國家安全中發揮著至關重要的作用,但在沒有司法監督的情況下對美國公民進行監視,以及在未經人類授權的情況下部署致命自主武器,都是需要更加慎重考慮的界限。”卡利諾夫斯基此前因領導 Meta 的增強現實眼鏡部門而聞名,她於 2024 年 11 月加入 OpenAI。在辭職信中,她強調她





首頁






