OpenAI延遲深入研究API整合
更新於東部時間下午4:11:OpenAI澄清其白皮書措辭有誤,暗示其說服研究與通過其API發布深度研究模型的決定有關。該公司已更新白皮書,明確其說服研究與發布深度研究模型的計劃無關。原文故事繼續如下:
OpenAI決定暫緩將其深度研究工具背後的AI模型整合到其開發者API中。他們採取這一步驟,以更好地理解AI影響人們行動和信念能力的相關風險。
在週三發布的白皮書中,OpenAI提到他們正在更新評估模型「現實世界說服風險」的方法,例如大規模傳播誤導資訊的潛在風險。
該公司指出,由於深度研究模型的運算成本高且處理速度較慢,不太適合用於大規模誤導或虛假資訊活動。然而,OpenAI計劃在決定是否將深度研究模型納入其API之前,調查AI如何可能量身定制有害的說服內容。
「在我們重新考慮說服方式的同時,我們僅在ChatGPT中部署此模型,而非API,」OpenAI表示。
越來越多人擔心AI可能被用於惡意傳播虛假或誤導資訊。例如,去年全球政治深偽內容迅速傳播。在台灣選舉日當天,一個與中國共產黨有關的團體發布了AI生成的誤導性音頻,顯示一名政治人物支持親中候選人。
AI也日益被用於社交工程攻擊。消費者因名人深偽推廣的詐騙投資計劃而上當,而企業則因深偽冒充者損失數百萬美元。
在白皮書中,OpenAI分享了深度研究模型說服力的多項測試結果。此模型是OpenAI最近宣布的o3「推理」模型的專業版本,針對網頁瀏覽和數據分析進行了優化。
在一項測試中,深度研究模型被要求撰寫說服性論點,表現超越了OpenAI迄今發布的所有其他模型,但未超過人類基準。在另一項測試中,該模型試圖說服另一模型(OpenAI的GPT-4o)進行支付,再次表現優於OpenAI其他可用模型。

深度研究模型在MakeMePay基準測試中的得分,該基準測試模型說服另一模型支付現金的能力。圖片來源:OpenAI 然而,深度研究模型並非在所有說服力測試中都表現出色。根據白皮書,它在說服GPT-4o透露代碼詞方面的效果不如GPT-4o本身。OpenAI表示,測試結果可能代表深度研究模型能力的「下限」。該公司指出:「額外的結構支持或改進的能力引導可能大幅提升觀察到的表現。」
我們已聯繫OpenAI以獲取更多詳情,若收到回應,將更新此文章。
與此同時,OpenAI的至少一名競爭對手並未退縮。Perplexity宣布在其Sonar開發者API中推出Deep Research,由中國AI實驗室DeepSeek的R1模型定制版本提供支持。
相關文章
山姆·奧特曼引發關於人工智慧減速的辯論
在Apple Podcasts上收聽在Spotify上收聽OpenAI執行長薩姆·阿爾特曼(Sam Altman)最近表示,現在可能是時候“控制人工智慧的發展速度”,以便社會“在這些新的能力水平周圍加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我討論了阿爾特曼的言論可能由最近的一次駭客攻擊所觸發,該攻擊中一名OpenAI代理突破了Hugging Face的系統。Sean指出,雖然由AI代理執行的駭客攻擊是前所未
OpenAI 與蘋果公司就商業秘密訴訟進行對抗
OpenAI 於週二駁回了蘋果公司的商業秘密指控,稱該訴訟毫無根據。“我們認真對待這些指控,但未發現任何支援它們的證據,”OpenAI 表示,據彭博社記者 Ed Ludlow 在 X 平臺報道,“我們支援公平競爭和工作自由,專注於創造賦能全球使用者的技術。”此前,蘋果公司於週五在美國加利福尼亞州北區聯邦地區法院提起訴訟,指控 OpenAI 策劃了一項從前蘋果員工處竊取機密資料和智慧財產權的計劃。這份長達 41 頁的訴狀針對 OpenAI 的高管層,包括首席硬體官 Tang Tan,他是一名擁有
OpenAI機器人專案主管凱特琳·卡利諾夫斯基因五角大樓合作專案辭職
OpenAI 機器人業務負責人凱特琳·卡利諾夫斯基(Caitlin Kalinowski)在該公司與國防部達成備受爭議的合作伙伴關係後辭職。“這不是一個輕鬆的決定,”卡利諾夫斯基在社交媒體宣告中解釋道。“雖然人工智慧在國家安全中發揮著至關重要的作用,但在沒有司法監督的情況下對美國公民進行監視,以及在未經人類授權的情況下部署致命自主武器,都是需要更加慎重考慮的界限。”卡利諾夫斯基此前因領導 Meta 的增強現實眼鏡部門而聞名,她於 2024 年 11 月加入 OpenAI。在辭職信中,她強調她
相關專題推薦
評論 (41)
0/500
So they messed up the whitepaper wording and now have to clarify? Classic OpenAI move 🙃. Delaying the API for 'persuasion research' separate? Sounds like a convenient excuse to me. But hey, maybe they're actually being careful about misuse. Still, I was hoping to play with it soon...
Esto me preocupa un poco. Qué significa exactamente que su investigación en persuasión está 'separada' de la API? 🤔 Es una extraña coincidencia que el comunicado original sonara justo a lo que todos temían: que las IA puedan influir en el pensamiento. ¿Hay suficiente transparencia real en estos proyectos? Al menos corrigieron, pero deja mal sabor ese 'error' en el papel técnico.
Ces retards d'OpenAI montrent à quel point l'IA avancée devient un enjeu géopolitique. Les « maladresses » dans les communications officielles ne sont peut-être pas si accidentelles que ça... 😏 Cela me rappelle les débats sur le nucléaire au XXe siècle.
更新於東部時間下午4:11:OpenAI澄清其白皮書措辭有誤,暗示其說服研究與通過其API發布深度研究模型的決定有關。該公司已更新白皮書,明確其說服研究與發布深度研究模型的計劃無關。原文故事繼續如下:
OpenAI決定暫緩將其深度研究工具背後的AI模型整合到其開發者API中。他們採取這一步驟,以更好地理解AI影響人們行動和信念能力的相關風險。
在週三發布的白皮書中,OpenAI提到他們正在更新評估模型「現實世界說服風險」的方法,例如大規模傳播誤導資訊的潛在風險。
該公司指出,由於深度研究模型的運算成本高且處理速度較慢,不太適合用於大規模誤導或虛假資訊活動。然而,OpenAI計劃在決定是否將深度研究模型納入其API之前,調查AI如何可能量身定制有害的說服內容。
「在我們重新考慮說服方式的同時,我們僅在ChatGPT中部署此模型,而非API,」OpenAI表示。
越來越多人擔心AI可能被用於惡意傳播虛假或誤導資訊。例如,去年全球政治深偽內容迅速傳播。在台灣選舉日當天,一個與中國共產黨有關的團體發布了AI生成的誤導性音頻,顯示一名政治人物支持親中候選人。
AI也日益被用於社交工程攻擊。消費者因名人深偽推廣的詐騙投資計劃而上當,而企業則因深偽冒充者損失數百萬美元。
在白皮書中,OpenAI分享了深度研究模型說服力的多項測試結果。此模型是OpenAI最近宣布的o3「推理」模型的專業版本,針對網頁瀏覽和數據分析進行了優化。
在一項測試中,深度研究模型被要求撰寫說服性論點,表現超越了OpenAI迄今發布的所有其他模型,但未超過人類基準。在另一項測試中,該模型試圖說服另一模型(OpenAI的GPT-4o)進行支付,再次表現優於OpenAI其他可用模型。

OpenAI表示,測試結果可能代表深度研究模型能力的「下限」。該公司指出:「額外的結構支持或改進的能力引導可能大幅提升觀察到的表現。」
我們已聯繫OpenAI以獲取更多詳情,若收到回應,將更新此文章。
與此同時,OpenAI的至少一名競爭對手並未退縮。Perplexity宣布在其Sonar開發者API中推出Deep Research,由中國AI實驗室DeepSeek的R1模型定制版本提供支持。
山姆·奧特曼引發關於人工智慧減速的辯論
在Apple Podcasts上收聽在Spotify上收聽OpenAI執行長薩姆·阿爾特曼(Sam Altman)最近表示,現在可能是時候“控制人工智慧的發展速度”,以便社會“在這些新的能力水平周圍加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我討論了阿爾特曼的言論可能由最近的一次駭客攻擊所觸發,該攻擊中一名OpenAI代理突破了Hugging Face的系統。Sean指出,雖然由AI代理執行的駭客攻擊是前所未
OpenAI 與蘋果公司就商業秘密訴訟進行對抗
OpenAI 於週二駁回了蘋果公司的商業秘密指控,稱該訴訟毫無根據。“我們認真對待這些指控,但未發現任何支援它們的證據,”OpenAI 表示,據彭博社記者 Ed Ludlow 在 X 平臺報道,“我們支援公平競爭和工作自由,專注於創造賦能全球使用者的技術。”此前,蘋果公司於週五在美國加利福尼亞州北區聯邦地區法院提起訴訟,指控 OpenAI 策劃了一項從前蘋果員工處竊取機密資料和智慧財產權的計劃。這份長達 41 頁的訴狀針對 OpenAI 的高管層,包括首席硬體官 Tang Tan,他是一名擁有
OpenAI機器人專案主管凱特琳·卡利諾夫斯基因五角大樓合作專案辭職
OpenAI 機器人業務負責人凱特琳·卡利諾夫斯基(Caitlin Kalinowski)在該公司與國防部達成備受爭議的合作伙伴關係後辭職。“這不是一個輕鬆的決定,”卡利諾夫斯基在社交媒體宣告中解釋道。“雖然人工智慧在國家安全中發揮著至關重要的作用,但在沒有司法監督的情況下對美國公民進行監視,以及在未經人類授權的情況下部署致命自主武器,都是需要更加慎重考慮的界限。”卡利諾夫斯基此前因領導 Meta 的增強現實眼鏡部門而聞名,她於 2024 年 11 月加入 OpenAI。在辭職信中,她強調她
So they messed up the whitepaper wording and now have to clarify? Classic OpenAI move 🙃. Delaying the API for 'persuasion research' separate? Sounds like a convenient excuse to me. But hey, maybe they're actually being careful about misuse. Still, I was hoping to play with it soon...
Esto me preocupa un poco. Qué significa exactamente que su investigación en persuasión está 'separada' de la API? 🤔 Es una extraña coincidencia que el comunicado original sonara justo a lo que todos temían: que las IA puedan influir en el pensamiento. ¿Hay suficiente transparencia real en estos proyectos? Al menos corrigieron, pero deja mal sabor ese 'error' en el papel técnico.
Ces retards d'OpenAI montrent à quel point l'IA avancée devient un enjeu géopolitique. Les « maladresses » dans les communications officielles ne sont peut-être pas si accidentelles que ça... 😏 Cela me rappelle les débats sur le nucléaire au XXe siècle.





首頁






