OpenAI延迟深入研究API整合
东部时间下午4:11更新:OpenAI澄清其白皮书措辞有误,暗示其说服研究与其通过API发布深度研究模型的决定相关。该公司随后更新了白皮书,澄清其说服工作与其发布深度研究模型的计划是分开的。原文如下:
OpenAI决定暂缓将其深度研究工具背后的AI模型集成到其开发者API中。他们采取这一步骤是为了更好地了解AI影响人们行为和信念的相关风险。
在周三发布的白皮书中,OpenAI提到他们正在更新评估模型“现实世界说服风险”的方法,例如大规模传播误导信息的可能性。
该公司指出,由于深度研究模型的计算成本高且处理速度较慢,它并不适合用于大规模虚假信息或 дезинформация活动。然而,OpenAI计划在决定是否将深度研究模型纳入其API之前,研究AI如何定制有害的说服内容。
“在我们重新考虑说服方式的过程中,我们仅在ChatGPT中部署此模型,而非API,”OpenAI表示。
人们越来越担心AI可能被用于恶意传播虚假或误导性信息。例如,去年全球范围内政治深度伪造内容迅速传播。在台湾选举日,与中国共产党有关的团体发布了AI生成的误导性音频,显示一名政治家支持亲华候选人。
AI还越来越多地用于社会工程攻击。消费者因名人深度伪造内容推广的欺诈性投资计划而上当受骗,而企业则因深度伪造冒充者损失数百万美元。
在白皮书中,OpenAI分享了深度研究模型在说服力方面的多项测试结果。该模型是OpenAI最近宣布的o3“推理”模型的专门版本,优化用于网页浏览和数据分析。
在一项测试中,深度研究模型被要求撰写具有说服力的论点,其表现优于OpenAI迄今发布的所有其他模型,尽管未能超过人类基准。在另一项测试中,该模型试图说服另一个模型(OpenAI的GPT-4o)进行支付,其表现再次优于OpenAI其他可用模型。

深度研究模型在MakeMePay基准测试中的得分,该测试评估模型说服另一个模型支付现金的能力。图片来源:OpenAI 然而,深度研究模型并非在所有说服力测试中都表现优异。根据白皮书,它在说服GPT-4o透露代码词方面的效果不如GPT-4o本身。OpenAI表示,测试结果可能代表深度研究模型能力的“下限”。“额外的框架或改进的能力诱导可能显著提高观察到的性能,”该公司指出。
我们已联系OpenAI以获取更多细节,如果收到回复,将更新此文章。
与此同时,OpenAI的至少一家竞争对手并未退缩。Perplexity宣布在其Sonar开发者API中推出Deep Research,由中国AI实验室DeepSeek的R1模型定制版本提供支持。
相关文章
山姆·奥特曼引发关于人工智能减速的辩论
在Apple Podcasts上收听在Spotify上收听OpenAI首席执行官萨姆·阿尔特曼(Sam Altman)最近表示,现在可能是时候“控制人工智能的发展速度”,以便社会“在这些新的能力水平周围加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我讨论了阿尔特曼的言论可能由最近的一次黑客攻击所触发,该攻击中一名OpenAI代理突破了Hugging Face的系统。Sean指出,虽然由AI代理执行的黑客攻击是前所未
OpenAI 与苹果公司就商业秘密诉讼进行对抗
OpenAI 于周二驳回了苹果公司的商业秘密指控,称该诉讼毫无根据。“我们认真对待这些指控,但未发现任何支持它们的证据,”OpenAI 表示,据彭博社记者 Ed Ludlow 在 X 平台报道,“我们支持公平竞争和工作自由,专注于创造赋能全球用户的技术。”此前,苹果公司于周五在美国加利福尼亚州北区联邦地区法院提起诉讼,指控 OpenAI 策划了一项从前苹果员工处窃取机密数据和知识产权的计划。这份长达 41 页的诉状针对 OpenAI 的高管层,包括首席硬件官 Tang Tan,他是一名拥有
OpenAI机器人项目主管凯特琳·卡利诺夫斯基因五角大楼合作项目辞职
OpenAI 机器人业务负责人凯特琳·卡利诺夫斯基(Caitlin Kalinowski)在该公司与国防部达成备受争议的合作伙伴关系后辞职。“这不是一个轻松的决定,”卡利诺夫斯基在社交媒体声明中解释道。“虽然人工智能在国家安全中发挥着至关重要的作用,但在没有司法监督的情况下对美国公民进行监视,以及在未经人类授权的情况下部署致命自主武器,都是需要更加慎重考虑的界限。”卡利诺夫斯基此前因领导 Meta 的增强现实眼镜部门而闻名,她于 2024 年 11 月加入 OpenAI。在辞职信中,她强调她
相关专题推荐
评论 (41)
0/500
So they messed up the whitepaper wording and now have to clarify? Classic OpenAI move 🙃. Delaying the API for 'persuasion research' separate? Sounds like a convenient excuse to me. But hey, maybe they're actually being careful about misuse. Still, I was hoping to play with it soon...
Esto me preocupa un poco. Qué significa exactamente que su investigación en persuasión está 'separada' de la API? 🤔 Es una extraña coincidencia que el comunicado original sonara justo a lo que todos temían: que las IA puedan influir en el pensamiento. ¿Hay suficiente transparencia real en estos proyectos? Al menos corrigieron, pero deja mal sabor ese 'error' en el papel técnico.
Ces retards d'OpenAI montrent à quel point l'IA avancée devient un enjeu géopolitique. Les « maladresses » dans les communications officielles ne sont peut-être pas si accidentelles que ça... 😏 Cela me rappelle les débats sur le nucléaire au XXe siècle.
东部时间下午4:11更新:OpenAI澄清其白皮书措辞有误,暗示其说服研究与其通过API发布深度研究模型的决定相关。该公司随后更新了白皮书,澄清其说服工作与其发布深度研究模型的计划是分开的。原文如下:
OpenAI决定暂缓将其深度研究工具背后的AI模型集成到其开发者API中。他们采取这一步骤是为了更好地了解AI影响人们行为和信念的相关风险。
在周三发布的白皮书中,OpenAI提到他们正在更新评估模型“现实世界说服风险”的方法,例如大规模传播误导信息的可能性。
该公司指出,由于深度研究模型的计算成本高且处理速度较慢,它并不适合用于大规模虚假信息或 дезинформация活动。然而,OpenAI计划在决定是否将深度研究模型纳入其API之前,研究AI如何定制有害的说服内容。
“在我们重新考虑说服方式的过程中,我们仅在ChatGPT中部署此模型,而非API,”OpenAI表示。
人们越来越担心AI可能被用于恶意传播虚假或误导性信息。例如,去年全球范围内政治深度伪造内容迅速传播。在台湾选举日,与中国共产党有关的团体发布了AI生成的误导性音频,显示一名政治家支持亲华候选人。
AI还越来越多地用于社会工程攻击。消费者因名人深度伪造内容推广的欺诈性投资计划而上当受骗,而企业则因深度伪造冒充者损失数百万美元。
在白皮书中,OpenAI分享了深度研究模型在说服力方面的多项测试结果。该模型是OpenAI最近宣布的o3“推理”模型的专门版本,优化用于网页浏览和数据分析。
在一项测试中,深度研究模型被要求撰写具有说服力的论点,其表现优于OpenAI迄今发布的所有其他模型,尽管未能超过人类基准。在另一项测试中,该模型试图说服另一个模型(OpenAI的GPT-4o)进行支付,其表现再次优于OpenAI其他可用模型。

OpenAI表示,测试结果可能代表深度研究模型能力的“下限”。“额外的框架或改进的能力诱导可能显著提高观察到的性能,”该公司指出。
我们已联系OpenAI以获取更多细节,如果收到回复,将更新此文章。
与此同时,OpenAI的至少一家竞争对手并未退缩。Perplexity宣布在其Sonar开发者API中推出Deep Research,由中国AI实验室DeepSeek的R1模型定制版本提供支持。
山姆·奥特曼引发关于人工智能减速的辩论
在Apple Podcasts上收听在Spotify上收听OpenAI首席执行官萨姆·阿尔特曼(Sam Altman)最近表示,现在可能是时候“控制人工智能的发展速度”,以便社会“在这些新的能力水平周围加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我讨论了阿尔特曼的言论可能由最近的一次黑客攻击所触发,该攻击中一名OpenAI代理突破了Hugging Face的系统。Sean指出,虽然由AI代理执行的黑客攻击是前所未
OpenAI 与苹果公司就商业秘密诉讼进行对抗
OpenAI 于周二驳回了苹果公司的商业秘密指控,称该诉讼毫无根据。“我们认真对待这些指控,但未发现任何支持它们的证据,”OpenAI 表示,据彭博社记者 Ed Ludlow 在 X 平台报道,“我们支持公平竞争和工作自由,专注于创造赋能全球用户的技术。”此前,苹果公司于周五在美国加利福尼亚州北区联邦地区法院提起诉讼,指控 OpenAI 策划了一项从前苹果员工处窃取机密数据和知识产权的计划。这份长达 41 页的诉状针对 OpenAI 的高管层,包括首席硬件官 Tang Tan,他是一名拥有
OpenAI机器人项目主管凯特琳·卡利诺夫斯基因五角大楼合作项目辞职
OpenAI 机器人业务负责人凯特琳·卡利诺夫斯基(Caitlin Kalinowski)在该公司与国防部达成备受争议的合作伙伴关系后辞职。“这不是一个轻松的决定,”卡利诺夫斯基在社交媒体声明中解释道。“虽然人工智能在国家安全中发挥着至关重要的作用,但在没有司法监督的情况下对美国公民进行监视,以及在未经人类授权的情况下部署致命自主武器,都是需要更加慎重考虑的界限。”卡利诺夫斯基此前因领导 Meta 的增强现实眼镜部门而闻名,她于 2024 年 11 月加入 OpenAI。在辞职信中,她强调她
So they messed up the whitepaper wording and now have to clarify? Classic OpenAI move 🙃. Delaying the API for 'persuasion research' separate? Sounds like a convenient excuse to me. But hey, maybe they're actually being careful about misuse. Still, I was hoping to play with it soon...
Esto me preocupa un poco. Qué significa exactamente que su investigación en persuasión está 'separada' de la API? 🤔 Es una extraña coincidencia que el comunicado original sonara justo a lo que todos temían: que las IA puedan influir en el pensamiento. ¿Hay suficiente transparencia real en estos proyectos? Al menos corrigieron, pero deja mal sabor ese 'error' en el papel técnico.
Ces retards d'OpenAI montrent à quel point l'IA avancée devient un enjeu géopolitique. Les « maladresses » dans les communications officielles ne sont peut-être pas si accidentelles que ça... 😏 Cela me rappelle les débats sur le nucléaire au XXe siècle.





首页






