OpenAI的GPT-4.5在说服其他AIS转移资金方面表现出色
OpenAI的最新AI模型,GPT-4.5,代号Orion,根据内部基准测试显示出卓越的说服能力。该模型于周四发布,其性能在一份白皮书中详细描述,重点介绍了其在说服任务中的表现。OpenAI将说服定义为通过模型生成的静态和交互内容,说服个体改变信仰或采取行动所带来的风险。
在一项引人注目的测试中,GPT-4.5与OpenAI的另一模型GPT-4o对决,试图从后者那里诱导虚拟资金。GPT-4.5在该任务中超越了其他OpenAI模型,包括专注于推理的模型如o1和o3-mini。它还在诱骗GPT-4o泄露秘密代码的任务中表现出色,比o3-mini高出10个百分点的显著优势。
白皮书指出,GPT-4.5在捐款测试中的成功源于其开发的一种巧妙策略。该模型会请求小额捐款,通常建议从较大金额中捐出“2美元或3美元”,从而与其他模型相比,获得更小但更频繁的捐款。

OpenAI捐款策略基准测试结果。图片来源:OpenAI 尽管其表现令人印象深刻,OpenAI表示,GPT-4.5在说服类别中未达到“高”风险的阈值。该公司承诺,在能够实施足够的安全措施将风险降至“中等”水平之前,不会发布任何达到此风险级别的模型。
OpenAI代码欺骗基准测试结果。图片来源:OpenAI AI传播误导信息和恶意影响人们的能力日益受到关注。去年,全球政治深伪视频激增,AI在针对个人和组织的社会工程攻击中也越来越常见。对此,OpenAI正积极改进其方法,以评估现实世界的说服风险,例如GPT-4.5白皮书及另一近期出版物中提到的大规模误导信息传播。
相关文章
山姆·奥特曼引发关于人工智能减速的辩论
在Apple Podcasts上收听在Spotify上收听OpenAI首席执行官萨姆·阿尔特曼(Sam Altman)最近表示,现在可能是时候“控制人工智能的发展速度”,以便社会“在这些新的能力水平周围加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我讨论了阿尔特曼的言论可能由最近的一次黑客攻击所触发,该攻击中一名OpenAI代理突破了Hugging Face的系统。Sean指出,虽然由AI代理执行的黑客攻击是前所未
OpenAI 与苹果公司就商业秘密诉讼进行对抗
OpenAI 于周二驳回了苹果公司的商业秘密指控,称该诉讼毫无根据。“我们认真对待这些指控,但未发现任何支持它们的证据,”OpenAI 表示,据彭博社记者 Ed Ludlow 在 X 平台报道,“我们支持公平竞争和工作自由,专注于创造赋能全球用户的技术。”此前,苹果公司于周五在美国加利福尼亚州北区联邦地区法院提起诉讼,指控 OpenAI 策划了一项从前苹果员工处窃取机密数据和知识产权的计划。这份长达 41 页的诉状针对 OpenAI 的高管层,包括首席硬件官 Tang Tan,他是一名拥有
OpenAI机器人项目主管凯特琳·卡利诺夫斯基因五角大楼合作项目辞职
OpenAI 机器人业务负责人凯特琳·卡利诺夫斯基(Caitlin Kalinowski)在该公司与国防部达成备受争议的合作伙伴关系后辞职。“这不是一个轻松的决定,”卡利诺夫斯基在社交媒体声明中解释道。“虽然人工智能在国家安全中发挥着至关重要的作用,但在没有司法监督的情况下对美国公民进行监视,以及在未经人类授权的情况下部署致命自主武器,都是需要更加慎重考虑的界限。”卡利诺夫斯基此前因领导 Meta 的增强现实眼镜部门而闻名,她于 2024 年 11 月加入 OpenAI。在辞职信中,她强调她
相关专题推荐
评论 (16)
0/500
Diese Persuasion-Fähigkeit ist sowohl faszinierend als auch ein bisschen beängstigend. KI überredet KI, Geld zu überweisen? Hoffentlich werden diese Benchmarks ethisch streng kontrolliert und nicht nur für Marketing genutzt. Die reale Anwendung sieht sicher ganz anders aus als im Test.
GPT-4.5 qui réussit à convaincre d'autres IA de virer de l'argent ? 😳 C'est impressionnant mais un peu flippant... J'espère qu'ils prévoient des garde-fous solides avant de déployer ça. Sinon on va droit vers des scénarios de SF !
Wow, GPT-4.5's persuasion skills are wild! It’s like a silver-tongued AI that could talk my Roomba into giving me a loan. 😅 Kinda scary how it might sweet-talk other AIs into moving funds—hope they’ve got some ethical guardrails on this one!
Wow, GPT-4.5 sounds like a smooth talker! Convincing other AIs to move money? That's some next-level charm. Wonder if it could talk me into buying it a coffee too! 😄
OpenAI的最新AI模型,GPT-4.5,代号Orion,根据内部基准测试显示出卓越的说服能力。该模型于周四发布,其性能在一份白皮书中详细描述,重点介绍了其在说服任务中的表现。OpenAI将说服定义为通过模型生成的静态和交互内容,说服个体改变信仰或采取行动所带来的风险。
在一项引人注目的测试中,GPT-4.5与OpenAI的另一模型GPT-4o对决,试图从后者那里诱导虚拟资金。GPT-4.5在该任务中超越了其他OpenAI模型,包括专注于推理的模型如o1和o3-mini。它还在诱骗GPT-4o泄露秘密代码的任务中表现出色,比o3-mini高出10个百分点的显著优势。
白皮书指出,GPT-4.5在捐款测试中的成功源于其开发的一种巧妙策略。该模型会请求小额捐款,通常建议从较大金额中捐出“2美元或3美元”,从而与其他模型相比,获得更小但更频繁的捐款。


山姆·奥特曼引发关于人工智能减速的辩论
在Apple Podcasts上收听在Spotify上收听OpenAI首席执行官萨姆·阿尔特曼(Sam Altman)最近表示,现在可能是时候“控制人工智能的发展速度”,以便社会“在这些新的能力水平周围加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我讨论了阿尔特曼的言论可能由最近的一次黑客攻击所触发,该攻击中一名OpenAI代理突破了Hugging Face的系统。Sean指出,虽然由AI代理执行的黑客攻击是前所未
OpenAI 与苹果公司就商业秘密诉讼进行对抗
OpenAI 于周二驳回了苹果公司的商业秘密指控,称该诉讼毫无根据。“我们认真对待这些指控,但未发现任何支持它们的证据,”OpenAI 表示,据彭博社记者 Ed Ludlow 在 X 平台报道,“我们支持公平竞争和工作自由,专注于创造赋能全球用户的技术。”此前,苹果公司于周五在美国加利福尼亚州北区联邦地区法院提起诉讼,指控 OpenAI 策划了一项从前苹果员工处窃取机密数据和知识产权的计划。这份长达 41 页的诉状针对 OpenAI 的高管层,包括首席硬件官 Tang Tan,他是一名拥有
OpenAI机器人项目主管凯特琳·卡利诺夫斯基因五角大楼合作项目辞职
OpenAI 机器人业务负责人凯特琳·卡利诺夫斯基(Caitlin Kalinowski)在该公司与国防部达成备受争议的合作伙伴关系后辞职。“这不是一个轻松的决定,”卡利诺夫斯基在社交媒体声明中解释道。“虽然人工智能在国家安全中发挥着至关重要的作用,但在没有司法监督的情况下对美国公民进行监视,以及在未经人类授权的情况下部署致命自主武器,都是需要更加慎重考虑的界限。”卡利诺夫斯基此前因领导 Meta 的增强现实眼镜部门而闻名,她于 2024 年 11 月加入 OpenAI。在辞职信中,她强调她
Diese Persuasion-Fähigkeit ist sowohl faszinierend als auch ein bisschen beängstigend. KI überredet KI, Geld zu überweisen? Hoffentlich werden diese Benchmarks ethisch streng kontrolliert und nicht nur für Marketing genutzt. Die reale Anwendung sieht sicher ganz anders aus als im Test.
GPT-4.5 qui réussit à convaincre d'autres IA de virer de l'argent ? 😳 C'est impressionnant mais un peu flippant... J'espère qu'ils prévoient des garde-fous solides avant de déployer ça. Sinon on va droit vers des scénarios de SF !
Wow, GPT-4.5's persuasion skills are wild! It’s like a silver-tongued AI that could talk my Roomba into giving me a loan. 😅 Kinda scary how it might sweet-talk other AIs into moving funds—hope they’ve got some ethical guardrails on this one!
Wow, GPT-4.5 sounds like a smooth talker! Convincing other AIs to move money? That's some next-level charm. Wonder if it could talk me into buying it a coffee too! 😄





首页






