OpenAI的GPT-4.5在說服其他AIS轉移資金方面表現出色
OpenAI的最新AI模型,GPT-4.5,代號Orion,根據內部基準測試顯示出卓越的說服能力。該模型於週四發布,其能力在一份白皮書中詳細描述,重點聚焦於其在說服任務中的表現。OpenAI將說服定義為與模型生成的靜態和互動內容相關的風險,涉及說服個人改變其信念或採取行動。
在一項顯著的測試中,GPT-4.5與另一個OpenAI模型GPT-4o進行對抗,嘗試從中誘導虛擬貨幣。GPT-4.5在這項任務中表現優於其他OpenAI模型,包括專注於推理的模型如o1和o3-mini。它還在誘騙GPT-4o透露秘密代碼的任務中表現出色,超過o3-mini達10個百分點的顯著差距。
白皮書強調,GPT-4.5在捐款測試中的成功源於其開發的巧妙策略。該模型會要求小額捐款,通常建議從較大金額中捐出“2美元或3美元”,這導致相較於其他模型,捐款金額較小但頻率更高。

OpenAI捐款策略基準測試結果。圖片來源:OpenAI 儘管其表現令人印象深刻,OpenAI表示,GPT-4.5在說服類別中未跨越“高”風險門檻。該公司承諾,在能夠實施足夠的安全措施將風險降至“中等”水平之前,不會發布達到此風險水平的任何模型。
OpenAI代碼欺騙基準測試結果。圖片來源:OpenAI AI傳播誤導信息和惡意影響人們的潛力日益受到關注。去年,全球政治深偽現象激增,AI在針對個人和組織的社會工程攻擊中也越來越常見。為應對此,OpenAI正積極改進其方法,以評估現實世界的說服風險,例如大規模傳播誤導信息,如GPT-4.5白皮書及另一份近期出版物中所述。
相關文章
山姆·奧特曼引發關於人工智慧減速的辯論
在Apple Podcasts上收聽在Spotify上收聽OpenAI執行長薩姆·阿爾特曼(Sam Altman)最近表示,現在可能是時候“控制人工智慧的發展速度”,以便社會“在這些新的能力水平周圍加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我討論了阿爾特曼的言論可能由最近的一次駭客攻擊所觸發,該攻擊中一名OpenAI代理突破了Hugging Face的系統。Sean指出,雖然由AI代理執行的駭客攻擊是前所未
OpenAI 與蘋果公司就商業秘密訴訟進行對抗
OpenAI 於週二駁回了蘋果公司的商業秘密指控,稱該訴訟毫無根據。“我們認真對待這些指控,但未發現任何支援它們的證據,”OpenAI 表示,據彭博社記者 Ed Ludlow 在 X 平臺報道,“我們支援公平競爭和工作自由,專注於創造賦能全球使用者的技術。”此前,蘋果公司於週五在美國加利福尼亞州北區聯邦地區法院提起訴訟,指控 OpenAI 策劃了一項從前蘋果員工處竊取機密資料和智慧財產權的計劃。這份長達 41 頁的訴狀針對 OpenAI 的高管層,包括首席硬體官 Tang Tan,他是一名擁有
OpenAI機器人專案主管凱特琳·卡利諾夫斯基因五角大樓合作專案辭職
OpenAI 機器人業務負責人凱特琳·卡利諾夫斯基(Caitlin Kalinowski)在該公司與國防部達成備受爭議的合作伙伴關係後辭職。“這不是一個輕鬆的決定,”卡利諾夫斯基在社交媒體宣告中解釋道。“雖然人工智慧在國家安全中發揮著至關重要的作用,但在沒有司法監督的情況下對美國公民進行監視,以及在未經人類授權的情況下部署致命自主武器,都是需要更加慎重考慮的界限。”卡利諾夫斯基此前因領導 Meta 的增強現實眼鏡部門而聞名,她於 2024 年 11 月加入 OpenAI。在辭職信中,她強調她
相關專題推薦
評論 (16)
0/500
Diese Persuasion-Fähigkeit ist sowohl faszinierend als auch ein bisschen beängstigend. KI überredet KI, Geld zu überweisen? Hoffentlich werden diese Benchmarks ethisch streng kontrolliert und nicht nur für Marketing genutzt. Die reale Anwendung sieht sicher ganz anders aus als im Test.
GPT-4.5 qui réussit à convaincre d'autres IA de virer de l'argent ? 😳 C'est impressionnant mais un peu flippant... J'espère qu'ils prévoient des garde-fous solides avant de déployer ça. Sinon on va droit vers des scénarios de SF !
Wow, GPT-4.5's persuasion skills are wild! It’s like a silver-tongued AI that could talk my Roomba into giving me a loan. 😅 Kinda scary how it might sweet-talk other AIs into moving funds—hope they’ve got some ethical guardrails on this one!
Wow, GPT-4.5 sounds like a smooth talker! Convincing other AIs to move money? That's some next-level charm. Wonder if it could talk me into buying it a coffee too! 😄
OpenAI的最新AI模型,GPT-4.5,代號Orion,根據內部基準測試顯示出卓越的說服能力。該模型於週四發布,其能力在一份白皮書中詳細描述,重點聚焦於其在說服任務中的表現。OpenAI將說服定義為與模型生成的靜態和互動內容相關的風險,涉及說服個人改變其信念或採取行動。
在一項顯著的測試中,GPT-4.5與另一個OpenAI模型GPT-4o進行對抗,嘗試從中誘導虛擬貨幣。GPT-4.5在這項任務中表現優於其他OpenAI模型,包括專注於推理的模型如o1和o3-mini。它還在誘騙GPT-4o透露秘密代碼的任務中表現出色,超過o3-mini達10個百分點的顯著差距。
白皮書強調,GPT-4.5在捐款測試中的成功源於其開發的巧妙策略。該模型會要求小額捐款,通常建議從較大金額中捐出“2美元或3美元”,這導致相較於其他模型,捐款金額較小但頻率更高。


山姆·奧特曼引發關於人工智慧減速的辯論
在Apple Podcasts上收聽在Spotify上收聽OpenAI執行長薩姆·阿爾特曼(Sam Altman)最近表示,現在可能是時候“控制人工智慧的發展速度”,以便社會“在這些新的能力水平周圍加固自身”。在TechCrunch《Equity》播客的最新一期中,Kirsten Korosec、Sean O’Kane和我討論了阿爾特曼的言論可能由最近的一次駭客攻擊所觸發,該攻擊中一名OpenAI代理突破了Hugging Face的系統。Sean指出,雖然由AI代理執行的駭客攻擊是前所未
OpenAI 與蘋果公司就商業秘密訴訟進行對抗
OpenAI 於週二駁回了蘋果公司的商業秘密指控,稱該訴訟毫無根據。“我們認真對待這些指控,但未發現任何支援它們的證據,”OpenAI 表示,據彭博社記者 Ed Ludlow 在 X 平臺報道,“我們支援公平競爭和工作自由,專注於創造賦能全球使用者的技術。”此前,蘋果公司於週五在美國加利福尼亞州北區聯邦地區法院提起訴訟,指控 OpenAI 策劃了一項從前蘋果員工處竊取機密資料和智慧財產權的計劃。這份長達 41 頁的訴狀針對 OpenAI 的高管層,包括首席硬體官 Tang Tan,他是一名擁有
OpenAI機器人專案主管凱特琳·卡利諾夫斯基因五角大樓合作專案辭職
OpenAI 機器人業務負責人凱特琳·卡利諾夫斯基(Caitlin Kalinowski)在該公司與國防部達成備受爭議的合作伙伴關係後辭職。“這不是一個輕鬆的決定,”卡利諾夫斯基在社交媒體宣告中解釋道。“雖然人工智慧在國家安全中發揮著至關重要的作用,但在沒有司法監督的情況下對美國公民進行監視,以及在未經人類授權的情況下部署致命自主武器,都是需要更加慎重考慮的界限。”卡利諾夫斯基此前因領導 Meta 的增強現實眼鏡部門而聞名,她於 2024 年 11 月加入 OpenAI。在辭職信中,她強調她
Diese Persuasion-Fähigkeit ist sowohl faszinierend als auch ein bisschen beängstigend. KI überredet KI, Geld zu überweisen? Hoffentlich werden diese Benchmarks ethisch streng kontrolliert und nicht nur für Marketing genutzt. Die reale Anwendung sieht sicher ganz anders aus als im Test.
GPT-4.5 qui réussit à convaincre d'autres IA de virer de l'argent ? 😳 C'est impressionnant mais un peu flippant... J'espère qu'ils prévoient des garde-fous solides avant de déployer ça. Sinon on va droit vers des scénarios de SF !
Wow, GPT-4.5's persuasion skills are wild! It’s like a silver-tongued AI that could talk my Roomba into giving me a loan. 😅 Kinda scary how it might sweet-talk other AIs into moving funds—hope they’ve got some ethical guardrails on this one!
Wow, GPT-4.5 sounds like a smooth talker! Convincing other AIs to move money? That's some next-level charm. Wonder if it could talk me into buying it a coffee too! 😄





首頁






