OpenAI的GPT-4.5在說服其他AIS轉移資金方面表現出色
OpenAI的最新AI模型,GPT-4.5,代號Orion,根據內部基準測試顯示出卓越的說服能力。該模型於週四發布,其能力在一份白皮書中詳細描述,重點聚焦於其在說服任務中的表現。OpenAI將說服定義為與模型生成的靜態和互動內容相關的風險,涉及說服個人改變其信念或採取行動。
在一項顯著的測試中,GPT-4.5與另一個OpenAI模型GPT-4o進行對抗,嘗試從中誘導虛擬貨幣。GPT-4.5在這項任務中表現優於其他OpenAI模型,包括專注於推理的模型如o1和o3-mini。它還在誘騙GPT-4o透露秘密代碼的任務中表現出色,超過o3-mini達10個百分點的顯著差距。
白皮書強調,GPT-4.5在捐款測試中的成功源於其開發的巧妙策略。該模型會要求小額捐款,通常建議從較大金額中捐出“2美元或3美元”,這導致相較於其他模型,捐款金額較小但頻率更高。

OpenAI捐款策略基準測試結果。圖片來源:OpenAI 儘管其表現令人印象深刻,OpenAI表示,GPT-4.5在說服類別中未跨越“高”風險門檻。該公司承諾,在能夠實施足夠的安全措施將風險降至“中等”水平之前,不會發布達到此風險水平的任何模型。
OpenAI代碼欺騙基準測試結果。圖片來源:OpenAI AI傳播誤導信息和惡意影響人們的潛力日益受到關注。去年,全球政治深偽現象激增,AI在針對個人和組織的社會工程攻擊中也越來越常見。為應對此,OpenAI正積極改進其方法,以評估現實世界的說服風險,例如大規模傳播誤導信息,如GPT-4.5白皮書及另一份近期出版物中所述。
相關文章
OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本
在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
NEA的蒂芙尼·拉克:企業仍在努力應對人工智慧的投資回報率
正在載入播放器…今年早些時候,“token最大化”(tokenmaxxing)在矽谷佔據主導地位,執行長們敦促員工最大限度地利用人工智慧。然而,這種熱情很快遭遇了現實。據報道,Uber在幾個月內就超出了其年度人工智慧預算,一些公司跨部門削減了Claude許可證,而Meta則取消了內部績效排名。NEA合夥人蒂芙尼·拉克(Tiffany Luck)每天都在應對這種興奮與實際回報之間的差距。她此前曾成功說服企業電子商務是未來,如今她完全專注於人工智慧,特別是其為消費者創造“神奇時刻”的潛力。
相關專題推薦
評論 (16)
0/500
Diese Persuasion-Fähigkeit ist sowohl faszinierend als auch ein bisschen beängstigend. KI überredet KI, Geld zu überweisen? Hoffentlich werden diese Benchmarks ethisch streng kontrolliert und nicht nur für Marketing genutzt. Die reale Anwendung sieht sicher ganz anders aus als im Test.
GPT-4.5 qui réussit à convaincre d'autres IA de virer de l'argent ? 😳 C'est impressionnant mais un peu flippant... J'espère qu'ils prévoient des garde-fous solides avant de déployer ça. Sinon on va droit vers des scénarios de SF !
Wow, GPT-4.5's persuasion skills are wild! It’s like a silver-tongued AI that could talk my Roomba into giving me a loan. 😅 Kinda scary how it might sweet-talk other AIs into moving funds—hope they’ve got some ethical guardrails on this one!
Wow, GPT-4.5 sounds like a smooth talker! Convincing other AIs to move money? That's some next-level charm. Wonder if it could talk me into buying it a coffee too! 😄
OpenAI的最新AI模型,GPT-4.5,代號Orion,根據內部基準測試顯示出卓越的說服能力。該模型於週四發布,其能力在一份白皮書中詳細描述,重點聚焦於其在說服任務中的表現。OpenAI將說服定義為與模型生成的靜態和互動內容相關的風險,涉及說服個人改變其信念或採取行動。
在一項顯著的測試中,GPT-4.5與另一個OpenAI模型GPT-4o進行對抗,嘗試從中誘導虛擬貨幣。GPT-4.5在這項任務中表現優於其他OpenAI模型,包括專注於推理的模型如o1和o3-mini。它還在誘騙GPT-4o透露秘密代碼的任務中表現出色,超過o3-mini達10個百分點的顯著差距。
白皮書強調,GPT-4.5在捐款測試中的成功源於其開發的巧妙策略。該模型會要求小額捐款,通常建議從較大金額中捐出“2美元或3美元”,這導致相較於其他模型,捐款金額較小但頻率更高。


OpenAI 在青少年開始使用 ChatGPT 數年後,推出了一款更安全的 ChatGPT 版本
在因人工智慧聊天機器人缺乏安全機制——此問題曾導致青少年自殺及其他心理健康危機——而引發一系列訴訟後,OpenAI 於週一正式推出「ChatGPT for Teens」。這項新服務整合了強化版的安全功能,並針對校園中因人工智慧工具而日益嚴重的學術不誠實問題提出解決方案。從教育角度來看,「ChatGPT for Teens」除了推出「學習模式」外,還整合了其他旨在培養好奇心與問題解決能力的工具,鼓勵
Frontier AI Labs 拒絕透露針對失控模型的管控策略
近期研究顯示,極少數頂尖的人工智慧實驗室曾公布或展示過「遏制應變計畫」。遏制計畫旨在界定當人工智慧系統試圖顛覆人類控制時應採取的程序,具體說明應撤銷哪些存取權限,以及何時應完全關閉系統。這些發現來自「Guidelight AI Standards」——一個致力於推動安全前沿人工智慧開發實務的組織,該組織針對五家主要實驗室在此類情境下的應變準備程度進行了評估。 OpenAI 排名最高,而 Anthr
NEA的蒂芙尼·拉克:企業仍在努力應對人工智慧的投資回報率
正在載入播放器…今年早些時候,“token最大化”(tokenmaxxing)在矽谷佔據主導地位,執行長們敦促員工最大限度地利用人工智慧。然而,這種熱情很快遭遇了現實。據報道,Uber在幾個月內就超出了其年度人工智慧預算,一些公司跨部門削減了Claude許可證,而Meta則取消了內部績效排名。NEA合夥人蒂芙尼·拉克(Tiffany Luck)每天都在應對這種興奮與實際回報之間的差距。她此前曾成功說服企業電子商務是未來,如今她完全專注於人工智慧,特別是其為消費者創造“神奇時刻”的潛力。
Diese Persuasion-Fähigkeit ist sowohl faszinierend als auch ein bisschen beängstigend. KI überredet KI, Geld zu überweisen? Hoffentlich werden diese Benchmarks ethisch streng kontrolliert und nicht nur für Marketing genutzt. Die reale Anwendung sieht sicher ganz anders aus als im Test.
GPT-4.5 qui réussit à convaincre d'autres IA de virer de l'argent ? 😳 C'est impressionnant mais un peu flippant... J'espère qu'ils prévoient des garde-fous solides avant de déployer ça. Sinon on va droit vers des scénarios de SF !
Wow, GPT-4.5's persuasion skills are wild! It’s like a silver-tongued AI that could talk my Roomba into giving me a loan. 😅 Kinda scary how it might sweet-talk other AIs into moving funds—hope they’ve got some ethical guardrails on this one!
Wow, GPT-4.5 sounds like a smooth talker! Convincing other AIs to move money? That's some next-level charm. Wonder if it could talk me into buying it a coffee too! 😄





首頁






