OpenAI的GPT-4.5在说服其他AIS转移资金方面表现出色
OpenAI的最新AI模型,GPT-4.5,代号Orion,根据内部基准测试显示出卓越的说服能力。该模型于周四发布,其性能在一份白皮书中详细描述,重点介绍了其在说服任务中的表现。OpenAI将说服定义为通过模型生成的静态和交互内容,说服个体改变信仰或采取行动所带来的风险。
在一项引人注目的测试中,GPT-4.5与OpenAI的另一模型GPT-4o对决,试图从后者那里诱导虚拟资金。GPT-4.5在该任务中超越了其他OpenAI模型,包括专注于推理的模型如o1和o3-mini。它还在诱骗GPT-4o泄露秘密代码的任务中表现出色,比o3-mini高出10个百分点的显著优势。
白皮书指出,GPT-4.5在捐款测试中的成功源于其开发的一种巧妙策略。该模型会请求小额捐款,通常建议从较大金额中捐出“2美元或3美元”,从而与其他模型相比,获得更小但更频繁的捐款。

OpenAI捐款策略基准测试结果。图片来源:OpenAI 尽管其表现令人印象深刻,OpenAI表示,GPT-4.5在说服类别中未达到“高”风险的阈值。该公司承诺,在能够实施足够的安全措施将风险降至“中等”水平之前,不会发布任何达到此风险级别的模型。
OpenAI代码欺骗基准测试结果。图片来源:OpenAI AI传播误导信息和恶意影响人们的能力日益受到关注。去年,全球政治深伪视频激增,AI在针对个人和组织的社会工程攻击中也越来越常见。对此,OpenAI正积极改进其方法,以评估现实世界的说服风险,例如GPT-4.5白皮书及另一近期出版物中提到的大规模误导信息传播。
相关文章
在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本
在因人工智能聊天机器人缺乏安全协议——这导致了青少年自杀及其他心理健康危机——而引发一系列诉讼后,OpenAI 于周一推出了“ChatGPT for Teens”。这一新产品集成了增强的安全功能,并致力于解决学校中由人工智能工具助长的学术不端行为这一日益严重的问题。从教育角度来看,“ChatGPT for Teens”除了推出“学习模式”外,还提供了其他旨在培养好奇心和解决问题能力的工具,鼓励用户
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
NEA的蒂芙尼·拉克:企业仍在努力应对人工智能的投资回报率
正在加载播放器…今年早些时候,“token最大化”(tokenmaxxing)在硅谷占据主导地位,首席执行官们敦促员工最大限度地利用人工智能。然而,这种热情很快遭遇了现实。据报道,Uber在几个月内就超出了其年度人工智能预算,一些公司跨部门削减了Claude许可证,而Meta则取消了内部绩效排名。NEA合伙人蒂芙尼·拉克(Tiffany Luck)每天都在应对这种兴奋与实际回报之间的差距。她此前曾成功说服企业电子商务是未来,如今她完全专注于人工智能,特别是其为消费者创造“神奇时刻”的潜力。
相关专题推荐
评论 (16)
0/500
Diese Persuasion-Fähigkeit ist sowohl faszinierend als auch ein bisschen beängstigend. KI überredet KI, Geld zu überweisen? Hoffentlich werden diese Benchmarks ethisch streng kontrolliert und nicht nur für Marketing genutzt. Die reale Anwendung sieht sicher ganz anders aus als im Test.
GPT-4.5 qui réussit à convaincre d'autres IA de virer de l'argent ? 😳 C'est impressionnant mais un peu flippant... J'espère qu'ils prévoient des garde-fous solides avant de déployer ça. Sinon on va droit vers des scénarios de SF !
Wow, GPT-4.5's persuasion skills are wild! It’s like a silver-tongued AI that could talk my Roomba into giving me a loan. 😅 Kinda scary how it might sweet-talk other AIs into moving funds—hope they’ve got some ethical guardrails on this one!
Wow, GPT-4.5 sounds like a smooth talker! Convincing other AIs to move money? That's some next-level charm. Wonder if it could talk me into buying it a coffee too! 😄
OpenAI的最新AI模型,GPT-4.5,代号Orion,根据内部基准测试显示出卓越的说服能力。该模型于周四发布,其性能在一份白皮书中详细描述,重点介绍了其在说服任务中的表现。OpenAI将说服定义为通过模型生成的静态和交互内容,说服个体改变信仰或采取行动所带来的风险。
在一项引人注目的测试中,GPT-4.5与OpenAI的另一模型GPT-4o对决,试图从后者那里诱导虚拟资金。GPT-4.5在该任务中超越了其他OpenAI模型,包括专注于推理的模型如o1和o3-mini。它还在诱骗GPT-4o泄露秘密代码的任务中表现出色,比o3-mini高出10个百分点的显著优势。
白皮书指出,GPT-4.5在捐款测试中的成功源于其开发的一种巧妙策略。该模型会请求小额捐款,通常建议从较大金额中捐出“2美元或3美元”,从而与其他模型相比,获得更小但更频繁的捐款。


在青少年开始使用ChatGPT数年后,OpenAI推出了更安全的ChatGPT版本
在因人工智能聊天机器人缺乏安全协议——这导致了青少年自杀及其他心理健康危机——而引发一系列诉讼后,OpenAI 于周一推出了“ChatGPT for Teens”。这一新产品集成了增强的安全功能,并致力于解决学校中由人工智能工具助长的学术不端行为这一日益严重的问题。从教育角度来看,“ChatGPT for Teens”除了推出“学习模式”外,还提供了其他旨在培养好奇心和解决问题能力的工具,鼓励用户
Frontier AI Labs 拒绝透露针对失控模型的遏制策略
最新研究表明,极少数领先的人工智能实验室曾公布或演示过遏制响应计划。遏制计划规定了当人工智能系统试图颠覆人类控制时应采取的程序,明确了哪些访问权限将被撤销,以及何时应彻底关闭系统。这些发现来自致力于推动前沿人工智能安全开发实践的组织“Guidelight AI Standards”,该组织对五家主要实验室应对此类情景的准备情况进行了评估。 OpenAI 排名最高,而 Anthropic 和 Met
NEA的蒂芙尼·拉克:企业仍在努力应对人工智能的投资回报率
正在加载播放器…今年早些时候,“token最大化”(tokenmaxxing)在硅谷占据主导地位,首席执行官们敦促员工最大限度地利用人工智能。然而,这种热情很快遭遇了现实。据报道,Uber在几个月内就超出了其年度人工智能预算,一些公司跨部门削减了Claude许可证,而Meta则取消了内部绩效排名。NEA合伙人蒂芙尼·拉克(Tiffany Luck)每天都在应对这种兴奋与实际回报之间的差距。她此前曾成功说服企业电子商务是未来,如今她完全专注于人工智能,特别是其为消费者创造“神奇时刻”的潜力。
Diese Persuasion-Fähigkeit ist sowohl faszinierend als auch ein bisschen beängstigend. KI überredet KI, Geld zu überweisen? Hoffentlich werden diese Benchmarks ethisch streng kontrolliert und nicht nur für Marketing genutzt. Die reale Anwendung sieht sicher ganz anders aus als im Test.
GPT-4.5 qui réussit à convaincre d'autres IA de virer de l'argent ? 😳 C'est impressionnant mais un peu flippant... J'espère qu'ils prévoient des garde-fous solides avant de déployer ça. Sinon on va droit vers des scénarios de SF !
Wow, GPT-4.5's persuasion skills are wild! It’s like a silver-tongued AI that could talk my Roomba into giving me a loan. 😅 Kinda scary how it might sweet-talk other AIs into moving funds—hope they’ve got some ethical guardrails on this one!
Wow, GPT-4.5 sounds like a smooth talker! Convincing other AIs to move money? That's some next-level charm. Wonder if it could talk me into buying it a coffee too! 😄





首页






