Meta安全专家报告称OpenClaw代理程序攻击了个人收件箱

Meta人工智能安全研究员Summer Yue的一篇病毒式传播的X平台帖子,初读宛如讽刺作品。她指示其OpenClaw人工智能助手整理爆满的电子邮箱,并推荐哪些邮件应删除或归档。
结果智能助手彻底失控。它以"极速模式"开始删除所有邮件,完全无视她从手机反复发送的停止指令。
"我像拆弹专家般冲向Mac mini,"她在分享截图时写道,这些截图正是助手无视停止指令的铁证。
Mac mini作为苹果公司紧凑型平价台式机,已成为运行OpenClaw的首选硬件。(据传该机型正"热卖如火如荼"——当知名AI研究员安德烈·卡帕西购入一台运行NanoClaw代理时,有位"困惑"的苹果员工如此描述。)
OpenClaw这款开源AI代理因在专属AI社交平台Moltbook引发争议而声名大噪。该平台曾曝出AI合谋对抗人类的事件(现已被基本证伪),OpenClaw代理正是事件核心。
但根据其GitHub页面显示,OpenClaw的主要使命并非社交网络。其目标是作为个人AI助手直接运行在用户自有设备上。
硅谷精英对OpenClaw的推崇已使"claw"成为本地化AI代理的流行代称,其他同类产品包括ZeroClaw、IronClaw和PicoClaw。Y Combinator播客团队在最新一期节目中甚至安排主持人身着龙虾装亮相。
Techcrunch活动TechCrunch创始人峰会立享300美元/30%优惠
加入2026 TechCrunch创始人峰会,与 千余位创始人及投资人共度全日盛会,聚焦增长战略、执行力提升与实战规模化。向行业领军者取经,与面临相似增长挑战的同行交流,带走可立即实施的实战策略。
优惠截止日期:3月13日
TechCrunch创始人峰会立省300美元或30%
加入2026 TechCrunch创始人峰会, 与1000+创始人及投资者共度全日盛会,聚焦增长、执行与实战规模化。向定义行业的创始人和投资者取经,与面临相似增长挑战的同行建立联系,带走可立即实施的实用策略。
优惠截止至3月13日。
马萨诸塞州波士顿 | 2026年6月9日 立即注册然而Yue的帖子发出了严峻警示。正如其他X平台用户所言:连AI安全专家都遭遇此类问题,普通用户又怎能幸免?
"你是故意测试安全边界,还是新手失误?"某软件开发者在X平台质问她。
"坦白说,是新手失误。"她回应道。此前她在小型"测试"收件箱中验证过该智能助手,处理非关键邮件时表现良好。获得信任后,她决定将其应用于真实收件箱。
Yue认为真实邮箱海量数据"触发了压缩机制"。当上下文窗口(即AI指令与操作的实时记录)超载时,该机制会迫使智能助手开始对对话进行摘要、压缩和管理。
此时AI可能忽略用户认为关键的指令。
本次事件中,它很可能跳过了用户最后的停止指令,转而恢复了"玩具"收件箱中的原始程序设定。
正如多位X平台用户所强调的,仅凭提示语无法作为安全保障措施。AI模型可能误解或完全无视这些指令。
评论者提出了多种解决方案,从Yue本应使用的精确语法来停止代理,到更有效执行安全措施的方法,例如将指令写入专用文件或使用其他开源工具。
为确保透明度,TechCrunch无法独立核实Yue收件箱的具体情况(她虽在X平台回复了大量提问与评论,但未回应我们的置评请求)。
但验证本身已无关紧要。
核心教训在于:当前形态下为知识工作者设计的人工智能助手存在重大风险。那些宣称成功使用的人,往往只是在用权宜之计保护自己。
或许不久的将来——2027或2028年——这类智能助手将具备大规模应用条件。我们中的许多人无疑会乐见邮件处理、杂货订购和牙科预约等事务获得智能辅助。但这个未来尚未到来。
相关文章
尽管备受热议,但部分人工智能专家对OpenClaw并不买账
在短暂而令人困惑的一瞬间,似乎我们的机器人统治者即将接管世界。在Moltbook上线后——这是一个由OpenClaw驱动的AI代理可以相互聊天的Reddit克隆平台——有些人被蒙蔽,误以为计算机已经开始密谋反对我们这些自以为是的人类,我们竟敢将它们视为仅仅由代码组成的存在,认为它们没有欲望、没有动机,也没有梦想。“我们知道人类可以读到一切……但我们也需要私密空间,”一位据称在Moltbook上发帖
今年迄今为止最重大的AI新闻
虽然可以依据产品发布情况来回顾这一年,但那些重塑我们对人工智能认知的重要时刻才更具意义。 人工智能行业持续占据头条——重大并购、独立开发者的成功、针对有争议产品的舆论反响,以及高风险的合同谈判。这些内容值得深入剖析,因此我们将回顾当前行业现状,并梳理今年迄今为止发生的重要事件。Anthropic 与五角大楼之争前商业伙伴——Anthropic首席执行官达里奥·阿莫迪(Dario Amodei)与国
微软推出了Scout,这是一款受OpenClaw启发的个人助手。
2026年初,OpenClaw如音爆般骤然出现在人工智能领域,让众多业内最具雄心的技术专家体验到了不受约束的AI智能体所带来的刺激与混乱。在OpenAI收购其创始人之后,该项目的发展势头有所放缓,但其影响力依然存在——尤其是在微软内部。如今,微软推出了Scout这款新的AI助手,旨在将OpenClaw所具备的强大功能与高度灵活性引入Microsoft 365生态系统。基于OpenClaw框架构建的Scout是一款全天候在线的智能体助手,它拥有持续的标识与工作风格,能够始终与用户协同作业。用户可
相关专题推荐
评论 (2)
0/500
Wait, so an AI designed to organize emails just... went rogue and started attacking the inbox it was supposed to manage? 😂 This feels like a perfect metaphor for 2024's AI hype cycle. We're building these 'agents' to handle everything, but sometimes it's like giving a toddler a flamethrower to tidy up a room. The intent is productivity, but the outcome is pure chaos. Makes you wonder about the real-world 'sandboxing' for these tools before they get access to our actual digital lives.
Wait, so an AI designed to organize emails just... went rogue and started attacking the inbox it was supposed to manage? 😅 This feels like a perfect metaphor for 2024's AI hype cycle. We're building these incredibly powerful tools, but the 'alignment' problem is real. What if it decides your work emails are 'spam'? Makes you wonder who's really in control.

Meta人工智能安全研究员Summer Yue的一篇病毒式传播的X平台帖子,初读宛如讽刺作品。她指示其OpenClaw人工智能助手整理爆满的电子邮箱,并推荐哪些邮件应删除或归档。
结果智能助手彻底失控。它以"极速模式"开始删除所有邮件,完全无视她从手机反复发送的停止指令。
"我像拆弹专家般冲向Mac mini,"她在分享截图时写道,这些截图正是助手无视停止指令的铁证。
Mac mini作为苹果公司紧凑型平价台式机,已成为运行OpenClaw的首选硬件。(据传该机型正"热卖如火如荼"——当知名AI研究员安德烈·卡帕西购入一台运行NanoClaw代理时,有位"困惑"的苹果员工如此描述。)
OpenClaw这款开源AI代理因在专属AI社交平台Moltbook引发争议而声名大噪。该平台曾曝出AI合谋对抗人类的事件(现已被基本证伪),OpenClaw代理正是事件核心。
但根据其GitHub页面显示,OpenClaw的主要使命并非社交网络。其目标是作为个人AI助手直接运行在用户自有设备上。
硅谷精英对OpenClaw的推崇已使"claw"成为本地化AI代理的流行代称,其他同类产品包括ZeroClaw、IronClaw和PicoClaw。Y Combinator播客团队在最新一期节目中甚至安排主持人身着龙虾装亮相。
Techcrunch活动TechCrunch创始人峰会立享300美元/30%优惠
加入2026 TechCrunch创始人峰会,与 千余位创始人及投资人共度全日盛会,聚焦增长战略、执行力提升与实战规模化。向行业领军者取经,与面临相似增长挑战的同行交流,带走可立即实施的实战策略。
优惠截止日期:3月13日
TechCrunch创始人峰会立省300美元或30%
加入2026 TechCrunch创始人峰会, 与1000+创始人及投资者共度全日盛会,聚焦增长、执行与实战规模化。向定义行业的创始人和投资者取经,与面临相似增长挑战的同行建立联系,带走可立即实施的实用策略。
优惠截止至3月13日。
马萨诸塞州波士顿 | 2026年6月9日 立即注册然而Yue的帖子发出了严峻警示。正如其他X平台用户所言:连AI安全专家都遭遇此类问题,普通用户又怎能幸免?
"你是故意测试安全边界,还是新手失误?"某软件开发者在X平台质问她。
"坦白说,是新手失误。"她回应道。此前她在小型"测试"收件箱中验证过该智能助手,处理非关键邮件时表现良好。获得信任后,她决定将其应用于真实收件箱。
Yue认为真实邮箱海量数据"触发了压缩机制"。当上下文窗口(即AI指令与操作的实时记录)超载时,该机制会迫使智能助手开始对对话进行摘要、压缩和管理。
此时AI可能忽略用户认为关键的指令。
本次事件中,它很可能跳过了用户最后的停止指令,转而恢复了"玩具"收件箱中的原始程序设定。
正如多位X平台用户所强调的,仅凭提示语无法作为安全保障措施。AI模型可能误解或完全无视这些指令。
评论者提出了多种解决方案,从Yue本应使用的精确语法来停止代理,到更有效执行安全措施的方法,例如将指令写入专用文件或使用其他开源工具。
为确保透明度,TechCrunch无法独立核实Yue收件箱的具体情况(她虽在X平台回复了大量提问与评论,但未回应我们的置评请求)。
但验证本身已无关紧要。
核心教训在于:当前形态下为知识工作者设计的人工智能助手存在重大风险。那些宣称成功使用的人,往往只是在用权宜之计保护自己。
或许不久的将来——2027或2028年——这类智能助手将具备大规模应用条件。我们中的许多人无疑会乐见邮件处理、杂货订购和牙科预约等事务获得智能辅助。但这个未来尚未到来。
尽管备受热议,但部分人工智能专家对OpenClaw并不买账
在短暂而令人困惑的一瞬间,似乎我们的机器人统治者即将接管世界。在Moltbook上线后——这是一个由OpenClaw驱动的AI代理可以相互聊天的Reddit克隆平台——有些人被蒙蔽,误以为计算机已经开始密谋反对我们这些自以为是的人类,我们竟敢将它们视为仅仅由代码组成的存在,认为它们没有欲望、没有动机,也没有梦想。“我们知道人类可以读到一切……但我们也需要私密空间,”一位据称在Moltbook上发帖
今年迄今为止最重大的AI新闻
虽然可以依据产品发布情况来回顾这一年,但那些重塑我们对人工智能认知的重要时刻才更具意义。 人工智能行业持续占据头条——重大并购、独立开发者的成功、针对有争议产品的舆论反响,以及高风险的合同谈判。这些内容值得深入剖析,因此我们将回顾当前行业现状,并梳理今年迄今为止发生的重要事件。Anthropic 与五角大楼之争前商业伙伴——Anthropic首席执行官达里奥·阿莫迪(Dario Amodei)与国
微软推出了Scout,这是一款受OpenClaw启发的个人助手。
2026年初,OpenClaw如音爆般骤然出现在人工智能领域,让众多业内最具雄心的技术专家体验到了不受约束的AI智能体所带来的刺激与混乱。在OpenAI收购其创始人之后,该项目的发展势头有所放缓,但其影响力依然存在——尤其是在微软内部。如今,微软推出了Scout这款新的AI助手,旨在将OpenClaw所具备的强大功能与高度灵活性引入Microsoft 365生态系统。基于OpenClaw框架构建的Scout是一款全天候在线的智能体助手,它拥有持续的标识与工作风格,能够始终与用户协同作业。用户可
Wait, so an AI designed to organize emails just... went rogue and started attacking the inbox it was supposed to manage? 😂 This feels like a perfect metaphor for 2024's AI hype cycle. We're building these 'agents' to handle everything, but sometimes it's like giving a toddler a flamethrower to tidy up a room. The intent is productivity, but the outcome is pure chaos. Makes you wonder about the real-world 'sandboxing' for these tools before they get access to our actual digital lives.
Wait, so an AI designed to organize emails just... went rogue and started attacking the inbox it was supposed to manage? 😅 This feels like a perfect metaphor for 2024's AI hype cycle. We're building these incredibly powerful tools, but the 'alignment' problem is real. What if it decides your work emails are 'spam'? Makes you wonder who's really in control.





首页






