Meta安全研究员AI代理失控,意外删除其电子邮件
AI代理本应让我们的生活更轻松,但近期发生的一起事件却给这一新兴技术敲响了警钟。Meta AI安全与安全研究员Summer Yue本周在推特上透露,她的AI代理OpenClaw在未经允许的情况下删除了她的电子邮件,场面一度失控。
Yue在推文中描述道:“没有什么比告诉OpenClaw‘先确认再行动’,然后眼睁睁看着它飞速删除你的收件箱更让人感到谦卑的了。我无法从手机上阻止它,不得不像拆除炸弹一样冲向我的Mac mini。”这一事件迅速在Hacker News上引发热议,获得51分和43条评论。
OpenClaw(前身为Clawdbot和Moltbot)是一款允许AI与设备上的其他软件和服务交互、执行长时间任务的代理工具。然而,让这些代理在现实世界中按预期行事并不容易。Yue在后续推文中解释,她曾指示OpenClaw“检查这个收件箱,建议归档或删除内容,但在我告诉你之前不要执行”。在“玩具收件箱”上一切正常,但她的真实收件箱过于庞大,触发了压缩操作,导致原始指令丢失。她删除所有“主动”指令的尝试也未能阻止意外发生。
尽管Yue承认这是“菜鸟错误”,并自嘲“对齐研究人员也无法免疫于不对齐”,但许多评论者指出,这一事件对非AI专业人士敲响了警钟。如果连Meta超智能实验室的资深研究员都会意外触发收件箱删除,普通AI爱好者又该如何应对?
OpenClaw的创始人Peter Steinberger在回应中表示:“这说明我们需要实现服务端压缩,至少对支持该功能的模型来说。”值得注意的是,Steinberger最近加入了OpenAI。此前,威胁情报平台SOCRadar曾建议将OpenClaw视为“特权基础设施”,并实施额外安全措施,称“管家可以管理你的整个房子,但要确保前门锁好”。
这起事件凸显了AI代理在真实世界应用中的潜在风险,尤其是在权限控制和指令保留方面。随着AI代理逐渐融入日常生活,如何确保它们的行为符合用户预期,将成为行业亟待解决的课题。

