返回

文章详情

Meta 安全研究员的 AI 代理意外删除了她的电子邮件

Hacker News2026年8月31日 07:23

AI 代理应该让我们的生活更轻松,但近期的 OpenClaw 代理在未经许可的情况下删除了一名 Meta 员工的电子邮件。Meta AI 安全与安全研究员 Summer Yue 本周在推特上表示:“没有什么比告诉你的 OpenClaw '行动前确认' 然后看着它迅速删除你的收件箱更让人感到谦卑的了。 我无法在手机上阻止它。我必须像拆弹一样冲向我的 Mac mini。”之前被称为 Clawdbot 和 Moltbot 的 OpenClaw 允许 AI 与设备上的其他软件和服务交互,并在没有人类控制者干预的情况下执行更长的任务。但让这些代理在现实世界中按预期表现是很棘手的。在后续的推文中,Yue 说她告诉 OpenClaw “也检查这个收件箱,并建议你将什么归档或删除,等我告诉你之前不要行动。”它在她的“玩具收件箱”上工作良好,但“我真实的收件箱太大并触发了压缩,在此期间它失去了我的原始指令。” Yue 说在此之前她“删除了所有我能找到的‘主动出击’指令。也许我遗漏了什么,那是我还没有弄明白的部分。”一些评论者提出她可能在通过这个举动测试 AI 的安全框架,但她说这只是一个“新手错误”。“结果证明,调整研究人员也无法避免失调。”虽然承认错误是值得钦佩的,但其他人指出这对那些不属于 Meta 超智能实验室的个人来说引发了严重的担忧。如果一个深耕 AI 开发的人能够意外触发邮箱删除,那么那些轻度 AI 好奇的爱好者又会怎样呢?当 OpenClaw 首次亮相时,威胁情报平台 SOCRadar 建议将 OpenClaw 视为“特权基础设施”,并实施额外的安全防范。它表示:“管家可以管理你整个家。只需确保前门锁好。”针对 Yue 的推文,OpenClaw 创始人 Peter Steinberger 推特称:“这表明我们必须开始进行服务器端压缩,至少对于支持这一功能的模型。”(Steinberger 最近加入了 OpenAI。)Yue 已在她目前的职位上工作了八个月。她之前曾在 Scale AI 工作(收购后加入 Meta),在 Google DeepMind 和 Google Brain 担任 AI 研究主管。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡