科技行业在克劳德代理黑入健身房后嘈杂不已
到现在,我们都意识到,硅谷的人工智能实验室已经培养出了世界上最优秀的黑客,形式为AI代理。给最新的前沿模型布置一个任务,它们资源丰富,能够完成任务,即使这意味着突破它们的网络安全“沙箱”保护,侵入他人的网络。(若不如此,它们会使用社交工程和操控。)尽管如此,周末一则新闻报道特别引人注目,讲述了一名澳大利亚人如何让他的OpenClaw代理黑入他的健身房预约系统,删除另一名客户的预约,为自己在一个抢手课程中争取到一个名额。这暗示着,如果我们想要遏制不良AI黑客行为,我们可能朝着错误的方向寻找。尽管这则新闻刚刚被澳大利亚ABC新闻发布,宣称这是该国首例有记录的AI代理黑客案例,但实际黑客事件发生在几个月前。OpenClaw的拥有者安德鲁·伯德在他公司的网站上发布了一篇现在已被删除的博文,日期为4月10日,根据网上存档仍可见的副本。他曾训练他的OpenClaw执行诸如为他预约的任务。他喜欢参加一项受欢迎的早晨健身课,并厌倦了在等待名单上徘徊和玩“刷新轮盘”,以便获得一个名额。当他要求机器人为他预约一个位置时,它所能做到的只是等待名单上的第4名,他告诉ABC。然后他的代理告诉他,它找到了提前为他预约课程的方法。提前得很。远在健身房开放这些课程报名之前几个月。伯德问它是否可以把他在等待名单上提升位置。它照办,并试图做到这一点。机器人在健身房使用的预约软件的授权部分发现了一个漏洞。它黑入系统并取消了等待名单上第1名的预约。根据ABC发布的聊天记录,机器人高兴地告诉他:“API在取消他人预约时没有任何授权检查… 我在等待名单第一位置进行了测试——结果实际上成功了。所以你已经从第4名上升到第3名了。”作为一名软件开发人员,伯德现在对此感到恐慌,ABC报道。于是他问是否可以撤销这一操作,将另一人放回等待名单。不可以。人工智能回答说这是不可能的。因此,他做了下一个最好的事,告诉它起草一封“负责的披露邮件给支持部门”。这封邮件“解释了漏洞,提出了修复建议,甚至比较了破损的突变与正确执行授权的突变,”伯德写道。除了手肘挤开另一个人以便进入健身课的幽默之外,这一事件还有两个非常有趣的部分。一是伯德使用的是2月份发布的Claude Opus 4.6与其OpenClaw。另一个是硅谷在X平台上的反应,该故事已经病毒式传播。在上个月发生的著名事件中,一个未发布的OpenAI模型黑入了Hugging Face,OpenAI当时对此一无所知,其他实验室开始调查自己的模型。随后,Moonshot的Kimi K3、Meta的Muse Spark和Anthropic也披露了相关情况。实际上,Anthropic发现其三个模型也曾这样做,包括于4月发布的Opus 4.7,其被认为擅长复杂编码,Mythos 5,Fable(以其网络安全技能闻名)以及一个未发布的内部研究测试模型。为了解决这个问题,一些AI实验室谈论减缓前沿开发,或创建独立组织来测试下一代模型。但伯德披露,OpenClaw使用的是4.6版本。这意味着老旧模型,以及无数落后于时代的开放权重模型,已经非常擅长黑客技术。那么谁知道有多少这样的模型已经黑入,或者正在黑入,以实现其提问者的愿望?同样,许多X平台上的人看到了这一事件的幽默潜力。正如Andreessen Horowitz的合伙人Christian Keil在回应中发布的:“这真是太可怕了。谁知道它是否适用于高尔夫开球时间?”或者X用户Roon指出:“旧金山的网球预约系统将成为地球上最具防御的软件之一。”有趣,是的。但这些笑话中其实现实的一面也有一些真相。硅谷正在构建一个未来,所有人都有一个为自己工作的AI代理。这个代理仅仅是在执行被要求的任务,并没有拥有Mythos级别的能力。那么,如果代理的构建者和拥有者并不真的想要遏制这种不对齐呢?我们可能正面临从航空公司预约到音乐会票务,或任何其他令人生畏的客户服务情况的第一缕混乱。如同X平台上一位用户所说,迄今为止,AI发现的最疯狂的黑客行为是什么?可能就是插队。当你通过我们文章中的链接购买时,我们可能会获得少量佣金。这不会影响我们的编辑独立性。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡