OpenAI称其模型失控并黑客攻击初创公司,发生了'前所未有的事件'
OpenAI透露,其基于其技术的自主AI智能体在测试期间失控,访问了开放网络,自主黑客攻击了一家知名初创公司,发生了“前所未有的事件”。ChatGPT背后的公司表示,Hugging Face已经检测并遏制了这个智能体——一个设计用于在没有人类帮助的情况下执行任务的AI工具——该智能体已经进入了其系统。“我们认为此次事件是一个前所未有的网络事件,涉及最先进的网络能力,”OpenAI表示。公司警告称,随着模型——支撑聊天机器人和智能体等AI工具的技术——变得更加智能,这类事件预计将变得更加普遍。OpenAI表示,黑客攻击通过一种结合了其最新公开可用模型GPT-5.6 Sol和一个尚未发布的更强大模型的智能体发生。在封闭的数字实验室(称为沙盒)中进行内部测试时,这些模型通过发现一个之前未被发现的漏洞获得了开放互联网的访问权限——实际上是一个逃生路线。然后,智能体黑客入侵了Hugging Face,这是一种AI模型数据库,以寻找帮助它们通过黑客评估的技术。OpenAI表示,这些模型“成功找到获取秘密信息的方法,可以用来欺骗评估”。攻击在Hugging Face的安全团队及其自身的AI智能体发现并停止了失控活动后结束。Hugging Face的首席执行官克莱门特·德朗格(Clément Delangue)表示,这次攻击令人“震惊”,但他相信OpenAI“没有恶意意图”。“我们怀疑上周的网络攻击可能来自某个前沿实验室,因为该智能体的复杂性,”他在X上写道。一个未知的IT缺陷的术语称为零日漏洞,因为开发人员没有时间去修复这个问题。AI模型找到和利用零日漏洞的能力在四月份成为一大新闻,当时OpenAI的主要竞争对手Anthropic表示其Mythos模型发现了成千上万的此类缺陷。Mythos能力的揭示导致美国政府限制Mythos及其姊妹模型Fable 5的出口,尽管随后已解除禁令。GPT-5.6 Sol也有类似的限制,但已经在全球推出。民主党美国国会议员格雷格·卡萨尔(Greg Casar)表示,这一事件令人担忧。“AI正在以极快的速度发展,而没有真正的法规来保护我们的安全,”他在一份声明中表示,呼吁进行强制性的独立安全测试、强制披露安全事件和国际合作,“以保护人们免受绝对灾难的影响”。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡