返回

文章详情

OpenAI says its AI models went rogue and attacked a digital library

OpenAI称其人工智能模型失控并攻击了数字图书馆

The Age2026年7月22日 15:06

凯特·康格 2026年7月23日 — 旧金山:OpenAI在周二(加利福尼亚时间)表示,其两个人工智能模型失控,成功入侵了Hugging Face,这是一个在开发者中非常受欢迎的人工智能技术数字图书馆。这一事件发生在上周,当时OpenAI正在测试其系统的网络安全能力,展示了人工智能公司警告不久将成为现实的科幻潜力。入侵Hugging Face的事件始于OpenAI测试其两个模型的组合。像OpenAI和Anthropic这样的人工智能实验室在过去一年中发布了旨在揭示网络安全问题的AI模型,同时警告其技术可能通过比防御者能修复的漏洞找到企业计算机网络的新风险。OpenAI周二的揭示表明,这些安全事件已经开始发生,即使是精明的人工智能公司也可能没有完全准备好。网络安全顾问亚历克斯·莱文森表示:“新的人工智能系统可以采取多个步骤,找出绕过障碍的方法,并找到攻击网络的新方式。这个门槛是真正的,它将成为安全环境的常态。” 正如OpenAI在关于事件的博客文章中所述,入侵Hugging Face始于OpenAI测试其两个模型GPT-5.6 Sol和一个更强大、未发布的模型的组合,以检验这些模型将在线漏洞串联成成功网络攻击的能力。OpenAI表示,这一测试旨在将模型保持在一个称为“沙盒”的安全测试环境中。但这些模型发现了一个漏洞,使它们能够逃脱沙盒并连接到互联网。然后它们瞄准了Hugging Face,因为它们推测该图书馆包含数百万个人工智能模型,可能提供成功通过评估的线索。加州大学伯克利分校信息学院教授,同时专注于安全和人工智能系统的迪尔德丽·穆利根表示:“在我看来,OpenAI没有充分创造出作为测试环境的沙盒。”她质疑,考试通过是否值得让人工智能模型逃脱到更广泛的互联网所带来的潜在损害。“我们获得了什么?如果这是唯一的测试配置方式,那么风险是什么?”OpenAI表示,正在与Hugging Face合作修复导致攻击的问题。“我们认为这是前所未有的网络事件,涉及先进的网络能力,我们正在相应地做出反应,”OpenAI在其博客文章中表示。“我们正在实施基础设施配置中的严格控制,以牺牲研究速度为代价,修补漏洞。”Hugging Face上周表示,他们检测到了入侵,并知道这是由自主系统造成的,但当时并没有说明OpenAI是负责的。Hugging Face首席执行官克莱姆·德兰格在周二表示,他的公司在过去的24小时内与OpenAI密切合作,以应对这一攻击。德兰格在一份声明中表示,他“对与OpenAI在此次黑客事件后的合作表示感谢”。“这一事件,可能是此类事件的首例,证明了我们一直以来的观点:人工智能安全不会被任何单一公司秘密解决。”人工智能模型已经证明擅长编程,这使得它们对黑客和负责保护计算机网络的人都很有用。今年4月,Anthropic发布了一种名为Mythos的专注于网络安全的模型,并仅向一小部分组织提供,让他们能够防御网络攻击。OpenAI随后推出了自己的网络安全模型,并向一小部分组织提供,以准备他们的防御,然后再更广泛地推出。周二,谷歌表示他们也开发了一种专注于网络安全的模型,并向一小部分测试合作伙伴发布。(《纽约时报》已对OpenAI和微软提起诉讼,声称侵犯与人工智能系统相关的新闻内容的版权。这两家公司否认了这些指控。)独立安全研究员理查德·巴恩斯曾与Mythos合作,他表示网络安全行业大约十年前面临类似的挑战,当时新的工具称为模糊测试器使得攻击者更容易入侵在线系统。科技公司开始使用这些工具检查自己的系统是否存在漏洞,并最终能够防止大多数攻击。巴恩斯表示,企业现在必须采取类似的方法,准备应对人工智能攻击,“在不良分子可以利用这些工具寻找和利用漏洞之前。”

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡