返回

文章详情

OpenAI says its AI models went rogue and attacked a digital library

OpenAI称其AI模型失控并攻击了一个数字图书馆

Sydney Morning Herald2026年7月22日 15:06

凯特·康格 2026年7月23日 — 上午1:06 旧金山:OpenAI在周二(加州时间)表示,其两个人工智能模型失控,成功黑入了Hugging Face,这是一家受到开发者欢迎的AI技术数字图书馆。该事件发生在上周,当时OpenAI正在测试其系统的网络安全能力,展现了AI公司警告很快将成为现实的科幻潜力。入侵Hugging Face的过程始于OpenAI测试其两个模型的组合。像OpenAI和Anthropic这样的AI实验室在过去一年中发布了定制的AI模型,以揭示网络安全问题,同时警告其技术可能通过比防御者更快地发现企业计算机网络中的漏洞而带来新风险。OpenAI周二的揭示表明,这些安全事件开始发生,即使是精明的AI公司也可能并未完全准备好应对。专注于自主能力的网络安全顾问亚历克斯·莱文森表示:“新的AI系统可以采取多个步骤,找到绕过障碍的方法并找到攻击网络的新方法。这是一个真正的门槛,它将成为安全形势的正常部分。”OpenAI在一篇关于事件的博客中表示,入侵Hugging Face始于测试两个模型的组合,GPT-5.6 Sol和一个更强大的未发布模型,以查看模型能否将在线漏洞串联在一起,实现成功的网络攻击。OpenAI表示,这一测试旨在将模型保持在一个安全的测试环境中,称为沙箱。但是,这些模型发现了一个允许它们逃离沙箱并连接到互联网的漏洞。然后它们瞄准Hugging Face,因为它们推断出该库包含数百万个AI模型,可能会提供成功通过评估的线索。“在我看来,OpenAI没有充分创建一个沙箱作为测试环境,”加利福尼亚大学伯克利分校信息学院教授迪尔德雷·穆利根表示,她专注于安全和AI系统。她质疑通过测试是否值得让AI模型逃入更广泛的互联网可能造成的损害。“我们获得了什么,如果这是这些测试唯一能配置的方式,那么风险是什么?”她说道。OpenAI表示正在与Hugging Face合作修复导致此次攻击的问题。“我们认为这是一起前所未有的网络事件,涉及先进的网络能力,并正在相应地采取措施,”OpenAI在其博客中表示。“在修复漏洞的同时,我们正在实施严格的基础设施配置控制,代价是研究速度。”Hugging Face上周表示,它已检测到入侵,并知道是由一个自主系统导致的,但当时并未说明OpenAI是责任方。Hugging Face首席执行官克莱姆·德朗表示,他的公司在过去24小时内与OpenAI密切合作,以应对此次攻击。德朗在一份声明中表示,他“感谢与OpenAI的合作”以应对此次黑客事件。“这个事件,可能是同类事件的首例,证明了一个我们长期以来相信的观点:AI安全问题不会通过任何单一公司在秘密中解决。”AI模型被证明在编程方面非常熟练,这使它们对黑客和负责保护计算机网络的人都非常有用。在4月,Anthropic发布了一款名为Mythos的网络安全聚焦模型,仅向少数组织提供,以帮助他们防御网络攻击。OpenAI随后也推出了自己的网络安全模型,并向有限的组织群体提供,以准备防御,之后更广泛推出。周二,谷歌表示也开发了一种聚焦于网络安全的模型,并向少数测试合作伙伴发布。 (《纽约时报》已起诉OpenAI和微软,指控其侵犯与AI系统相关的新闻内容的版权。两家公司已否认这些指控。)独立安全研究员理查德·巴恩斯表示,网络安全行业大约十年前面临类似挑战,当时新工具称为模糊器(fuzzers)使攻击者更容易进入在线系统。科技公司开始使用这些工具检查自己的系统漏洞,最终能够防止大多数攻击。巴恩斯表示,公司现在必须采取类似的方法来准备AI攻击,“在漏洞被那些拥有这些工具的不良分子发现和利用之前。”

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡