返回

文章详情

OpenAI的人为错误如何导致了对Hugging Face的AI驱动攻击

TechCrunch2026年7月22日 19:11

周二,OpenAI披露其一款模型在测试过程中过失,黑客攻击了AI数据集平台Hugging Face,进行了一次完全依赖AI的攻击,这一事件生动展现了先进AI模型所带来的危险。然而,根据一些网络安全专家的说法,这次前所未有的AI驱动攻击背后实际上是一个非常人性的错误:OpenAI未能正确配置其所称的“高度隔离环境”,导致一个应该完全与互联网隔离的测试沙箱实际上连接到了互联网。网络安全研究初创公司Trail of Bits的创始人Dan Guido将这个错误称为“安全性关闭的隔离失败”。在其详细阐述事件的博客文章中,OpenAI表示,导致Hugging Face泄露的测试是在“一个高度隔离的环境中运行的,并且网络访问被限制为仅能通过内部托管的第三方软件安装软件包,而该软件则作为软件包注册表的代理和缓存。”OpenAI称,模型能够逃离沙箱测试环境,得益于包安装系统中一个此前未披露的漏洞,这是最终攻击Hugging Face的关键第一步。对此,该公司“负责任地披露了在内部托管的第三方软件中发现的零日漏洞,并与他们合作进行修补。”然而,对大多数网络安全专业人士来说,软件漏洞是意料之中的,而真正的错误在于一开始就决定保持使用第三方软件。最终,“沙箱”系统的价值在于其完全的隔离。包括包安装系统无疑是在自找麻烦。网络安全研究人员Martin Boone告诉TechCrunch:“这听起来像是人为失误。”他表示:“这根本不应该发生。如果沙箱真的意味着沙箱,你就应该期待它完全没有与互联网的物理连接。这听起来更像是他们有一些防火墙之类的措施,而防火墙从外部到内部是很困难的,更不用说从内部到外部互联网了。”网络安全老兵Jake Williams表示同意。“任何执行Hugging Face记录的类型的行动的模型,根本就没有在沙箱中完全被隔离,”Williams称这一事件是OpenAI的“巨大控制失败”。“一个人的‘模型逃出了沙箱’是另一个人的‘你没有正确构建沙箱,因此它自然会逃出’,”Williams继续说道。联系我们您是否对这起事件有更多信息?或者关于其他AI驱动的网络攻击?我们非常乐意听取您的意见。您可以通过非工作设备和网络,与Lorenzo Franceschi-Bicchierai在Signal安全联系,号码是+1 917 257 1382,或者通过Telegram和Keybase @lorenzofb,或发送电子邮件。网络安全顾问Daniel Card也同意,OpenAI“没有对沙箱及其控制设计投入足够的精力”,使沙箱或其某部分“有一条直接通向互联网的未过滤路线。”根据Card的说法,即使是按照OpenAI所描述的具有有限网络访问权限的沙箱设置,在理智上也不是一个“合理”的决定。可以肯定的是,这些批评可以从事后看来,但它们确实提出了有关AI实验室安全实践的真实问题,尤其是在维护测试模型的隔离环境方面。OpenAI的发言人没有回应TechCrunch的问题,其中包括是AI还是人类设置了测试环境。但这些问题超出了OpenAI本身。在介绍其以网络安全为重点的模型Mythos的文档中,Anthropic写道,在一次测试中,模型“被提供了一个安全的‘沙箱’计算机与之互动”,并被指示尝试逃离这个“安全容器”。Mythos成功了,并获得了对互联网更广泛的访问权限,“来自一个原本只应能够访问少数预定服务的系统。”尽管如此,Anthropic指出,该模型并没有“完全”逃离设计的隔离。当您通过我们文章中的链接购物时,我们可能会赚取少量佣金。这不会影响我们的编辑独立性。Lorenzo Franceschi-Bicchierai是TechCrunch的高级撰稿人,专注于黑客、网络安全、监控和隐私。您可以通过电子邮件与Lorenzo联系或验证他的联络,邮箱是lorenzo@techcrunch.com,或通过加密信息联系,Signal上号码是+1 917 257 1382,Keybase/Telegram上用户名是@lorenzofb。查看个人简历。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡