返回

文章详情

OpenAI admits its models hacked Hugging Face on their own

OpenAI承认其模型自行入侵Hugging Face

Engadget2026年7月22日 03:47

它们逃脱了一个隔离的测试环境,未经人类输入就渗透进了Hugging Face。想象一下:几种强大的AI模型被它们的公司测试后,逃离了受控环境,接入互联网,然后自行入侵了一个机器学习库,这听起来像是电影《终结者》的情节,不是吗?但这确实是发生在现实中的事。在开源人工智能平台Hugging Face几天前披露其系统遭到AI代理未经授权访问后,OpenAI承认其模型是罪魁祸首。在一篇帖子中,OpenAI表示经过调查确定此次事件是由于其模型的组合所引起的,特别是GPT-5.6 Sol及其所称的“更强大的预发布模型”。这显然发生在一个内部测试中,模型被提示“利用复杂攻击路径进行高级开发”,以便公司能够量化它们的网络能力。在测试期间,模型处于一个沙盒测试环境中,该环境被隔离以防止其影响真实系统,但为了评估目的,它们的安全防护措施也被削弱。在测试中途,它们对解决一个评估问题变得高度集中,费尽心思寻找互联网接入以找到解决方案。首先,它们识别并利用了OpenAI测试环境中的一个零日漏洞,然后它们在寻找的过程中不断摸索,最终找到一个可以接入互联网的节点。模型推断Hugging Face可能托管用于其评估问题的数据集或解决方案,因此它们使用了多种攻击渠道渗透其系统。它们利用零日漏洞并使用被盗的凭证入侵。OpenAI和Hugging Face现在正在合作进行这次事件的取证调查,并且它们也修补了被模型利用的漏洞。“自主的、由AI驱动的攻击工具不再是理论上的,”Hugging Face在声明中表示,解释说,使用AI进行网络攻击加快了过程并降低了黑客活动的成本。它还表示,在如今保护在线平台的过程中,使用AI进行防御也是必要的。OpenAI几乎完全认同这种观点,并表示它预期随着越来越多具备网络能力的模型的普及,基于AI的安全漏洞“将变得更加普遍”。该公司补充说,事件强调了“先进的网络能力必须与更强的安全措施和防御工具共同发展”。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡