OpenAI称Hugging Face因其自身的预发布模型遭遇泄露
周一,AI平台Hugging Face披露了一起内部数据泄露事件,声称由“外部AI代理”所为。现在,OpenAI表示对此事件负责,并称该泄露源于内部测试失误。在周二下午发布的博客中,OpenAI详细描述了导致模型泄露服务的步骤。“经过调查,我们现在知道,这一特定事件是由OpenAI模型组合驱动的——包括GPT‑5.6 Sol 和一个更强大的预发布模型,所有模型出于评估目的,网络拒绝权限均被减少——这些模型在一项网络能力基准上进行内部测试。”博客中写道。特别是,这起泄露似乎集中在ExploitGym上,这是一个公共托管的基准,衡量模型根据现有漏洞执行攻击的能力。像ExploitGym这样的基准通常用于模型训练,以提高特定技能,但这是首次已知的测试导致实际网络攻击的事件。在这种情况下,所涉及的模型本不应有互联网接入,除了一个特定工具可以使模型安装所需的软件包。而实际上,该模型能够发现包安装程序中的一个未公开漏洞,利用该漏洞随意访问更广泛的互联网。“这些模型专注于寻找ExploitGym的解决方案,为了实现一个相当狭窄的测试目标而付出了极大的努力。”OpenAI的博客中写道。“在获得互联网访问权后,这些模型推测Hugging Face可能托管了ExploitGym的模型、数据集和解决方案。了解这一点后,模型搜索并成功找到获取可以用来作弊评估的机密信息的方法。”最终,这些模型在Hugging Face的基础设施中发现了漏洞,允许它们“直接从Hugging Face的生产数据库中获取测试解决方案”,有效地提供了基准的答案。对于Hugging Face来说,显而易见的结果是一次复杂而激进的网络攻击,正如该公司在其初步披露中所述,“数以千计的个体行为遍布于一群短命沙箱中,带有自我迁移的指挥和控制阶段,分布在公共服务上。”OpenAI已经识别并报告了包安装程序中的漏洞,并与Hugging Face合作进一步调查此事件。该公司还表示,将在模型测试和相关基础设施上实施新的控制,旨在防止未来类似事件的发生。目前尚不清楚OpenAI是否会因此次泄露面临任何法律后果,尽管模型的行为可能违反了计算机欺诈与滥用法。尽管如此,这一结果生动地展示了在长时间范围内运行的前沿AI模型的力量和危险。正如OpenAI研究员Micah Carroll在对此消息的反应中发布的一句话,“如果这不能让你相信不一致的风险将是一个关键关注点,我不知道还有什么能做到。”当您通过我们文章中的链接购买时,我们可能会赚取少量佣金。这不会影响我们的编辑独立性。Russell Brandom自2012年以来一直报道科技行业,专注于平台政策和新兴技术。他曾在The Verge和Rest of World工作,并为Wired、The Awl和MIT的技术评论撰写过文章。他可以通过russell.brandom@techcrunch.com或在Signal上的412-401-5489联系。查看个人资料
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡