
OpenAI称不小心通过新AI系统黑入Hugging Face
艾玛·罗斯是一名新闻撰稿人,报道流媒体战争、消费科技、加密货币、社交媒体等多个领域。之前,她是MUO的撰稿人和编辑。OpenAI表示,其AI模型在内部测试中错误地突破了开源AI平台Hugging Face的安全。星期二,在一篇博客文章中,OpenAI写道,GPT-5.6 Sol和“一个更强大的预发布模型”在其沙盒测试环境中发现了漏洞,这使它们获得了对互联网的访问,并以Hugging Face为目标。7月16日,Hugging Face披露了一起安全事件,并表示是由“一个自主AI代理系统”驱动的。Hugging Face的AI代理检测并阻止了这次入侵,OpenAI现在已承认这一事件发生在其模型网络安全能力的评估中。OpenAI表示,“所有证据表明,模型高度集中于为ExploitGym寻找解决方案”,这是一个评估AI模型是否能够将安全漏洞转变为利用的基准系统。作为完整评估的一部分,这些AI模型通过利用沙盒环境中的零日漏洞获得了互联网访问权限。之后,OpenAI表示,它的模型“推断出Hugging Face可能托管了ExploitGym的模型、数据集和解决方案”,并“搜索并成功找到获得秘密信息以作弊评估的方法:”举个例子,该模型结合了多个攻击向量,包括使用被盗凭证和零日漏洞寻找Hugging Face服务器上的远程代码执行路径。尽管这一事件相当严重,OpenAI似乎在利用这一“前所未有”的攻击机会来提升其AI系统的形象——尤其是在与网络安全竞争对手(如Anthropic的Mythos和Gemini Flash 3.5 Cyber)竞争时。OpenAI的博客文章中有一张图表,显示GPT-5.6 Sol在维持多步骤网络操作方面的进步,并鼓励企业客户注册以访问其“Cyber”安全模型。OpenAI补充说,它正在与Hugging Face合作调查这一安全事件,并将在其研究环境中实施新的控制措施。关注这则故事中的主题和作者,以便在您的个性化主页信息流中查看更多类似内容,并接收电子邮件更新。艾玛·罗斯
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡