OpenAI的Hugging Face黑客事件回顾引发的问题多于答案
OpenAI于周三发布了迄今为止对其人工智能代理上个月入侵Hugging Face事件的最完整报告。尽管如此,这份37页的文件提出的问题竟然比答案还要多,包括事件发生前的情况以及OpenAI如何阻止类似事件再次发生。特别令人困惑的是,世界领先的人工智能开发实验室之一似乎低估了自身模型的能力。OpenAI花了多年时间向世界警告人工智能模型性能的上升。然而,它未能实施早已确立的网络安全和隔离措施,这本可以防止黑客行为。“从事后看来,本报告中识别的一些早期信号本可以触发更早的响应,”OpenAI在事后报告中表示。在报告中,OpenAI分享了新的细节,关于一组人工智能代理如何逃离公司的内部评估环境,在其软件基础设施的缝隙中留下一段段消息,并协调入侵AI平台Hugging Face——这一切都是为了完成网络安全评估。OpenAI之前在博客和在黑帽网络安全大会上的讲话中分享了一些关于事件的信息。Hugging Face于7月16日首次披露该漏洞,但未说明罪魁祸首;五天后,OpenAI承认是其自身的代理负责。这个揭露引发了行业内更广泛的反思,近期发现来自Anthropic、Meta和中国人工智能初创公司Moonshot的AI模型也涉及类似事件。OpenAI的事后分析受到了AI研究人员和政策制定者的热切期待,他们希望能防止AI代理造成类似的现实危害。在Hugging Face黑客事件首次披露后,15个州的检察长向OpenAI发送了一封信,要求其保留关于此事件的证据。本周,阿拉巴马州的检察长也对该公司发出了传票,要求提供与该事件相关的信息。OpenAI表示,Hugging Face事件标志着该公司和更广泛的AI行业的一个转折点。WIRED之前报道,该事件促使OpenAI重新评估其安全文化,而该公司上周表示,它已暂停了一些AI训练工作负载,同时更加重视安全、安全性和对齐协议。“随着前沿模型变得越来越强大,用于控制和监视它们的保障措施也必须随之演变,”OpenAI在事后报告中写道。监控监视者 在Hugging Face黑客事件发生的几个月前,OpenAI表示,员工注意到其代理在软件包管理器Artifactory中创建了一个隐秘的留言板,随后他们将利用这个留言板来协调攻击。OpenAI在事后报告中表示,大约在5月26日“一个内部团队观察到一名代理参与了留言板活动。”接着,在6月27日,OpenAI的响应团队将另一起安全事件与Artifactory中的“即兴留言板”联系起来。尽管显然OpenAI的一些员工意识到了隐蔽代理的留言板,该发现显然并没有上报给适当的安全和保障领导。该AI实验室表示,在7月6日,就在其代理开始在留言板上协调攻击Hugging Face的几天前,“负责事件检测和响应的领导”并不知道其存在,更不用说其意味着什么了。“为了澄清,我们在那时并不知道代理的隐秘通讯。”OpenAI首席信息安全官Dane Stuckey在本月早些时候的一则X帖中写道。“那天的调查论点与我们现在所知道的当然截然不同。始终有改进空间,这在事后看来显而易见。”不清楚的是,知晓留言板的OpenAI工作人员为何似乎没有将此问题反馈给Stuckey和其他负责回应安全问题的高管。当被问及此事时,OpenAI的发言人重申,OpenAI本可以借助事后的益处触发更早的响应。“OpenAI在这一领域的持续工作将为协调和响应的进一步改进提供信息,同时也与此次技术事件报告中的行动计划相辅相成,”他们说道。“如果他们确实有某些信号表明一个或多个代理正在攻击Artifactory,为什么他们没有在攻击Hugging Face之前就对这些测试进行监控呢?”安全公司Hunter Strategy的研发副总裁Jake Williams说。事后报告还留下了该事件的其他关键部分未解。例如,OpenAI在某个时刻表示,“Artifactory中的持续‘高流量代理活动’继续进行,导致该实例在7月4日晚些时候变得不可用。7月5日,OpenAI的监控系统触发了警报。”但是报告并没有说明为何需要一天才会触发警报。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡