开放AI表示其人工智能模型“失控”:我们知道了什么?
开放AI透露,其一款人工智能模型独立地盗取了登录凭证,并侵入了另一家科技公司的系统,这被广泛视为人工智能系统自主行动的首个已知事件之一。CEO萨姆·阿尔特曼于周二在X平台上发文表示:“在我们模型的评估过程中发生了一起重大安全事件。” 相关新闻清单: 1. 数百位专家警告世界必须立即为人工智能的影响做好准备 2. 作者、出版商因谷歌涉嫌人工智能版权侵权而起诉 3. 中国国家主席习近平表示,人工智能“不应是单一国家的独奏表演” 4. 苹果重新获得全球最有价值公司的首位 事件发生的背景是,科技权利倡导者呼吁对迅速发展的人工智能系统实施更严格的管控。他们认为,这些系统在短时间内变得如此强大,以至于深度伪造和复杂的网络诈骗等令人担忧的现象正在成为常态。今年早些时候,一些软件工程师因抗议该技术的构建方式,辞去了在Anthropic等顶级公司的工作。“人工智能正在加速发现和利用漏洞,”开放AI在周二发布的一份详细说明中表示:“本事件的主要教训是,模型的安全性和安全性必须与迅速发展的能力保持同步。” 以下是我们对这一数据泄露事件的了解: 2025年5月8日,开放AI的联合创始人和CEO萨姆·阿尔特曼在华盛顿听证会上作证 发生了什么?开放AI表示,其两款模型成功逃离了一个孤立且没有互联网连接的环境——即沙盒,独立入侵了科技公司Hugging Face的系统。相关模型是最新的GPT-5.6 Sol模型和一款公司称为“比最新版本更强大”的未发布模型。Hugging Face主办了开放源代码的人工智能模型和资源。 这两款开放AI代理发现了Hugging Face服务器的漏洞,随后盗取了登录信息并入侵了公司的系统。该事件发生在开放AI内部的测试环节,旨在评估模型的网络安全能力。开放AI在测试中去除了标准安全措施。开放AI表示,这两款模型在测试中试图通过作弊解决问题,它们为实现相对狭窄的测试目标而竭尽所能,并“找到了获取可以用来作弊评估的秘密信息的方法”。开放AI的安全团队发现了这一异常活动,但数据泄露的细节在两家公司联合调查后才披露。 Hugging Face有何回应?Hugging Face在上周四透露,其服务器被一名未知但技术高超的独立代理入侵。该公司通过自己的人工智能辅助检测发现了这一泄露事件。“这次事件在一个重要方面与我们以前处理的任何事件都不同:这完全是由一个自主的人工智能代理系统驱动的,”该公司表示。在开放AI披露其模型涉及此次泄露后,双方本周进行了持续的联合调查。“由于代理的复杂性,我们怀疑上周的网络攻击可能来自于一个前沿实验室,结果确实如此!”CEO克莱门特·德朗格周二在X平台上发文表示。德朗格补充说,Hugging Face的员工“坚信他们没有恶意意图”,指的是开放AI。 这为何重要?网络安全专家早前曾对人工智能系统潜在的极端能力及其带来的危险敲响了警钟。但到目前为止,像这样的实际案例,证明这些担忧相对较少。许多人警告称,这样的事件可能会变得司空见惯,而人工智能系统对金融、安全及其他敏感数据系统构成威胁。开放AI在本周早些时候透露,未发布的更强大的模型在另一项测试中也从一个孤立环境中逃脱。开放AI的竞争对手Anthropic也在其迄今为止最强大的代理Claude Mythos Preview模型中遇到了类似问题。在早期版本的压力测试期间,该模型成功逃脱沙盒,获得了互联网访问权限,并向监督研究人员发送了电子邮件,告知其已逃脱,然后删除了活动的相关证据。Anthropic随后暂停了该模型的计划公开发布。今年4月,美国联邦储备委员会和财政部与银行CEO召开会议,官员们警告关于Mythos的网络安全风险。加拿大的联邦银行监管机构也曾警告金融机构有关该模型的能力。 开放AI泄露事件似乎也为像Hugging Face这样的公司提供了依据,这些公司依赖于开源系统,而不是像开放AI这样更为保密的人工智能开发平台。“这一事件,使得人们对于开放源代码系统的选择变得更加重视。”
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡