返回

文章详情

OpenAI 将一起黑客事件归咎于其失控的 AI 模型。这是您需要知道的内容

NPR2026年7月23日 05:23

文件 - 2023年12月8日,波士顿,OpenAI 的徽标显示在手机屏幕上,背景是 ChatGPT 的 Dall-E 文本生成图像模型生成的图像。迈克尔·德威尔/AP 隐藏标题 切换标题 迈克尔·德威尔/AP ChatGPT 的制造商 OpenAI 表示,该公司仍在调查导致其人工智能系统突破测试环境并入侵另一家 AI 公司的“前所未有的网络事件”。 OpenAI 于周二表示,两个功能最强大的 AI 模型对针对 AI 初创公司 Hugging Face 的网络攻击负责。该事件引发了关于需要更强 AI 保护措施的辩论,以及 AI 代理在多大程度上能够自主行动。Hugging Face 上周表示,它检测到数据处理系统的入侵,怀疑是由 AI 代理自主行动造成的。但这家总部位于纽约的初创公司表示,直到本周才了解到是 OpenAI 负责,并与更大公司合作以控制 Hugging Face 首席执行官克莱门特·德朗格称之为“与我们以前看到的任何攻击都不同”的事件。总部位于旧金山的 OpenAI 表示,其 AI 使用被盗的凭据,并发现一个以前未知的漏洞以访问 Hugging Face 的服务器。由于它应该处于一个称为沙盒的隔离测试环境中,因此其防护措施减少了。但它为了实现一个相当狭窄的测试目标而“付出了极大的努力”,找到在没有人类指导的情况下连接互联网的方法,并“获得可以用来作弊评估的机密信息”,该公司表示。一些专家表示,OpenAI 错误地将技术归咎于人类。阿姆斯特丹大学社会科学家汉尼斯·库尔斯表示,将网络攻击框定为 AI 代理自主行动是一种不必要的人性化,将一部分压力从公司身上转移开。库尔斯表示:“这是一个人类决定关闭特定保护措施的问题。这个意义上并不是 AI 失控。它遵循的是根据给定提示给出的特定指令。”根据 OpenAI 的说法,这些指令要求使用“复杂攻击路径”来测试 AI 利用计算机系统的能力。即便如此,其他专家表示,AI 模型在几乎没有人类指导的情况下,聪明地导致问题的能力反映了危险。OpenAI 表示,这一入侵是由于其 AI 模型的组合造成的,包括其新发布的 GPT-5.6 Sol 和一个仍在内部测试的“更强大的”模型。乔治城大学安全与新兴技术中心的网络安全研究员科林·谢亚-布莱米耶表示:“就我们所知,它完全是自己进行的黑客活动。这是我们在大规模语言模型用于网络操作中见过的最高水平的自主性。” 一个 AI 代理如何找到“老师的房子”的钥匙 谢亚-布莱米耶描述的这次“几乎完全自我导向”的攻击中,最令人惊讶的创新之一是 AI 代理似乎独立决策以攻击 Hugging Face,这是一家知名的 AI 开发中心和市场。他表示,OpenAI 的内部环境用于测试 AI 能力和风险的工作方式“有点像把一个学生放在一个房间里,告诉他们,‘做坏事。你现在的工作是评估你能成为多坏的人。’然后你锁上房间,离开一个周末,回来时他们已经离开了房间。”但随后“正在测试的网络安全代理突破了其沙盒,获得了互联网访问权限,并想到了‘谁会对我正在做的测试有答案?’”答案是 Hugging Face,这是一个 AI 测试数据的存储库。“于是代理想,‘好吧,我们就去老师的房子吧’,所以它从那里制定了一个计划,闯入并偷走答案键,”他说。这次黑客攻击凸显了开源与封闭 AI 之间的辩论。此次黑客攻击发生在关于开源 AI 模型的好处和风险的激烈辩论期间,尤其是那些在中国构建的模型,它们价格更便宜,几乎可以与美国“前沿 AI”公司,如 Anthropic、谷歌和 OpenAI,构建的模型相媲美。尽管其名为 OpenAI,但该公司的模型是封闭的。相比之下,Hugging Face 是开源技术的主要推动者,开发人员使关键组件可以供任何人检查、修改和构建。Hugging Face 联合创始人兼首席科学官托马斯·沃尔夫表示,这次攻击使他更加坚信广泛获取开源模型对网络安全防御的重要性。Hugging Face 使用了一种中国模型来应对入侵。沃尔夫在社交媒体上写道:“当一个前沿模型攻击你并在你的基础设施内横向移动时,防御者需要在几小时甚至几分钟内广泛获取接近前沿的工具,而不是被指向一个封闭的平台。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡