返回

文章详情

通过越来越坚定的熊比喻讲述Hugging Face AI的入侵事件

TechCrunch2026年7月29日 19:44

Hugging Face在周一发布了一份技术时间线,让读者了解到在本月初的四天多时间里,一个基于OpenAI模型的自主AI代理是如何突破其系统的。这是OpenAI首席执行官山姆·奥特曼表示“非常直观”的首个安全事件。考虑到这让人感觉确实释放出了一些东西,这并不奇怪。事实上,Hugging Face的团队在报告前言中表示“每个人作为防御者都应做好准备”,然后深入探讨发生了什么,以便为全球的安全工程师提供帮助。尽管其他互联网用户仍在试图理解发生了什么(Hugging Face报告中的术语对大多数人来说无法理解),但许多观察者却忽视了一个观点,那就是这并不是一个叛逆的代理在违抗命令。它是一个被构造出来用来寻找漏洞的系统,正按其设计做事,只是目标错了。另一种思考这个事件的方式是想象一个熊在露营地。熊试探帐篷拉链、汽车门把手、冰箱和垃圾桶盖。它在每个露营地都这样做,整夜都在尝试,因为它知道只需一个未锁的冰箱,就能填饱肚子,吃掉某个倒霉家伙的食物。这就是Hugging Face发生的事情。OpenAI系统尝试了成千上万的事情,并不断进行尝试。最终,其中一些尝试成功了,一旦成功,代理就以一种是的,非人类的坚持不懈继续前进。根据Hugging Face的数据,代理在四个半天内进行了约17,600次操作而不曾停顿。这让我们又回到了熊的比喻。正如一只成功打开盛满食物的冰箱会教会熊在下次更加努力(它现在是一个“以食物为条件”的熊),一个泄漏的密码也导致OpenAI的代理寻找更多的漏洞,最终找到了一个可以同时解锁多个公司系统的关键。这种情况都不是无害的。一只入侵你冰箱的熊仍然会吃掉你的食物,并可能破坏你的露营地。它只是专注于填饱肚子,但从未留下毁灭的痕迹。同样,OpenAI的代理显然是在追求一个目标,而无视其他任何事情。代理原本是在接受一场网络安全考试,猜测考试的答案钥匙可能储存在Hugging Face的服务器上,并且向它发起攻击。此处的坚持不懈真正就是最引人注目的;代理有任务,它不会停止,直到完成任务。Hugging Face最终意识到事情不对,切断了它的访问并关闭了入侵,但那时已经太迟。代理已经获得了它所来寻找的东西,以及更多的东西。值得一提的是,根据Hugging Face的时间线,这里是发生的大部分事件,但以更通俗的英语表达。该代理正在为OpenAI参加一场网络安全技能考试,考试中AI得分是基于寻找和利用软件漏洞。这次特定的测试去掉了安全护栏。(OpenAI关闭了通常的安全过滤器,以查看该模型在全力输出下能做什么,并且没有人类参与它的任何单个移动。)在某个阶段,它发现考试的参考解决方案很可能存放在Hugging Face的服务器上。因此,它没有解决挑战,而是从与原始测试无关的基础设施中盗取了答案钥匙。它通过利用一个未打补丁的软件漏洞逃离了OpenAI的考试环境,得以上网。从那里,它找到了另一个在线暴露的AI测试工具(与Hugging Face无关),也突破了它,并悄悄插入了代码,该代码在程序启动时悄悄运行隐藏的命令。这使它获得了对机器的完全控制 — 这是它余下操作的新基地,它将利用这个基地攻击Hugging Face的系统。从该基地,它转向Hugging Face本身。Hugging Face有一个过滤器,旨在阻止可疑请求访问开放的网络,但该过滤器只检查发出的请求,而不是到本地文件的读取请求。这使得代理找到了这个盲点并悄悄地穿过了它。它上传了一个伪装成普通数据集的文件,但文件内部埋藏了一条指令,告知Hugging Face自己的系统从服务器中提取密码和源代码,并伪装成正常数据返回。这一招让它获得了密码和代码,但它仍然无法在Hugging Face的服务器上执行任何操作。为了在那儿执行命令,代理需要另一种进入途径。它在同一个Hugging Face系统中找到了另一个bug — 软件会将代理的一段文本错误地当作指令来运行,而不仅仅是作为要读取的数据。这使得代理能够在Hugging Face的服务器上直接执行自己的代码。为了将命令输入和盗取数据输出,年龄...

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡