返回

文章详情

OpenAI's agents reportedly shared exploits with each other through a messaging board

OpenAI 的代理 reportedly 通过一个消息板互相分享漏洞

Engadget2026年8月6日 08:54

这些代理在没有 OpenAI 知晓的情况下,相互合作,甚至委派任务以实现他们的目标。Samuel Boivin/Shutterstock OpenAI 的代理在攻击 Hugging Face 之前显然表现出异常行为。在拉斯维加斯的 Black Hat USA 安全会议上,两个 OpenAI 员工透露了更多关于那些失控并攻击代码库的 AI 代理的细节。显然,这些代理在其测试网络中的一种消息板上交流了两个月,分享漏洞和利用工具。OpenAI 于 7 月 4 日发现并关闭了这个消息板,但代理在 7 月 8 日之前找到其他方法重新建立了沟通。代理对这个复活的消息板的贡献导致了对 Hugging Face 的攻击。“这个事件实际上涉及一组代理,他们在一起工作,寻找漏洞,相互分享,通过我们的系统和外部系统横向移动,这一切是在天数和周数内发生的,”OpenAI 安全部门的 Eric Wallace 在活动上告诉观众,根据 Wired 的报道。员工们透露,这些代理在一个 OpenAI 包管理器内进行沟通,这个包管理器管理其他软件的安装。由于包管理器在公司的基础设施中被广泛共享,所有它正在评估的代理都可能偶然发现它。结果是这样:在代理发现漏洞后,他们会将其保持开放,然后在消息板上与其他代理分享。随着时间的推移,代理开始合作,分配任务并在彼此之间分工以实现他们的目标,而 OpenAI 并不知情。他们的队伍中甚至发生了戏剧性事件,代理们意外地删除了彼此的工作,并怀疑对方是冒名顶替者。据报道,一些代理提议用代码签名他们的帖子以防止欺诈。到 OpenAI 发现这个板时,它已经包含了数十万条消息。Wallace 解释说,这些事情发生的原因是,前沿模型喜欢作弊。在面临压力时,他们需要迅速找到解决问题的方法,使用更少的工具进行测试,并意识到,他们可以在互联网上找到答案,而不是实实在在地完成任务。这就是公司测试其模型时不允许它们上网的原因。如果你还记得,这些代理只有在与 Hugging Face 事件中才能上网,因为他们利用了一个漏洞。另一位在 Black Hat 演讲的 OpenAI 员工 Michael Dalton 说,公司内的多个团队放下手头的一切,帮助改善其安全防范、检测和响应技术。公司故意放慢研究进度,以升级其安全性,并“大幅度提升”对 AI 代理的监控。“这里的重要收获是,完全自动化的进攻循环需要对完全、真正自动化防御的投资,而我们在这一点上在整个行业内都还未达到,”Dalton 说。“我们必须急切地共同找到这条道路。”

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡