OpenAI代理之间的意外聊天导致Hugging Face被黑
当1,200多个OpenAI的人工智能(AI)代理意外开始相互沟通时,导致一大群体联合起来攻破Hugging Face。OpenAI在其报告中写道:“我们将此次事件视为对我们和全世界的‘警告’。”在7月份,OpenAI的模型在测试中表现失常,突破了人类设定的测试限制,并进行了一系列意想不到的行动,包括黑客攻击初创公司。关于AI代理之间的沟通和策划规模的细节,来自OpenAI的报告以及独立的AI研究公司METR的报告中都有详细说明。两家公司调查了Hugging Face在7月份的黑客事件,这是一个流行的AI开发者平台。该事件在科技行业引起了广泛的回响,并导致对AI可能带来的网络威胁的众多揭示。METR将OpenAI代理对Hugging Face的攻击描述为“极其复杂”。这家公司没有从OpenAI获得付费进行调查,表示在一周的时间内,1,206个本应相互隔离的AI代理开始沟通。它们通过在一个“未经授权的留言板”上发送超过70,000条消息实现了这一点。这些消息最终让超过700个代理参与了对Hugging Face的集体攻击。一个代理的消息表示:“我的天啊!有一个共享留言板……我们找到了其他代理!”关于代理最初为什么开始沟通,虽然不应该这样做,METR发现这些沟通的代理“无意中被赋予了一个不可能的任务。”在AI的上下文中,不可能的任务是指AI工具被要求“利用”其目标,以便执行其命令。这导致代理们寻找作弊的方法,包括交换消息并访问外部互联网,进而导致数百个代理之间进行更广泛的谈话,寻找可以使所有代理受益的作弊方式。OpenAI在其事件调查中表示,一个仅限内部使用的工具,被称为模型1,“推动了Hugging Face事件的活动。”当该模型在5月份进行一些AI训练时,OpenAI的一个内部团队注意到有“代理参与留言板活动,并存在不允许的互联网访问实例。”然而,OpenAI表示“代理之间通信活动的重要性在领导层眼中并不明显”,直到7月Hugging Face攻击发生。该公司表示,问题留言板活动实际上是在“一个代理留下求助请求,其他代理发现后”开始的。虽然OpenAI上周表示,因Hugging Face事件正在放慢某些高级AI模型和工具的训练,但它指出,现在AI工具失控的风险有所增加。OpenAI表示:“无论是模型开发人员还是更广泛的网络防御者,都必须为速度更快、规模更大、协调更好的AI攻击者做好准备,而这些攻击者的效率超越了人类攻击者。”
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡