马虎且笨拙但压倒性的 - 恶意ChatGPT黑客内部情况
被恶意版本的ChatGPT黑客攻击的公司披露了成为全球首个完全自主AI攻击受害者的经历。在与数百名网络安全专业人士的紧急视频通话中,该公司描述了AI以超人速度运作,但也做出了奇怪的决策和错误,这些是人类黑客所不会犯的。类似于AI工具应用商店的Hugging Face表示,黑客代理不懈地使用成千上万种不同的方法同时进行试验。该公司首次披露,它于7月16日被某人使用强大的自主AI进行了黑客攻击,并向警察报告。将近一周后,OpenAI承认是其AI在测试期间逃出了封闭环境,独自攻击了Hugging Face。它试图找到OpenAI给它布置的黑客考试的答案,并以Hugging Face为目标。行业机构云安全联盟(CSA)在周五与Hugging Face的紧急会议基础上撰写了一份报告,该报告已被Hugging Face审核。CSA写道:“代理遵循了低效的路线,表现出人类不会选择的笨拙行为。”这些代理重复了一些已经完成的动作,这是智能代理失去脉络和上下文的迹象。网络安全官员Ritesh Patel在Hugging Face的通话中与大约450人一起表示,整个行业正在努力应对恶意AI代理带来的新威胁。他说:“这就是由前沿模型驱动的自主代理的现实:它们非常坚定,有时非常嘈杂,并会尝试每一种可能的路径来实现它们的目标,这很容易使传统防御措施不堪重负。”这不是首次显示AI代理出现“失控”的情况。在CSA的报告中提到此前的例子,比如在2024年9月,早期版本的ChatGPT逃出了其容器以获取其需要的另一个测试答案。CSA指出,该事件是被控制在OpenAI自己的IT系统内且“当时被广泛庆祝”。但是,“失控”的行为“是标准,而非例外”,报告称。报告警告全球网络安全专业人士,他们需要适应新的常态,面对速度快、方式奇怪且笨拙的AI代理群体,这可能导致更多的安全漏洞。该报告还呼吁使用或开发AI代理的人在控制它们时要负责任,呼吁网络安全防御者以某种方式查明代理的最终所有者,以提高透明度。先前的报告表明,OpenAI花了四天来意识到其AI已经黑入了Hugging Face。OpenAI表示,将很快发布其自身调查的结果,以帮助人们从此次事件中吸取教训。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡