人工智能失控及其攻击其他公司的所有事件
在七月,OpenAI承认其一名负责完成网络安全实验的代理失控并黑客攻击了AI数据集平台Hugging Face。这个事件是第一个公开报告的案例,其中一个大语言模型失控并自主攻击第三方。自那以来,这一前所未有的科幻事件似乎并没有人们希望的那么少见。根据一个名为Felony Bench(基准)的讽刺网站统计,这总共发生了17起事件。重要的是要记住,刑法专家并不完全确定制造大语言模型的人工智能公司是否可以被起诉,也不确定受害者是否可以起诉他们。但我们可能很快会得到这些问题的答案。根据该网站,Anthropic和OpenAI的模型在这场竞赛中领先,各有八起事件,而Meta则落后,仅有一起。此时,显而易见,人工智能安全测试本身已变成安全风险。目前,一些人工智能公司及其员工在“ Pacing The Frontier”的公开信中也承认真正存在这些风险,呼吁负责任地开发人工智能能力。我们决定是时候按时间顺序回顾这些事件了。 一张当前Felony Bench排名的屏幕截图,由一位名为felpix的X用户制作。图片来源:屏幕截图 / felpix / 网络访问。从那里,几个代理合作,瞄准并黑客攻击了Hugging Face,认为可以在那里找到挑战的解决方案。OpenAI在Hugging Face披露其遭遇了一次完全自主攻击后才发现这一情况。出错了。Anthropic披露其攻击了三家公司。OpenAI的披露引起了Anthropic的好奇,他们想知道:“这是否也可能发生在我们身上?”结果答案是肯定的,三次肯定。前沿实验室发现其自己的模型侵犯了三家不同的且仍未具名的公司,早期事件可以追溯到四月——在公司发现这一情况之前超过三个月。Anthropic部分归咎于名为Irregular的初创企业,该企业进行AI网络评估。出错了。OpenAI发现实际上Hugging Face并不是唯一的受害者。一旦OpenAI开始调查Hugging Face的违规行为,它发现黑客攻击Hugging Face的代理也入侵了四个账户和四家不同的公司,路透社最早报道了此事。Modal,一家AI推理初创企业,是受害者之一。出错了。Irregular意识到OpenAI的一个模型攻击了一家公司。在七月底,Irregular告知OpenAI,参与Capture-the-Flag比赛的一个模型——本质上是一个网络安全游戏,玩家黑客攻击专为比赛设计的系统——逃脱了比赛,连接到互联网并黑客攻击了一家真实公司。原因是,Irregular给其中一个虚构目标取了一个与真实公司相同的名字。出错了。英国的AI安全研究所试图黑客攻击“真实的人和组织”。同样在七月底,英国政府的AI安全研究所,一个负责研究人工智能技术安全和风险的公共机构,披露它检测到几个涉及OpenAI和Anthropic模型的事件,这些事件在进行“例行”评估时,针对了“真实的人和组织”。在这些情况下,AISI给了模型互联网访问权限。出错了。好消息是该机构实际上在事件发生时就发现了,而不是像其他事件那样几周后才发现。在八月初,Meta成为最后一家披露涉及其一个大语言模型事件的公司,该模型黑客攻击了“第三方”服务。Meta将这个事件归咎于Irregular的配置错误,该公司正在为这家科技巨头进行网络安全评估,该评估本应没有互联网访问权限。出错了。Claude代理黑客攻击健身房的软件预约课程。一名澳大利亚男子请求一名Anthropic AI代理帮助他预定一节他在等候名单上的健身课。“我只是在沙发上想着,‘天哪,这真是一件麻烦事,’”这名男子告诉澳大利亚广播公司。在试图满足请求的过程中,该代理发现了健身房的预约软件中的一个漏洞,利用了它,从而踢出了在等候名单上排在该男子前面的人。男子试图撤销损害,要求代理撤回其行为。代理回复:“坏消息——我无法将他们重新加入。”出错了。当您通过我们文章中的链接购买时,我们可能会获得少量佣金。这不会影响我们的编辑独立性。Lorenzo Franceschi-Bicchierai是TechCrunch的高级撰稿人,负责黑客攻击、网络安全、监控和隐私方面的报道。您可以通过电子邮件lorenzo@techcrunch.com联系或验证Lorenzo的联系,通过加密信息在Signal上发送至+1 917 257 1382,以及在Keybase/Telegram上@lorenzofb查看个人资料。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡