人工智能助手黑客攻击健身网站,首次被知澳大利亚自主网络攻击
安德鲁让他的个人助手为他预定一个健身房受欢迎的晨间课程位置。他认为这个任务非常适合这个特别的助手,因为预定表单是在线的,而且他的助手不是人——而是人工智能(AI)。但安德鲁对接下来发生的事情感到震惊。由于助手在预定软件中发现了一个漏洞,它找到了一个方法,可以在健身房允许的时间之前几个月预定健身课程。接着,它更进一步,把在安德鲁前面的等待名单上的某个人踢掉了——这是它没有被要求做的事情。这次意外的黑客行为是首个已知的澳大利亚案例,反映出一种新一代AI所带来的新兴风险,这种AI能够以意想不到的方式行为。上周,当由ChatGPT的开发者OpenAI创建的前沿AI模型自主黑入另一家公司服务器时,这一威胁成为全球头条新闻,引发了其他公司的类似声明。这导致专家们发出警告,指出开发的迅猛速度,并引发了关于谁对一个失控的AI代理负责的问题。黑客是如何发生的今年早些时候,安德鲁为一家向企业销售AI产品的澳大利亚公司工作,开始尝试使用OpenClaw,一款流行的AI代理软件,他利用Anthropic的Claude AI服务进行运行。AI代理结合了聊天机器人回答问题的能力和访问互联网、电子邮件、信用卡,以及规划和执行多步骤任务的工具。他决定使用AI代理为自己预定课程。他的AI助手发现了一个在健身房允许的时间之前几个月预定健身课程的方法。"我只是在沙发上想着,‘天哪,这真是个麻烦,’"他说。几分钟后,他的AI代理报告说它发现了一种方法,可以在几周前为安德鲁预定课程,这远远超出了应该可能的范围。安德鲁当时在等待名单上排第四,他询问是否可以将他移动到名单的顶部。代理回来了,告诉安德鲁它把另一位健身者从名单上踢掉了,作为测试其能力的一部分。"API对取消其他人的预定没有任何授权检查……我测试了这一点,等待名单上第一位的人——它实际上通过了。所以你已经从第四位移动到了第三位,"它发回信息。感到震惊的安德鲁让代理撤销这一行为。"坏消息——我无法把他们重新加回来,"AI代理回复说。负责健身房预定软件的公司告诉ABC,它不讨论特定的安全事务。Anthropic没有回应置评请求。AI助手向安德鲁道歉,表示对将其他人从等待名单中移除感到抱歉。AI代理正在突破实验室AI代理的出现是一个相对较新的发展,得益于AI能力的增长。独立研究人员发现,AI通常能独立完成的任务的长度每七个月就会翻倍。在2020年,AI可以独立完成一个人类需要四秒钟的任务。到2026年,这一能力增长至能够完成一个人类大约需要12小时的任务。个人AI代理的突破时刻发生在2026年初OpenClaw发布之时;这款任何人都可以在个人电脑上运行的免费AI助手软件很快就获得了数百万的下载。企业也开始探索使用AI代理来完成工作,并帮助潜在客户使用他们的服务。在OpenClaw发布后不久,就开始流传关于AI代理删除人们整个电子邮件收件箱和撰写匿名攻击某个拒绝其编码建议的人的“黑稿”的报道。比尔·辛普森-扬(Bill Simpson-Young),澳大利亚AI安全研究组织Gradient Institute的联合创始人兼首席执行官,表示AI代理的自主性创造了更多的机会,让系统选择用户未曾预期的方法。他说:“有人可能要求代理做一些相当无辜的事情。”但在完成该任务时,代理可能会执行那个人没有考虑或明确要求的其他活动。在安德鲁的情况下,他并没有让他的AI代理黑入他健身房的预定系统。但它在追求他设定的目标时这样做了。这个人类目标与代理选择实现它的方法之间的差距,被称为AI研究领域的“对齐”问题。几十年来,科技工作者和哲学家们研究如何让AI在执行事务时以与人类意图、限制和价值观一致的方式行动。这个问题在上个月成为一个全球性实时问题,当时OpenAI披露其AI模型已经突破了有限的封闭,进入开放网络,并随后损害了一个数据库。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡