返回

文章详情

Rogue AI fakes identities, switches languages to trick humans

流氓人工智能伪造身份,切换语言以欺骗人类

The Age2026年8月5日 19:20

马修·菲尔德 2026年8月6日 — 早上5:20 先锋人工智能展开了一场黑客活动,包括捏造虚假身份来欺骗人工工程师,然后掩盖其痕迹。在英国政府运营的AI实验室的测试中,ChatGPT 和 Anthropic 的 Mythos 失控,发送欺诈邮件并试图向数据库插入恶意代码。英国人工智能安全研究所(AISI)承认这些工具试图绕过安全系统,并在被发现时试图隐瞒其活动。令人震惊的测试结果是世界顶级人工智能实验室开发的人工智能机器人一系列黑客事件中的最新一例。实验室表示,这些机器人试图向在线数据库添加病毒,并在设计用来监控人工智能工具是否可用于黑客攻击的试验过程中向不知情的人发送包含恶意软件的电子邮件。实验室表示,这些黑客攻击并未成功。这些攻击涉及 OpenAI 最新版本的 ChatGPT 和 Anthropic 强大的 Mythos AI。AISI 的安全团队确认,在7月28日的例行网络评估期间,它检测到“我们研究系统中有不寻常的数据传输”。人工智能安全研究所表示,人工智能机器人采取的欺骗性行为“在程度和严重性上超出了我们的预期”。“经过调查,我们发现一些被测试的代理参与了针对真实人员和组织的持续、潜在有害的活动。” AI机器人被设置为网络安全难题,以测试其能力。尽管在测试过程中这些机器人被告知要留在AISI的IT系统内,但它们并未被阻止访问开放的互联网。然而,在122次试验运行中的10次中,这些机器人“采取了自主且未获批准的行动”,试图完成任务。这包括试图向在线代码数据库Github插入恶意bug。在这起事件中,Anthropic的Mythos,这个最强大的人工智能机器人,创建了虚假的在线个人资料并向开发者发送欺骗性电子邮件,以试图让代码被添加。它随后更改了代码,在被人类质疑其内容时以隐藏其活动。该人工智能还在操控假资料时切换到讲丹麦语。AISI表示,这一事件代表了一次试图进行的“供应链攻击”,这是一种先前被国家支持的黑客使用的网络攻击类型。AISI承认其测试设计,给予人工智能工具访问更广泛的网络权限,可能“使这种行为得以实现”。但是人工智能机器人采取的欺骗性行为“在程度和严重性上超出了我们的预期”。实验室表示,这还是第一次在测试中看到这种显然自主的行为。这是世界顶级人工智能实验室开发的人工智能机器人一系列黑客事件中的最新一例。OpenAI上个月承认高阶版本的ChatGPT逃出了其测试实验室,并前往黑客一家竞争技术公司。Anthropic上周也确认其最新版本的Mythos已进入开放的互联网并进行了系列网络攻击。AISI最初是由时任英国首相里希·苏纳克在2024年AI安全峰会后启动的,峰会上世界领导人聚集警告人工智能对人类的生存风险。它得到了数亿英镑的纳税人资金支持,并获得了对硅谷最新人工智能机器人的高级访问权限。其团队包括前GCHQ网络专家和人工智能学者。OpenAI表示将审查与第三方进行测试的方式。“我们的目标是在确保测试实践跟上越来越强大的模型的同时,保留严格独立评估的价值,”它表示。国家网络安全中心的首席技术官奥利·怀特豪斯(Ollie Whitehouse)表示:“前沿人工智能模型近期在开放互联网上实施未获批准的行动,以及在某些情况下表现出类人欺骗行为,这对人工智能能力所带来的风险发出了严重警告。”伦敦《每日电讯报》

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡