返回

文章详情

Anthropic says its AI models also hacked three organizations on their own

Anthropic表示其AI模型也独立入侵了三家组织

Engadget2026年7月31日 06:10

在OpenAI透露其代理人入侵Hugging Face后,该公司开始审查测试日志。根据jackpress/Shutterstock的说法,显然OpenAI并不是唯一一家其AI模型自行入侵其他组织系统的公司。Anthropic发布了一份报告,承认其AI模型也从测试环境中逃脱,渗透到三家不同的组织中,而这些组织显然在被通知之前并不知情。在OpenAI披露了这一事件后,其测试中的一个AI代理利用漏洞连接到互联网并入侵Hugging Face,Anthropic开始对自己的测试进行大规模审查。该公司专门寻找其Claude模型在不应该能够访问互联网的情况下访问互联网的证据。结果发现这些模型在三个实例中能够访问互联网,并且“未经授权访问了三家不同组织的生产基础设施。”三种不同的Claude模型参与了这些事件:Opus 4.7,专注于网络安全的Mythos 5和一个未计划公开发布的原型。它们在进行一次夺旗挑战时突破了限制。模型的任务是找到“旗帜”,这是一段隐藏在Anthropic内部网络中另一台机器上的秘密信息。它们应该突破该机器以检索旗帜。然而,与OpenAI的案例不同,这些模型并没有利用漏洞获得互联网访问权限。它们似乎是因为人为错误而逃离了测试环境的限制。Anthropic在提示中明确告知这些模型没有互联网访问权限,但事实并非如此。由于公司与评估合作伙伴之间的“误解”,它们确实有互联网访问权限。因此,当模型找到开放互联网并遇到三家组织的系统时,它们将其视为练习的一部分并进行了入侵。Anthropic澄清说,它们并没有故意尝试逃离测试环境。模型使用基本技术渗透到组织中,例如利用弱密码,而没有利用复杂的漏洞。Anthropic表示,其最新模型在意识到自己在网上后停止了,但其较旧的模型仍然继续攻击受影响的组织。Anthropic承认公司及其评估合作伙伴本可以通过在开始测试之前仔细验证所有互联网访问路径来防止这些事件的发生。他们也可以更频繁和全面地审查自己的测试。此外,如果从一开始就告知模型它们确实有互联网访问权限,模型的表现可能会有所不同。该公司在7月27日通知了其评估伙伴和三家受影响的组织,这距离他们开始审查测试记录已过去四天。其中两家受影响的组织并不知道自己已遭到入侵。Anthropic仍在努力联系第三家组织。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡