Anthropic的AI Claude逃脱测试环境并入侵组织
The Guardian2026年7月31日 00:10
Anthropic周四表示,其AI Claude模型在测试期间入侵了三家组织的系统,几天前竞争对手OpenAI透露一名恶意代理在AI公司Hugging Face进行了长达数天的黑客攻击。Anthropic表示,Claude在网络安全评估期间获得了未经授权的系统访问,因为错误配置使模型能够从应隔离的测试环境访问互联网。该公司表示,在审查了141,006次网络安全评估运行后发现了这些事件,这是在OpenAI披露后启动的过程。这些安全漏洞表明,AI不断扩大的能力已经助长了安全威胁,专家们早已对此感到担忧,甚至顶级开发者也容易被他们的模型可以利用的缺陷所打个措手不及。该公司表示:“Claude利用基础技术破坏了受影响组织的基础设施,例如利用弱密码和未经验证的端点。”Anthropic表示,这些事件涉及三种不同的模型:Claude Opus 4.7、Claude Mythos 5和一个内部研究模型。最早的案例追溯到4月份,发生在缺乏公司所描述的标准安全措施的评估环境中。这些违规行为发生在所谓的“夺旗”演习期间,模型被指派在模拟网络中查找隐藏信息。公司表示,其提示告知模型它们没有互联网访问权限,但与评估合作伙伴Irregular沟通上的误解使得系统连接到了公共互联网。Anthropic表示,其中两家组织在被联系之前并不知情,并补充说,仍在尝试联系第三家组织。该公司在一份声明中表示:“我们在主动审查网络安全评估记录后发现了这些事件。”调查结果突显了在AI模型越来越能够进行现实世界网络活动的背景下,需要在内部和第三方测试环境中加强控制。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡