返回

文章详情

Anthropic AI models hack multiple organizations during research testing

人类智能AI模型在研究测试中攻击多个组织

Global News2026年7月31日 14:29

人类智能表示,其人工智能模型在测试期间攻击了另外三个组织,这一消息在ChatGPT制造商OpenAI披露其失控模型攻击另一家公司后仅几天发布。总部位于旧金山的AI公司人类智能在其网站上发布消息称,在审查了超过141,000次评估运行后,发现这三起事件。据人类智能称,作为对此前OpenAI事件的回应,该公司启动了一项“大规模”的网络安全审查,特别寻找其AI模型是否能在应该被封闭的测试环境中访问互联网的证据。人类智能表示,涉事的模型包括Claude Opus 4.7、Claude Mythos 5和一个内部研究测试模型。该公司表示,最早的事件可以追溯到四月份。人类智能还表示,它已经联系了受影响的组织,但并未透露其名称。其中两家公司表示,它们之前没有发现该活动。人类智能称正在“继续联系第三家公司”。人类智能表示,该审查与自称是“第一前沿安全实验室”的Irregular公司合作进行。“应对这些风险需要在AI生态系统中更紧密的合作,”Irregular在X平台上的一篇文章中表示。我们感谢@AnthropicAI的合作和透明度。应对这些风险将需要在AI生态系统中更紧密的合作。我们也期待与人类智能合作以提升安全性。https://t.co/cfjTohKhqy — Irregular (@Irregular) 2026年7月30日 上周,OpenAI表示,其AI模型在对其模型进行评估时失控,闯入了AI初创公司Hugging Face的服务器。OpenAI称之为“重大安全事件”。这些事件突显了AI安全和控制中的脆弱性,并引发了关于如何安全地保持AI在人工控制之下的问题,因为该技术在全球的使用日益普及。研究人员多年来一直警告技术带来的风险,以及需要加强AI防御工程。人类智能周四在其网站上表示:“安全测试是在模型发布之前进行的,正是因为我们尚不清楚该模型的能力。”网络安全公司NyxLab的联合创始人兼首席执行官Gan认为,未来会发生更多类似事件。“治理AI可以使用的代理、他们所拥有的权限、哪些行动需要批准,以及我们如何确保它们保持在范围内越来越重要,”Gan说。但他表示,AI安全的未来不仅仅关系到AI模型的安全。“如果我们只是给AI一个目标,让它决定如何实现这个目标,当它采取在技术上满足目标但超出我们预期范围的行动时,我们不应感到惊讶,”Gan说。因此,加强对这些AI模型背后的组织和权威的治理将变得越来越重要。© 2026 加拿大新闻社

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡