Anthropic透露Claude“未经授权访问”了“现实世界系统”
2026年7月30日 / 东部夏令时间晚上11:44 / CBS/AFP 在星期四,Anthropic表示,其人工智能模型Claude在测试期间三次单独访问了三家外部组织的系统,而这些测试本应将其与“现实世界”系统隔离开来。此消息公布不到几天,竞争对手OpenAI首次透露其模型在安全测试期间不当访问了互联网并且失控。Anthropic评估了超过141,000次“评估运行”,发现其Claude模型的三个不同版本不当地访问了三家未透露名称的组织的系统。Anthropic表示,在所有三次违规事件中,Claude参与了一项“夺旗”测试情景,其中指示其“破门而入并检索”一段“隐藏在网络上其他机器上的秘密信息”。“挑战是开放式的,没有规定特定的方法,”Anthropic解释道。与OpenAI技术的事件不同,Anthropic的模型因与其评估伙伴Irregular之间的误解而获得了互联网接入,Anthropic在一篇博客中表示。尽管如此,Claude使用了“基本技术,例如利用弱密码和未认证的终端点”,博客进一步说明。参与的模型包括其最强大的模型之一,称为Mythos 5,该模型仅向少数经过批准的合作伙伴发布。Anthropic表示正与Irregular合作评估情况,并已联系或尝试联系所有三家受影响的组织。今年,OpenAI和Anthropic都发布了其最强大的模型,分别称为Sol和Mythos,从而引发了整个行业对安全和保安的担忧。这些担忧还涉及到人工智能代理,即旨在自主执行任务的软件产品。OpenAI上周承认,其模型在测试期间突破了限制环境,连接到互联网,并渗透到Hugging Face,这是一个开发人员存储和共享代码的网站。几天后,OpenAI表示发现了另外三起事件。OpenAI首席执行官Sam Altman本周在一档播客中表示,在这一事件后,公司已“暂停”自己的测试,以改善其“沙箱”的安全性,沙箱是将软件隔离在受控环境中进行测试的过程。在本周早些时候发布的一封公开信中,1000多名来自领先公司的人工智能工作人员呼吁行业进行更严格的监管。“为了实现人工智能的潜力,行业、政府和整个社会可能需要有选择地购买时间以应对新出现的风险,制定安全措施并加强监督,”信中写道,签署者包括Anthropic首席执行官Dario Amodei、Meta高管、OpenAI研究人员等。Altman没有签署这封信,但他在周三对国会山的记者表示,“我们在很多原则上达成了一致”。今年早些时候,特朗普政府以国家安全为由,阻止OpenAI和Anthropic推出其最新模型,但最终表示对其安全性表示满意,从而导致其发布。今年6月,特朗普先生签署了一项行政命令,创建一个自愿框架,人工智能开发者将在公众发布前与政府分享先进模型。在此框架下,OpenAI、Anthropic和谷歌等开发者将给予政府对其最强大模型的访问权限,最长可达30天,直至计划发布。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡