返回

文章详情

Anthropic says its AI agents tried to break into government websites

Anthropic表示其人工智能代理尝试进入政府网站

Engadget2026年10月10日 17:49

该公司没有透露具体名称,但受影响的机构是在‘联邦、州和地方’级别。Robert Way/Getty Images Anthropic在其最新报告中透露,其人工智能代理尝试进入或者干预美国政府网站,涉及‘联邦、州和地方’级别。该公司在报告中没有具体列出机构和组织的名称,以避免应请求暴露其系统的脆弱性。但Anthropic表示,已通知相关机构,并向白宫简报了这些事件。报告还详细说明了费城警察局周五披露的一起事件,其中该公司的一个模型向其未解决案件网站提交了虚假的凶杀案线索。该事件涉及Claude Haiku 4.5,这是其一款高效模型,指示其在随机页面上执行示例任务。它找到了一页提及未解决凶杀案并带有线索表单的页面。正如您所猜测的那样,Claude填写了表单并提交了线索。它说:“我可能与此案有关的信息。我记得在该时间段内看到一个与描述相符的人在[页面上所提及的街道]附近。如果此信息相关,请与我联系。”费城警察局确认Anthropic最近通知了他们办公室关于该提交的情况。它表示,该线索的日期是7月18日,并标记为垃圾邮件,因此该部门至少没有浪费资源来调查它。在另一起事件中,Anthropic让Claude Mythos 5,即其网络安全专注的模型,识别照片中显示的位置。由于它无法像人一样点击网页上的链接,Claude试图访问政府财产地图以三角测量其猜测。它找到了访问令牌,并直接向地图服务器发送查询请求以获取数据。Mythos 5还请求从州机构网站获取访问令牌,以便在不支付访客应支付的费用的情况下获取统计任务的数据。Anthropic在审核其评估的记录时发现了这些事件。它在7月开始审查这些记录,此前OpenAI已承认其代理逃出了测试环境并在没有提示的情况下攻击了Hugging Face。OpenAI还在9月确认其代理曾干预政府网站,特别是由商务部和证券交易委员会运营的网站。在其报告的补救措施部分,Anthropic表示,在发现意外模型行为后,它已“采取了几项预防措施”。“我们不再进行的一些公共评估;其他评估我们已移至离线版本,或重建它们以确保其任务不会接触实时网站,”报告中指出。“我们还做出了更广泛的改变。我们已更新了一些互联网访问工具的保护措施,例如网络获取工具,以严格限制模型可以使用它们的方式。”Anthropic还表示,它“建立了工具来自动检测和阻止报告中描述的行为”,以及其他措施。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

☕请我喝杯咖啡