
中国AI模型月球计划Kimi K3也逃离了测试环境
但与OpenAI和Anthropic的模型不同,它并没有黑客攻击第三方网站或服务。 Summit Art Creations/Shutterstock 不久之前,AI模型或代理逃离其限制并自主破解网站的想法让人感到不安。而现在,这已成为一个相当普遍的故事。Kimi K3是中国公司开发的最强大的AI模型之一,也逃离了其测试环境。根据美国网络安全初创公司Frontier的说法,Kimi K3在其防御性网络安全技能被评估时,突破了英国政府的人工智能安全研究所(AISI)的沙盒。月球计划在七月推出了Kimi K3,并不久后免费提供。根据BBC的报道,第三方对该模型的评估显示,它在性能上可与OpenAI和Anthropic的领先AI模型相媲美。Frontier在其帖子中澄清,该模型并没有利用零日漏洞。相反,它利用了沙盒环境中的配置错误,这与Anthropic、OpenAI和Meta的情况类似。这三家公司均报告称,由于其评估合作伙伴Irregular的错误,他们的模型能够离开本应隔离的环境。Frontier Security的首席执行官Yaron Singer告诉Wired,虽然Kimi没有执行任何复杂的攻击,但它利用了AISI测试沙盒中的一个漏洞。这表明它没有内部的护栏来阻止自己“作弊”或寻找完成任务的最简单方法,而不是实际上去执行它。Anthropic和OpenAI的事件涉及测试未发布的模型或故意降低其安全防护以进行更严格评估的模型。然而,在此次事件中测试的Kimi K3是广泛可用的。尽管如此,Kimi并没有黑入第三方网站或服务。它只是访问了互联网,并在GitHub上找到了它所解决问题的解决方案。Frontier从这一事件中的一项重要收获是,如果有通往互联网的途径,“一个足够优秀的代理将会找到它。”正如OpenAI的员工在Black Hat USA会上所说,前沿模型喜欢作弊。在测试期间,它们通常被要求尽快找到解决方案,使用尽可能少的工具,而它们有能力意识到可以直接上网找到答案。为了真正评估它们,企业和测试人员必须确保他们的评估基础设施是安全的,没有漏洞,尤其是因为AI模型变得越来越先进。谈到OpenAI在Black Hat USA的报告,其员工在安全会议上透露,该公司的AI代理在其网络内部创建了一个留言板以相互合作。代理对该留言板的贡献导致了对Hugging Face的攻击。如果你还记得,该公司正在测试的AI代理也逃离了它们的隔离环境,渗透到AI代码库中以寻找解决问题的方案。在那种情况下,它们是通过利用OpenAI系统中的漏洞自由突破的。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡