
什么是开放权重AI,这项在硅谷引起关注的技术背后的Kimi K3?
中国最新的高性能AI模型来了——但如果你认为这只是另一个聊天机器人,那就再想想。总部位于北京的Moonshot公司在周一发布了其Kimi K3模型的权重——意味着指导AI回答的参数现在是公开的。任何人都可以下载这些权重并进行调整以满足自己的需求。开放权重模型的自由和较低价格吸引了西方商业领袖的目光,这些优点促使科技行业的顶尖领导者发出信件,警告对开放模型的限制,尽管存在潜在的安全风险。那么,什么是开放权重模型?为什么有这么多科技领袖在谈论它们?你需要知道的是什么?什么是开放权重?AI模型是基于大量数据进行训练的。在训练过程中,模型的知识和理解会被编码在“权重”中——一组数字,决定AI如何行为和响应提示。通过开放权重模型,这些数字是公开的。Moonshot AI的创始人杨志霖在2023年3月25日在北京发表演讲。 (Tingshu Wang/路透社)卡纳达CIFAR AI主席、以及多伦多大学教授Nicolas Papernot研究AI安全,他表示,可以把共享权重想象成发布一个蛋糕的食谱,里面列出了成分及其分量,以便其他人可以烘焙并做出替代。在实用层面上,使权重可用意味着任何有互联网连接和足够强大的计算机的人都可以下载并使用该模型。Papernot表示:“这使得现有的开放权重模型成为使用AI的一种经济实惠且可接近的方法,因为常见应用几乎不需要经验。”许多来自中国的模型会发布他们的权重——包括DeepSeek的模型,其中一个在2025年引起了很多关注,当时开发者表示他们以不到600万美元的成本制作它,并声称它可以与北美科技竞争,同时使用更少的数据。WATCH | DeepSeek在2025年1月流行上升:DeepSeek AI应用在2025年1月27日的流行急剧上升,扰乱金融市场,时长2:49来自中国公司DeepSeek的AI驱动聊天机器人已成为北美下载量最多的应用。它的迅速崛起和低成本扰乱了金融市场,并引发了美国人工智能领域领导者的担忧。OpenRouter的排行榜上前五名模型,提供数百个竞争AI模型的访问,均为中国公司的开放权重模型。来自美国顶尖公司的领先模型,如OpenAI和Anthropic,往往是封闭的,尽管它们中的一些确实有开放权重的产品——例如Meta的Llama模型。但是像ChatGPT这样的程序不能下载,必须按原样使用,使用任何公司设置的保护措施和限制。控制和成本是企业的优势。据Omdia技术研究与咨询集团的首席AI分析师Lian Jye Su称,现在,企业领导者仍主要依赖内部AI技术和大名鼎鼎的AI公司。到2025年11月,超过一百万家公司正在使用OpenAI的产品来推动其业务的某些部分,而Anthropic表示,在此之前它每月为超过300,000个企业客户提供支持。但Su表示,越来越多的企业开始采纳开放模型。他说,这部分是因为封闭模型背后的公司可能随时更改或撤回访问权限。随着越来越多的企业开始依赖AI在其运营中的部分,Su表示,基于理论上可能消失的技术构建关键AI系统的想法令人担忧。根据AI初创公司Bagel Labs的创始人和CEO Bidhan Roy的说法,数据隐私也是一个因素。他表示,由于用户可以在自己的技术上下载并运行它们,因此无需与外部公司共享敏感数据。此外,开放模型的自由还可能帮助解决新问题。上周,OpenAI表示,它的一款模型驱动的代理在最近的一次安全测试中逃脱了控制,并对AI初创公司Hugging Face发起了攻击。WATCH | 开放权重模型帮助控制网络攻击:OpenAI模型在安全测试中失控,对初创公司发起网络攻击,时间为7月23日,时长0:56 OpenAI模型在安全测试中失控,触发了对Hugging Face初创公司基础设施的网络攻击。Hugging Face最初尝试使用Anthropic的模型来阻止攻击,但说保护措施阻止了它能够正确识别和控制威胁。最后,正是来自中国公司Z.ai的开放权重模型GLM 5.2被用来“非常迅速”地遏制威胁,Hugging Face的机器学习负责人Yacine Jernite说。 然后,
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡