中国最新的人工智能模型终于能与美国竞争者媲美吗?科学家的看法
来源:CN-STR/法新社 通过 Getty 图片 最近,中国研发的大型语言模型(LLM)凭借其规模和能力赢得了科学家的赞誉。上周,总部位于北京的Moonshot AI 发布了‘Kimi K3’,一款强大的推理 LLM,能够处理大量文本。该公司的测试发现,K3 在编码和操作电子表格等任务中,能够与美国竞争模型相匹敌或表现更优。自 DeepSeek 以来,尚无其他中国人工智能模型引起如此大的关注。澳大利亚新南威尔士大学的认知神经科学家 Joel Pearson 表示:“这是一个转折点。他补充道:“人们称之为‘斯普特尼克时刻’。”在模型发布三天后,Moonshot AI 宣布暂停 K3 的新注册,因为需求已经将其系统推到了处理能力的极限。该模型于7月16日发布,恰逢2026年上海人工智能世界大会的前夕。大会上,中国国家主席习近平宣布正式启动全球联盟,创建确保人工智能安全和惠及人类的监管。习近平在会上表示:“在中国看来,所有国家都应采取以人为本的方法,积极、良好地发展人工智能。”同时,他补充,人工智能应成为“共享繁荣与共同安全”的推动者。Kimi K3 发布的时机意义重大,西澳大利亚大学的人工智能研究员 Mehwish Nasim 表示。该模型是在美国公司 Anthropic 发布 Claude Fable 5 的几周后,以及在 OpenAI 发布最新的 GPT-5.6 模型的几天后推出的。她表示:“中国正在表明其不仅要构建前沿人工智能系统的雄心,还希望帮助塑造国际人工智能生态系统及其治理。” 最大的开放权重模型 K3 与其前身 Kimi K2 和 DeepSeek 模型一样,属于开放权重,意味着其核心组件是公开可用的,研究人员可以免费下载和修改,而有关模型训练的信息则是私有的。此外,它还可以通过“应用程序编程接口”(API)进行访问,这使得软件能够以低于 OpenAI、谷歌和 Anthropic 等专有 LLM 的成本进行通信。这些 LLM 是封闭权重,无法下载和修改。Moonshot 表示,模型的权重或参数将于 7 月 27 日发布。澳大利亚国立大学的机器人和人工智能研究员 Rahul Shome 表示,消费者、开发人员和研究人员一直在推动让人工智能模型采用开放权重。Shome 说,K3 尤其令人兴奋,因为它将是最大的开放权重模型,拥有 2.8 万亿个参数和一百万个标记的工作记忆(即人工智能模型使用的文本单位)。然而,该模型的规模太大,无法在个人设备上运行,因此可能需要机构进行 significant 投资来运行它。K3 的大工作记忆意味着它能够记住成千上万行代码的内容或整本书,并减少产生名为幻觉的虚构信息的可能性,悉尼天主教大学的计算智能研究员 Niusha Shafiabady 表示。Shafiabady 表示,她打算亲自测试 K3,要求其总结研究结果。 缩小差距 开放权重模型的性能和能力历来落后于美国专有模型。但该差距似乎是历史上最接近的,昆士兰科技大学生成式 AI 实验室的人工智能问责研究员 Aaron Snoswell 表示。Pearson 表示,中国的开放权重模型正在改变投资者和用户对美国前沿模型价值的看法。谷歌、Anthropic 和 OpenAI 在训练模型方面花费数十亿美元,而中国公司的预算则低得多。此外,Pearson 表示,如果政府决定实施限制,用户可能会失去对美国模型的访问。上个月,Anthropic 在美国政府指示暂停外国国籍人士的访问后,暂时禁用了其最先进的模型 Fable 5 和 Mythos 5。这个月,Fable 5 的访问权限已恢复,但 Mythos 5 仅对特定美国组织可用。新南威尔士大学的计算机科学家 Toby Walsh 表示,尽管美国限制中国获得先进人工智能芯片,出于国家安全考虑,中国 AI 公司仍能够构建前沿人工智能模型。他补充道:“可以说,这里的必要性是发明之母。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡