中国的开放式 AI 模型正在挑战硅谷的玩法
人工智能行业并没有真正经历类 DeepSeek 2.0 的时刻,但感觉非常接近。领先的中国 AI 实验室最近表现活跃,发布了一系列几乎是前沿的开源模型。Z.ai 在六月发布了 GLM 5.2,Moonshot AI 上周发布了 Kimi K3,而阿里巴巴则在本周一发布了 Qwen 3.8。硅谷和华盛顿立即开始讨论这些模型,尤其是 K3,它被广泛视为最佳之作。风险投资家、特朗普总统的 AI 顾问 David Sacks 称 Moonshot 的模型表现“令人担忧”。本周早些时候,商务部长 Scott Bessent 表示美国可能会对中国 AI 公司实施制裁。周三,白宫科技政策办公室主任 Michael Kratsios 指控特朗普政府“掌握了 Moonshot AI 提炼 Anthropic 的 Fable 用于开发其 K3 模型的信息”,他表示这相当于“窃取美国专有技术并破坏美国研究”,并且“不可接受”。(Moonshot AI 尚未立即对此做出回应。)新的中国模型有一些共同点:第三方基准测试表明,性能几乎可以与最佳西方模型相媲美;它们针对代理编码任务进行了优化(这是今年人工智能领域最热门的主题);它们或将很快以开源权重的形式发布,使其可访问且透明。但或许当前时刻与 2025 年 1 月的最大相似之处在于——当时世界因 DeepSeek 的 R1 模型而感到震惊——它重申了美国和中国 AI 实验室在开放或封闭方面走向分歧之路。深度崛起首次进入公众视野时,挑战了这样的前提:只有投入数十亿美元计算基础设施和培训建造的封闭源模型才能达到最前沿的表现。但此后,西方 AI 实验室依旧以相同方式发展 AI,而现在的美国前沿模型感觉比一年前更加封闭。Anthropic 说了几个月,其最新的 Mythos 模型在黑客领域表现极为出色,因此只有经过批准的合作伙伴才能使用。当它最终更广泛发布时,白宫通过发布广泛的出口管制作出了回应,迫使 Anthropic 暂时下线 Mythos 及其能力较弱的姊妹模型 Fable 5。同样,OpenAI 在收到白宫请求后也推迟了 GPT 5.6 的发布。与此同时,在中国,情况则显得截然不同。中国初创企业和科技巨头在开源方面愈加重视:任何拥有足够好计算环境的人现在都可以下载开源权重模型,在本地运行,添加自定义,并享受远超 OpenAI 和 Anthropic 所允许的自由。在许多方面,开放与封闭的辩论比以往任何时候都更加复杂地纠缠在美国与中国的辩论中。中国实验室选择建立在开源模型之上的商业战略有很多原因。作为 AI 领域较新的小型参与者,开放和免费的模型能够帮助中国公司吸引更多用户、合作者和媒体关注。这也使他们与 OpenAI、Anthropic、谷歌、SpaceX 和其他深口袋巨头之间的竞争走上了不同的轨道。今年早些时候,有传闻称阿里巴巴可能会在调整其企业 AI 模型开发团队后考虑加入封闭源的竞争。然而,科技巨头在周一宣布将再次发布最新版本的 Qwen——其系列受全球科技社区喜爱的开源模型——并保持开源权重,向客户和公众发出信号,即它尚未转向。这种中国方法的最强有力验证在于模型本身。中国实验室已生产出被广泛认为是世界上最好的开源 AI 模型,表明美国公司不再独占构建最强大系统的权利。Arena AI,一个众包模型评估平台,目前将 K3 排名为 web 开发任务的最佳模型,并在代理任务中排名第四,仅次于 Anthropic 的 Fable 和 Opus 4.8,以及 OpenAI 的 GPT 5.6。独立 AI 基准测试公司 Artificial Analysis 在其智能指数中将 K3 排在第三位。在 Moonshot AI 于 7 月 16 日发布 K3 的预览版后,全球用户开始争相试用,消耗了大量推理计算资源,导致该公司暂时限制新用户注册。当越来越多的人开始使用几乎与西方竞争对手相当的开源中国模型时,有人开始质疑是否真的值得为 OpenAI 或 Anthropic 的产品付费。多个中国实验室能够创建有能力的代理模型并且不惧怕发布它们的事实,
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡