返回

文章详情

苹果是人工智能的王者,而没有人知道

Hacker News2026年7月25日 16:55

我想记录下这一点,注明日期:2026年7月17日。苹果现在是人工智能的第一,无可争议的王者,而几乎没有人知道这一点。英伟达正在走向衰亡。我私下里已经说了几个月 — 在群聊中、在电话中,对任何愿意静下来听的人。每隔几周就会有另一个头条出来,让我看起来更像先知,而我厌倦了看着自己的观点在六个月后出现在其他人的思考文章中。所以我写下来了。这是一篇意见文章。这是我的观点。它也恰好是正确的,我会为你提供证据。现在,世界在人工智能领域如何计分:谁拥有最好的前沿模型,以及谁出售训练它的芯片。通过这个计分器,英伟达是无可动摇的。历史上第一家公司市值超过5万亿美元。收入同比增长85%。黄仁勋穿着皮夹克在台上告诉大家“我们的GPU没有闲置的机会。”整个标准普尔500几乎都是对那句话的杠杆押注。但这个计分器衡量的是训练竞赛。而训练竞赛并不是这一切的终点。从来就不是。人工智能的最终目标不是四家公司从弗吉尼亚的数据中心按需租赁智力。最终目标是将智能视为商品——足够满足95%需求的模型,免费下载,在你拥有的硬件上运行,无需向任何人汇报。每一次历史性的技术浪潮都以同样的方式结束:主机变为个人电脑,租用时间变为笔记本电脑,云计算变为边缘计算。唯一反对这种观点的人是出售主机的人。因此,正确的问题不是“谁拥有最好的模型?”而是“当模型变得免费时,它们将在哪种硬件上运行?”这个问题的答案只有一个,而且不是黄仁勋的。让我简单回顾一下过去五个月开放权重AI发生的事情,因为其规律才是真正的故事。二月:阿里巴巴发布Qwen 3.5,一个3970亿参数的混合专家模型,权重已在互联网上发布。四月:DeepSeek发布V4——1.6万亿参数,获得麻省理工学院许可证,以80.6%的分数在SWE-bench验证的开放排行榜上名列第一,同时Moonshot在同一周发布Kimi K2.6。六月:MiniMax发布了具有百万标记上下文窗口的M3;Moonshot随后发布K2.7-Code;而Zhipu发布GLM-5.2——大约7500亿参数,百万标记的上下文,麻省理工学院许可证,毫无附加条件——一个在真实编码基准测试中与封闭前沿系统相抗衡的模型。然后就在这周——实际上是昨天,7月16日——Moonshot宣布了Kimi K3:一个约2.8万亿参数的模型,根据早期的排行榜数据,世界排名第三,仅次于Anthropic和OpenAI的最佳封闭模型。权重承诺在7月27日公开。彭博社的标题是关于中国“缩小与美国竞争对手的差距”。这是礼貌的说法。粗鲁的说法是“买到的最佳模型”和“免费下载的最佳模型”之间的差距现在仅在个位数基准点之间,并且每几周在缩小。这只是本周的模型。这是人们一直未能消化的部分。这不是一次幸运的发布——而是一个规律。现在,几乎每三到六周就会发布一个接近前沿的开放权重模型,每一个都有麻省理工学院许可,并且比上一个更好。你无法通过规律构建护城河。在你将一次发布的价格考虑入你的世界观时,又有两个新的发布出来了。因此,前沿正在实时商品化。这强迫整个市场提出一个拒绝大声问的问题:免费前沿模型究竟在什么地方运行?这是万亿参数模型的肮脏秘密:它们不是被计算限制的,而是被内存限制的。像Kimi或GLM这样的混合专家模型每个标记只激活几十亿参数——计算几乎是平常的,但是整个模型必须坐在快速内存中,所有万亿个参数都在等待。瓶颈不是浮点运算,而是字节。英伟达对“字节”的回答是显存,而显存正是他们消费者故事崩溃的地方。英伟达会卖给你的最大的显卡——RTX Pro 6000 Blackwell,工作站系列的皇冠宝石——只有96GB。就这样。这就是上限。单单一个4位量化的GLM-5.2就大约需要467GB。该卡物理上无法容纳一个现代的开放权重前沿模型。慢慢地,不可能。一个前沿级推理设备,配有整个操作团队的图片。苹果的回答是统一内存——由CPU和GPU共享的一个大型快速RAM池,在M3 Ultra上具有819GB/s的带宽。苹果发布了一款可以配置为512GB的Mac Studio,大约售价9500美元,耗电几百瓦。而且软件也迅速跟上:MLX,苹果专为该架构构建的机器学习框架,加上一个社区,在权重发布后的几天内对每个主要版本进行量化。收据是公开的。DeepSeek的6710亿参数V3以20+

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡