英伟达表示,Groq机架将在今年上线,购买金额达200亿美元
2026年3月18日,在加利福尼亚州圣荷西举行的Nvidia GTC大会上展示的Nvidia Groq 3 LPU芯片。 大卫·保罗·莫里斯 | 彭博社 | Getty Images 英伟达周一宣布,其Groq 3 LPX机架已全面投入生产,标志着该公司历史上最大收购的技术商业化。 Groq机架将在neocloud Nebius中与Vera中央处理器和Rubin图形处理器一起部署,并将在今年晚些时候上线,英伟达高级总监Dion Harris告诉记者。 英伟达在制造Groq芯片并向客户提供时,突显了低延迟推理的日益重要性,这对于使人工智能代理能够快速响应而不让用户长时间等待,尤其是在编码时,至关重要。 英伟达表示,云公司可以为这些类型的令牌收费更高。 Harris在电话会议上表示:“对于那些提供令牌的用户,这解锁了为那些实际需要最敏感延迟服务协议的用户和客户提供高级服务层的能力。” 去年12月,英伟达以200亿美元收购了芯片创业公司Groq的资产,这是该公司最大的收购。 Groq架构在芯片的Die上包含500MB的快速SRAM,以减少与内存相关的瓶颈。 Groq芯片由三星制造,而台湾半导体制造公司则制造英伟达的GPU。 英伟达将在其LPX机架中包装256颗独立的Groq 3芯片。 英伟达表示,其Groq 3 LPX机架每秒可提供3,400个令牌,引用了来自Artificial Analysis的基准数据。 这是一个竞争激烈的领域。 较小的GPU制造商超威半导体(AMD)今年早些时候宣布将其机架级系统与最近上市的Cerebras的芯片集成,专注于低延迟推理。 OpenAI新宣布的超快模式目前承诺每秒750个令牌,并由Cerebras提供动力。 低延迟芯片并不能替代GPU,后者是AI芯片的主力,不仅能够进行训练,还可以进行推理,并具备足够的灵活性以适应新技术和新模型。 Groq等低延迟芯片主要集中在服务模型的“解码”阶段。 Harris表示:“这并不是要替代GPU,而是要为工作负载的正确部分使用合适的价格和正确的处理器。” 英伟达目前正在加速出货其Vera Rubin系统,该系统于今年早些时候开始生产。在3月Vera Rubin和Groq 3 LPX的发布会上,英伟达首席执行官黄仁勋预计,在2027年之前,当前一代Blackwell芯片和新的Vera Rubin系统之间的累积销售额将达到1万亿美元。 黄仁勋当时表示,他将为编码应用分配四分之一的数据中心空间用于Groq芯片。 “我数据中心的其余部分都是100%的Vera Rubin,”黄仁勋表示。 英伟达将在周三发布财报。 观看:走进英伟达的Vera Rubin人工智能系统现在观看
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡