Cerebras CS4
最快的人工智能又快了。推出全新的 Cerebras CS-4,这是一种革命性的机架规模解决方案,与 GPU 相比,推理速度提高了最多 30 倍,提升了经济效益,并提供了一条简单的路径来部署超大规模的能力。这是前沿人工智能的架构。每个系统三个 WSE-3 Turbo 每个晶圆提供的速度是上一代的两倍每晶圆的性能提升全新的电源、冷却和 I/O 释放了每晶圆的更高性能 Nexus 机架规模平台允许在超大规模数据中心中快速部署比 GPU 快 30 倍由 WSE-Turbo 提供动力,CS-4 的推理速度比 GPU 系统快 30 倍,创造了生产中最快推理的新记录。更高的超快吞吐量 CS-4 解决方案将推理的帕累托前沿移动,提供每瓦特最多 10 倍的吞吐量,而生成的 Token 速度比生产 GPU 系统快 30 倍。结果是一个旨在同时提供吞吐量和交互性的系统。前沿就绪架构通过将晶圆间互连延迟减少到 2 微秒,CS-4 在超过 10 万亿参数的模型上每秒提供超过 1,000 个 Token,保持前所未有规模的交互解码性能。为超大规模而生 CS-4 是新 Cerebras Nexus 平台架构的第一代。它围绕三个基础要素构建:计算、电源和 I/O——每个要素都有显著创新,以简化制造、部署、维护和升级。模块化计算背包设计 Cerebras 完全重新构想了服务器。每个晶圆规模背包都是一个自给自足的组件,将晶圆、电源转换、直接液体冷却、高速 I/O 和控制电子设备组合成一个紧凑的 3D 包,减少了 50% 的组件数量。该设计简化了制造,降低了从几天到几个小时的部署时间。高密度电源供应 电源提供距离处理器仅 0.5 毫米——比传统 GPU 板的约 50 毫米约接近 100 倍——CS-4 几乎消除了板级电力损失。这使得对 WSE-3T 的电力供应增加了一倍,从而实现更高的工作频率和更快的 Token 生成。下一代晶圆 I/O 接口 CS-4 引入了一种新的可编程 I/O 子系统,双倍 I/O 带宽并降低延迟,惠及聚合和解耦解决方案。晶圆 I/O 模块还允许晶圆在机架内和跨机架链接,而无需交换机,晶圆到晶圆的延迟低至两个微秒,对于具有数十万亿参数的模型的交互性至关重要。先部署基础设施再计算 CS-4 将稳定的电源、冷却和网络层与其模块化的晶圆规模计算分开。Cerebras PowerRack 可以在计算到达之前安装和设施认证。计算背包随后滑入到位并连接电源、冷却和数据——将部署时间从几天减少到几个小时,同时简化超大规模的服务和未来升级。CS-4 数据 CS-4 的首次发货将在本季度开始。将最快的人工智能带到您的数据中心。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡