返回

文章详情

多重宇宙计算公司与高通合作,将高效AI模型引入数据中心

Financial Post2026年8月5日 07:01

西班牙圣塞巴斯蒂安和美国圣地亚哥,2026年8月5日(全球新闻通讯社)——多重宇宙计算公司今天宣布与高通技术公司(Qualcomm Technologies, Inc.)达成合作,将高效的AI模型引入全球数据中心。多重宇宙计算公司的AI模型将专门为高通Dragonfly™ AI200和AI250加速器优化。该合作侧重于高通技术公司的AI加速硬件与多重宇宙计算公司的模型优化技术,使数据中心运营商能够以更高的性能和更低的能耗运行大规模AI工作负载。对于数据中心运营商而言,直接的好处是使用相同硬件获得更多的容量。通过在高通Dragonfly AI200和AI250加速器上运行之前优化AI模型,多重宇宙计算公司减少了每个模型所需的计算和内存占用。这为现有部署腾出了余量,使运营商能够处理更多的推理请求、同时运行更多模型或扩展其AI服务,而无需添加新的加速器或扩展数据中心基础设施。最新的头条新闻、突发新闻和专栏。通过注册,您同意收到Postmedia Network Inc.的上述通讯。欢迎电子邮件正在发送中。如果您没有看到它,请检查您的垃圾邮件文件夹。下一期的头条新闻很快会到达您的收件箱。我们在为您注册时遇到了问题。请再试一次。效率提升在2026年3月的移动世界大会上得到了现场演示,多重宇宙计算和高通技术公司展示了一个在高通® Cloud AI100 Ultra加速器上运行的压缩开源大型语言模型。在一个实时紧急医疗报告的应用场景中,压缩模型的演示提供了比未压缩基础模型快93%的响应时间和高出44%的吞吐量,同时将内存使用量降低了45%,电力消耗降低了21%,且准确率没有损失。在第二次演示中,一个用于查询机密金融文档的本地检索增强生成(RAG)聊天机器人运行速度提高了35%。

赞助内容

NordVPN Next-gen Antivirus

本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。

请我喝杯咖啡