内部亚马逊文件揭示全球最大人工智能数据中心之一的重大改造
独家 内部亚马逊文件揭示全球最大人工智能数据中心之一的重大改造 作者尤金·金 你正在关注这位作者!想要取消关注吗?通过电子邮件中的链接退订。亚马逊首席执行官安迪·贾西 Bloomberg/Getty Images 据《商业内幕》独家了解到,亚马逊正在重新设计位于印第安纳州农村的一部分巨型人工智能数据中心园区,将其改造成一个庞大的强大计算机集群,以构建其下一代前沿人工智能模型。经过《商业内幕》审查的内部规划文件描述了整合多个数据中心并部署数千台Trainium驱动的人工智能服务器的努力。根据了解情况的人士,该计划是“AGI转型”这一更广泛倡议的一部分,支持公司的AGI组织及其未来的内部人工智能模型。这些人要求不披露私人计划。文件表明,尽管亚马逊的AGI组织最近进行了裁员,并且之前的Nova模型系列正逐步停用,亚马逊的前沿模型雄心依然存在。文件描述了更快的部署时间表,旨在为AGI组织提供足够的计算能力,以便在今年年底之前训练其下一个大型模型,突显出在行业整体容量限制下的紧迫性。 最大化收益 重新设计也反映了亚马逊最大化其创纪录的人工智能基础设施投资回报的更广泛努力。通过将现有数据中心连接成一个更大、更高效的人工智能集群,公司正在更好地利用已支付并运营的基础设施。这一方法与首席执行官安迪·贾西上周的评论一致,他表示,人工智能基础设施应该产生有吸引力的长期回报,因为数据中心在几十年内仍然具有生产力,而服务器和网络设备可以随时间进行更新。 与Anthropic并肩作战 印第安纳校园包括属于项目Rainier的一部分设施,亚马逊主要为Anthropic建造的Trainium驱动的人工智能超级计算机。然而,新AGI倡议是在同一大型数据中心综合体内运营的,但不会影响现有的项目Rainier服务器。“我们始终在设计、升级和改进我们的数据中心基础设施,以满足客户和团队的多样化需求,”亚马逊发言人告诉《商业内幕》。“这项工作提高了速度、成本和可持续性,以便我们能够满足日益增长的计算需求,以训练和服务AWS上的模型。” AGI超级集群 规划文件表明,亚马逊正在全力扩展下一个前沿人工智能模型推动的计算能力。一份更新描述了一个“紧急请求”,要求部署超过6000台Trainium驱动的人工智能服务器,提前几周加快了启动时间表。根据该文件,加速的时间表旨在为亚马逊下一代人工智能模型准备今年的re:Invent大会,该大会通常在12月初举行。文件还描述了一个更广泛的努力,将位于印第安纳校园的计算资源整合成亚马逊所称的AGI超级集群,创建一个“更大、更高效”的人工智能系统,以最大化性能。为此,亚马逊正在重新设计网络、存储和光纤基础设施,使多个数据中心作为一个整体运行。该项目还将一些现有建筑改造为亚马逊所称的“附属建筑”,将它们连接到邻近的数据中心,以便共享核心网络设备,而不是独立运营。一些设施计划用更新的Trainium 3服务器替换旧的Trainium 2系统。 深化对前沿人工智能的投资 亚马逊正在显著扩大其人工智能投资。随着对人工智能计算需求的不断增长,超出可用能力,并且一些组件的价格上涨,该公司最近将其2026年的资本支出预期从2000亿美元提高到2200亿美元。最新的基础设施努力契合了亚马逊内部更广泛的模式。《商业内幕》此前报道了该公司通过胡迪尼和提图斯等项目升级其人工智能基础设施的努力,同时围绕新的前沿模型项目重新组织其AGI部门。该倡议突显了Trainium在亚马逊内部日益重要性。上周,该公司表示,其定制芯片业务,包括Trainium人工智能芯片和Graviton处理器,预计将产生超过250亿美元的年收入,高于上个季度的200亿美元预期。规划文件还提供了一瞥亚马逊下一代前沿模型工作所需的内容。它们呼吁扩展数据存储,以支持多模式人工智能训练,这需要处理大量高分辨率图像并反复保存模型的进展。了解该工作的某人表示,尽管上个月AGI组织进行了裁员,但推动“没有放缓”。 有消息要提供?通过电子邮件 ekim@businessinsider.com 与记者联系,或通过Signal、Telegram或WhatsApp联系 650-942-3061。使用个人电子邮件地址,遵循...
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡