数据中心的未来是可携带的?Runware打造了一个模块来探索
本周二,人工智能基础设施公司Runware宣布推出其自主模块化数据中心,名为Sonic Inference Pod。该Pod被设计为一个可运输的单元,代表了一种更灵活的计算方式,可以与超大规模的数据中心项目并存。Runware表示,该Pod能够提供比其他无服务器推理平台和GPU云更高质量但更低成本的推理。模块化设计意味着可以快速通过创建新的Pod来增加容量,而不必扩展固定的数据中心。在某种程度上,这就是未来,Runware的联合创始人兼首席执行官Flaviu Radulescu对TechCrunch表示。“我们相信,分布式计算,更靠近最终用户以提供更快速的推理,将在长期内取得胜利,”他说,并以自己的公司作为例子。除了更低的价格,Radulescu还指出,Runware系统可以快速扩展和增加容量,能够在任何有电的地方部署,并能快速适应新硬件的发布。Runware的Pod也不需要水,而是使用一个可以在几天内建成的闭环冷却系统,而传统数据中心的建设则通常需要几个月甚至几年。Radulescu表示:“对推理的需求增长速度超过了设施的建设速度。我们希望能够驱动世界的智能,成为每个AI模型运行的基础设施,以跟上需求的容量,而不是限制它。”Radulescu还表示,Runware目前已经在美国、欧洲和亚太地区部署了10个Pod。该公司已经为一些公司提供推理服务,包括Higgsfield AI和Wix,并且目前有160个可以支持其Pod的地点。Runware在12月份宣布完成5000万美元的A轮融资,以提供公司生成图像所需的基础设施。他们将扩展到Pod视为公司核心使命的一部分:为公司提供推理,而不是单一产品。类似于OpenAI和SpaceX这样的AI实验室仍在美国迅速建设数据中心。例如,OpenAI据报道可能接近达成一份价值5000亿美元的协议,以在俄亥俄州建设一个数据中心。但Radulescu并不认为这些项目对Sonic Inference Pods构成威胁,他将Pod的灵活性描述为一个关键的差异化因素。“每个Pod都是一个单一网络的一部分,因此请求可以转发到任何有容量的地方,靠近用户,如果一个Pod掉线,流量会转移到另一个Pod,”他说,并补充道,系统故障意味着一个Pod处于离线状态,而不是整个固定设施。“想要专用硬件的客户可以拥有整个Pod。”他对其他公司自己建设这个系统并不太担心,简单地表示硬件的开发是缓慢的,能够构建和修复该技术的人才库也很小。“电路板设计中的错误需要几个月的时间进行重新设计、模拟、制造、测试和交付,”他说。“每一个这样的环节都需要一个了解每个组件作用和一旦它失效可能导致的问题的人。”然而,建设AI数据中心是一个有争议的话题,尤其是因为它所消耗的资源。这些数据中心所在的社区已经报告看到公用事业成本上涨。Runware希望有一天能够依靠可再生能源运行,并不占用社区所需的资源,但那一天并不一定是今天。Radulescu表示,AI的能源使用将不可避免地增加,“这是由对推理的需求驱动,而不是由谁提供它。”他表示,Runware目前关注的是如何满足这种需求。“没有传输损失,冷却过程中不使用水,而且我们使用的是已经存在的电力,而不是要求建设新的电网容量。以这种方式构建的更多推理意味着更少的新电网,更少的水资源,以获得相同数量的计算。”通过我们文章中的链接进行购买时,我们可能会获得小额佣金。这不会影响我们的编辑独立性。Dominic-Madori Davis是TechCrunch的高级风险投资和初创企业记者,常驻纽约市。您可以通过电子邮件联系Dominic,邮件地址为dominic.davis@techcrunch.com,或通过Signal上的加密消息:+1 646 831-7565。查看个人资料
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡