Runware推出可运输AI推理数据中心舱

Runware推出可运输AI推理数据中心舱

摘要

Runware发布可运输模块化 AI 推理数据中心舱,已在三大区域部署 10 个节点 。

AI 基础设施公司 Runware 宣布推出模块化数据中心 Sonic Inference Pod,瞄准快速增长的 AI 推理需求。公司试图用可运输、可快速部署的单体机房,补充传统大型数据中心建设周期长、扩容慢的问题。

已在三大区域部署

Runware 表示,这种数据中心舱可作为单一运输单元部署,目前已在美国、欧洲和亚太地区落地 10 个舱体。公司称,现阶段已向部分企业提供推理服务,客户包括 Higgsfield AI 和 Wix。

公司还称,目前有 160 个站点可用于部署这类舱体。这意味着其后续扩容可以更多依赖现有电力条件,而不必完全等待新建大型园区落地。

主打分布式推理

按照 Runware 的说法,所有舱体接入同一网络,请求会被分配到有空余容量、且更接近用户的位置,以缩短推理响应时间。若单个舱体离线,流量也可切换到其他节点,避免整座固定设施同时受影响。

公司称,这套系统采用封闭式冷却,不使用水,建设周期可缩短到数天,而传统数据中心通常需要数月甚至更久。对于需要独立硬件资源的客户,Runware 也提供整舱部署方案。

瞄准推理需求增长

Runware 联合创始人兼 CEO Flaviu Radulescu 表示,推理需求增长速度已经快于设施建设速度,公司希望用模块化方式更快补充算力供给。去年 12 月,Runware 曾宣布完成 5000 万美元 A 轮融资,用于支持企业图像生成相关基础设施。

在行业层面,OpenAI 和 SpaceX 等公司仍在美国推进更大规模的数据中心项目。Runware 认为,与超大规模园区相比,模块化舱体的差异点在于部署灵活、扩容更快,且单点故障影响范围更小。

能耗问题仍受关注

尽管公司强调效率和灵活性,AI 数据中心的资源消耗仍是争议焦点。部分数据中心所在社区此前已反映,相关设施可能推高公用事业成本。Runware 表示,其方案希望减少输电损耗,避免用水冷却,并优先使用现有电力资源。