【科技24时区】周二,AI基础设施公司Runware正式揭晓了其最新力作——Sonic Inference Pod(声波推理舱)。这并非传统意义上那种需要数年规划、耗资巨大的固定建筑,而是一个可单台运输的模块化单元。它像一个个灵活的算力集装箱,既能独立运作,也能无缝嵌入超大规模数据中心的周边生态。Runware声称,这种形态不仅提供了比无服务器推理平台和GPU云更高质量的推理服务,成本也更为低廉。
从某种角度看,这或许预示着算力供给模式的未来转向。Runware联合创始人兼首席执行官Flaviu Radulescu在接受TechCrunch采访时直言:“我们相信,分布式计算才是长期的赢家。”他的逻辑很清晰:将算力推向离最终用户更近的地方,推理速度自然更快。Radulescu指出,当前推理需求的增长速度远超设施建设的步伐,Runware的目标是成为全球AI模型的算力骨架,让容量紧随需求而动,而非成为扼住需求咽喉的瓶颈。
值得注意的是,Sonic Inference Pod在工程实现上极具巧思。它采用闭合循环冷却系统,彻底摒弃了对水资源的依赖——要知道,传统数据中心往往是当地的“用水大户”。更重要的是其部署速度:传统项目从立项到投运动辄数月甚至数年,而Pod只需几天即可落地。只要有电,它就能运转。这种模块化设计使得扩容变得异常简单:需要更多算力?那就再加一个Pod,无需对固定基础设施进行伤筋动骨的扩建。此外,该系统还能快速适配新硬件的发布节奏,展现出极强的敏捷性。
目前,Runware已在全球范围内部署了10个Pod,覆盖美国、欧洲和亚太地区。公司已拥有160个可用站点为其提供电力支持,客户名单中包括Higgsfield AI和Wix等知名企业。去年12月,Runware完成了5000万美元的A轮融资,原计划用于构建图像生成所需的基础设施。如今看来,Pod的扩展正是这一核心使命的自然延伸:他们不再局限于单一产品,而是致力于为企业提供通用的推理服务能力。
尽管OpenAI、SpaceX等巨头仍在全美各地争抢土地建设超大规模数据中心——据报道,OpenAI即将敲定一笔高达5000亿美元的交易,在俄亥俄州建造巨型数据中心——但Radulescu并不认为这些庞然大物会威胁到Sonic Inference Pod的生存空间。“灵活性是关键区分点,”他解释道。每个Pod都运行在同一张网络中,推理请求会自动导向有剩余容量的节点,且优先选择离用户更近的节点。若某个Pod离线,流量会瞬间切换至其他节点;系统故障的影响被局限在单个Pod内,而非导致整个固定设施瘫痪。对于需要专用硬件的客户,甚至可以独占整个Pod。
Radulescu对其他公司自行构建类似设施持乐观态度,他认为硬件迭代缓慢,且具备构建和维护此类技术的人才池十分稀缺。“电路板设计中的一个错误,可能导致数月的重新设计、仿真、制造、测试和交付延迟,”他指出,“每一个环节都需要有人确切知道每个组件的作用以及缺失后的后果。”
当然,AI数据中心的建设始终伴随着争议,尤其是资源消耗问题。已有社区反映,数据中心所在地公用事业成本上升。虽然Runware愿景中有一个完全依靠可再生能源、不占用社区资源的世界,但那尚非当下现实。Radulescu坦言,无论由谁供应,受推理需求驱动,AI功耗必将增加。Runware当下的专注点在于如何更高效地满足这一需求:“无传输损耗、无水冷却,利用现有电力而非要求新建电网容量。以这种方式构建更多的推理能力,意味着在同等算力下,更少的新电网建设和更少的水资源消耗。”
告别“建厂数年”:Runware推出便携AI推理舱,几天部署挑战传统数据中心
科技区角
2026-08-05 00:02
关于科技区角:国内科技展会垂直内容策划服务商,提供从论坛内容全案策划、会展市场化IP打造到精准专业观众一站式邀约服务,以产业内容吸引高质量B端人群,打通展会从议题设计、演讲嘉宾邀约、宣传预热、精准邀观到供需对接全链路。
声明:内容取材于网络,仅代表作者观点,如有内容违规问题,请联系处理。