郭震 AI公众号:郭震AI

实时 AI 消息

Runware推出模块化数据中心Sonic Inference Pod,主打靠近用户的分布式推理

8月4日,AI推理基础设施公司Runware宣布推出自研模块化数据中心Sonic Inference Pod,采用单一可运输单元设计,可在数天内建成并部署在任何有电力的地方。公司称其能以更低成本提供更高质量的推理服务,目前已有10个Pod部署于美国、欧洲和亚太地区。

发布时间
Runware推出模块化数据中心Sonic Inference Pod,主打靠近用户的分布式推理
图源: techcrunch.com

8月4日,AI推理基础设施公司Runware宣布推出自研的模块化数据中心Sonic Inference Pod。该产品采用单一可运输单元设计,代表了一种更灵活的算力形态,可与超大规模云厂商的巨型数据中心项目互补并存。

Runware称,Sonic Inference Pod能以比其他serverless推理平台和GPU云更低的成本提供更高质量的推理服务。模块化设计意味着扩容变得简单——通过不断新建Pod即可快速增加容量,而无需扩建固定数据中心。

联合创始人兼CEO Flaviu Radulescu向TechCrunch表示,靠近终端用户的分布式计算才是长期赢家。除了价格更低,Pod还能快速扩展、可在任何有电力的地方部署,并迅速适配新硬件;它采用闭环冷却系统、不使用水,几天内即可建成,而传统数据中心需要数月甚至数年。

"推理需求增长的速度已经超过了设施建设速度。"Radulescu说,"我们希望为世界的智能提供动力,成为每个AI模型运行的骨干,让算力跟上需求而不是限制需求。"

据Radulescu介绍,Runware目前已有10个Pod部署在美国、欧洲和亚太地区,正在为Higgsfield AI、Wix等公司提供推理服务,并有160个站点可用于部署Pod。去年12月,Runware刚完成5000万美元A轮融资(由Dawn Capital和Comcast Ventures领投),为图像生成场景提供基础设施,Pod被视为公司核心使命——为各类公司提供推理服务——的延伸。

与此同时,OpenAI、SpaceX等公司仍在全美竞相建设大型数据中心,据媒体报道OpenAI接近达成一项5000亿美元的俄亥俄州数据中心协议。但Radulescu并不认为这些巨型项目威胁到Sonic Inference Pod,他把Pod的灵活性视为关键差异点。

"每个Pod都作为单一网络的一部分运行,请求会被发送到离用户更近、有容量的节点;如果一个Pod宕机,流量会自动转移到另一个。"他表示,系统故障只影响一个Pod而非整个固定设施,需要专属硬件的客户也可以独占整个Pod。

看点在于,AI数据中心本就因资源消耗巨大而饱受争议,Runware能否以小型化、快速部署的Pod方案在成本、能效与监管之间找到平衡,将决定"让算力跟上需求"的承诺能否兑现。

为什么重要

Runware以可运输的小型模块化数据中心切入推理算力市场,与超大规模数据中心形成差异化竞争,若规模化落地可能改变推理基础设施的部署与扩容逻辑。

微博邮件

RunwareAI InfrastructureData Center
返回实时消息

附近消息

全部

08/04 21:00

Linux基金会与Open Secure AI联盟发布SAFE指南草案:把智能体安全事件变成全行业防护

在拉斯维加斯Black Hat大会开幕当天,Linux基金会发布SAFE(Shared AI Findings Exchange)指南征求意见稿,旨在把智能体AI安全事故转化为全行业共享防护。该指南由拥有120多家成员的Open Secure AI联盟工作组起草,NVIDIA、思科、CrowdStrike、Hugging Face与红帽等均参与其中。

08/04 21:14

开源版“Claude Science”发布:零依赖、MIT协议,内置30多项科研Skills

据量子位报道,北京大学与元空AI Agent联合实验室发布了一款开源版“Claude Science”,采用MIT协议、零依赖设计,并内置30多项科研Skills。该项目为科研场景的AI智能体提供了一个可直接上手的开源方案。

08/04 21:52

AI智能体公司HappyRobot完成1.5亿美元C轮融资,加码物流与供应链场景

AI智能体公司HappyRobot宣布完成1.5亿美元C轮融资,资金将用于扩大其面向物流与供应链的AI智能体平台,据AI Insider报道。在智能体从通用助手走向行业落地的当口,这笔大额融资再次印证了垂直场景智能体受资本追捧的热度。

08/04 21:58

Liquid AI发布LFM2.5-2.6B:2.6B参数端侧智能体模型,笔记本手机都能跑

Liquid AI在Hugging Face博客发布LFM2.5-2.6B,一个面向端侧部署的2.6B参数智能体模型,支持工具调用与多步工作流。官方称其推理速度最高达220 token/s、内存占用低于2.5GB,可在笔记本乃至手机上运行本地智能体,并已上线浏览器Demo。