郭震 AI公众号:郭震AI

实时 AI 消息

英伟达称Groq机架将于今年上线,此前以约200亿美元完成收购

据CNBC报道,英伟达表示,其通过约200亿美元收购获得的Groq AI推理机架将于今年内上线运行。这一时间表意味着英伟达正把Groq的推理硬件加速整合进自身基础设施,推理服务布局进入落地阶段。

发布时间

据CNBC报道,英伟达表示,其通过约200亿美元收购获得的Groq AI推理机架将于今年内上线运行。

报道援引英伟达方面的说法称,Groq机架的部署正在推进,预计今年即可投入使用。这一时间表意味着,英伟达在收购Groq之后,正加速把后者的推理硬件整合进自己的基础设施版图。

Groq以面向低延迟推理的专用加速器著称,其产品在AI推理市场拥有独特定位。英伟达收购Groq后,外界普遍关注它如何将Groq的硬件与自身的GPU生态结合。

此次上线计划是英伟达从销售芯片走向提供推理服务战略的一部分。随着AI应用从训练转向大规模推理,英伟达希望同时覆盖硬件供应与推理服务两个层面。

为什么值得关注:Groq机架年内上线意味着英伟达的推理基础设施布局进入落地阶段,这将直接影响推理服务市场的竞争格局,尤其是与云厂商和新兴推理芯片公司的竞争。

需要说明的是,目前公开信息有限,机架的具体部署规模、服务客户与收费模式尚未披露。CNBC的报道主要确认了年内上线这一时间节点。

接下来值得关注的是:Groq机架的首批客户是谁、部署规模有多大,以及英伟达将如何定价与运营这一推理服务。

为什么重要

Groq机架年内上线意味着英伟达推理服务布局进入落地阶段,将加剧推理服务市场的竞争,部署规模与客户名单是后续看点。

微博邮件

NvidiaGroqData Center
返回AI日报

附近消息

全部

08/24 23:00

英特尔Crescent Island GPU最多搭载32个Xe3P核心:面向智能体AI,支持高达480GB LPDDR5X

据Wccftech报道,英特尔新一代Crescent Island GPU最多搭载32个Xe3P核心,并针对智能体AI工作负载进行专门优化。该系列采用成本更低的LPDDR5X内存,容量最高可达480GB,为大规模AI推理部署提供了新选择。

08/24 23:00

NVIDIA Vera Rubin NVL72 宣称每瓦工作量最高提升 30 倍,为 AI 智能体设立效率新标准

NVIDIA 发布官方博客称,其 Vera Rubin NVL72 平台可将每瓦特完成的工作量最高提升 30 倍,为 AI 智能体负载树立新的效率标准。文章援引 OpenRouter 数据指出,智能体工作负载消耗的 token 量是普通对话请求的 15 倍。

08/24 23:00

Groq 3 LPX全面投产,NVIDIA为智能体扩展Vera Rubin推理能力

NVIDIA于8月24日宣布,Groq 3 LPX已进入全面生产,同时扩展Vera Rubin NVL72机架级系统,为其加入面向智能体的快速令牌生成能力。公司认为,AI推理的下一个时代将由AI工厂各层的协同决定,而非单一芯片或系统。

08/24 23:00

AI动态:How XPUs Meet a World Class AI Factory

据 blogs.nvidia.com 消息,How XPUs Meet a World Class AI Factory。To generate intelligence at scale, AI factories run continuously, and their economics are defined by delivered output: tokens per second, tokens per watt, cost per token, utilization and uptime. That requires AI infrastructure designed and built as a full fact...