郭震 AI公众号:郭震AI

实时 AI 消息

Groq 3 LPX全面投产,NVIDIA为智能体扩展Vera Rubin推理能力

NVIDIA于8月24日宣布,Groq 3 LPX已进入全面生产,同时扩展Vera Rubin NVL72机架级系统,为其加入面向智能体的快速令牌生成能力。公司认为,AI推理的下一个时代将由AI工厂各层的协同决定,而非单一芯片或系统。

发布时间
Groq 3 LPX全面投产,NVIDIA为智能体扩展Vera Rubin推理能力
图源: blogs.nvidia.com

8月24日,NVIDIA宣布扩展其Vera Rubin NVL72机架级系统,为智能体(Agent)工作负载加入快速令牌生成能力,同时宣布Groq 3 LPX进入全面生产阶段。公司表示,AI推理的下一个时代不会由单一芯片、网络或系统定义,而取决于AI工厂各层如何协同工作。

这一更新将Vera Rubin平台定位为面向AI智能体的推理引擎。智能体需要快速、持续的令牌生成来支撑多步推理和工具调用,而NVL72新增的快速令牌生成能力正是针对这一工作负载模式。

公告的另一半是Groq 3 LPX进入全面生产。从发布走向规模化供货,对于正在围绕Vera Rubin一代规划数据中心部署的客户来说是一个实质性信号,意味着相关能力不再只是路线图上的承诺。

NVIDIA将这次更新放在其AI工厂战略的框架下:基础设施应当被设计并构建为完整的系统,而不是单个加速器的集合。同一公告还强调了AI工厂的网络与互连层,包括NVLink Fusion和Spectrum-X。

值得关注的原因在于,智能体AI正在把数据中心的瓶颈从训练吞吐转向推理延迟。能够在机架规模上维持快速令牌生成的系统,正在成为NVIDIA以及在其平台上建设云服务的企业的重要差异化优势。

后续看点:具备新能力的Vera Rubin NVL72系统何时广泛可用,以及在真实智能体工作负载上相比上一代的表现如何。对于正在构建智能体基础设施的企业来说,Groq 3 LPX的量产状态是更直接、更可执行的信号。

为什么重要

NVIDIA正把机架级推理硬件推向智能体工作负载,快速令牌生成而非单纯训练算力,正在成为AI基础设施的下一个竞争焦点。

微博邮件

NVIDIAVera RubinGroq 3 LPXAI Infrastructure
返回实时消息

附近消息

全部