实时 AI 消息
Groq 3 LPX全面投产,NVIDIA为智能体扩展Vera Rubin推理能力
NVIDIA于8月24日宣布,Groq 3 LPX已进入全面生产,同时扩展Vera Rubin NVL72机架级系统,为其加入面向智能体的快速令牌生成能力。公司认为,AI推理的下一个时代将由AI工厂各层的协同决定,而非单一芯片或系统。

8月24日,NVIDIA宣布扩展其Vera Rubin NVL72机架级系统,为智能体(Agent)工作负载加入快速令牌生成能力,同时宣布Groq 3 LPX进入全面生产阶段。公司表示,AI推理的下一个时代不会由单一芯片、网络或系统定义,而取决于AI工厂各层如何协同工作。
这一更新将Vera Rubin平台定位为面向AI智能体的推理引擎。智能体需要快速、持续的令牌生成来支撑多步推理和工具调用,而NVL72新增的快速令牌生成能力正是针对这一工作负载模式。
公告的另一半是Groq 3 LPX进入全面生产。从发布走向规模化供货,对于正在围绕Vera Rubin一代规划数据中心部署的客户来说是一个实质性信号,意味着相关能力不再只是路线图上的承诺。
NVIDIA将这次更新放在其AI工厂战略的框架下:基础设施应当被设计并构建为完整的系统,而不是单个加速器的集合。同一公告还强调了AI工厂的网络与互连层,包括NVLink Fusion和Spectrum-X。
值得关注的原因在于,智能体AI正在把数据中心的瓶颈从训练吞吐转向推理延迟。能够在机架规模上维持快速令牌生成的系统,正在成为NVIDIA以及在其平台上建设云服务的企业的重要差异化优势。
后续看点:具备新能力的Vera Rubin NVL72系统何时广泛可用,以及在真实智能体工作负载上相比上一代的表现如何。对于正在构建智能体基础设施的企业来说,Groq 3 LPX的量产状态是更直接、更可执行的信号。
为什么重要
NVIDIA正把机架级推理硬件推向智能体工作负载,快速令牌生成而非单纯训练算力,正在成为AI基础设施的下一个竞争焦点。
附近消息
全部08/24 23:00
NVIDIA Vera Rubin NVL72 宣称每瓦工作量最高提升 30 倍,为 AI 智能体设立效率新标准
NVIDIA 发布官方博客称,其 Vera Rubin NVL72 平台可将每瓦特完成的工作量最高提升 30 倍,为 AI 智能体负载树立新的效率标准。文章援引 OpenRouter 数据指出,智能体工作负载消耗的 token 量是普通对话请求的 15 倍。
08/24 23:00
英特尔Crescent Island GPU最多搭载32个Xe3P核心:面向智能体AI,支持高达480GB LPDDR5X
据Wccftech报道,英特尔新一代Crescent Island GPU最多搭载32个Xe3P核心,并针对智能体AI工作负载进行专门优化。该系列采用成本更低的LPDDR5X内存,容量最高可达480GB,为大规模AI推理部署提供了新选择。
08/24 23:00
英伟达称Groq机架将于今年上线,此前以约200亿美元完成收购
据CNBC报道,英伟达表示,其通过约200亿美元收购获得的Groq AI推理机架将于今年内上线运行。这一时间表意味着英伟达正把Groq的推理硬件加速整合进自身基础设施,推理服务布局进入落地阶段。
08/24 22:45
回收机器人公司EverestLabs为其MRF方案新增AI智能体
据Waste Dive报道,回收领域机器人公司EverestLabs正在为其材料回收设施(MRF)机器人产品线新增AI智能体。目前报道未透露该智能体的具体功能与部署时间,AI在回收自动化中的落地进展值得关注。