实时 AI 消息
NVIDIA Vera Rubin NVL72 宣称每瓦工作量最高提升 30 倍,为 AI 智能体设立效率新标准
NVIDIA 发布官方博客称,其 Vera Rubin NVL72 平台可将每瓦特完成的工作量最高提升 30 倍,为 AI 智能体负载树立新的效率标准。文章援引 OpenRouter 数据指出,智能体工作负载消耗的 token 量是普通对话请求的 15 倍。

NVIDIA 发布官方博客称,其 Vera Rubin NVL72 平台为 AI 智能体工作负载树立了新的效率标准,宣称每瓦特可完成的工作量最高提升 30 倍。
博客援引 OpenRouter 的数据指出,智能体(agentic)AI 工作负载消耗的 token 量是简单对话请求的 15 倍,智能体场景正在成为推理算力消耗的主要来源。
文章以投资研究为例说明智能体的工作方式:智能体查询金融数据库、搜索新闻与监管申报文件、调用子智能体进行同行对比与估值建模,最后把所有信息综合成一份报告。
这种多步骤推理、工具调用与子智能体协作的模式,让单次任务的 token 消耗成倍放大,也使“每 token 成本”成为智能体应用能否规模化落地的关键变量。
在 NVIDIA 的叙事中,AI 工厂的经济性由实际产出定义——每瓦特完成的工作量、token 成本与利用率,决定大规模推理能否持续盈利。
Vera Rubin NVL72 是 NVIDIA 面向 AI 工厂的下一代机架级平台,此次效率宣传直接瞄准智能体负载这一增长最快的推理场景,意在巩固其在推理市场的竞争力。
接下来值得关注的是,这一效率数字能否在第三方基准测试与真实客户部署中得到验证,以及它对云厂商采购决策和 token 定价带来的实际影响。
为什么重要
智能体负载正成为推理算力消耗的主要来源,NVIDIA 以每瓦效率为卖点切入这一场景,可能加速推理市场围绕成本与效率的竞争。
附近消息
全部08/24 23:00
英特尔Crescent Island GPU最多搭载32个Xe3P核心:面向智能体AI,支持高达480GB LPDDR5X
据Wccftech报道,英特尔新一代Crescent Island GPU最多搭载32个Xe3P核心,并针对智能体AI工作负载进行专门优化。该系列采用成本更低的LPDDR5X内存,容量最高可达480GB,为大规模AI推理部署提供了新选择。
08/24 23:00
英伟达称Groq机架将于今年上线,此前以约200亿美元完成收购
据CNBC报道,英伟达表示,其通过约200亿美元收购获得的Groq AI推理机架将于今年内上线运行。这一时间表意味着英伟达正把Groq的推理硬件加速整合进自身基础设施,推理服务布局进入落地阶段。
08/24 23:00
Groq 3 LPX全面投产,NVIDIA为智能体扩展Vera Rubin推理能力
NVIDIA于8月24日宣布,Groq 3 LPX已进入全面生产,同时扩展Vera Rubin NVL72机架级系统,为其加入面向智能体的快速令牌生成能力。公司认为,AI推理的下一个时代将由AI工厂各层的协同决定,而非单一芯片或系统。
08/24 22:45
回收机器人公司EverestLabs为其MRF方案新增AI智能体
据Waste Dive报道,回收领域机器人公司EverestLabs正在为其材料回收设施(MRF)机器人产品线新增AI智能体。目前报道未透露该智能体的具体功能与部署时间,AI在回收自动化中的落地进展值得关注。