郭震 AI公众号:郭震AI

实时 AI 消息

NVIDIA Vera Rubin NVL72 首登 MLPerf Inference v6.1 即取得领先性能

NVIDIA 在官方博客中公布,Vera Rubin NVL72 机架级系统首次参加 MLPerf Inference v6.1 基准测试即取得领先性能。博文把 AI 推理的经济性归纳为三个杠杆:系统性能、基础设施的线性扩展能力,以及持续不断的软件优化。

发布时间
NVIDIA Vera Rubin NVL72 首登 MLPerf Inference v6.1 即取得领先性能
图源: blogs.nvidia.com

NVIDIA 在官方博客中公布,Vera Rubin NVL72 机架级系统首次参加 MLPerf Inference v6.1 即取得领先性能。MLPerf Inference 是业界用来横向比较 AI 系统服务模型速度与效率的参考基准,因此这一成绩被视为面向采购方的公开信号。

博文把 AI 推理的经济性归纳为三个杠杆。第一个是系统性能:性能越高,生成的 token 就越多,而更多的 token 直接意味着更高的收入。

第二个杠杆是基础设施的高效扩展。NVIDIA 表示,高效扩展意味着增加硬件时吞吐量能够按比例增长,从而在规模化服务用户时占用更少资源;这也是线性扩展的集群与每加一台机器收益递减的集群之间的区别。

第三个杠杆是持续的软件优化,NVIDIA 将其描述为从已经采购的基础设施中产出更多价值。这项工作发生在同一批芯片之上的软件栈中,是三者中最不显眼、却往往见效最快的一环。

之所以值得关注:推理而非训练才是 AI 算力支出增长的主要去向,这一赛道的基准成绩会被云厂商与企业当作下一轮基础设施采购的参考。

对 NVIDIA 而言,这次提交也是一个公开节点,说明 Vera Rubin 这一代平台已经成熟到可以用与其前代相同的基准来衡量。

后续看点包括:这一成绩在之后几轮 MLPerf 中能否保持、扩展效率的说法能否在真实客户部署中得到验证,以及基于该平台的产品何时真正交到客户手中。

为什么重要

MLPerf 成绩仍是推理硬件采购的重要参考,Vera Rubin NVL72 的首秀为 NVIDIA 下一代机架级平台提供了公开的性能背书。随着推理需求成为算力支出的重心,这类基准结果会直接影响云厂商与企业的采购判断。

微博邮件

NVIDIAMLPerfInference
返回AI日报

附近消息

全部

09/16 22:53

不改模型也能提效:Salesforce 智能体浏览器任务完成率从 43.5% 升到 93%

Salesforce 研究人员在不改动底层模型的情况下,把一款 AI 智能体的浏览器任务完成率从 43.5% 提升到 93%。这一结果表明,智能体的可靠性瓶颈很大一部分来自模型之外的工程环节,而不是模型本身的能力上限。

09/16 23:56

诺和诺德联手 Anthropic:用 Claude 前沿模型与科学工作台加速药物发现

诺和诺德与 Anthropic 于 9 月 16 日宣布合作,这家丹麦制药巨头将在部分研发工作流中使用 Anthropic 的前沿模型,并测试 Claude Science 科学工作台,目标是加快新药发现与开发。诺和诺德此前已用 Claude Code 打造监管文档平台 NovoScribe,把临床研究文档产出时间从十周以上压缩到十分钟。

09/16 22:02

微软称竞争对手Anthropic的AI可能对人类造成“灾难性影响”

据BBC报道,微软公开表示,其人工智能竞争对手Anthropic的技术可能对人类造成“灾难性影响”。这把前沿AI的极端风险表述直接放进了竞争语境,也让“谁来定义哪类模型危险”成为争论焦点。

09/17 00:00

OpenAI 联手 AARP:在 10 个美国社区为约 1000 名老年人免费开设 ChatGPT 课堂

OpenAI Academy 与 AARP 旗下的老年人技术服务组织 OATS 合作,在美国 10 个社区举办免费线下活动 Older Adults AI Skills Jam,为约 1000 名老年人提供实操课程,教他们自信、安全地使用 ChatGPT。课程把防诈骗作为核心内容,讲解催促性语言、要求保密、可疑链接等危险信号,并给出暂停、思考、再确认的简单规则。