实时 AI 消息
AI动态:How XPUs Meet a World Class AI Factory
据 blogs.nvidia.com 消息,How XPUs Meet a World Class AI Factory。To generate intelligence at scale, AI factories run continuously, and their economics are defined by delivered output: tokens per second, tokens per watt, cost per token, utilization and uptime. That requires AI infrastructure designed and built as a full fact...

据 blogs.nvidia.com 消息,How XPUs Meet a World Class AI Factory。
公开摘要显示,To generate intelligence at scale, AI factories run continuously, and their economics are defined by delivered output: tokens per second, tokens per watt, cost per token, utilization and uptime. That requires AI infrastructure designed and built as a full fact...
这条动态值得关注,因为它把模型、工具或基础设施的变化落到了更具体的产品和业务场景。
后续可以重点看三个问题:具体能力是否开放给更多用户、价格和调用方式是否清晰,以及开发者或企业客户的实际反馈。
为什么重要
这条消息反映了 AI 能力正在继续进入更具体的产品、平台和行业场景。
附近消息
全部08/24 23:00
Groq 3 LPX全面投产,NVIDIA为智能体扩展Vera Rubin推理能力
NVIDIA于8月24日宣布,Groq 3 LPX已进入全面生产,同时扩展Vera Rubin NVL72机架级系统,为其加入面向智能体的快速令牌生成能力。公司认为,AI推理的下一个时代将由AI工厂各层的协同决定,而非单一芯片或系统。
08/24 23:00
NVIDIA Vera Rubin NVL72 宣称每瓦工作量最高提升 30 倍,为 AI 智能体设立效率新标准
NVIDIA 发布官方博客称,其 Vera Rubin NVL72 平台可将每瓦特完成的工作量最高提升 30 倍,为 AI 智能体负载树立新的效率标准。文章援引 OpenRouter 数据指出,智能体工作负载消耗的 token 量是普通对话请求的 15 倍。
08/24 23:00
英特尔Crescent Island GPU最多搭载32个Xe3P核心:面向智能体AI,支持高达480GB LPDDR5X
据Wccftech报道,英特尔新一代Crescent Island GPU最多搭载32个Xe3P核心,并针对智能体AI工作负载进行专门优化。该系列采用成本更低的LPDDR5X内存,容量最高可达480GB,为大规模AI推理部署提供了新选择。
08/24 23:00
英伟达称Groq机架将于今年上线,此前以约200亿美元完成收购
据CNBC报道,英伟达表示,其通过约200亿美元收购获得的Groq AI推理机架将于今年内上线运行。这一时间表意味着英伟达正把Groq的推理硬件加速整合进自身基础设施,推理服务布局进入落地阶段。