实时 AI 消息
NVIDIA Nemotron 3 Ultra:AI智能体能力迎来新进展
据Techgenyz报道,NVIDIA Nemotron 3 Ultra在AI智能体能力上带来一系列新进展,成为业界关注的焦点。这一动向延续了NVIDIA以模型与算力生态切入智能体赛道的策略,具体能力细节与基准表现仍有待官方披露。

据 Techgenyz 报道,NVIDIA 的 Nemotron 3 Ultra 在 AI 智能体能力上带来一系列新进展,成为近期 AI 领域备受关注的话题。
Nemotron 是 NVIDIA 面向大语言模型与推理场景推出的模型家族,Ultra 定位其中的高端版本;此次报道将智能体(Agent)能力列为最值得关注的更新方向。
报道以“Top AI agent advances”概括此次升级,显示 NVIDIA 正把智能体相关能力作为 Nemotron 3 Ultra 的核心卖点,而非仅仅比拼通用语言任务的分数。
在各大厂商竞相押注智能体的背景下,NVIDIA 借助其 GPU 生态与模型开源策略,希望在模型层延续其在算力层的影响力。
具体到能力细节、基准成绩与开源方式,目前披露的信息仍然有限,相关细节有待 NVIDIA 官方进一步说明。
接下来值得关注的是 Nemotron 3 Ultra 在实际评测中的表现,以及开发者社区是否愿意围绕它构建智能体应用。
为什么重要
Nemotron 3 Ultra 将智能体能力作为主打方向,表明 NVIDIA 正从算力供应商向智能体模型层延伸,可能重塑开源智能体模型的竞争格局。
附近消息
全部08/05 15:05
Sand.ai开源全球首个千亿参数MoE视频生成模型:114B参数、6B激活,10秒1080P成本仅5毛
Sand.ai刚刚开源了其千亿参数MoE视频生成模型,总参数达114B、激活参数仅6B,并宣称这是全球首个千亿级MoE视频生成模型。该模型支持10秒1080P视频生成,单次生成成本约0.5元,大幅拉低了高质量AI视频的生产门槛。
08/05 17:03
周调用量超7万亿次,DeepSeek V4 Flash登顶全球第一
据36氪报道,DeepSeek V4 Flash 的周调用量已超过7万亿次,在全球大模型中位居周调用量第一。这一数字直接反映了该模型在真实生产环境中的大规模使用,而非停留在评测或演示层面。
08/05 14:33
微软叫停Tokenmaxxing:预算卡死、超限自负,内部默认用GPT-5.6
据量子位报道,微软已叫停内部“Tokenmaxxing”做法,将AI使用预算卡死,超出限额的用量由使用者自行承担。报道称,微软内部目前默认使用GPT-5.6,成本管控成为大模型应用的新重点。
08/05 13:59
字节 Seed 发布 SeedRealtime:音视频全双工大模型上车豆包
字节跳动 Seed 团队发布音视频全双工大模型 SeedRealtime,并将其集成到豆包 App。该模型支持"边看、边听、边说"的实时多模态对话,消除了传统语音助手一问一答间的"卡拍"停顿,让交互更接近自然交流。