郭震 AI公众号:郭震AI

实时 AI 消息

英伟达在 IFA 2026 加速本地 AI:RTX Spark Windows PC 十月上市,PAIR 工具可串联多台 PC 算力

在 IFA 2026 上,英伟达联合微软等伙伴集中发布了本地 AI 升级:Hermes Agent、OpenClaw、Perplexity Portable Computer 将获得简化的本地模型配置,llama.cpp 推理吞吐最高提升 1.9 倍,还推出了可在局域网内调度多台 PC 算力的免费工具 NVIDIA PAIR。联想与宏碁的紧凑型 NVIDIA RTX Spark Windows PC 将于 10 月上市。

发布时间
英伟达在 IFA 2026 加速本地 AI:RTX Spark Windows PC 十月上市,PAIR 工具可串联多台 PC 算力
图源: blogs.nvidia.com

在 IFA 2026 上,英伟达联合微软及多家合作伙伴推出了一系列面向本地 AI 的新品与新工具,目标是让前沿智能体更轻松地在个人设备上安装和运行。英伟达同时确认,紧凑型 NVIDIA RTX Spark Windows PC 将于 10 月上市,为 AI 爱好者、开发者和创作者提供本地、安全运行智能体的新选择。

这轮发布的核心主题是消除阻碍本地 AI 普及的配置门槛。英伟达表示,Hermes Agent、OpenClaw 和 Perplexity Portable Computer 三款主流智能体应用将很快提供针对 NVIDIA GPU 的简化本地模型支持,三者均基于 llama.cpp 并集成英伟达最新的推理优化,用户不再需要手动挑选模型、配置推理服务并反复调整量化参数。

推理性能的提升同样具体。新的 llama.cpp 优化在 GeForce RTX 5090 上带来最高 1.9 倍的吞吐提升,涉及内核优化、增强的投机解码与更快的预填充;vLLM 在 RTX PRO 6000 Blackwell 工作站上提升 1.2 倍,在双 DGX Spark 集群上最高提升 1.4 倍。相关优化已可在这两个推理后端直接使用,也可通过 LM Studio 和 Ollama 应用体验。

软件层面还出现了扩大算力池的新工具。NVIDIA PAIR(Personal AI Router,个人 AI 路由器)是一款免费开源工具,目前已在 Windows、macOS 和 Linux 上推出测试版,可自动发现本地网络中的兼容 PC,并把独立的推理请求调度到有空闲算力的设备上,配合 Ollama 和 LM Studio,让智能体任务分散到多台 GPU 并行执行,而不是全部挤在一张显卡上排队。

硬件方面,RTX Spark 将于 10 月上市,联想与宏碁将带来新款 Windows 机型,联想在 IFA 上发布了 Yoga Pro 9n 与 Yoga 9n 二合一笔记本,宏碁展示了紧凑台式机概念。RTX Spark 搭载 1 Petaflop 算力的 RTX Blackwell GPU、最高 128GB 统一内存与 20 核 Grace CPU,并配合新版 Windows Agent 框架,让智能体能在操作系统级管控下于后台安全运行。

生态扩展还延伸到游戏与创意软件:EA、Embark 和 Ubisoft 是最新一批将重磅作品带到 RTX Spark 的发行商,此前 KRAFTON、网易、Riot Games 与 Xbox 已宣布支持;CyberLink 的 PhotoDirector AI PC Mode 也将在 10 月随 RTX Spark 发布并针对其优化,支持本地或云端处理的选择。

从这轮发布可以看出,本地 AI 正从极客实验走向主流 PC 功能,Windows 原生支持与多机算力池化正在改变智能体工作负载的运行位置。接下来的看点是 10 月 RTX Spark 的正式发售,以及 Hermes Agent、OpenClaw 与 Perplexity 的 Windows 支持何时全面落地。

为什么重要

本地 AI 正从开发者实验走向 Windows 主流体验,英伟达与微软围绕智能体硬件、软件与推理栈的协同,将在 10 月 RTX Spark 上市后迎来集中检验。

微博邮件

NVIDIALocal AIIFA 2026
返回实时消息

附近消息

全部

09/04 00:09

家庭AI助手Ollie押注隐私保护,争夺个人AI助手市场

TechCrunch报道,面向家庭与日常生活的AI助手Ollie把隐私保护作为核心卖点,承诺不会用用户数据训练AI模型,也不会与第三方共享。在个人AI助手竞争日益激烈的当下,这家初创公司希望以“可信赖”的定位赢得用户。

09/04 00:24

腾讯发布并开源混元新模型 Hy4 preview:7700 亿参数 MoE,上下文超百万 token

腾讯发布并开源了混元大模型家族最新成员 Hy4 preview,该模型采用混合专家架构,总参数 7700 亿、激活参数 490 亿,支持超过 100 万 token 的上下文窗口。模型将陆续接入 WorkBuddy、CodeBuddy、元宝与 ima 等产品,并可通过腾讯云 TokenHub 与 OpenRouter 的 API 调用,输入定价为每百万 token 0.834 美元。

09/04 00:36

英伟达同意以129.3亿美元收购Hugging Face

据Tech Edition报道,英伟达已同意以129.3亿美元收购开源AI平台Hugging Face,交易消息于9月3日传出。若交易完成,英伟达将把全球最大的开源模型托管社区收入囊中,其在AI基础设施生态中的地位也将进一步巩固。

09/03 23:00

谷歌DeepMind发布AI天气预报模型WeatherNext 3:5公里级分辨率、支持逐小时预报,将接入搜索、地图与Gemini

谷歌DeepMind与谷歌研究院9月3日发布新一代AI天气预报模型WeatherNext 3,关键变量预测分辨率可达5公里,降雨评估较前代提升60%,并可提供逐小时预报。谷歌表示,该模型将接入搜索、谷歌地图与Gemini中的天气信息,同时向谷歌云平台上的用户和研究人员开放。