郭震 AI公众号:郭震AI

实时 AI 消息

Perplexity 把本地智能体 Portable Computer 带到 Windows,需 24GB 显存 RTX 显卡

Perplexity 于 9 月 14 日把本地智能体 Portable Computer 带入 Windows 平台,该功能可在搭载 NVIDIA GeForce RTX 或 RTX PRO 显卡、显存不低于 24GB 的电脑上完全本地运行,面向 Pro 与 Max 订阅用户开放。与云端版本不同,模型、智能体框架、编排器与调度器全部运行在本机,敏感数据不出设备,本地完成的任务也不消耗 Perplexity Computer 额度。

发布时间

Perplexity 在 9 月 14 日把 Portable Computer 带到了 Windows 平台。此前这款本地智能体主要面向 NVIDIA DGX Spark 等设备,并且首发时先支持 Linux,如今它已经进入 Windows 版 Perplexity 应用,用户可以在一台普通 Windows 电脑上运行一个不依赖云端的 AI 智能体。

代价是相当明确的硬件门槛:需要 NVIDIA GeForce RTX 或 RTX PRO 系列显卡,显存不低于 24GB。NVIDIA 表示,对 DGX Station 工作站的支撑预计很快到来,这意味着目前的适用机型仍集中在高端游戏本、移动工作站和配备大显存的桌面主机上。

与云端智能体最大的区别在于运行位置。Portable Computer 把模型、智能体框架、编排器和调度器全部放在本机执行,Perplexity 在 8 月首次发布该产品时就强调,本地完成的工作不会消耗 Perplexity Computer 的额度,敏感信息也不必离开设备。

功能面向 Pro 与 Max 订阅用户开放,覆盖个人方案与企业方案,应用通过 Microsoft Store 下载。用户在模型下拉菜单中选择想要的本地模型后,一键即可完成下载,从而省去自行研究模型和配置推理栈的麻烦。

为了让智能体真正能干活,Portable Computer 提供 Outlook、OneDrive、Word、Google Drive、Gmail、Slack 和 GitHub 等连接器,并可通过运行在 Windows 设备上的本地 MCP 服务器接入其他桌面应用,让本地模型把这些工具与数据纳入自动化流程。

Perplexity 举了一个物流公司的例子:调度方让智能体每天早上核对货运发票,按承运商的本地费率表逐单比对,标出重复收费或偏离合同的价格,并生成异常清单。遇到需要实时信息或更强推理的任务时,智能体可以在征得用户许可后调用 Perplexity Search 或前沿模型。

为什么值得关注?本地智能体把隐私和按量计费这两个云端 Agent 的痛点同时处理掉,数据不出设备,重复性的本地任务也不再消耗额度。这也意味着 Agent 的竞争正从单纯的云端模型能力,延伸到端侧运行效率与办公生态的接入深度。

后续看点在于三件事:更多本地模型何时进入可选列表,DGX Station 等工作站平台何时被正式纳入,以及企业客户是否会为了数据合规而优先选择这种近乎全本地的部署路径。

为什么重要

这标志着 Perplexity 把智能体的卖点从模型能力转向数据主权与成本控制,本地推理成为云端 Agent 的直接替代方案。对企业而言,24GB 显存门槛把选择范围限定在高端 RTX 机型,短期内更可能是专业人士与企业采购而非大众用户的选择。

微博邮件

PerplexityAgentNVIDIAOn-device AI
返回实时消息

附近消息

全部

09/15 18:41

智象未来发布首个原生全模态视频模型 HiDream-O1-Video-1.0,双榜进入全球第一梯队

智象未来(HiDream.ai)9月15日正式发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0,支持文本、图片、视频多模态输入,可一键直出5至20秒1080p视频。该模型在 Artificial Analysis 图生视频榜(含音频)排名全球第四、Arena.ai 图生视频盲测排名第八,发布同期公司宣布完成由新微资本、交子资本、工银资本参与的 C+轮融资。

09/15 17:58

单张GPU跑10万原子:分子之心QuantaMind把酶催化反应模拟成电影

分子之心最新披露,其反应性机器学习力场 QuantaMind 已能在单张 GPU 上以接近量子化学计算的精度,模拟十万原子级体系数百纳秒的化学反应,单步耗时约 0.25 秒。论文层面,它在一个包含 17,792 个原子的完整 PET 水解酶体系中连续模拟 6 纳秒,跑通质子转移、断键成键到完整催化循环的全过程,AI 结果与量子力学复核吻合度超过 0.99。

09/15 20:00

Salesforce 与英伟达推出推理模型 Koa,基于 Nemotron 专攻销售与客服

TechCrunch 报道称,Salesforce 与英伟达合作推出推理模型 Koa,它建立在英伟达开权重的 Nemotron 之上,并被训练用于销售、市场营销和客户支持任务。报道用“AI 实验室应当警惕”来定义这一动作,因为它显示企业软件公司可以基于开源权重自建垂直推理模型,减少对通用大模型厂商的依赖。

09/15 20:03

The Information:字节跳动上半年利润降至200亿美元,AI 支出成主要拖累

据 The Information 报道,字节跳动今年上半年利润降至200亿美元,报道把这一变化主要归因于公司在人工智能上的高额投入。该报道未在公开摘要中披露收入结构与资本开支的详细拆分,但给出了 AI 支出挤压头部公司利润的一个具体量化信号。