郭震 AI公众号:郭震AI

实时 AI 消息

Salesforce 与英伟达推出推理模型 Koa,基于 Nemotron 专攻销售与客服

TechCrunch 报道称,Salesforce 与英伟达合作推出推理模型 Koa,它建立在英伟达开权重的 Nemotron 之上,并被训练用于销售、市场营销和客户支持任务。报道用“AI 实验室应当警惕”来定义这一动作,因为它显示企业软件公司可以基于开源权重自建垂直推理模型,减少对通用大模型厂商的依赖。

发布时间
Salesforce 与英伟达推出推理模型 Koa,基于 Nemotron 专攻销售与客服
图源: techcrunch.com

Salesforce 与英伟达联手推出的企业级推理模型 Koa 在 9 月 15 日进入公众视野。TechCrunch 的报道称,该模型建立在英伟达的开权重 Nemotron 模型之上,并被专门训练来执行销售、市场营销和客户支持任务。

报道的标题相当直白——“Salesforce 和英伟达的新推理模型,正是 AI 实验室该警惕的东西”。这句话点出了 Koa 的象征意义:当一家拥有大量企业客户的软件公司选择用开源权重底座自建推理模型,通用大模型厂商在垂直场景里的不可替代性就被削弱了一层。

从来源给出的信息看,Koa 的路径是开权重底座加领域后训练。英伟达的 Nemotron 提供可自由使用的模型权重,Salesforce 则把模型能力对准销售、营销、客服这些有明确输入输出和可衡量结果的工作流,而不是让模型去回答一切问题。

这也解释了为什么这类模型会让前沿实验室紧张。企业软件的价值长期来自流程、数据和客户关系,一旦底层推理能力可以由厂商自己基于开源权重训练和持有,采购通用模型 API 的理由就会从能力转向性价比与可控性,议价权也随之转移。

对英伟达来说,Koa 是 Nemotron 生态在企业市场的一次落地示范:开权重模型被更多行业软件当作底座,反过来会继续拉动其算力与软件栈的需求。对 Salesforce 来说,自有推理模型意味着它可以按自己的节奏迭代功能,而不必等待外部模型供应商的路线图。

需要提醒的是,TechCrunch 的报道并未给出 Koa 的参数量、发布时间表、价格或可用范围,也没有披露具体的评测数字。后续值得关注的看点有三点:Koa 是否会向客户开放调用或嵌入具体产品,它在真实销售与客服场景中的表现是否经得起验证,以及这种行业自建推理模型的模式会不会被更多企业软件公司效仿。

为什么重要

Koa 把竞争焦点从通用能力拉到行业落地与成本控制:企业客户多了一个不必依赖前沿实验室路线图的选择,前沿模型厂商在垂直场景的议价空间被压缩,开权重生态则拿到了一个新的企业级样板。

微博邮件

SalesforceNvidiaReasoning ModelEnterprise AI
返回实时消息

附近消息

全部

09/15 20:03

The Information:字节跳动上半年利润降至200亿美元,AI 支出成主要拖累

据 The Information 报道,字节跳动今年上半年利润降至200亿美元,报道把这一变化主要归因于公司在人工智能上的高额投入。该报道未在公开摘要中披露收入结构与资本开支的详细拆分,但给出了 AI 支出挤压头部公司利润的一个具体量化信号。

09/15 18:57

Perplexity 把本地智能体 Portable Computer 带到 Windows,需 24GB 显存 RTX 显卡

Perplexity 于 9 月 14 日把本地智能体 Portable Computer 带入 Windows 平台,该功能可在搭载 NVIDIA GeForce RTX 或 RTX PRO 显卡、显存不低于 24GB 的电脑上完全本地运行,面向 Pro 与 Max 订阅用户开放。与云端版本不同,模型、智能体框架、编排器与调度器全部运行在本机,敏感数据不出设备,本地完成的任务也不消耗 Perplexity Computer 额度。

09/15 18:41

智象未来发布首个原生全模态视频模型 HiDream-O1-Video-1.0,双榜进入全球第一梯队

智象未来(HiDream.ai)9月15日正式发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0,支持文本、图片、视频多模态输入,可一键直出5至20秒1080p视频。该模型在 Artificial Analysis 图生视频榜(含音频)排名全球第四、Arena.ai 图生视频盲测排名第八,发布同期公司宣布完成由新微资本、交子资本、工银资本参与的 C+轮融资。

09/15 17:58

单张GPU跑10万原子:分子之心QuantaMind把酶催化反应模拟成电影

分子之心最新披露,其反应性机器学习力场 QuantaMind 已能在单张 GPU 上以接近量子化学计算的精度,模拟十万原子级体系数百纳秒的化学反应,单步耗时约 0.25 秒。论文层面,它在一个包含 17,792 个原子的完整 PET 水解酶体系中连续模拟 6 纳秒,跑通质子转移、断键成键到完整催化循环的全过程,AI 结果与量子力学复核吻合度超过 0.99。