郭震 AI公众号:郭震AI

实时 AI 消息

DeepSeek 把 V4-Pro 的 API 流量全部切到 V4.1-Flash,并按 Flash 价格计费

据 Pandaily 报道,DeepSeek 已把发往 V4-Pro 的 API 流量全部路由至 V4.1-Flash,并按 Flash 档位的价格计费。这意味着需要 V4-Pro 能力的请求,现在由 V4.1-Flash 承接,成本侧的预期也随之改变。

发布时间
DeepSeek 把 V4-Pro 的 API 流量全部切到 V4.1-Flash,并按 Flash 价格计费
图源: deepseek.com

DeepSeek 又一次走了非常规的产品调整路径。据 Pandaily 报道,该公司把发往 V4-Pro 的 API 流量全部路由到 V4.1-Flash,并按 Flash 档位的价格计费。整件事没有伴随模型发布或技术报告,而是体现在服务端的路由与定价上。

对调用方来说,最直接的变化是请求路径没变、回答的模型变了。需要 V4-Pro 能力的请求,现在由 V4.1-Flash 承接;报道把这一点与计费口径放在一起说,意味着成本侧也随之下移。

从命名与按 Flash 价格计费这一表述看,Flash 档位通常对应更低的价格与更轻的服务定位。如果这一理解成立,那么此次调整的实际效果是:原本按 Pro 档计费的流量,转由 Flash 档位的模型作答并按 Flash 价格结算。

对调用方来说,最值得注意的不是模型名字,而是版本更迭的方式:从发布博客、开放权重,变成了直接改一条路由。这种方式效率很高,却也给下游带来新的功课——评测口径、成本预算与选型记录都需要重新对齐。

需要提醒的是,报道只给出了路由与计费两点信息。V4-Pro 是否停用、V4.1-Flash 与 V4-Pro 的能力差距、切换是否有时间表、旧调用是否需要迁移,报道都没有说明。把“V4-Pro 退役”当成结论,会超出信源给出的范围。

从行业视角看,这类静默切换反映的是推理经济学的变化:在同一条产品线内部,把流量引导到更低成本的版本,是维持价格竞争力最直接的手段之一。代价是用户必须在没有正式公告的情况下,自行确认服务的一致性。

后续可以盯的点包括:DeepSeek 官方文档与定价页是否同步更新、是否提供迁移说明、以及开发者实测到的延迟与质量差异。在这些信息出现之前,最稳妥的做法是把自己对 V4-Pro 的调用当作对 V4.1-Flash 的调用来做验证。

为什么重要

模型版本更迭正在从公开发布转向服务端静默切换,调用方需要把评测、成本与迁移验证常态化,否则很容易在不知情的情况下换了模型。

微博邮件

DeepSeekAPI推理服务
返回实时消息

附近消息

全部

09/14 08:30

智谱在财务公告里提前剧透 GLM-6.0,完全自训练方法被公开

据量子位报道,智谱在一份财务公告中提前披露了下一代模型 GLM-6.0,并公开了其完全自训练的方法,而模型本体与相关论文目前尚未发布。本该由技术博客或论文首发的信息先出现在财务文件里,让外界提前看到了智谱下一代模型的训练路线。

09/14 07:01

《泰晤士报》:英国大臣为「保护国家利益」回避对AI施加约束

《泰晤士报》9 月 13 日报道称,英国大臣们在 AI 监管问题上回避了施加约束,给出的理由是保护英国的国家利益。这篇报道把英国政府在安全关切与产业竞争力之间的取舍重新推到台面上,成为观察其先进 AI 规则走向的一个信号。

09/14 05:03

马斯克欢迎 Grok 接入微软 Copilot,纳德拉强调更多模型选择

微软 CEO 纳德拉宣布把 xAI 的 Grok 模型接入 Microsoft Copilot,称这为用户带来更多模型选择,马斯克 9 月 12 日在 X 上回应表示欢迎。此次接入初期聚焦 Word、Excel 和 PowerPoint 中的 Copilot 体验,推送从参与微软 Frontier 计划的客户开始。

09/14 04:10

约翰逊回应AI降速呼声:国会不能下暂停令,“中国会追上我们”

美国众议院议长迈克·约翰逊在CNN《国情咨文》节目中回应头部AI公司CEO的降速呼吁,拒绝由国会出手监管,称“我们不能对这件事下暂停令,因为中国会追上我们”,安全应由行业自己负责。同日特朗普也表示美国在AI上领先中国、“谁赢得AI谁就赢得一切”,可以设置护栏,但不应被“负面力量”推着走。