郭震 AI公众号:郭震AI

实时 AI 消息

DeepSeek 把 V4-Pro 的 API 流量全部切到 V4.1-Flash,并按 Flash 价格计费

据 Pandaily 报道,DeepSeek 已把发往 V4-Pro 的 API 流量全部路由至 V4.1-Flash,并按 Flash 档位的价格计费。这意味着需要 V4-Pro 能力的请求,现在由 V4.1-Flash 承接,成本侧的预期也随之改变。

发布时间
DeepSeek 把 V4-Pro 的 API 流量全部切到 V4.1-Flash,并按 Flash 价格计费
图源: deepseek.com

DeepSeek 又一次走了非常规的产品调整路径。据 Pandaily 报道,该公司把发往 V4-Pro 的 API 流量全部路由到 V4.1-Flash,并按 Flash 档位的价格计费。整件事没有伴随模型发布或技术报告,而是体现在服务端的路由与定价上。

对调用方来说,最直接的变化是请求路径没变、回答的模型变了。需要 V4-Pro 能力的请求,现在由 V4.1-Flash 承接;报道把这一点与计费口径放在一起说,意味着成本侧也随之下移。

从命名与按 Flash 价格计费这一表述看,Flash 档位通常对应更低的价格与更轻的服务定位。如果这一理解成立,那么此次调整的实际效果是:原本按 Pro 档计费的流量,转由 Flash 档位的模型作答并按 Flash 价格结算。

对调用方来说,最值得注意的不是模型名字,而是版本更迭的方式:从发布博客、开放权重,变成了直接改一条路由。这种方式效率很高,却也给下游带来新的功课——评测口径、成本预算与选型记录都需要重新对齐。

需要提醒的是,报道只给出了路由与计费两点信息。V4-Pro 是否停用、V4.1-Flash 与 V4-Pro 的能力差距、切换是否有时间表、旧调用是否需要迁移,报道都没有说明。把“V4-Pro 退役”当成结论,会超出信源给出的范围。

从行业视角看,这类静默切换反映的是推理经济学的变化:在同一条产品线内部,把流量引导到更低成本的版本,是维持价格竞争力最直接的手段之一。代价是用户必须在没有正式公告的情况下,自行确认服务的一致性。

后续可以盯的点包括:DeepSeek 官方文档与定价页是否同步更新、是否提供迁移说明、以及开发者实测到的延迟与质量差异。在这些信息出现之前,最稳妥的做法是把自己对 V4-Pro 的调用当作对 V4.1-Flash 的调用来做验证。

为什么重要

模型版本更迭正在从公开发布转向服务端静默切换,调用方需要把评测、成本与迁移验证常态化,否则很容易在不知情的情况下换了模型。

微博邮件

DeepSeekAPI推理服务
返回AI日报

附近消息

全部

09/14 11:01

DeepSeek-V4.1-Flash 技术拆解:552B 总参数、8B 激活的 MoE 多模态模型

HackerNoon 对 DeepSeek-V4.1-Flash 的模型卡做了技术梳理:这是一款接受文本与图像输入的多模态混合专家模型,总参数 552B,单次推理只激活约 8B 参数,主打长上下文下的内存与推理效率。模型以 MIT 许可开放权重,支持 1M token 上下文与可调推理强度,但在部分推理基准上仍不及体量更大的 V4-Pro 系列。

09/14 08:30

智谱在财务公告里提前剧透 GLM-6.0,完全自训练方法被公开

据量子位报道,智谱在一份财务公告中提前披露了下一代模型 GLM-6.0,并公开了其完全自训练的方法,而模型本体与相关论文目前尚未发布。本该由技术博客或论文首发的信息先出现在财务文件里,让外界提前看到了智谱下一代模型的训练路线。

09/14 11:18

中国物理AI模型PhysBrain 1.5登顶全球开源榜,空间智能对标GPT-6 Astra

量子位报道称,中国团队的物理AI模型PhysBrain 1.5已登顶全球开源榜一,报道将其描述为跑完了物理闭环里最难的一段路。该模型在空间智能上的表现被拿来与GPT-6 Astra并提,物理AI方向的落地路径因此再次受到关注。

09/14 11:45

CosmosMind联合多校发布MetaRSI-v1:统一三类RSI,并开源可自我迭代的Harness

9月14日,量子位刊载了CosmosMind团队MetaRSI-v1的发布内容:该架构由CosmosMind联合斯坦福、伯克利、MIT、清华、北大等十余家海内外高校提出,被称为全球首个统一Model-RSI、Data-RSI与Harness-RSI的元递归架构,目标是改进“自我改进的过程”本身。团队同时开源了可自我学习、自我迭代的RSI-Harness,并称30亿激活参数的小模型在四项基准上平均自我提升10.9分,六款前沿模型在Terminal-Bench 2.1上平均提升7.3分。