实时 AI 消息
中国大模型调用量连续十六周领跑,DeepSeek-V4-Flash正式版连续两周第一,今日起API正式涨价
8月17日0时起,DeepSeek正式执行更新调整后的API价格,采用峰谷定价,空闲时段价格为高峰时段的一半,V4-Pro高峰时段涨幅最高达1100%。同期数据还显示,DeepSeek-V4-Flash正式版连续两周位居全球大模型周调用量第一,中国大模型周调用量已连续十六周超过美国。

8月17日0时起,DeepSeek正式执行更新调整后的API价格,采用峰谷定价,空闲时段价格为高峰时段价格的一半,其中V4-Pro在高峰时间段的涨幅最高达1100%。这一调整,发生在DeepSeek-V4-Flash正式版连续两周登顶全球大模型周调用量榜首的背景下。
消息来自《每日经济新闻》8月17日发布的测算报告。该报根据OpenRouter最新数据测算,上周(8月10日至8月16日)全球AI大模型总调用量为75.3万亿Token,环比增长9.13%。其中,中国AI大模型周调用量达36.84万亿Token,环比增长7.56%;同期美国AI大模型周调用量为10.26万亿Token,环比增长11.89%。中国大模型周调用量连续十六周超过美国,稳居全球首位。
在具体排名上,上周全球调用量前二均为中国AI大模型:DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版)连续两周位居第一,周调用量达11.2万亿Token,环比增长27%;腾讯Hy3连续两周位居第二,周调用量达9.95万亿Token,环比增长24%。而DeepSeek-V4-Flash-0423(即预览版)排名第四,周调用量达4.83万亿Token,环比下滑18%。
与调用量数据同步落地的是价格调整。自8月17日0时起,DeepSeek采用峰谷定价,空闲时段价格为高峰时段价格的一半,V4-Pro在高峰时间段的涨幅最高达1100%。这意味着在需求高峰时段调用头部模型的成本将明显上升,而低谷时段则保留了价格弹性。
榜单另一端,OpenAI旗下GPT-5.6 Luna首次进入前三,周调用量达5.31万亿Token,环比增长20%,实现连续三周增长。此前OpenAI已宣布优化GPT-5.6系列定价和性能,其中GPT-5.6 Luna价格下调80%;据Artificial Analysis测算,GPT-5.6 Luna正式版完成单项测试任务的平均成本约为0.05美元,只有Anthropic旗舰模型Claude Fable 5的1/60。
一升一降之间,中美大模型的定价策略形成鲜明对比。一端是中国头部模型随着能力和调用量提升逐渐提高价格,另一端是美国厂商继续通过降低中低端模型价格争夺开发者,中美大模型此前悬殊的价格差正在收窄。摩根士丹利数据显示,2025年第一季度,中国大模型平均输入、输出API价格分别只有美国同行的6%和5%;到2026年第二季度,这两个比例已经上升至19%和14%。
此外,Claude Opus 5首次进入榜单,排名第八,周调用量达2.67万亿Token,环比增长102%,而此前一周排名第八的英伟达Nemotron 3 Ultra(免费版)跌出榜单。接下来值得关注的是,DeepSeek提价之后其调用量是否仍能维持增长,以及国产模型阵营是否会跟进类似的分时定价策略。
为什么重要
DeepSeek在调用量连续登顶后启动分时提价,标志着中国头部大模型从低价竞争转向按能力定价,中美模型API价格差继续收窄,开发者的调用成本结构将随之变化。
附近消息
全部08/17 10:50
摩根大通:GLM 5.3升级+DeepSeek提价重塑中国AI,上调智谱与MiniMax目标价 华尔街见闻
据 news.google.com 消息,摩根大通:GLM 5.3升级+DeepSeek提价重塑中国AI,上调智谱与MiniMax目标价 华尔街见闻。摩根大通:GLM 5.3升级+DeepSeek提价重塑中国AI,上调智谱与MiniMax目标价 华尔街见闻
08/17 09:55
阿里巴巴AI模型下载量突破30亿次,超越Meta与Google
阿里巴巴的AI模型累计下载量突破30亿次,超过Meta和Google,成为全球开发者中采用规模领先的开源模型家族。这一里程碑反映出中国开源AI策略在开发者生态中的影响力正在快速上升。
08/17 09:00
阿里发布Qwen3.8-27B仅四天,即在智能体基准上击败Meta“最强小体量智能体”
阿里Qwen团队8月14日发布开源多模态模型Qwen3.8-27B,发布仅四天,其智能体基准成绩便超过Meta上周推出的“最佳小体量智能体”Muse Glimmer。在SWE-bench Pro与Terminal-Bench 2.1上,Qwen3.8-27B分别领先超过10分和20分,本地开源智能体模型的竞争节奏正以天为单位加速。
08/17 07:43
Hugging Face最新报告:中国开源模型参数规模领跑,AMD与英伟达成美国开源主力
Hugging Face近日发布最新观察报告,显示中国开源模型在参数规模上显著领先美国同行:中国模型月度参数上限在7540亿至2.78万亿之间,而美国模型多数月份低于1300亿。报告还指出AMD与英伟达已成为美国开源模型主要发布方,Qwen衍生模型数量超过15万个,AI智能体正成为模型调用的新用户。