DeepSeek涨价后调用量暴跌94%:大模型“降价潮“里的真实成本账
DeepSeek涨价后调用量暴跌94%:大模型"降价潮"里的真实成本账
体系A · 深度技术商业分析
2026年8月17日
一、一个反常的信号
如果你只关注大模型行业的"主流叙事",过去两个月听到的几乎都是同一句话:token在降价,AI越来越便宜。
OpenAI 把 GPT-5.6 Luna 砍了 80%;Anthropic 用半价推出 Claude Opus 5;Google 给 Gemini 3.7 Flash 打了五折,还附赠一张有效期四个月的"体验券"。就连 FT 的统计都在说:美国头部模型的成交价自 7 月中旬以来一路走低,中美模型的价差已经收窄到输入约 19%、输出约 14%。
就在这种"降价潮"的合唱声中,有一家公司做出了完全相反的选择——大幅涨价。而且,涨完之后,它的 API 调用量在一个被开发者广泛观测的窗口里,5 小时内从 63300 掉到了 3800,降幅 94%。
这家公司叫 DeepSeek。那个曾经把全球大模型价格打到地板、靠"性价比"三个字出圈的"价格屠夫"。

今天(8 月 17 日)0 点,DeepSeek 的新价格正式生效。这篇文章想算清楚一笔账:当 token 单价不再下降,"降价潮"叙事里的真实成本到底是多少?
二、事件还原:从"深夜放大招"到"靴子落地"
把时间线拉直,这次调价其实是一个酝酿了两周、分三步走完的动作:
8 月 6 日,DeepSeek 在开发者后台挂出一条公告:计划近期整体上调 API 定价,"预计涨幅较大"。公告没说具体数字,但"涨幅较大"四个字已经让 V2EX、掘金、微博炸了锅——#DeepSeek计划大幅涨价# 话题一度冲到 474 万热度。当时多数分析还停留在猜测层面:涨多少?什么时候涨?涨完还有没有性价比?
8 月 13 日晚,靴子第一次落下。DeepSeek 连发两个重磅:
- DeepSeek-V4-Pro 正式版(版本号 0813)上线,覆盖 App、网页端与 API 三端,支持 1M 上下文、最大输出 384K tokens,原生支持 OpenAI Responses API 与 Anthropic 兼容接口,Agent 工作流能力大幅升级;
- 开源 DeepSeek Harness(v0.1 预览版,MIT 协议)——一个"一切皆插件"的多智能体执行框架,模型、工具、技能、会话、沙箱、存储、循环、调度、UI 全部插件化,被业内解读为 DeepSeek 从"API 服务商"向"Agent 运行底座"的战略转身。
同一天,调价细节也公布了。
8 月 17 日 0 时,新价格正式生效。DeepSeek-V4-Pro 结束测试期,全面转为正式版商用服务;V4-Flash 同步调价。"降价潮"里唯一的逆行者,把刀落了下来。
三、新价格表:涨幅最高 1100%,但不是"一刀切"
先说结论:这次涨价不是简单的普涨,而是**"整体调价 + 峰谷定价"**的组合方案。DeepSeek 取消了沿用已久的统一计费,改为按高峰/空闲两档时段计价——高峰时段为北京时间工作日 9:00-12:00、14:00-18:00,空闲时段价格是高峰的一半。
以 V4-Pro 为例,每百万 tokens 的价格变化如下:
| 计费项 | 原价 | 高峰价 | 高峰涨幅 | 空闲价 | 空闲涨幅 |
|---|---|---|---|---|---|
| 输入(缓存命中) | 0.025元 | 0.30元 | +1100% | 0.15元 | +500% |
| 输入(缓存未命中) | 3元 | 9元 | +200% | 4.5元 | +50% |
| 输出 | 6元 | 27元 | +350% | 13.5元 | +125% |
V4-Flash 同样上调:原输出 2 元/百万 tokens,高峰涨至 9 元(+350%),空闲 4.5 元;输入(缓存未命中)原 1 元,高峰 3 元,空闲 1.5 元。


两个容易被忽略的细节:
第一,"涨幅最高 1100%"指的是缓存命中输入。 这是最便宜的计费项——从 0.025 元涨到 0.3 元,绝对涨幅其实只有两毛七分五。真正影响账单的是输出价格:高峰 27 元/百万 tokens,是原价的 4.5 倍。对生成型应用来说,输出 token 才是成本大头,这一刀才是切在肉上的。
第二,峰谷定价不是"贴心地帮你省钱",而是"用价格指挥调度"。 官方说得很直白:引导开发者错峰部署任务,平抑日间算力拥堵。翻译过来就是——白天高峰时段的算力已经挤爆了,DeepSeek 选择用涨价把一部分负载赶到夜里去。这与其说是商业策略,不如说是算力供不应求的物理信号。
四、成本真相:token 单价下降 vs 单次成功成本上升
现在回到最核心的问题:为什么"降价潮"里,开发者的真实成本反而可能上升?
因为大模型的成本结构变了——从"按 token 计费"变成了"按成功任务计费"。
传统 API 时代,成本模型是线性的:一次调用消耗多少 token,就付多少钱,账单清晰可预测。开发者选模型的标准很简单——单价越低越好。
但 Agent 时代不是这么玩的。一个 Agent 任务不是一次调用,而是几十次、几百次连续调用组成的执行链:规划 → 调工具 → 看结果 → 修正 → 再执行。在这个结构里,真正决定成本的变量是单次成功任务的期望成本:
成功成本 = 单次调用成本 ÷ 成功率
换句话说,如果一个模型便宜 50%,但它的工具调用成功率低 10%,导致任务平均多重试 20%——便宜的那个模型,最终算下来可能更贵。
这恰恰解释了 DeepSeek 这次调价里的"矛盾操作":一边大幅涨价,一边拼命强化 Agent 能力(V4-Pro 正式版主打生产环境 Agent 性能、开源 Harness 抢占执行框架)。DeepSeek 的真实算盘是:涨价提高单价,但用 Agent 能力提高成功率,让"单次成功成本"的涨幅远小于"token 单价"的涨幅。 它在赌开发者会从"比单价"切换到"比成功成本"。
这个赌注能不能成立,取决于一件事:开发者的调用量,是跟着单价走,还是跟着总账走。
五、调用量暴跌 94%:开发者用脚投票?
知乎热榜上一个 8.1 万热度的问题记录了一个让人心惊的数据:涨价(生效)后,某个被广泛观测的调用窗口里,API 用量从 63300 骤降到 3800,5 小时,降幅 94%。
先声明:这不是 DeepSeek 官方数据,而是开发者社区在热榜问题里晒出的实测/监控观察,样本口径不明,不能直接推成"DeepSeek 全平台调用量跌了 94%"。但它的信号价值不容忽视——它代表的是"价格敏感型用户"这个群体的即时反应。
谁在逃离?三类人最典型:
-
个人开发者与"一人公司":很多轻量级 AI 工具、浏览器插件、Bot 服务,原本就是靠 DeepSeek 的极低价维持正毛利。涨价后,这类产品的成本模型直接失衡——不是"不想用",是"用不起了"。
-
批量跑量的中间层:数据标注、内容批量生成、电商文案流水线这类"高 token 消耗、低单次价值"的调用场景,对单价极其敏感。输出价格 ×4.5 倍,意味着这类业务的单位经济模型要重算。
-
被"缓存命中红利"惯坏的用户:0.025 元→0.3 元的 1100% 涨幅,打击的是深度依赖 prompt 缓存的优化派。缓存命中率越高的用户,这次账单的涨幅感知越剧烈。
但也有一个反向的证据链:DeepSeek 最核心的企业客户——私有化部署方和重度 Agent 依赖方——对价格弹性很低。分析师在涨价公布后接受采访时也判断:中大型企业的调用量不会断崖下滑,因为他们选 DeepSeek 从来不是因为它最便宜,而是因为"够用且不贵"。
所以更准确的说法是:94% 的暴跌发生在"价格敏感的长尾",而基本盘未必动摇。 这恰恰是 DeepSeek 想要的结构——用涨价洗掉低价值流量,把算力让给高价值客户。

六、格局反转:价格战真的结束了
这次调价最有戏剧性的地方在于时间点:DeepSeek 涨价的同时,美国大厂正在集体降价。
| 厂商 | 动作 | 具体数据 |
|---|---|---|
| OpenAI | GPT-5.6 Luna 降价 80% | $0.20 输入 / $1.20 输出,7 月底生效 |
| Anthropic | Claude Opus 5 半价首发 | $5 / $25,仅为 Fable 5 的 $10/$50 一半;搁置 Sonnet 5 九月涨价计划 |
| Gemini 3.7 Flash 五折限时 | $0.75 / $3.75,约为 3.6 Flash 一半,优惠至年底 | |
| DeepSeek | V4-Pro 大幅涨价 | 高峰输出 27 元/百万 tokens(约 $3.8),最高涨幅 1100% |

把两张表放在一起,结论很直白:过去两年"DeepSeek = 最便宜"的条件反射,对于旗舰模型已经失效了。 按当前牌面,GPT-5.6 Luna 和 Gemini 3.7 Flash 的价格都低于 V4-Pro,只有 V4-Flash 还趴在价格底部。
这不是孤立事件。过去一年,"降价潮"的逻辑是:头部厂商靠规模摊薄成本,价格持续下行,倒逼全行业跟进。但 DeepSeek 这次涨价戳破了两个泡沫:
泡沫一:算力不是无限供应的。 出口管制限制高端加速器采购,国产替代产能还在爬坡。推理算力成为稀缺品之后,"用低价换规模"的模式天然不可持续——规模越大,亏得越多。
泡沫二:免费/低价流量不产生收入。 DeepSeek 刚完成第一轮融资(500 亿元),估值已经到 5000 亿量级。投资人要的是 ARPU 和健康毛利,不是"全球第一的 token 消耗量"。梁文锋在内部交流中说过"只赚六倍利润"——这次涨价,就是给这个承诺补上财务注脚。
七、冷思考:大模型商业化的终极矛盾
把视角拉远,DeepSeek 的涨价其实是整个行业走到一个拐点的缩影。大模型商业化始终面临一个结构性矛盾:
规模效应要求调用量无限增长,盈利压力要求单价足够高。这两个目标,天然互斥。
过去两年的解决方式是"先规模后盈利"——用亏损换生态位。但这个窗口正在关闭:算力成本在涨、融资节奏在收紧、资本市场在要求回报。于是我们看到一个奇怪的共生局面:中国厂商开始提价、美国厂商在降价促销——大家都在用各自的方式,寻找"规模与盈利"的新平衡点。
这件事对开发者的影响是深远的:
-
"最便宜的模型"这个头衔,现在月月易主。 过去你选模型可以只看一家,现在必须保持对全市场的价格敏感度——因为"性价比最优解"可能每 30 天就换一次人。
-
单模型绑定是危险的。 模型无关的路由层(Model Routing)会从"优化手段"变成"生存必需"——把简单任务路由到便宜的 Flash,把复杂任务路由到强模型,把失败重试路由到备用供应商。
-
算力,而不是模型质量,正在成为真正的稀缺品。 下一个阶段的竞争主题,大概率是"怎么把有限的算力花出更高的成功成本比",而不是"谁的模型再便宜一毛钱"。
八、给开发者的四张降本清单
面对已经生效的新价格,抱怨没有用,算账才有用:
-
先盘调用结构。 你的成本大头在输入还是输出?缓存命中率多少?高峰时段占比多少?——大多数团队算完会发现,优化 prompt 结构把缓存命中率从 40% 提到 60%,比换供应商省得多。
-
错峰调度。 新价格表里空闲时段是高峰的一半。把批量任务、数据清洗、夜间同步这些不要求实时性的负载挪到晚上,账单直接腰斩。
-
接入路由层。 现在这个价格格局下,单模型策略等于裸奔。至少保留 2-3 家 API 的备选,按任务复杂度自动分配——这已经是标配能力,不是高级玩法。
-
重算"成功成本"而不是"单价"。 如果 V4-Pro 的 Agent 成功率确实高于竞品,27 元的输出价格未必比 10 元的"低成功率模型"更贵。用真实业务数据跑一遍总账,再下结论。
九、结语:价格屠夫的成人礼,行业的分水岭
8 月 6 日,我在上一篇分析里把 DeepSeek 涨价称为"价格屠夫自砍身价";今天靴子落地,我更愿意把它称为行业的分水岭。
从今天起,"降价潮"这个叙事要打个问号了。它不是结束了,而是分化了——头部模型的价格战已经打完了,接下来比拼的是"单次成功成本"、是 Agent 执行效率、是算力调度能力。 便宜的模型依然存在,但"永远最便宜"的承诺不会再有了。
对开发者来说,这是个坏消息,也是个好消息。坏消息是:薅羊毛的时代结束了,每一分 token 都要精打细算。好消息是:当价格不再撒谎,真正有价值的 AI 应用才会浮出水面。 靠低价补贴撑起来的泡沫项目会消失,但用真实效率赢得市场的产品,才刚刚开始。
大模型行业的第一场价格战结束了。第二场战争——关于成本效率的战争——从今天开始。
本文数据来源:DeepSeek 官方公告、华夏时报、中新经纬、第一财经、新浪财经、TechWeb、Fortune/Caixin Global、AIincider、BriefAsia、Pick Right、FT 报道、知乎热榜、V2EX、掘金开发者社区
免责声明:本文为技术与商业分析,不构成投资建议;"调用量暴跌 94%"为开发者社区实测观察,非官方数据,引用请注明口径。
更多推荐



所有评论(0)