「调用量暴跌 94%」是假的,但 DeepSeek 涨价首日,确实有人被精准收割了
导语
DeepSeek 涨价首日(8·17),全网都在骂。但有一个数据被骂声盖住了:它的调用量,没掉。更反常识的是——真正被这轮涨价"精准收割"的,不是那些喊着要离开的人,而是把缓存命中率优化到 98%、把 Pro 当默认选项的重度用户,比如我。这篇文章不替谁喊冤,只做两件事:把"暴跌"的谣言拆干净,把"怎么不再被坑"的账算明白。
一、先拆一个蔓延全网的谣言
涨价首日,一条消息在群里疯传:"DeepSeek 调用量暴跌 94%!"
别急着转发。这个数字,是个误读。

它指的并不是 DeepSeek 官方调用量,而是第三方平台 OpenCode 的 Go 套餐额度调整:V4-Flash 的每 5 小时调用配额,从约 63300 次 砍到了 3800 次——降幅确实接近 94%。但这是 OpenCode 替用户扛的补贴,因 DeepSeek 涨价而收缩了。它是 OpenCode 的额度,不是 DeepSeek 的调用量。 把"第三方补贴被砍"说成"官方调用量暴跌",相当于把"超市优惠券发完了"说成"全国人民都不买菜了"。
那真实数据长什么样?看 OpenRouter 的周度口径(涨价前一周 8/10–16):
- 全球大模型总调用 75.3 万亿 Token,环比 +9.13%;
- 中国模型 36.84 万亿 Token,连续 16 周 超过美国;
- DeepSeek-V4-Flash 11.2 万亿 Token,环比 +27%,连续两周登顶。
需求惯性极强。"用户用脚投票离开 DeepSeek"这件事,目前没有任何数据支撑。
于是反差就立在这里:骂声一片,但调用量没掉。 为什么涨价没吓跑人?答案不在"用不用",而在"怎么用"——而这,才是本轮涨价真正改写的规则。
二、主体:缓存绞索与一次思维转变
2.1 最狠的一刀,砍在"最安全"的那一列
先看清涨价的真实结构(单位:元 / 百万 token,高峰时段):
| 模型 | 计费项 | 旧价 | 高峰新价 | 高峰涨幅 |
|---|---|---|---|---|
| V4-Pro | 缓存命中输入 | 0.025 | 0.30 | +1100% |
| V4-Pro | 输出 | 6 | 27 | +350% |
| V4-Flash | 缓存命中输入 | 0.02 | 0.10 | +400% |
| V4-Flash | 输出 | 2 | 9 | +350% |
高峰时段:北京时间 9:00–12:00、14:00–18:00;空闲时段半价。
注意看那个"异常列"。涨幅最狠的,不是你直觉里的"输出",而是过去两年被开发者当免费午餐的缓存命中输入:Pro +1100%、Flash +400%。
这反常识。因为过去两年,工程师们最得意的事,就是把自己的工作流"缓存命中率优化到 98%"——那是勋章,意味着又省又快。可现在,恰恰是这一列被放大得最狠。

2.2 一张截图的两副面孔
涨价首日最传神的一幕:工程师 GDP 在 X 上晒出一张 "Cache hit 98%" 的截图,本意是证明"涨价后 DeepSeek 仍最便宜"。
三天后,有人把新价表做成百分比可视化图——"缓存命中 +1114%" 这一个数字,让那张截图从勋章变成了靶子。
网友的总结很毒,也很准:
- @web3tasks:「高命中率才是陷阱。」
- @Bryan_1269:「DeepSeek 在推理和每轮工具调用上更费 token,单价优势会被用量抵消。」(单价便宜 ≠ 总账便宜)
一句话提炼:
缓存曾经是工程指标,现在成了财务旋钮——厂商随时可以拧它。
类比很俗但很真:就像外卖平台取消满减的同时,把抽成翻了十倍。你以为自己省了,其实只是计费项换了地方。
2.3 云商业的经典剧本
把这事拉远一点看,它一点都不新鲜。
先用超低的缓存命中价,培养全世界的开发者建出"高命中路径依赖";等无数 Agent、工作流、产品都跑在这条路径上、离不开你,再涨命中价——这是云计算史上"先低价养负载,再重新定价稀缺资源"的经典剧本。
但 DeepSeek 这一刀的特别之处在于:它涨的,是用户最视为安全区的那一列。你越信任它、越优化它、越把它当默认,它反弹时打你的位置就越准。
你优化得越好,被收割得越狠。这是云计算史上最优雅的陷阱。
2.4 谁最疼:被绞索套住的三类人
把账单摊开,这一轮真正被套住的,是三类人:
- 高缓存命中、长上下文复用的 Agent 用户——缓存价涨最狠,命中率越高、账单被放大的比例越大;
- 输出密集型用户:批量写营销文案、商品介绍、小说剧本、长报告——注意,这条直接命中我这种内容创作者;
- 必须国内工作时间实时响应的应用:在线客服、实时编程助手,无法错峰,注定吃不到空闲半价。
我是第二类,同时带着第一类特征。接下来的账,我替自己算。
2.5 我的账,与一次思维转变
我是个 AI 重度用户:写网文初稿、给客户出营销文案、跑长报告,顺带探索一人公司(OPC)。过去我的默认动作是——复杂任务无脑上 Pro,且默认相信"缓存命中最便宜,命中率越高越省"。
这次涨价逼我把这套信念拆了重算(以下为我按自身上月用量的估算,实际以你账单为准):
假设我月度消耗约 1000 万 token 输出(约 670 万字产出,含多轮生成与重写)、输入中 80% 命中缓存。
-
场景 A「无脑 Pro + 全高峰」
- 输出:27 元/百万 × 10 = 270 元
- 命中输入:0.30 元 × 32(命中 3200 万)= 96 元
- 未命中输入:9.0 元 × 8 = 72 元
- 月账单 ≈ 438 元
-
场景 B「Flash 为主 + 复杂才 Pro + 错峰」
- 输出:70% 走 Flash(9×7=63)+ 30% 走 Pro(27×3=81)= 144 元
- 命中输入:Flash(0.10×22.4=22.4)+ Pro(0.30×9.6=2.88)= 25.3 元
- 未命中输入:Flash(3×5.6=16.8)+ Pro(9×2.4=21.6)= 38.4 元
- 月账单 ≈ 208 元
两个场景差出 230 元 / 月,一年就是 2700 多元。再叠加空闲时段半价,还能再降一截。
而最刺眼的一组对照,是价格极差本身:V4-Pro 高峰输出 27 元,对上 V4-Flash 空闲输出 4.5 元——6 倍价差。过去我懒得切换,等于每个月白白交了一笔"无脑税"。
所以这一轮涨价教我的一件事,是一句必须刻进工作流的话:
过去无脑 Pro,现在算 TCO。简单任务用 Flash,复杂才上 Pro——该用 Flash 就得用 Flash。
TCO(总拥有成本)不是新词,但它是这次涨价后每个 AI 用户的必修课:别再比"价目表上谁便宜",要比"完成同一件事,我到底花了多少"。错峰、维持高命中、按任务路由模型——组合起来,才是真实的省钱。
三、一节防骗:那些骂 DeepSeek 的,可能骂错了对象
讲完"怎么不被价格绞索套住",必须补一节防骗。原因有两个:
其一,别让读者捡便宜吃大亏。 涨价当口,最容易冒出来的是各种"低价 DeepSeek""永久会员""本地部署神器"——它们很多根本不是 DeepSeek。
其二,也是更关键的:替 DeepSeek 正名。 不少人体验过"卡顿、答非所问、要付费才能用"的所谓 DeepSeek,转头就骂原厂拉胯。可那很可能是李鬼,不是李逵。把垃圾体验算在 DeepSeek 头上,既不公平,也耽误你自己避坑。

三个真实案例,足够当警钟:
- 315 曝光:2026 年 315 点名仿冒 DeepSeek 的山寨应用超 12 种——套官方名和图标、充会员收费、套壳免费 API,甚至干脆是纯假输入框,你输什么它都装模作样回一句。
- 监管铁案:市场监管总局公布的 5 起 AI 不正当竞争案里,3 起是仿冒 DeepSeek——"DeepSeek 本地部署工具"套官方图标引流、杭州博珩用相似图标混淆、上海熵云伪装成"ChatGPT 中文版"。
- Monolith-1.0 骗局:一个德国人,用 Qwen2.5-7B 的权重碎片 + DeepSeek API 套壳,冒名"世界第 1 大模型",15 万人围观后翻车。
李鬼的错,不该算在 DeepSeek 头上。
给你三条可操作的识别铁律:
- 认准官方域名:网页只信
deepseek.com,API 只信api.deepseek.com; - 不从第三方买 key:凡是让你去某宝、某群、某网盘买"DeepSeek 密钥"的,一律当骗子;
- 凡是连钱包、谈 Pre-IPO、要扫码验证的,一律假的:官方不会用这些话术找你"投资"或"激活"。
四、收尾:一句话,接回上一篇
首日数据印证了上篇的判断:需求没掉、算力更紧,重新定价是必然。
至于调用量的真实走向,等 OpenRouter 下周报出来,再做一次数据深读——不抢下无据的结论。
更多推荐
所有评论(0)