开头

8 月 13 日,DeepSeek 把 V4 Pro 从预览版转正,版本号切到 DeepSeek-V4-Pro-0813。同一张定价页上,分时计价也落地了:北京时间 8 月 17 日 0 点生效。Pro 高峰期缓存命中,从 0.025 元/百万 tokens 直接干到 0.30 元,整整 12 倍

受影响的不是围观群众,是所有已经把 DeepSeek 写进生产链路的团队——尤其是那些靠「缓存极便宜」把长上下文、Agent 循环跑起来的人。

核心分析

这波涨价,打的不是「整体贵一点」,而是 DeepSeek 过去一年最能讲的故事。

缓存命中一直是 DeepSeek 的杀手锏:系统提示词、工具定义、长文档反复打,输入几乎免费。新价里,Pro 缓存未命中只涨 3 倍(3 元→9 元),输出涨 4.5 倍(6 元→27 元),缓存命中却按 12 倍去砍。空闲时段也不是「维持原价」——缓存命中已经先涨到 0.15 元,6 倍起步。高峰再翻一倍,才到 0.30。

更狠的是时段设计。官方高峰是 UTC 01:00–04:00 和 06:00–10:00,换算北京时间就是 上午 9 点到 12 点、下午 2 点到 6 点。中国开发者的核心工作窗口,几乎全是高峰。所谓「空闲半价」,对国内业务基本是夜里和午休。

纸面规格上,Flash 和 Pro 几乎是同一张能力清单:1M 上下文、384K 输出、JSON、工具调用、Responses API、Anthropic 接口,两边都勾了。真正拉开的是账单和配额——Pro 比 Flash 贵 3 倍,并发上限却只有 500,Flash 是 2500。旗舰卖更贵、限更死,这在云厂商里常见;前提是旗舰真的更强。

问题就出在这里。社区里已经有不少人反馈:Pro 正式版体感还不如 Flash。我们自己测下来,很多场景甚至不如之前的版本。该稳的不稳,该准的不准,再叠上 thinking 模式下 reasoning_content 必须原样回传这类接入坑,生产里用 Pro,既贵又脆。

对开发者来说,决策其实很简单:规格一样、质量对不上、价格还按旗舰收,Pro 这个档位就没有存在的理由。对企业来说,更麻烦——财务按「DeepSeek 很便宜」批过的预算,8 月 17 日之后会按工作日高峰重算;产品侧如果还拿官方跑分当选型依据,很容易把钱砸在一个一线并不买账的模型上。

落地建议就三条:默认切 Flash;能缓存的继续缓存,但别再把缓存命中当免费午餐;Pro 只留给你能明确测出增益的那一类任务,测不出来就别付这 3 倍溢价。

苍狮技术团队观点

  • 是否被高估:严重高估。被高估的不是 DeepSeek 这家公司,是「Pro = 更强、值得加价」这套叙事。0813 转正得很快,质量没有同步转正。
  • 短期价值:Flash 仍是国内性价比默认项;Pro 在高峰价下,对绝大多数业务是负价值。
  • 长期价值:涨价本身合理,补贴不可能永久。但先涨价、后把旗舰做稳,顺序反了。长期要看 DeepSeek 敢不敢承认 Pro 现在不值这个价。
  • 是否值得投入:现在不值得为 Pro 付溢价。把评测和时间花在 Flash 的稳定接入、缓存命中率和路由策略上,比追旗舰型号更划算。

总结

DeepSeek 有资格涨价,但没有资格在 Pro 体验还没打过 Flash 的时候,把高峰缓存命中按 12 倍去收。

Logo

欢迎加入DeepSeek 技术社区。在这里,你可以找到志同道合的朋友,共同探索AI技术的奥秘。

更多推荐