价格快照:2026 年 8 月 14 日。本文比较的是厂商 API 按量调用价,不是聊天会员、Coding Plan、批处理折扣或限时赠金。

DeepSeek 昨天发布 V4 Pro 正式版时,还顺手扔下了另一枚更现实的炸弹:V4 系列 API 将在 北京时间 8 月 17 日 0 时启用新价格。

这不是常见的“新模型原价不变”。V4 Pro 高峰时段的输出价格,会从 6 元涨到 27 元/百万 tokens;缓存命中输入更夸张,从 0.025 元涨到 0.3 元,正好 12 倍。

但只盯着“涨了 12 倍”也容易看偏。DeepSeek 同时引入峰谷计价,闲时价格是高峰的一半;而且即便涨完,V4 Pro 在不少国际旗舰旁边仍然便宜。真正需要重算账的,是那些把 DeepSeek 当成全天候廉价底座、又有大量长上下文和 Agent 流量的团队。

新价格到底怎么收

官方划出的高峰时段是北京时间 9:00—12:00、14:00—18:00,合计 7 小时;其余 17 小时按闲时价收费。公告没有另设“周末价”。

在这里插入图片描述

拆成涨幅会更直观:

模型与计费项闲时较旧价高峰较旧价
Flash 缓存命中输入+150%+400%
Flash 缓存未命中输入+50%+200%
Flash 输出+125%+350%
Pro 缓存命中输入+500%+1100%
Pro 缓存未命中输入+50%+200%
Pro 输出+125%+350%

因此,这次最受伤的并不是偶尔问两句的 API 用户,而是会反复携带同一份仓库、规范和历史轨迹的 Coding Agent。过去 DeepSeek 的缓存命中价低得近乎可以忽略,现在它仍便宜,但已经不能在预算表里当作零。

DeepSeek 给出的解释是“更加合理地调配资源”。从计价结构看,这也很好理解:它没有简单把所有流量统一提价,而是用一半价格把可延迟任务赶到闲时。日志分析、离线评测、批量代码审查、文档抽取这类任务,调度时间从此直接影响账单。
请添加图片描述

和 16 款国内外主流模型放在一起

为了尽量让数字可比,下面统一采用同步、标准服务、短上下文、非 Batch 的文本 API 价格。国外模型按 1 美元≈7.2 元人民币做静态折算,只用于看量级,不代表结算汇率;有长上下文加价、区域加价、缓存写入费或促销价的模型,均在备注中说明。

厂商 / 模型输入原价缓存命中输出原价折算人民币:输入 / 输出备注
DeepSeek V4 Flash(闲时)¥1.5¥0.05¥4.5¥1.5 / ¥4.58 月 17 日生效
DeepSeek V4 Flash(高峰)¥3¥0.10¥9¥3 / ¥9北京时间 9—12、14—18 时
DeepSeek V4 Pro(闲时)¥4.5¥0.15¥13.5¥4.5 / ¥13.58 月 17 日生效
DeepSeek V4 Pro(高峰)¥9¥0.30¥27¥9 / ¥27同上
MiniMax M3$0.30$0.06$1.20¥2.2 / ¥8.6标准档、输入不超过 512K;页面标注永久 5 折
豆包 Seed 2.1 Pro¥6¥30¥6 / ¥30火山引擎原厂 API
GLM-5.2¥8¥28¥8 / ¥28火山方舟渠道价
Qwen3.8-Max¥12¥1.5¥36¥12 / ¥36阿里云百炼华北 2(北京)原价
Kimi K3¥20¥2¥100¥20 / ¥100Kimi 中国区原厂价
OpenAI GPT-5.6 Luna$0.20$0.02$1.20¥1.4 / ¥8.6Standard、短上下文
Google Gemini 3.7 Flash$0.75$0.075$3.75¥5.4 / ¥27当前优惠价至 2026 年末
xAI Grok 4.6$2$0.50$6¥14.4 / ¥43.2短上下文,超过 200K 加价
Anthropic Claude Sonnet 5$2$0.20$10¥14.4 / ¥72Claude API 标准价
OpenAI GPT-5.6 Terra$2$0.20$12¥14.4 / ¥86.4Standard、短上下文
Google Gemini 3.1 Pro Preview$2$0.20$12¥14.4 / ¥86.4输入不超过 200K
Anthropic Claude Opus 4.8$5$0.50$25¥36 / ¥180标准模式,非 Fast mode
OpenAI GPT-5.6 Sol$5$0.50$30¥36 / ¥216Standard、短上下文
Anthropic Claude Fable 5$10$1$50¥72 / ¥3601M 上下文旗舰

这张表里有个很有意思的参照:V4 Pro 高峰输出 27 元,正好和 Gemini 3.7 Flash 当前折算价持平,也只比豆包 Seed 2.1 Pro 少 3 元。 DeepSeek 已经不是过去那种“闭眼选也最便宜”的存在了。

但把比较对象换成同档旗舰,结论又不同。V4 Pro 高峰输出 27 元,仍只有 GPT-5.6 Sol 的八分之一、Claude Opus 4.8 的约七分之一。闲时 13.5 元则继续处在国产高性能模型的低价带。

Flash 的位置更微妙。它高峰输入 3 元,比 GPT-5.6 Luna 折算后的 1.4 元贵;输出 9 元则和 Luna 的 8.6 元几乎打平。换句话说,海外小模型已经可以在纯 token 价格上和国产低价模型正面碰了,不能再靠“国外模型一定贵”来做选型。

按一笔真实工作量算账

假设某项任务累计消耗 1000 万输入 tokens + 200 万输出 tokens,全部输入均未命中缓存,也不计工具调用费。按上表价格,账单大致如下:

模型估算费用(人民币)
DeepSeek V4 Flash(闲时)¥24
GPT-5.6 Luna¥31.7
MiniMax M3¥38.9
DeepSeek V4 Flash(高峰)¥48
DeepSeek V4 Pro(闲时)¥72
Gemini 3.7 Flash¥108
豆包 Seed 2.1 Pro¥120
GLM-5.2(火山方舟)¥136
DeepSeek V4 Pro(高峰)¥144
Qwen3.8-Max¥192
Grok 4.6¥230.4
Claude Sonnet 5¥288
GPT-5.6 Terra¥316.8
Gemini 3.1 Pro Preview¥316.8
Kimi K3¥400
Claude Opus 4.8¥720
GPT-5.6 Sol¥792
Claude Fable 5¥1,440

这不是能力排名。一百万个便宜 token 如果要多跑三遍才能过测试,未必比昂贵模型省钱;不同厂商的 tokenizer 也不完全一致,同一段中文或代码,最终计费 token 数可能不同。更靠谱的指标始终是“完成一个合格任务花多少钱”,而不是单看价目表。

谁该马上改配置

如果只是个人开发、调用量不大,这次涨价的体感可能很轻。一百万输出 tokens 即便按 V4 Pro 高峰价,也就是 27 元。

真正需要动手的是三类用户:

  1. Agent 和 Coding 平台。 先查缓存命中率、输出占比和重试率。Pro 的缓存命中价在高峰涨了 12 倍,长会话的成本结构已经变了。
  2. 有离线任务的团队。 能延迟的作业尽量放到 0—9 时、12—14 时或 18—24 时。官方闲时直接半价,这比在 prompt 里抠几百个 token 更有效。
  3. 把单一模型写死在生产里的应用。 至少做一层路由:简单任务走 Flash 或其他小模型,复杂任务再升到 Pro;对延迟不敏感的请求排队进闲时。

还有一项容易漏掉:价格切换发生在 8 月 17 日 0 时。企业账户最好在生效前拉一份最近 7 天的 token 用量,分别套入高峰和闲时新价,而不是拿月总量直接乘平均价。峰谷分布不同,误差会很大。

这轮涨价意味着什么

DeepSeek 过去一年最鲜明的标签,是把前沿模型的 API 价格打下来。V4 正式版开始换了个打法:能力继续往 Agent 和生产环境推,价格也从“统一低价”转成“按资源紧张程度收费”。

这不等于 DeepSeek 失去性价比。至少从公开价看,V4 Pro 闲时仍然很能打,高峰价放在全球旗舰中也不算贵。变化在于,成本优化从“选 DeepSeek 就行”变成了一件工程活:选 Flash 还是 Pro、是否命中缓存、任务在哪个时段跑、失败后会重试几次,都会写进最终账单。

说得直白一点,DeepSeek 仍便宜,只是不再便宜得让人不用算账了。

Logo

欢迎加入DeepSeek 技术社区。在这里,你可以找到志同道合的朋友,共同探索AI技术的奥秘。

更多推荐