DeepSeek 这次真涨价了:V4 Pro 高峰输出涨到 27 元,放到全球价格表里还便宜吗?
价格快照:2026 年 8 月 14 日。本文比较的是厂商 API 按量调用价,不是聊天会员、Coding Plan、批处理折扣或限时赠金。
DeepSeek 昨天发布 V4 Pro 正式版时,还顺手扔下了另一枚更现实的炸弹:V4 系列 API 将在 北京时间 8 月 17 日 0 时启用新价格。
这不是常见的“新模型原价不变”。V4 Pro 高峰时段的输出价格,会从 6 元涨到 27 元/百万 tokens;缓存命中输入更夸张,从 0.025 元涨到 0.3 元,正好 12 倍。
但只盯着“涨了 12 倍”也容易看偏。DeepSeek 同时引入峰谷计价,闲时价格是高峰的一半;而且即便涨完,V4 Pro 在不少国际旗舰旁边仍然便宜。真正需要重算账的,是那些把 DeepSeek 当成全天候廉价底座、又有大量长上下文和 Agent 流量的团队。
新价格到底怎么收
官方划出的高峰时段是北京时间 9:00—12:00、14:00—18:00,合计 7 小时;其余 17 小时按闲时价收费。公告没有另设“周末价”。

拆成涨幅会更直观:
| 模型与计费项 | 闲时较旧价 | 高峰较旧价 |
|---|---|---|
| Flash 缓存命中输入 | +150% | +400% |
| Flash 缓存未命中输入 | +50% | +200% |
| Flash 输出 | +125% | +350% |
| Pro 缓存命中输入 | +500% | +1100% |
| Pro 缓存未命中输入 | +50% | +200% |
| Pro 输出 | +125% | +350% |
因此,这次最受伤的并不是偶尔问两句的 API 用户,而是会反复携带同一份仓库、规范和历史轨迹的 Coding Agent。过去 DeepSeek 的缓存命中价低得近乎可以忽略,现在它仍便宜,但已经不能在预算表里当作零。
DeepSeek 给出的解释是“更加合理地调配资源”。从计价结构看,这也很好理解:它没有简单把所有流量统一提价,而是用一半价格把可延迟任务赶到闲时。日志分析、离线评测、批量代码审查、文档抽取这类任务,调度时间从此直接影响账单。

和 16 款国内外主流模型放在一起
为了尽量让数字可比,下面统一采用同步、标准服务、短上下文、非 Batch 的文本 API 价格。国外模型按 1 美元≈7.2 元人民币做静态折算,只用于看量级,不代表结算汇率;有长上下文加价、区域加价、缓存写入费或促销价的模型,均在备注中说明。
| 厂商 / 模型 | 输入原价 | 缓存命中 | 输出原价 | 折算人民币:输入 / 输出 | 备注 |
|---|---|---|---|---|---|
| DeepSeek V4 Flash(闲时) | ¥1.5 | ¥0.05 | ¥4.5 | ¥1.5 / ¥4.5 | 8 月 17 日生效 |
| DeepSeek V4 Flash(高峰) | ¥3 | ¥0.10 | ¥9 | ¥3 / ¥9 | 北京时间 9—12、14—18 时 |
| DeepSeek V4 Pro(闲时) | ¥4.5 | ¥0.15 | ¥13.5 | ¥4.5 / ¥13.5 | 8 月 17 日生效 |
| DeepSeek V4 Pro(高峰) | ¥9 | ¥0.30 | ¥27 | ¥9 / ¥27 | 同上 |
| MiniMax M3 | $0.30 | $0.06 | $1.20 | ¥2.2 / ¥8.6 | 标准档、输入不超过 512K;页面标注永久 5 折 |
| 豆包 Seed 2.1 Pro | ¥6 | — | ¥30 | ¥6 / ¥30 | 火山引擎原厂 API |
| GLM-5.2 | ¥8 | — | ¥28 | ¥8 / ¥28 | 火山方舟渠道价 |
| Qwen3.8-Max | ¥12 | ¥1.5 | ¥36 | ¥12 / ¥36 | 阿里云百炼华北 2(北京)原价 |
| Kimi K3 | ¥20 | ¥2 | ¥100 | ¥20 / ¥100 | Kimi 中国区原厂价 |
| OpenAI GPT-5.6 Luna | $0.20 | $0.02 | $1.20 | ¥1.4 / ¥8.6 | Standard、短上下文 |
| Google Gemini 3.7 Flash | $0.75 | $0.075 | $3.75 | ¥5.4 / ¥27 | 当前优惠价至 2026 年末 |
| xAI Grok 4.6 | $2 | $0.50 | $6 | ¥14.4 / ¥43.2 | 短上下文,超过 200K 加价 |
| Anthropic Claude Sonnet 5 | $2 | $0.20 | $10 | ¥14.4 / ¥72 | Claude API 标准价 |
| OpenAI GPT-5.6 Terra | $2 | $0.20 | $12 | ¥14.4 / ¥86.4 | Standard、短上下文 |
| Google Gemini 3.1 Pro Preview | $2 | $0.20 | $12 | ¥14.4 / ¥86.4 | 输入不超过 200K |
| Anthropic Claude Opus 4.8 | $5 | $0.50 | $25 | ¥36 / ¥180 | 标准模式,非 Fast mode |
| OpenAI GPT-5.6 Sol | $5 | $0.50 | $30 | ¥36 / ¥216 | Standard、短上下文 |
| Anthropic Claude Fable 5 | $10 | $1 | $50 | ¥72 / ¥360 | 1M 上下文旗舰 |
这张表里有个很有意思的参照:V4 Pro 高峰输出 27 元,正好和 Gemini 3.7 Flash 当前折算价持平,也只比豆包 Seed 2.1 Pro 少 3 元。 DeepSeek 已经不是过去那种“闭眼选也最便宜”的存在了。
但把比较对象换成同档旗舰,结论又不同。V4 Pro 高峰输出 27 元,仍只有 GPT-5.6 Sol 的八分之一、Claude Opus 4.8 的约七分之一。闲时 13.5 元则继续处在国产高性能模型的低价带。
Flash 的位置更微妙。它高峰输入 3 元,比 GPT-5.6 Luna 折算后的 1.4 元贵;输出 9 元则和 Luna 的 8.6 元几乎打平。换句话说,海外小模型已经可以在纯 token 价格上和国产低价模型正面碰了,不能再靠“国外模型一定贵”来做选型。
按一笔真实工作量算账
假设某项任务累计消耗 1000 万输入 tokens + 200 万输出 tokens,全部输入均未命中缓存,也不计工具调用费。按上表价格,账单大致如下:
| 模型 | 估算费用(人民币) |
|---|---|
| DeepSeek V4 Flash(闲时) | ¥24 |
| GPT-5.6 Luna | ¥31.7 |
| MiniMax M3 | ¥38.9 |
| DeepSeek V4 Flash(高峰) | ¥48 |
| DeepSeek V4 Pro(闲时) | ¥72 |
| Gemini 3.7 Flash | ¥108 |
| 豆包 Seed 2.1 Pro | ¥120 |
| GLM-5.2(火山方舟) | ¥136 |
| DeepSeek V4 Pro(高峰) | ¥144 |
| Qwen3.8-Max | ¥192 |
| Grok 4.6 | ¥230.4 |
| Claude Sonnet 5 | ¥288 |
| GPT-5.6 Terra | ¥316.8 |
| Gemini 3.1 Pro Preview | ¥316.8 |
| Kimi K3 | ¥400 |
| Claude Opus 4.8 | ¥720 |
| GPT-5.6 Sol | ¥792 |
| Claude Fable 5 | ¥1,440 |
这不是能力排名。一百万个便宜 token 如果要多跑三遍才能过测试,未必比昂贵模型省钱;不同厂商的 tokenizer 也不完全一致,同一段中文或代码,最终计费 token 数可能不同。更靠谱的指标始终是“完成一个合格任务花多少钱”,而不是单看价目表。
谁该马上改配置
如果只是个人开发、调用量不大,这次涨价的体感可能很轻。一百万输出 tokens 即便按 V4 Pro 高峰价,也就是 27 元。
真正需要动手的是三类用户:
- Agent 和 Coding 平台。 先查缓存命中率、输出占比和重试率。Pro 的缓存命中价在高峰涨了 12 倍,长会话的成本结构已经变了。
- 有离线任务的团队。 能延迟的作业尽量放到 0—9 时、12—14 时或 18—24 时。官方闲时直接半价,这比在 prompt 里抠几百个 token 更有效。
- 把单一模型写死在生产里的应用。 至少做一层路由:简单任务走 Flash 或其他小模型,复杂任务再升到 Pro;对延迟不敏感的请求排队进闲时。
还有一项容易漏掉:价格切换发生在 8 月 17 日 0 时。企业账户最好在生效前拉一份最近 7 天的 token 用量,分别套入高峰和闲时新价,而不是拿月总量直接乘平均价。峰谷分布不同,误差会很大。
这轮涨价意味着什么
DeepSeek 过去一年最鲜明的标签,是把前沿模型的 API 价格打下来。V4 正式版开始换了个打法:能力继续往 Agent 和生产环境推,价格也从“统一低价”转成“按资源紧张程度收费”。
这不等于 DeepSeek 失去性价比。至少从公开价看,V4 Pro 闲时仍然很能打,高峰价放在全球旗舰中也不算贵。变化在于,成本优化从“选 DeepSeek 就行”变成了一件工程活:选 Flash 还是 Pro、是否命中缓存、任务在哪个时段跑、失败后会重试几次,都会写进最终账单。
说得直白一点,DeepSeek 仍便宜,只是不再便宜得让人不用算账了。
更多推荐



所有评论(0)