今天(2026 年 8 月 17 日)0 点起,DeepSeek V4 系列峰谷定价正式生效:

  • 高峰时段(9-12 点、14-18 点):V4-Pro 输出 27 元/百万 token(较原价 6 元上涨 350%),缓存命中输入 0.3 元(较原 0.025 元涨 11 倍)
  • 空闲时段:半价
  • 普通用户 App/网页端:仍免费

这是国产龙头大模型第一次系统性价格上调。放在两个月前,各家还在疯狂降价抢份额;现在风向变了。

三个信号,比涨价本身更值得看

信号一:供给侧从「烧钱换份额」转向「峰谷错峰省钱」。
算力是有峰谷的:白天大家挤高峰,深夜算力空转。DeepSeek 用价格杠杆把流量往闲时赶,本质是把「买算力」变成「买错峰的算力」——这对供给侧是省钱,对用户是提醒:什么时候调用,正在成为成本的一部分。

信号二:涨价 + 开源 Harness,是一套组合拳。
8 月 13 日 DeepSeek 开源了 agent 框架 Harness(MIT 协议,24 小时 80k 星),核心是「一切皆插件」、模型无关、会话可审计回放。招商证券国际的点评很直接:这是「做 Agent 时代的安卓」——从模型层向框架层上移。涨价保模型层利润,开源抢框架层生态,两件事是一套战略。

信号三:国产模型集体变阵,一周三更。

  • 智谱 GLM-5.3(8-14):同基座纯靠后训练,编程能力提升 50%,开源模型第一
  • 阿里 Qwen3.8-27B(8-17):登顶 Hugging Face 趋势榜,2 天下载破 100 万,量化后 24GB 显存可本地跑

模型能力没停,但竞争点正从「谁的模型更强」移向「谁的框架更好用、谁的调度更省」。

对开发者:四条成本策略

  1. 错峰跑批:可延迟的批量任务(数据清洗、长文档总结、离线生成)挪到空闲时段,直接吃半价
  2. 缓存命中优先:缓存输入价涨 11 倍后,prompt 前缀工程(稳定 system prompt + 共享上下文)的收益更大——同样的请求尽量走缓存
  3. 国产开源本地化:Qwen3.8-27B 这类消费级模型本地跑,日常高频任务本地消化,云端只留高峰也值得的任务
  4. 混合路由:简单任务走 V4-Flash(约 0.14 美元/百万输入 token 量级),重活才上旗舰——按任务分层,不一个模型打天下

一句话总结

峰谷定价不是涨价,是成本重新定价:算力不再是无差别商品,时间维度开始收费。谁先把「错峰 + 缓存 + 本地化」这三件事做进自己的调用策略,谁就在这轮变阵里省下真金白银。在这里插入图片描述

Logo

欢迎加入DeepSeek 技术社区。在这里,你可以找到志同道合的朋友,共同探索AI技术的奥秘。

更多推荐