DeepSeek 首次涨价 350%,国产大模型转向峰谷定价:开发者成本策略要变
·
今天(2026 年 8 月 17 日)0 点起,DeepSeek V4 系列峰谷定价正式生效:
- 高峰时段(9-12 点、14-18 点):V4-Pro 输出 27 元/百万 token(较原价 6 元上涨 350%),缓存命中输入 0.3 元(较原 0.025 元涨 11 倍)
- 空闲时段:半价
- 普通用户 App/网页端:仍免费
这是国产龙头大模型第一次系统性价格上调。放在两个月前,各家还在疯狂降价抢份额;现在风向变了。
三个信号,比涨价本身更值得看
信号一:供给侧从「烧钱换份额」转向「峰谷错峰省钱」。
算力是有峰谷的:白天大家挤高峰,深夜算力空转。DeepSeek 用价格杠杆把流量往闲时赶,本质是把「买算力」变成「买错峰的算力」——这对供给侧是省钱,对用户是提醒:什么时候调用,正在成为成本的一部分。
信号二:涨价 + 开源 Harness,是一套组合拳。
8 月 13 日 DeepSeek 开源了 agent 框架 Harness(MIT 协议,24 小时 80k 星),核心是「一切皆插件」、模型无关、会话可审计回放。招商证券国际的点评很直接:这是「做 Agent 时代的安卓」——从模型层向框架层上移。涨价保模型层利润,开源抢框架层生态,两件事是一套战略。
信号三:国产模型集体变阵,一周三更。
- 智谱 GLM-5.3(8-14):同基座纯靠后训练,编程能力提升 50%,开源模型第一
- 阿里 Qwen3.8-27B(8-17):登顶 Hugging Face 趋势榜,2 天下载破 100 万,量化后 24GB 显存可本地跑
模型能力没停,但竞争点正从「谁的模型更强」移向「谁的框架更好用、谁的调度更省」。
对开发者:四条成本策略
- 错峰跑批:可延迟的批量任务(数据清洗、长文档总结、离线生成)挪到空闲时段,直接吃半价
- 缓存命中优先:缓存输入价涨 11 倍后,prompt 前缀工程(稳定 system prompt + 共享上下文)的收益更大——同样的请求尽量走缓存
- 国产开源本地化:Qwen3.8-27B 这类消费级模型本地跑,日常高频任务本地消化,云端只留高峰也值得的任务
- 混合路由:简单任务走 V4-Flash(约 0.14 美元/百万输入 token 量级),重活才上旗舰——按任务分层,不一个模型打天下
一句话总结
峰谷定价不是涨价,是成本重新定价:算力不再是无差别商品,时间维度开始收费。谁先把「错峰 + 缓存 + 本地化」这三件事做进自己的调用策略,谁就在这轮变阵里省下真金白银。
更多推荐

所有评论(0)