DeepSeek 涨价你换了吗?API 要涨了:留下、换模型还是上路由?来晒账单

2026 年 8 月 17 日 0 点,DeepSeek API 新价格正式生效。最高涨幅 1100%,输出 Token 高峰价翻 4.5 倍。那个让你"随便问、随便试、随便错"的"价格屠夫",忽然有了刻度。你的账单还好吗?

一、先看账单:到底涨了多少?

8 月 6 日,DeepSeek 在开发者后台发了一则预告:"计划近期整体上调 API 定价,预计涨幅较大。"当时很多人没当回事——毕竟 DeepSeek 之前降过好几次价,"涨价"听起来像狼来了。

8 月 13 日,正式方案公布。8 月 17 日 0 点,生效。

V4-Pro(旗舰推理模型)

计费项 调价前 空闲时段新价 高峰时段新价 高峰涨幅
输入(缓存命中) ¥0.025 / 百万 ¥0.15 ¥0.30 +1100%(12 倍)
输入(缓存未命中) ¥3.00 / 百万 ¥4.50 ¥9.00 +200%(3 倍)
输出 ¥6.00 / 百万 ¥13.50 ¥27.00 +350%(4.5 倍)

V4-Flash(轻量快速模型)

计费项 调价前 空闲时段新价 高峰时段新价 高峰涨幅
输入(缓存命中) ¥0.02 / 百万 ¥0.05 ¥0.10 +400%(5 倍)
输入(缓存未命中) ¥1.00 / 百万 ¥1.50 ¥3.00 +200%(3 倍)
输出 ¥2.00 / 百万 ¥4.50 ¥9.00 +350%(4.5 倍)

三个关键变化

  1. 首次引入峰谷定价:高峰时段(北京时间 09:00–12:00、14:00–18:00)价格为空闲时段的两倍。白天跑批量任务,成本直接翻倍。
  2. 输出 Token 是重灾区:两款模型输出高峰价均涨至原价 4.5 倍。代码批量生成、长文本续写场景,账单肉眼可见地膨胀。
  3. 缓存命中红利大幅缩水:V4-Pro 缓存命中输入涨 12 倍。过去靠多轮对话缓存"白嫖"输入成本的玩法,现在不香了。

注意:空闲价虽然比高峰价低一半,但每一项都比旧统一价贵。没有任何一个时段比以前更便宜。


二、为什么是现在涨?

DeepSeek 官方说法是"错峰调度,合理分配算力"。这话有道理,但不是全部。

需求跑赢了补贴

V4-Flash 在 7 月 31 日 checkpoint 更新后冲上全球 Token 用量榜首,8 月初单周消耗约 11.31 万亿 Token——接近 OpenAI GPT-5.6 Luna 同期的三倍。Agent 工作负载更是放大效应:一次 Agent 运行消耗的算力可能是普通对话的数十上百倍,而 DeepSeek 在以接近零利润的价格吸收这一切。

资本密集度追上来了

DeepSeek 6 月融资约 74 亿美元,投后估值近 500 亿美元,随后又传开启第二轮融资,投前估值 710–740 亿美元。钱正在砸向吉瓦级数据中心和自研推理芯片。创始人梁文锋多年来靠量化基金幻方自费维持公司、拒绝外部资本的姿态,已经反转。

IPO 在路上

据 Bloomberg 报道,DeepSeek 正在筹备国内上市,目标今年提交招股书,2027 年登陆科创板。准备进入公开市场审视的公司,不能无限期亏本卖 Token。

整个行业都在转向

智谱 AI 在 2026 年 Q1 涨价约 83%,调用量反而涨了约 400%。阿里云、腾讯云、百度智能云今年早些时候都上调了 AI 服务定价。中国 AI 行业从"烧钱抢市场"到"要利润"的集体转向已经进行了好几个月——DeepSeek 只是动静最大的那个。

讽刺的是:就在 DeepSeek 涨价 17 天前,OpenAI 把 GPT-5.6 Luna 降价 80%。Google 发布 Gemini 3.6 Flash,宣称输出 Token 效率提升 17%。整个市场还在往下卷,发起价格战的那家先下了牌桌。


三、三条路:留下、换模型、上路由

面对账单,开发者们大致分成了三派。

路线一:留下,优化调用

适合谁:业务深度依赖 DeepSeek 独有能力(代码能力、长上下文理解、指令跟随风格),Prompt 体系全部针对 DeepSeek 调优,迁移成本极高的项目。

能做什么

  • 严格管控上下文:及时清理无用历史,区分短期会话记忆和向量知识库,别把整个对话历史无脑塞回去
  • 限制输出长度:不需要超长输出时设置 max_tokens,别让模型自由发挥到天荒地老
  • 任务分层:简单任务用 V4-Flash,别什么都上 V4-Pro
  • 错峰调度:离线数据处理、批量生成尽量挪到夜间空闲时段,成本直接砍半
  • 提高缓存命中率:虽然缓存价涨了,但命中仍比未命中便宜得多,系统提示词和高频前缀尽量固定

优势:不用改业务代码,不用重调 Prompt,效果稳定可控。
劣势:基础单价上涨是长期的,高并发大批量场景总成本持续上升。

路线二:换模型,找平替

适合谁:中小型工具、日常高频调用、对单一模型依赖不深的项目。

国内竞品对标(全天统一价,无峰谷):

厂商 模型 输入(元/百万) 输出(元/百万) 亮点
字节火山方舟 Seed 2.0 Pro 0.70 2.80 通用+代码均衡,结构化输出稳定
阿里云 Qwen-Max 2.00 6.00 长文本、Agent 工具调用成熟
智谱 AI GLM-4-Air 1.00 2.50 中端性价比,轻量任务
月之暗面 K2.6 1.30 4.00 超长上下文,文档解析强,有缓存折扣
硅基流动 Qwen2.5-72B 0.55 1.10 低价开源模型聚合,简单任务

分场景看

  • 长会话多轮对话:夜间跑 DeepSeek V4-Flash 仍有竞争力;白天高峰持续对话,成本反超 Moonshot、Seed、Qwen
  • 一次性问答:白天高峰用 DeepSeek 明显不划算,Seed 2.0 Pro 输入 0.7 + 输出 2.8,组合成本远低于 V4-Flash 高峰的 3 + 9
  • 代码批量生成:输出 Token 占比极高,是本次涨价的最大受害者。白天批量生成代码,V4 系列账单会显著增加

避坑提醒:不要只比单价!不同模型的对齐风格、JSON 输出稳定性、Function Call 能力差异很大。项目依赖结构化返回或工具调用时,切换模型需要完整回归测试和 Prompt 重调。"无缝平替"几乎不存在。

路线三:上路由,多模型负载均衡

适合谁:面向用户的线上服务、每日大量请求、业务不能中断的中高频开发者。

核心逻辑:在应用和模型之间加一层调度网关——

  • 简单问答、文本清洗、摘要 → 路由到低价模型
  • 代码编写、复杂推理、深度 Agent → 保留 DeepSeek
  • 单一服务商调价、限流时 → 自动熔断切换到备选节点

落地方案

  • 自建调度服务:灵活度最高,按业务逻辑定制路由规则
  • OneAPI / NewAPI:开源网关,支持聚合多家密钥、流量分配、用量统计,部署成本低
  • 商业聚合平台:OpenRouter、硅基流动等,省去运维但增加一层中间成本

优势:兼顾成本与效果,风险分散,流量灵活调配。这次 DeepSeek 涨价如果已经有路由,切换就是改个配置的事。
劣势:额外增加运维复杂度,小型个人项目容易过度设计。


四、不同人群的选择建议

人群 建议路线 理由
个人玩具、低频调用、学习用途 留下 每月账单本来就低,折腾迁移和搭路由的时间成本远超省下的钱
中小型工具、日常高频、代码场景为主 先试换模型 测试 1-2 款代码能力强的竞品,小规模灰度,能平替就逐步迁移
线上服务、大量请求、不能中断 上路由 先用路由做灰度分流,低价值流量切到其他模型,核心逻辑保留 DeepSeek,平滑过渡
Agent 应用、长会话为主 留下 + 错峰 DeepSeek 的 Agent 能力和缓存机制仍有优势,尽量把任务调度到空闲时段
纯批量数据处理、可离线 错峰 + 低价模型 夜间跑 DeepSeek 空闲价,或直接用硅基流动等开源聚合

五、比账单更重要的事

这次涨价最该让人反思的,不是"DeepSeek 不厚道",而是单一厂商绑定本身就是风险

大模型厂商不可能长期亏本卖 Token。调价、限流、接口规则变更,随时可能冲击业务。过去一年"我们就跑 DeepSeek"成了一个合理的架构决策,因为它又好又便宜。但当价格锚点变化,这个决策的合理性也在变化。

短期看,按需取舍就行——该留留,该换换,该上路由上路由。

长期看,架构上预留多模型兼容能力才是稳妥方案。Prompt 写得模型无关一些,输出解析别硬编码某家的格式,工具调用层做个抽象。这样下次哪家又涨价了,你不是"换不换"的问题,而是"切哪个"的问题。


六、来晒账单

说了这么多,最实在的还是看看大家的真实情况。

  • 你每月 DeepSeek API 花多少钱? 涨价后预估会变成多少?
  • 你选了哪条路? 留下优化、换模型、还是上路由?
  • 有没有踩坑? 换模型后效果崩了?路由搭了一半发现过度设计?
  • 有没有省钱妙招? 错峰调度、缓存优化、Prompt 压缩,欢迎分享。

评论区见。让后来人少走弯路。


参考来源:DeepSeek API 官方定价页、新浪财经、Global Times、AI2.Work、稀土掘金、DeepSeek 技术社区。价格数据以官方最新公告为准。

Logo

欢迎加入DeepSeek 技术社区。在这里,你可以找到志同道合的朋友,共同探索AI技术的奥秘。

更多推荐