DeepSeek API 开始分峰谷价了:白天“梁文锋”,晚上“梁文谷”?我算了下 V4-Flash 的调用成本
最近刷 DeepSeek,看到一个挺有意思的新梗:
白天叫“梁文锋”,晚上叫“梁文谷”。
一开始还没反应过来,后来去看了一眼 DeepSeek 官方 API 价格,发现这个梗其实来自最近调整的 DeepSeek 峰谷定价。
从 2026 年 8 月 17 日开始,DeepSeek V4 系列 API 开始区分高峰和空闲时段。也就是说,同样调用一次 DeepSeek-V4-Flash,不同时间价格可能不一样。
对于偶尔调几次 API 的个人开发者来说可能没什么感觉,但如果是 Agent、批量生成、数据处理这类持续消耗 Token 的任务,时间段就真的会影响成本了。
这篇简单整理一下目前 DeepSeek-V4-Flash API 的价格、峰谷时间,以及如果不想考虑峰谷价,还有什么调用方式。
1. DeepSeek API 现在怎么区分峰谷?
先看官方目前给出的时间。
高峰时段
北京时间:
09:00 - 12:0014:00 - 18:00
空闲时段
除上述时间之外,都属于空闲时段。
而且不是便宜一点点。
空闲时段价格正好是高峰时段的一半。
所以“梁文锋 / 梁文谷”这个梗其实还挺形象:
白天大家都在调用,是“峰”。
晚上算力压力下来,就是“谷”。
2. DeepSeek-V4-Flash 官方 API 多少钱?
我主要关注的是最近的 DeepSeek-V4-Flash-0731。
这是目前 DeepSeek 官方 deepseek-v4-flash 对应的模型版本,支持思考 / 非思考模式,官方上下文长度已经做到 1M,同时支持 Tool Calls、JSON Output、Responses API 等能力。
截至 2026 年 8 月 18 日,官方价格如下:
| Token 类型 | 空闲时段 | 高峰时段 |
|---|---|---|
| 输入(缓存命中) | 0.05 元 / M tokens | 0.10 元 / M tokens |
| 输入(缓存未命中) | 1.5 元 / M tokens | 3 元 / M tokens |
| 输出 | 4.5 元 / M tokens | 9 元 / M tokens |
这里的 M tokens 就是 100 万 tokens。
如果只是普通问答,Token 用量不大,其实没必要为了几毛钱专门等到晚上。
但如果你是在做:
- 批量文本处理
- AI Agent
- 代码生成
- 批量数据清洗
- 内容生成
- RAG
- 长上下文分析
- 自动化工作流
一天几十万甚至几百万 Token 很正常。
这时候峰谷价格差异就开始明显了。
3. 举个例子:100 万输出 Token,差多少钱?
这个最好算。
假设某个任务最终消耗:
1,000,000 output tokens
使用 DeepSeek 官方 V4-Flash:
空闲时段:4.5 元
高峰时段:9 元
同一个任务,差了一倍。
如果每个月有:
100M output tokens
那么大概就是:
空闲时段:450 元
高峰时段:900 元
所以对于 API 用量比较稳定的项目,现在其实多出了一个以前不太需要考虑的问题:
任务什么时候跑?
如果本身就是离线任务,比如批量摘要、数据处理、Embedding 前的数据清洗之类,我觉得完全可以考虑把任务丢到低峰期跑。
但在线业务就比较尴尬了。
用户总不可能因为现在是下午 3 点,就等到晚上再问 AI。
4. 有没有不区分峰谷的 DeepSeek API?
我顺手看了一些第三方 API。
这里其实出现了另一种定价思路:
不区分峰谷,直接给固定价格。
比如我最近测试的算桥API,目前也提供 DeepSeek-V4-Flash-0731。
页面现在标的是:
| Token 类型 | 当前价格 |
|---|---|
| 输入 | 0.60 积分 / M tokens |
| 输入(缓存命中) | 0.12 积分 / M tokens |
| 输出 | 1.20 积分 / M tokens |
而且目前这套价格不区分高峰和低峰时段。模型页面列出的 API 地址为:
https://api.suanjiayun.com/v1/chat/completions
模型 ID:
DeepSeek-V4-Flash-0731
页面价格及接口信息可以直接查看:
https://www.suanjiayun.com/api/modelDetail/6a83b8db31cc72629e2b9ca3
这里我觉得比较适合两种情况。
一种是在线业务。
请求什么时候进来并不是自己能控制的,固定价格至少比较容易估算成本。
另一种就是我这种平时想测试模型的人。
我其实不太想每次调用之前还先看一下:
现在几点?
是不是 DeepSeek 高峰期?
要不要晚点再跑?
固定价格会简单一点。
5. Python 怎么调用 DeepSeek-V4-Flash?
接口本身还是比较标准的 Chat Completions 格式。
最简单可以直接用 requests:
import requests
url = "https://api.suanjiayun.com/v1/chat/completions"
headers = {
"Authorization": "Bearer YOUR_API_KEY",
"Content-Type": "application/json"
}
data = {
"model": "DeepSeek-V4-Flash-0731",
"messages": [
{
"role": "user",
"content": "用 Python 写一个快速排序"
}
]
}
response = requests.post(
url,
headers=headers,
json=data
)
print(response.json())
如果自己已经有 OpenAI Compatible API 的调用代码,迁移成本一般不会太高,主要就是改:
base_url
api_key
model
我一般测试一个新 API,也不会一上来就接业务。
先跑一个最小请求,看几个东西:
HTTP Status
response body
model
usage
prompt_tokens
completion_tokens
这些正常,再继续测 Streaming、Tool Call 和长上下文。
6. DeepSeek 官方 API 和第三方 API 怎么选?
我觉得没必要简单说谁一定更好。
直接调用 DeepSeek 官方 API
优点很明显:
- 官方渠道
- 新模型通常上线最快
- 官方文档最完整
- 模型能力和参数最容易确认
但现在需要多考虑一个:
峰谷价格。
尤其是在线业务,高峰期并不是你自己能决定的。
第三方 DeepSeek API
我更关注的是:
- 模型版本是不是一致
- API 是否兼容
- 有没有额外限速
- Streaming 是否正常
- Tool Call 是否正常
- 实际 Token 计费
- 稳定性
- 价格是否长期稳定
便宜只是其中一个变量。
所以正式接项目之前,最好还是自己用真实请求测一轮。
7. “梁文锋”和“梁文谷”,其实反映的是 API 成本开始变复杂了
这个梗挺好笑,但对开发者来说背后其实是一个比较实际的变化。
以前看大模型 API 价格,基本就是:
输入多少钱
输出多少钱
缓存多少钱
现在还得多加一个维度:
什么时候调用?
对于个人测试基本无所谓。
但如果是长期运行的 AI 产品、Agent 或批处理任务,DeepSeek API 的峰谷价格已经值得放进成本模型里了。
目前我的处理方式比较简单:
- 离线任务:能放低峰就放低峰
- 在线业务:优先看固定价格渠道
- 新模型测试:先跑最小 API 请求
- 大规模接入:重新测价格、限速和稳定性
毕竟 API 价格一直会变。
这篇记录的是 2026 年 8 月 18 日 我查到的价格。
以后如果“梁文锋”和“梁文谷”又换班了,还是以 DeepSeek 官方最新价格为准。
DeepSeek 官方价格文档:
https://api-docs.deepseek.com/zh-cn/quick_start/pricing/
算桥 DeepSeek-V4-Flash-0731:
https://www.suanjiayun.com/api/modelDetail/6a83b8db31cc72629e2b9ca3
更多推荐
所有评论(0)