最近刷 DeepSeek,看到一个挺有意思的新梗:

白天叫“梁文锋”,晚上叫“梁文谷”。

一开始还没反应过来,后来去看了一眼 DeepSeek 官方 API 价格,发现这个梗其实来自最近调整的 DeepSeek 峰谷定价

从 2026 年 8 月 17 日开始,DeepSeek V4 系列 API 开始区分高峰和空闲时段。也就是说,同样调用一次 DeepSeek-V4-Flash,不同时间价格可能不一样。

对于偶尔调几次 API 的个人开发者来说可能没什么感觉,但如果是 Agent、批量生成、数据处理这类持续消耗 Token 的任务,时间段就真的会影响成本了。

这篇简单整理一下目前 DeepSeek-V4-Flash API 的价格、峰谷时间,以及如果不想考虑峰谷价,还有什么调用方式。


1. DeepSeek API 现在怎么区分峰谷?

先看官方目前给出的时间。

高峰时段

北京时间:

  • 09:00 - 12:00
  • 14:00 - 18:00

空闲时段

除上述时间之外,都属于空闲时段。

而且不是便宜一点点。

空闲时段价格正好是高峰时段的一半。

所以“梁文锋 / 梁文谷”这个梗其实还挺形象:

白天大家都在调用,是“峰”。

晚上算力压力下来,就是“谷”。


2. DeepSeek-V4-Flash 官方 API 多少钱?

我主要关注的是最近的 DeepSeek-V4-Flash-0731

这是目前 DeepSeek 官方 deepseek-v4-flash 对应的模型版本,支持思考 / 非思考模式,官方上下文长度已经做到 1M,同时支持 Tool Calls、JSON Output、Responses API 等能力。

截至 2026 年 8 月 18 日,官方价格如下:

Token 类型 空闲时段 高峰时段
输入(缓存命中) 0.05 元 / M tokens 0.10 元 / M tokens
输入(缓存未命中) 1.5 元 / M tokens 3 元 / M tokens
输出 4.5 元 / M tokens 9 元 / M tokens

这里的 M tokens 就是 100 万 tokens

如果只是普通问答,Token 用量不大,其实没必要为了几毛钱专门等到晚上。

但如果你是在做:

  • 批量文本处理
  • AI Agent
  • 代码生成
  • 批量数据清洗
  • 内容生成
  • RAG
  • 长上下文分析
  • 自动化工作流

一天几十万甚至几百万 Token 很正常。

这时候峰谷价格差异就开始明显了。


3. 举个例子:100 万输出 Token,差多少钱?

这个最好算。

假设某个任务最终消耗:

1,000,000 output tokens

使用 DeepSeek 官方 V4-Flash

空闲时段:4.5 元
高峰时段:9 元

同一个任务,差了一倍。

如果每个月有:

100M output tokens

那么大概就是:

空闲时段:450 元
高峰时段:900 元

所以对于 API 用量比较稳定的项目,现在其实多出了一个以前不太需要考虑的问题:

任务什么时候跑?

如果本身就是离线任务,比如批量摘要、数据处理、Embedding 前的数据清洗之类,我觉得完全可以考虑把任务丢到低峰期跑。

但在线业务就比较尴尬了。

用户总不可能因为现在是下午 3 点,就等到晚上再问 AI。


4. 有没有不区分峰谷的 DeepSeek API?

我顺手看了一些第三方 API。

这里其实出现了另一种定价思路:

不区分峰谷,直接给固定价格。

比如我最近测试的算桥API,目前也提供 DeepSeek-V4-Flash-0731

页面现在标的是:

Token 类型 当前价格
输入 0.60 积分 / M tokens
输入(缓存命中) 0.12 积分 / M tokens
输出 1.20 积分 / M tokens

而且目前这套价格不区分高峰和低峰时段。模型页面列出的 API 地址为:

https://api.suanjiayun.com/v1/chat/completions

模型 ID:

DeepSeek-V4-Flash-0731

页面价格及接口信息可以直接查看:

https://www.suanjiayun.com/api/modelDetail/6a83b8db31cc72629e2b9ca3

这里我觉得比较适合两种情况。

一种是在线业务

请求什么时候进来并不是自己能控制的,固定价格至少比较容易估算成本。

另一种就是我这种平时想测试模型的人。

我其实不太想每次调用之前还先看一下:

现在几点?
是不是 DeepSeek 高峰期?
要不要晚点再跑?

固定价格会简单一点。


5. Python 怎么调用 DeepSeek-V4-Flash?

接口本身还是比较标准的 Chat Completions 格式。

最简单可以直接用 requests

import requests

url = "https://api.suanjiayun.com/v1/chat/completions"

headers = {
    "Authorization": "Bearer YOUR_API_KEY",
    "Content-Type": "application/json"
}

data = {
    "model": "DeepSeek-V4-Flash-0731",
    "messages": [
        {
            "role": "user",
            "content": "用 Python 写一个快速排序"
        }
    ]
}

response = requests.post(
    url,
    headers=headers,
    json=data
)

print(response.json())

如果自己已经有 OpenAI Compatible API 的调用代码,迁移成本一般不会太高,主要就是改:

base_url
api_key
model

我一般测试一个新 API,也不会一上来就接业务。

先跑一个最小请求,看几个东西:

HTTP Status
response body
model
usage
prompt_tokens
completion_tokens

这些正常,再继续测 Streaming、Tool Call 和长上下文。


6. DeepSeek 官方 API 和第三方 API 怎么选?

我觉得没必要简单说谁一定更好。

直接调用 DeepSeek 官方 API

优点很明显:

  • 官方渠道
  • 新模型通常上线最快
  • 官方文档最完整
  • 模型能力和参数最容易确认

但现在需要多考虑一个:

峰谷价格。

尤其是在线业务,高峰期并不是你自己能决定的。

第三方 DeepSeek API

我更关注的是:

  • 模型版本是不是一致
  • API 是否兼容
  • 有没有额外限速
  • Streaming 是否正常
  • Tool Call 是否正常
  • 实际 Token 计费
  • 稳定性
  • 价格是否长期稳定

便宜只是其中一个变量。

所以正式接项目之前,最好还是自己用真实请求测一轮。


7. “梁文锋”和“梁文谷”,其实反映的是 API 成本开始变复杂了

这个梗挺好笑,但对开发者来说背后其实是一个比较实际的变化。

以前看大模型 API 价格,基本就是:

输入多少钱
输出多少钱
缓存多少钱

现在还得多加一个维度:

什么时候调用?

对于个人测试基本无所谓。

但如果是长期运行的 AI 产品、Agent 或批处理任务,DeepSeek API 的峰谷价格已经值得放进成本模型里了。

目前我的处理方式比较简单:

  • 离线任务:能放低峰就放低峰
  • 在线业务:优先看固定价格渠道
  • 新模型测试:先跑最小 API 请求
  • 大规模接入:重新测价格、限速和稳定性

毕竟 API 价格一直会变。

这篇记录的是 2026 年 8 月 18 日 我查到的价格。

以后如果“梁文锋”和“梁文谷”又换班了,还是以 DeepSeek 官方最新价格为准。

DeepSeek 官方价格文档:

https://api-docs.deepseek.com/zh-cn/quick_start/pricing/

算桥 DeepSeek-V4-Flash-0731:

https://www.suanjiayun.com/api/modelDetail/6a83b8db31cc72629e2b9ca3

Logo

欢迎加入DeepSeek 技术社区。在这里,你可以找到志同道合的朋友,共同探索AI技术的奥秘。

更多推荐