8月17日零点,DeepSeek 的新价格正式生效。

很久以前刷到那条消息终于执行了:API 全面改峰谷定价,高峰时段输出价格涨到原来的 4.5 倍,缓存命中输入更是直接 12 倍 。

4-Flash 高峰输出从 2 元涨到 9 元,V4-Pro 输出从 6 元涨到 27 元,单位都是百万 token CSDN

说好的"白菜价",一觉醒来没了。

但对真正会用工具的人来说,这其实不是坏消息——甚至是个好消息。因为就在 DeepSeek 举起涨价牌的同一天前后,它做了另一件看起来自相矛盾的事:开源了 DeepSeek Harness。

一边涨价,一边开源"换掉自己的工具"。这两件事放在一起,才是这轮涨价最值得看的地方。

一、先算算账:这一刀切得有多狠

这次不是简单的涨价,而是把"分时电价"逻辑搬进了 AI API 。

高峰时段是工作日白天 9:00-12:00、14:00-18:00,其余算空闲时段,价格是高峰的一半。

具体数字摊开看:

表格

计费项 涨价前 高峰新价 涨幅
V4-Flash 输出 2元 9元 4.5倍
V4-Pro 输出 6元 27元 4.5倍
V4-Flash 缓存命中输入 0.02元 0.10元 5倍
V4-Pro 缓存命中输入 0.025元 0.30元 12倍

最扎眼的是最后一行。以前靠"缓存命中"把成本压到几乎为零的玩法——RAG、Agent 长会话、重复读上下文——这一下直接废掉 CSDN

要知道,DeepSeek 自己说 7 月 V4-Flash 单日处理 token 总量就有 8 万亿 中国城市报。它是全球调用量第一的模型,Agent 编程场景里大部分 token 都烧在重复读上下文上。现在缓存命中最便宜的档位涨了 12 倍,等于对着最疼的地方下手。

但这不重要。重要的是下面这层。

二、涨价不是重点,重点是我上周刚写过的那篇文章

8月13日晚上,DeepSeek 干了两件事:

一是 V4-Pro 正式版上线不到 24 小时就被紧急撤回,翻车了。

二是同一天,它悄悄开源了 DeepSeek Harness——一个"模型无关"的 Agent 调度器。

上篇文章我写过它,核心就一句话:一切皆插件,换模型等于改一行配置。

Claude Code、Codex、Cursor 都是"整机"交付,模型、工具、执行循环焊死在一起,厂商给你什么你用什什么。DeepSeek Harness 反着来——模型、工具、会话、沙箱、调度全是插件,挂在一块叫 Cordis 的底板上,想换哪个拔下来换一个就行 CSDN

更鸡贼的是,它还能把 Claude Code、OpenAI Codex 当子 Agent 调用。你不是我的竞品,你是我的零件。

当时我说,这是"Agent 时代的安卓"——开放、可插拔、不绑定任何厂商。

现在再看,这个判断有了新的含义:DeepSeek 一边把 API 涨价,一边把"换掉 API 的工具"免费送给了所有人。

这两件事是同一件事的两面:它想让你离不开模型,又亲手让你随时能离开它。

三、涨价后的平替方案:三个零件,拼成一套不花钱的 Harness

如果只看到"涨价",那这篇就到头了。但真正的玩法是:DeepSeek 涨价了,你的成本却可以一分钱不涨。

因为免费平替,已经排好队了。

零件一:腾讯微信小程序大赛送的 Coding Plan Token

微信小程序开发大赛,报名就送。不是参赛作品才能领,报名即可申请,收到邮件就能通过 API 调用模型 用户提供的微信原文

送的是两款模型:GLM-5.2 和 DeepSeek-V4-Flash

你没看错——V4-Flash,就是今天涨价的那个 V4-Flash。腾讯这边白送。

细节:

  • Token 管理页:weastraaiweb
  • API 接口:https://chatapi.weixin.qq.com/openai/v1/chat/completions
  • 完全兼容 OpenAI 协议,直接配到 Cursor、Claude Code 等 IDE 里
  • 不限 token,但限次数:每 5 小时约 1200 次、每周约 9000 次、每月约 18000 次(动态调整)
  • 报名窗口:7月17日到10月17日
  • 想参赛还能冲最高 10 万奖金

日常开发完全够用。唯一要注意:请求数和 token 不是一个概念,别被评论区带偏。

零件二:Agnes AI 免费全模态 API

这个我们之前写过——新加坡团队 Agnes AI,6月1日起把文本、图片、视频三大模态的 API 无限期免费开放 极客公园

免费不是噱头,首周文本模型调用量就破了 1 万亿 token,图片 200 万张,视频 200 万秒 掘金

  • 文本:agnes-2.0-flash(升级后 2.5-flash),1M 上下文,支持工具调用
  • 图片:agnes-image-2.1-flash,文生图、图生图、4K 输出
  • 视频:agnes-video-v2.0,文生视频、音画同出
  • 接口完全兼容 OpenAI 格式:https://api.agnes-ai.cn/v1
  • 官方明确说过可以接 Claude Code、Codex、OpenClaw、Hermes 等 harness 极客公园

零件三:DeepSeek Harness 这块底板

前两个是"零件",Harness 是让你能随便换零件的"插座"。

在 DeepSeek Harness 里,模型是个插件。你把默认的 DeepSeek API 换成腾讯的、Agnes 的,操作就是改一段配置的事——不是换一个产品,是拔插一个零件 Gigazine

一套组合拳下来:

白天高峰时段 DeepSeek 涨价?切腾讯免费额度里的 V4-Flash。

要长文档、要工具调用、要图片视频?切 Agnes 免费 API。

简单任务、大量并发的脏活?全部丢给免费模型,贵的留给真正难啃的硬骨头。

成本结构一夜之间,从"按 token 心惊胆战"变成"基本归零"。

四、为什么说涨价反而是好事

讲完省钱,说点更深的。

过去一年,整个行业都在玩"价格战",谁便宜用谁。DeepSeek 是那场战争里最大的赢家,也是第一个说"不打了"的人。

但你要看清一件事:模型正在变成水电煤。 谁给你供电不重要,重要的是你有一个不绑死任何供应商的"插座"。

涨价逼你把模型当"可替换的零件"看——这恰恰是 Harness 想让你做的事。DeepSeek 想靠涨价回血,但它开源的 Harness 恰好让"换掉它"变得前所未有地容易。这是商业上最拧巴、也最精彩的一点。

你看这几件事其实是同一条线:

  • OpenAI 在搞多智能体 v2,主 Agent 自动把任务分给便宜模型,20% 的步骤才动用最强模型
  • DeepSeek 在开源 Harness,让模型选型变成一个配置问题
  • 腾讯在送 token,Agnes 在免费开放全模态

模型的白菜化 + 模型的自由插拔 = 能力还在,价格归零。

谁最先想明白这件事,谁就先从"被涨价拿捏"里解放出来。

五、写在最后:安卓不关心你装什么芯片

上周那篇文章我写了句"R1 让推理变得便宜,DSH 想让 Agent 变得自由"。

今天这篇把它接上:DSH 想让你自由的,不只是换 harness,还包括——换模型不心疼。

当年安卓从来不管手机里装的是高通还是联发科,装什么芯片都能跑,生态照样长成参天大树。

现在轮到 Agent 了。你的 Agent 装什么模型都能跑——DeepSeek、GLM、Agnes、Claude、Codex,谁便宜、谁免费、谁强,就换谁。

DeepSeek 涨价这天,真正该做的事不是抱怨,而是把这句话记住:

别把身家性命,绑在任何一个 API 上。

模型会越来越便宜、越来越免费,真正值钱的是你手里的那套 Harness 工程能力——那个让你今天涨价能躲、明天换模型能跑的东西。

水电煤会涨价,但接水电煤的插座,永远是你的。

Logo

欢迎加入DeepSeek 技术社区。在这里,你可以找到志同道合的朋友,共同探索AI技术的奥秘。

更多推荐