DeepSeek 今天涨价了,最高12倍。但免费平替已经排好队了
8月17日零点,DeepSeek 的新价格正式生效。
很久以前刷到那条消息终于执行了:API 全面改峰谷定价,高峰时段输出价格涨到原来的 4.5 倍,缓存命中输入更是直接 12 倍 。
4-Flash 高峰输出从 2 元涨到 9 元,V4-Pro 输出从 6 元涨到 27 元,单位都是百万 token CSDN。
说好的"白菜价",一觉醒来没了。
但对真正会用工具的人来说,这其实不是坏消息——甚至是个好消息。因为就在 DeepSeek 举起涨价牌的同一天前后,它做了另一件看起来自相矛盾的事:开源了 DeepSeek Harness。
一边涨价,一边开源"换掉自己的工具"。这两件事放在一起,才是这轮涨价最值得看的地方。

一、先算算账:这一刀切得有多狠
这次不是简单的涨价,而是把"分时电价"逻辑搬进了 AI API 。
高峰时段是工作日白天 9:00-12:00、14:00-18:00,其余算空闲时段,价格是高峰的一半。
具体数字摊开看:
表格
| 计费项 | 涨价前 | 高峰新价 | 涨幅 |
|---|---|---|---|
| V4-Flash 输出 | 2元 | 9元 | 4.5倍 |
| V4-Pro 输出 | 6元 | 27元 | 4.5倍 |
| V4-Flash 缓存命中输入 | 0.02元 | 0.10元 | 5倍 |
| V4-Pro 缓存命中输入 | 0.025元 | 0.30元 | 12倍 |
最扎眼的是最后一行。以前靠"缓存命中"把成本压到几乎为零的玩法——RAG、Agent 长会话、重复读上下文——这一下直接废掉 CSDN。
要知道,DeepSeek 自己说 7 月 V4-Flash 单日处理 token 总量就有 8 万亿 中国城市报。它是全球调用量第一的模型,Agent 编程场景里大部分 token 都烧在重复读上下文上。现在缓存命中最便宜的档位涨了 12 倍,等于对着最疼的地方下手。
但这不重要。重要的是下面这层。
二、涨价不是重点,重点是我上周刚写过的那篇文章
8月13日晚上,DeepSeek 干了两件事:
一是 V4-Pro 正式版上线不到 24 小时就被紧急撤回,翻车了。
二是同一天,它悄悄开源了 DeepSeek Harness——一个"模型无关"的 Agent 调度器。
上篇文章我写过它,核心就一句话:一切皆插件,换模型等于改一行配置。
Claude Code、Codex、Cursor 都是"整机"交付,模型、工具、执行循环焊死在一起,厂商给你什么你用什什么。DeepSeek Harness 反着来——模型、工具、会话、沙箱、调度全是插件,挂在一块叫 Cordis 的底板上,想换哪个拔下来换一个就行 CSDN。
更鸡贼的是,它还能把 Claude Code、OpenAI Codex 当子 Agent 调用。你不是我的竞品,你是我的零件。
当时我说,这是"Agent 时代的安卓"——开放、可插拔、不绑定任何厂商。
现在再看,这个判断有了新的含义:DeepSeek 一边把 API 涨价,一边把"换掉 API 的工具"免费送给了所有人。
这两件事是同一件事的两面:它想让你离不开模型,又亲手让你随时能离开它。
三、涨价后的平替方案:三个零件,拼成一套不花钱的 Harness
如果只看到"涨价",那这篇就到头了。但真正的玩法是:DeepSeek 涨价了,你的成本却可以一分钱不涨。
因为免费平替,已经排好队了。
零件一:腾讯微信小程序大赛送的 Coding Plan Token
微信小程序开发大赛,报名就送。不是参赛作品才能领,报名即可申请,收到邮件就能通过 API 调用模型 用户提供的微信原文。
送的是两款模型:GLM-5.2 和 DeepSeek-V4-Flash。
你没看错——V4-Flash,就是今天涨价的那个 V4-Flash。腾讯这边白送。
细节:
- Token 管理页:weastraaiweb
- API 接口:https://chatapi.weixin.qq.com/openai/v1/chat/completions
- 完全兼容 OpenAI 协议,直接配到 Cursor、Claude Code 等 IDE 里
- 不限 token,但限次数:每 5 小时约 1200 次、每周约 9000 次、每月约 18000 次(动态调整)
- 报名窗口:7月17日到10月17日
- 想参赛还能冲最高 10 万奖金
日常开发完全够用。唯一要注意:请求数和 token 不是一个概念,别被评论区带偏。
零件二:Agnes AI 免费全模态 API
这个我们之前写过——新加坡团队 Agnes AI,6月1日起把文本、图片、视频三大模态的 API 无限期免费开放 极客公园。
免费不是噱头,首周文本模型调用量就破了 1 万亿 token,图片 200 万张,视频 200 万秒 掘金。
- 文本:agnes-2.0-flash(升级后 2.5-flash),1M 上下文,支持工具调用
- 图片:agnes-image-2.1-flash,文生图、图生图、4K 输出
- 视频:agnes-video-v2.0,文生视频、音画同出
- 接口完全兼容 OpenAI 格式:https://api.agnes-ai.cn/v1
- 官方明确说过可以接 Claude Code、Codex、OpenClaw、Hermes 等 harness 极客公园
零件三:DeepSeek Harness 这块底板
前两个是"零件",Harness 是让你能随便换零件的"插座"。
在 DeepSeek Harness 里,模型是个插件。你把默认的 DeepSeek API 换成腾讯的、Agnes 的,操作就是改一段配置的事——不是换一个产品,是拔插一个零件 Gigazine。
一套组合拳下来:
白天高峰时段 DeepSeek 涨价?切腾讯免费额度里的 V4-Flash。 要长文档、要工具调用、要图片视频?切 Agnes 免费 API。 简单任务、大量并发的脏活?全部丢给免费模型,贵的留给真正难啃的硬骨头。
成本结构一夜之间,从"按 token 心惊胆战"变成"基本归零"。
四、为什么说涨价反而是好事
讲完省钱,说点更深的。
过去一年,整个行业都在玩"价格战",谁便宜用谁。DeepSeek 是那场战争里最大的赢家,也是第一个说"不打了"的人。
但你要看清一件事:模型正在变成水电煤。 谁给你供电不重要,重要的是你有一个不绑死任何供应商的"插座"。
涨价逼你把模型当"可替换的零件"看——这恰恰是 Harness 想让你做的事。DeepSeek 想靠涨价回血,但它开源的 Harness 恰好让"换掉它"变得前所未有地容易。这是商业上最拧巴、也最精彩的一点。
你看这几件事其实是同一条线:
- OpenAI 在搞多智能体 v2,主 Agent 自动把任务分给便宜模型,20% 的步骤才动用最强模型
- DeepSeek 在开源 Harness,让模型选型变成一个配置问题
- 腾讯在送 token,Agnes 在免费开放全模态
模型的白菜化 + 模型的自由插拔 = 能力还在,价格归零。
谁最先想明白这件事,谁就先从"被涨价拿捏"里解放出来。
五、写在最后:安卓不关心你装什么芯片
上周那篇文章我写了句"R1 让推理变得便宜,DSH 想让 Agent 变得自由"。
今天这篇把它接上:DSH 想让你自由的,不只是换 harness,还包括——换模型不心疼。
当年安卓从来不管手机里装的是高通还是联发科,装什么芯片都能跑,生态照样长成参天大树。
现在轮到 Agent 了。你的 Agent 装什么模型都能跑——DeepSeek、GLM、Agnes、Claude、Codex,谁便宜、谁免费、谁强,就换谁。
DeepSeek 涨价这天,真正该做的事不是抱怨,而是把这句话记住:
别把身家性命,绑在任何一个 API 上。
模型会越来越便宜、越来越免费,真正值钱的是你手里的那套 Harness 工程能力——那个让你今天涨价能躲、明天换模型能跑的东西。
水电煤会涨价,但接水电煤的插座,永远是你的。
更多推荐

所有评论(0)