8月17日零点,DeepSeek的API价格准时变了。V4-Pro高峰输出从6元涨到27元/百万Token,缓存命中输入从0.025元飙到0.3元——涨了11倍。如果你是个习惯白天跑批量任务的开发者,今早打开账单的心情大概跟看到电费单差不多。

同一天,Anthropic宣布Sonnet 5不再涨价了,原定结束的"限时低价"变成永久定价。这边涨、那边保,中间还夹着Stripe花70亿美元买下OpenRouter——三件事撞在一起,不是巧合。

先说DeepSeek的峰谷定价。 高峰时段(9-12点、14-18点)价格是闲时两倍,这招跟电网学的。官方说法是"用价格杠杆调节负载",但换个角度:当"价格屠夫"开始涨价,说明国产大模型从"烧钱换规模"转向"可持续商业化"了。

有开发者算过:一个日均10万咨询的智能客服,按新基准价月成本从1200元升到3000元,高峰时段还要翻倍。但对中小团队来说,解法不是抱怨涨价,而是学会"错峰用电"——把批量任务挪到夜间,成本直接省一半。

再看OpenRouter被收购。 Stripe花70亿美元买的不是OpenRouter本身,是"模型选择、调用、支付"这一层的入口控制权。OpenRouter月处理200万亿Token、连接500多个模型,本质上已经是AI世界的"收费站"。Stripe从支付切入再拿下路由层,意味着未来你每次调API,可能都要经过它的计费系统——便利是真,中间商抽成和数据集中化的隐忧也是真。

最值得关注的反而是NVIDIA开源的NeMo Switchyard。 一个Rust写的、Apache 2.0协议的开源路由库。LangChain实测145个多轮Agent任务,只把7%的请求派给Claude Opus 4.8这种旗舰模型,成本从每次$11.45砍到$3.00,降幅74%。核心逻辑很简单:先让便宜模型试,搞不定再升级,这叫"逐级路由"。

这三件事指向同一个趋势:API中间层正在被三方同时瓜分——金融基础设施(Stripe/OpenRouter)控制计费;云厂商和运营商用Token套餐把算力变成流量包;开源路由工具让有技术能力的团队自己掌控路由逻辑。

对独立开发者来说,这意味着不能再"一套模型打天下"了。DeepSeek涨价告诉你依赖单一供应商有风险,OpenRouter被收购告诉你中间层在集中化,NVIDIA开源路由告诉你自己搭路由的成本门槛已经低到可以接受了。

那现在能做什么?

第一,把批量任务挪到凌晨跑。 DeepSeek闲时价格是高峰一半,这是白送的折扣。有团队把日报生成从上午9点改到凌晨2点,月成本降了40%。

第二,学会"逐级路由"。 先让便宜模型试,搞不定再升级。Reddit上有人六周把Agent账单从$847降到$159,核心就三件事:模型路由+提示压缩+语义缓存。

如果你不想一上来就折腾Switchyard这种开源路由库,也可以先走EasyAPI——它帮你提前完成供应商解耦,一个Key接入所有主流模型,切换只需要改配置项,不碰业务代码。先跑通"简单任务走Flash、复杂任务走Pro"这两档,就能看到明显变化。

第三,关注运营商Token套餐。 中国移动5元/月起步,接入300+模型,轻度用户可能比按量付费更划算,而且有发票、能审计。

API成本优化的本质,不是找最便宜的价格,而是建立弹性策略。今天DeepSeek涨价、明天OpenAI降价、后天又有新模型冒出来——只有你的路由策略是灵活的,才能在快速变化的市场里守住成本底线。

Logo

欢迎加入DeepSeek 技术社区。在这里,你可以找到志同道合的朋友,共同探索AI技术的奥秘。

更多推荐