把"过期时间"写进模型名:DeepSeek 5天三连操作的完整复盘

9月8日,有开发者在DeepSeek开放平台的API列表里刷到了一个奇怪的模型ID:

deepseek-v4.1-flash-expires-on-0910

注意这个命名——过期日期,直接写进了模型名里。没有任何发布会,没有新闻稿,甚至没有一条官方公告,只有一个潜台词:爱测不测,48小时后它就没了。

接下来的5天,DeepSeek的操作密度高到离谱:48小时限时内测 → 新模型转正发布 → 官宣旧模型退役 → 用户强烈反弹 → 官网悄悄加一行脚注,旧模型"死里逃生"。中间还穿插了一个语音对话功能的灰度测试。

一家公司,5天,把"发布、降价、退役、反转"四个动作全做了一遍。这篇文章把这5天逐帧拆开——你会发现这家以"实验室随缘风格"著称的公司,正在发生一场教科书级的产品治理转型。


一、5天时间线:三件大事,一件比一件大

先把时间线钉死,方便后面引用:

时间事件
9月8日API悄悄上线临时模型 deepseek-v4.1-flash-expires-on-0910,仅48小时测试窗口,计费按V4 Flash标准
9月10日48小时一到,V4.1 Flash直接转正,无发布会,API文档更新一行日志;同步官宣:V4 Pro将于9月14日12:00下线,现有请求自动路由至V4.1 Flash并按后者计费
9月11日API定价页悄悄新增脚注:"为响应广大用户的需求,9月14日之后继续提供V4 Pro的API调用服务,计费方式保持不变"
9月12日-13日App灰度测试语音对话功能曝光:右上角小喇叭按钮,四种音色可选
9月14日V4 Pro原定"大限之日",实际继续提供服务——一个模型的"退役",被用户顶了回去

三件事,三条线:模型线(V4.1 Flash发布)、商业线(V4 Pro退役与反转)、产品线(语音对话灰度)。分别对应技术、商业、体验三个层面,而且环环相扣。下面逐一拆。

5天时间线:限时内测、退役公告、用户反弹、反转续命,开发者站在迁移决策的岔路口


二、V4.1 Flash:重点不是便宜,是"原生多模态"

外界对V4.1 Flash的报道大多聚焦在价格上——确实便宜,空闲时段每百万Tokens:输入缓存命中0.02元、缓存未命中1元、输出4元;高峰时段(工作日9:00-12:00、14:00-18:00)价格翻倍。相比V4 Pro,整体价格降了约六成。

但真正值得注意的是架构层面的变化。官方口径是:全新模型结构系列中尺寸最小的模型,552B参数的MoE架构,采用全新的 Causal-Encoder-Decoder 结构,输入激活参数8B、输出激活参数16B。

关键词是"原生多模态"。上一代V4 Flash也能看图,但那是外挂式的——在文字模型外面套一个视觉编码器。V4.1是从架构层面就支持多模态,文字、图片、音频走同一个模型。

打个比方:外挂式像给轿车加装尾翼,能跑,但不是设计之初就考虑的;原生式是从底盘开始按赛车标准造的,协调性完全不同级别。更重要的是,官方明确后续更大参数的模型会沿用这个架构——也就是说,DeepSeek下一代旗舰天生就是多模态的。这次的语音对话功能,某种意义上就是新架构在音频通路上的第一次产品化落地。

当然,新模型不是没有争议。InfoQ的分析文章直接指出V4.1 Flash"缺的不是能力,是软件工程思维"——Agent类跑分更强,但在真实的工程任务里表现不稳定;掘金上甚至有吐槽帖标题就叫《浪费时间!DeepSeek 4.1 Flash》。快速迭代是有代价的,这一点后面还会提到。


三、退役反转:最值得复盘的不是"降价",是那两行互相矛盾的公告

整个事件里,最有戏剧性、也最值得所有做API服务的团队研究的一幕,是V4 Pro的"退役反转"。

先看反转的原因。V4.1 Flash确实便宜、Agent跑分也更强,但官方自己的评测里,V4 Pro在GPQA Diamond这类知识型任务上仍然领先。而现实中,大量跑知识问答、长文档处理的业务,换模型意味着整套评测流程要重跑一遍——省下来的钱能不能覆盖迁移和重测的成本,每个团队算完账都得掂量。

于是9月14日到期前,用户的声音集中爆发。DeepSeek的应对是:9月11日在API定价页悄悄加了一条脚注——"为响应广大用户的需求,继续提供V4 Pro服务"。

但有意思的是"改口改得并不彻底":

  • API定价页说:V4 Pro继续提供,计费不变;
  • V4.1 Flash发布公告说:V4 Pro将于9月14日12:00下线自动路由。

两个页面同时挂着,互相矛盾。有海外开发者专门写了迁移指南,标题就叫"退役、反转和检查清单",提醒同行的第一句话是:先看定价页——那是管钱的页面,它说了算。

这暴露了快速迭代的公司普遍存在的发布管理问题:新决策通过最小改动(加脚注)落地了,但旧公告没有回收,信息出现了分叉。对用户来说,两个页面的"话"不一样,比页面难看严重得多。

不过话说回来,我依然认为这次反悔是进步。以前的DeepSeek更像实验室:发模型看心情,定价随缘。8月17日峰谷定价大幅上调API价格,提前通知只有几天。而现在,它会因为用户的反弹在三天内改口——付费客户的话语权,肉眼可见地变重了。原因也不难猜:IPO都在筹备了,付费客户就是将来的财报,谁也不想在上市前把金主得罪了。


四、48小时限时内测:一个被低估的发布策略

回到9月8日那个奇怪的模型名,这个"把过期时间写进模型ID"的操作,我琢磨了很久,越想越觉得精明。

**第一,制造紧迫感。**开发者看到"expires-on-0910",会立刻去试,生怕错过。传统的"限时公测"公告没人看,写进模型名,每个调API的人都会被迫看到。

**第二,控制成本。**新架构的推理成本高,48小时窗口意味着无论多少人来测,成本都是有上限的。

**第三,收集真实流量。**实验室评测再全,也不如几千个开发者拿真实业务跑48小时。内测期间计费还按老价格算,等于白送——"加量不加价,这很DeepSeek"。

一套操作,同时解决了冷启动、成本控制和数据收集三个问题,成本只是改了一个模型命名。对做开发者产品的团队来说,这是一个可以直接抄的模板。


五、语音对话:来得晚,但细节控

5天里的第三件事:App灰度测试语音对话。被灰度到的用户,右上角会多一个小喇叭按钮;设置页新增"朗读音色",四个选项:

  • 贝壳:百变活泼
  • 白浪:明朗坚定
  • 海星:俏皮甜美
  • 暗潮:低沉浑厚

四个名字全是海洋系,和"深度探索"(DeepSeek)的品牌调性完全一致。对比某些产品"甜美女声1""磁性男声2"的命名,这个细节说明产品团队是真的在经营品牌质感。

但必须承认:语音这件事,DeepSeek来得太晚了。ChatGPT 2023年就有语音对话,Siri更是十几年前的事。为什么现在才做?合理的解释有两个:一是策略上"先把模型做聪明,再把产品做完整"——V4 Pro、V4 Flash、V4.1 Flash一个接一个,产品功能排在能力后面;二是语音是重投入功能,识别、合成、实时对话延迟每一项都要专门的算力和团队。

不管原因如何,语音补上之后,DeepSeek的产品形态才算完整:文字、图片、语音三大输入输出方式全覆盖。配合原生多模态架构,这更像是一个信号——"便宜的GPT平替"这个阶段要结束了,它开始按一个完整AI平台的规格补课。


六、给开发者的迁移决策清单

最后落到实操。如果你手上挂着V4 Pro的业务,结合这次反转,给你一份决策清单:

  1. **以定价页为准,不要以新闻为准。**官方公告和定价页冲突时,管钱的页面说了算。这次反转后计费方式保持不变,短期不用迁移。
  2. **别只看跑分差,先算重测成本。**V4.1 Flash在Agent类任务上更强、价格低六成,但V4 Pro在GPQA Diamond等知识型任务仍领先。跑知识问答、长文档处理的业务,先评估"省的钱 vs 重跑评测的工时"。
  3. **知识型业务迁移前,先做A/B灰度。**别全量切。InfoQ的分析已经指出新模型在软件工程任务上的稳定性问题,全量切换等于把回归测试外包给生产环境。
  4. **把"模型退役"写进你的架构假设。**这次是V4 Pro被顶回来了,下次未必。API集成层面做好模型路由抽象,换模型应该只改一行配置,而不是改整个调用链。
  5. **习惯"快速发布+快速改口"的节奏。**8月涨价提前几天通知,这次退役提前4天宣布。与其抱怨,不如在团队里建立模型版本巡检机制——盯API更新日志,比盯新闻稿有用。

写在最后

回头看这5天:把过期时间写进模型名是工程师的浪漫,被用户顶回来续命是商业的清醒,四音色的海洋命名是品牌的用心。一家曾经"发模型看心情"的实验室公司,正在学着在能力、成本和客户感受之间找平衡。

一个实验室开始"听劝",未必是坏事。只是这个通知节奏——做API集成的朋友,最好早点习惯。


参考信源:DeepSeek开放平台API定价页及公告、钛媒体(2026-09-13)、网易科技·三易生活(2026-09-13)、每日经济新闻、InfoQ《V4.1 Flash全面超越,开发者为何还在喷DeepSeek》。本文不构成任何采购或投资建议。

Logo

欢迎加入DeepSeek 技术社区。在这里,你可以找到志同道合的朋友,共同探索AI技术的奥秘。

更多推荐