深夜突袭!DeepSeek V4 Pro 正式版来了:1M 上下文、打平 Fable 5,价格还没涨

深夜突袭!DeepSeek V4 Pro 正式版来了:1M 上下文、打平 Fable 5,价格还没涨
8 月 12 日深夜,DeepSeek 在官方群里甩了一句话:V4 Pro 正式版上线了。
没有发布会,没有 PPT,没有热搜预热。这种"大半夜扔炸弹"的打法,已经成了 DeepSeek 的招牌动作,他们好像特别喜欢在别人睡觉的时候搞事情。
但这次的炸弹不一样。它不是又一个"又快又便宜"的轻量模型,而是一个正儿八经的旗舰:1M 上下文、384K 输出、思考模式默认开启,而且在 Agent 能力上,多项评测直接压过了 Opus 4.8,和目前公认最强的 Fable 5 打成了平手。
更反常的是价格。两天前整个行业还在喊"免费时代结束",DeepSeek 自己也预告过 API 要大幅涨价。结果这次 V4 Pro 转正,价格纹丝不动。
所以今天这篇,我想聊的不是参数表上又多了几个零,而是一个更实在的问题:这个模型,普通人到底能不能用、值不值得现在用。
1M 上下文,意味着你终于不用再"喂片段"了
以前用模型处理长文档,就像给一个近视眼看墙上的小字,得裁成一截一截喂。一本合同、一个代码仓库、一份几百页的研报,模型看一半就"忘了"前面。
1M token 是什么概念?约等于 75 万汉字,或者一整本长篇小说,或者一个中型代码库。一次塞进去,它从头看到尾。
这不是数字游戏。对写代码的人来说,以前让 AI 改一个跨文件的大项目,它经常改了这边漏了那边,因为上下文装不下整个仓库。现在 384K 的最大输出,意味着它不光能读,还能一口气给你写出一大段完整代码。长代码库分析、大规模文档摘要、需要连续跑几十步的 Agent 任务,这些以前要拆成很多次调用的活,现在一次就够。
对开发者和小团队,这是最实在的升级。别看 1M 听起来抽象,它解决的是"活儿太大装不下"这个每天都卡的痛。

它真的开始"干活"了,不是只会聊天
官方放出的对比表很说明问题。
DeepSWE,这是一个考真实软件工程能力的编程智能体测试,V4 Pro 从预览版的 12.8 直接跳到 62.7,差不多涨了 5 倍。Terminal Bench 2.1 从 72.1 升到 87.9,HLE(带工具)从 48.2 到 60.0,DSBench-Hard 从 31.1 到 67.2。
翻译成人话:这模型能自己开终端、跑命令、改代码、调接口,连续干一堆步骤还不出错的概率,比预览版高了一大截。在 AutomationBench(考智能体能不能真正把活干完)和 CyberGym(网络安全攻防)这两个基准上,它甚至超过了 Fable 5。横向比,多项 Agent 评测压过了 Opus 4.8,和 Fable 5 互有胜负。
但我得泼盆冷水。别被"打平 Fable 5"冲昏头。在 DSBench-FullStack 上,V4 Pro 是 71.1,Fable 5 是 77.2,还差着一截;Terminal Bench 2.1 是 87.9 对 88.0,基本贴脸但没过去。所以准确的说法是:国产模型第一次稳稳摸到了世界第一梯队,但塔尖那几分的差距还在。
从"聊天工具"到"能交付的同事",V4 Pro 跨过了关键一步。但它不是万能的,复杂全流程的工程活儿,离真人还是有距离。

价格没涨,但这是个"窗口期"陷阱
V4 Pro 每百万 token 定价:缓存命中输入 0.025 元、未命中 3 元、输出 6 元。V4 Flash 分别是 0.02、1、2 元。Pro 在输入未命中和输出这两项主要计费上,正好是 Flash 的 3 倍。并发限制:Pro 500,Flash 2500。
先看横向。同样是对标 Fable 5 这个级别的模型,海外那批按美元计费,一个中等任务动辄几刀。V4 Pro 输出 6 元 / 百万 token,换算下来一个长任务可能也就几毛到几块。所以"贵 3 倍"是跟自家的 Flash 比;跟对手比,它还是便宜得离谱。
但注意那个"窗口期"。DeepSeek 自己之前发过公告,说计划近期整体上调 API 定价,“预计涨幅较大”。这次 V4 Pro 转正价格没动,等于把涨价这颗雷往后挪了。
更要命的是它同时兼容 OpenAI 和 Anthropic 两套 API 格式。什么意思?很多公司本来在 Claude、GPT 上写好的 Agent 代码,几乎不用改就能切到 DeepSeek。迁移成本低到可以忽略,可一旦涨价,这批人也是最容易被"锁"住的。
现在是用 V4 Pro 试水 Agent 工作流最划算的时候。不是因为它永远便宜,而是因为便宜的尾巴正在收。
还有一条暗线:DeepSeek Harness
这次发布顺带露了个信号。DeepSeek 偷偷注册了"DeepSeek Harness 团队"的账号,logo 是一只黑鲸鱼,对内对标 Claude Code。5 月就有研究员说内部在组 Harness 团队。
模型强了,工具链在补,这是一条完整的国产 Agent 闭环在成型。值得盯着。
普通人、开发者、企业分别该干嘛
普通人,别被参数吓到。你用得到的,是"把一整份资料丢进去让它读、让它写"这件事变顺了。趁没涨价,长文档、写代码、做归纳,先薅一波。
开发者,双 API 兼容是真香。已经在 OpenAI 或 Claude 生态里的,可以低成本切过来跑 Agent。FIM 补全和前缀续写还在 Beta,只在非思考模式能用,写代码补全可以试试。
企业,盯紧 Harness 这条线。国产 Agent 工具链补齐后,把重复工程活外包给模型,成本结构会被重写。但别在涨价前盲目囤量,规则随时变。
DeepSeek 又一次证明了同一件事:把天花板抬高的人,不一定收最高的门票。但门票会不会一直这么便宜,答案大概率是不会。趁现在,先把活干完。
更多推荐


所有评论(0)