DeepSeek-V4-Pro正式版深夜上线:Agent 跑分、价格和 1M 上下文一次看懂

北京时间 8 月 13 日凌晨,DeepSeek 官网的 API 页面更新了 V4 Pro 的版本信息。调用时仍使用 deepseek-v4-pro,实际版本已变为 DeepSeek-V4-Pro-0813。
这次更新有几个关键数字。上下文长度为 1M,最大输出为 384K;模型支持思考和非思考模式,也支持 Tool Calls、Responses API 和 Anthropic API。
DeepSeek 官方群同步的 Agent Benchmark 表显示,V4 Pro 0813 在终端操作、软件工程和工具调用等测试上,相比 Pro 预览版有明显提升。价格暂时没有调整。
一、版本、上下文与接口

DeepSeek 官网规格表,截图时间为 2026 年 8 月 13 日
对普通用户来说,1M 上下文意味着一次可以放入更多材料,例如长报告、代码仓库或多份文档。384K 是最大输出上限,它表示容量,不代表模型每次都需要输出这么多内容。
Tool Calls 让模型能够调用外部工具。Responses API 和 Anthropic API 则方便它接入 Codex、Claude Code 一类 Agent 工作流。已经使用 deepseek-v4-pro 的 API 用户不需要更换模型名,但重要任务最好重新跑一遍测试,因为底层版本已经变了。
二、Agent Benchmark 有哪些提升

DeepSeek 官方群公布的 Agent 评测图,此处仅裁去右侧其他模型列,数据未重绘
图中的 V4 Pro 0813 在所列项目上都超过了 V4 Pro Preview。几组数字尤其明显。
-
Terminal Bench 2.1 从 72.1 升到 87.9。
-
DeepSWE 从 12.8 升到 62.7。
-
AutomationBench 从 12.8 升到 31.8。
-
DSBench-Hard 从 31.1 升到 67.2。
这些测试主要观察模型操作终端、处理软件工程任务、调用工具和完成多步自动化的能力。它们能说明 V4 Pro 0813 的 Agent 表现比预览版更强,却不能直接证明模型能写出更好的论文。论文任务还需要检查文献是否存在、引用是否支持对应论断、改写是否歪曲原意。这些都不在上面的 Benchmark 里。
三、当前 API 价格与调价提示

DeepSeek 官网当前价格,单位为每百万 Token
V4 Pro 每百万 Token 的缓存未命中输入为 3 元,输出为 6 元,缓存命中输入为 0.025 元。
假设一次任务使用 10 万 Token 新输入,最后输出 2 万 Token,不计缓存命中,当前成本约为 0.42 元。实际费用取决于输入、输出和缓存情况,不能把这个算例当成固定价格。
DeepSeek 已在官网脚注中提示,计划近期整体上调 API 定价,预计涨幅较大。因此,上面是 8 月 13 日查到的价格,长期使用前还要重新查看官网。
四、对长文档和论文写作有什么用
V4 Pro 0813 最直接的用处,是它能装下更多材料,也更适合接入需要连续调用工具的 Agent 任务。用在学术写作里,可以考虑以下几类工作。
-
同时读取论文、审稿意见和修改稿,定位尚未回应的问题。
-
配合检索工具查找文献,再按 DOI、标题和出版信息逐项复核。
-
对长文档做结构检查,找出章节重复、论点断层和前后表述冲突。
-
把修改要求拆成多个可检查的小任务,完成一项就记录一项。
1M 上下文解决的是容量问题。它不保证模型能准确找到所有证据,也不保证长文输出的每一段都可靠。把材料放进去只是开始,作者还需要检查来源和最终文本。
五、用 AIWritePaper 先建初稿,再让 Agent 深度处理
如果从空白页面开始,手动准备选题、大纲和各章初稿会占用不少时间。一种更省事的分工方式,是先用 AIWritePaper 生成论文基础稿,再把初稿和文献材料交给 Agent,做引用核验、结构检查和局部改写。
无论使用哪种模型,文献、数据和最终论断都需要作者自己复核。
V4 Pro 0813 已经可以通过 DeepSeek API 调用。已经在使用旧版 Pro 的用户,可以用同一个任务重跑一次,重点看工具调用是否更稳定,而不要只看模型自己给出的文字评价。
另外,xAI 也在 8 月 12 日同步上线了 Grok 4.6,重点加强长时间 Agent 任务以及交互、视觉项目生成能力。

DeepSeek 官网当前价格,单位为每百万 Token
更多推荐


所有评论(0)