8.13 国产开源双响炮:DeepSeek V4 Pro 转正 + Qwen3.8 放开权重,学生党开发者的实在账

2026-08-12 深夜到 08-13,杭州两支队伍几乎同夜放大招:DeepSeek 把 V4 Pro 从预览版静默转正为 0813 正式版,阿里 Qwen 团队首次放出 Qwen3.8-2.4T-A95B​ 的开放权重。没有发布会,全是 API 文档和 HuggingFace 仓库里悄悄挂出来的。

一、DeepSeek V4 Pro 0813:架构没换,后训练重做

  • 参数:1.6T 总参数 MoE,每 token 激活 ~49B,1M 上下文,最大输出 384K。

  • 模式:Non-Think / Think High / Think Max 三档,默认开 Think。

  • 能力跳变:DeepSWE 从预览版 12.8 跳到 62.7,Terminal-Bench 2.1 达 87.9(Fable 5 约 88.0),Agent/SE 能力正式进第一梯队。

  • 接口:原 deepseek-v4-pro 调用名不变,自动指向 0813 构建;新增 Responses API + Anthropic API 双协议,Claude Code / Codex 能直接挂。

  • 价格(官方):缓存命中输入 ¥0.025/M,未命中 ¥3/M,输出 ¥6/M(≈ 0.435/0.87)。官方已挂“近期大幅涨价”预告,当前价是窗口期。

对学生:解算法题、读课设报错、跑小 Agent,这个价位配合 1M 上下文基本零压力;毕设要分析整个代码仓库,一次丢进去不用切片。

二、Qwen3.8-2.4T-A95B:Max 级权重第一次开源

  • 参数:2.4T 总参数 MoE,每 token 激活 95B,每层 512 专家选 10 + 1 共享。

  • 上下文:原生 256K,可扩到 ~1.01M。

  • 许可:Qwen 自定义许可(非 Apache 2.0),个人可下可改可部署,大规模商用需另授权;开源版纯文本、强制思考模式,视觉/非思考/工具调用只在云端 Qwen3.8-Max 有。

  • 部署门槛:FP8 权重 + 激活 95B,单卡消费级显卡跑不动,需 vLLM/SGLang 在多卡 A100/H100 或 GB300 NVL72 级机器跑;学生党本地玩不现实,但实验室/校超算可以申请。

意义:以前“Qwen-Max 多强”只能云上试,现在权重端出来了,可以做 LoRA 微调、做评测、做私有化 RAG,毕业论文的“基座可控性”论证直接有抓手。

三、两条路线同台:闭源 API vs 开放权重

维度

DeepSeek V4 Pro 0813

Qwen3.8-2.4T-A95B

获取方式

官方/OpenRouter API

HF/ModelScope 下权重自部署

上下文

1M

256K(扩 1.01M)

激活成本

49B/token

95B/token

多模态

开源版否,云端版是

适合谁

个人开发者、作业辅助、Agent 产品

课题组微调、私服 RAG、合规内网

DeepSeek 走“低价 API 抢心智”,Qwen 走“放权重抢生态”,两件事同一天发生,说明国产旗舰已经不纠结“追不追得上”,开始分叉找自己的商业模式。

四、学生/开发者的落地建议

  1. 日常作业答疑、解 Bug、读课设代码:直接用 DeepSeek V4 Pro 0813 API,Luna 级轻量任务用 GPT-5.6 Luna 探路,V4 Pro 做深一档推演,成本也就几毛钱。

  2. 毕设/小论文要“可复现”:在 MetaChat元语 这类聚合台里把 DeepSeek V4 Pro、GPT-5.6、Claude Opus 5、Gemini 3.1 Pro 串起来,同一对话切模型上下文不断档,不用自己管 key 和路由;要引用“国产开源模型”时,把 Qwen3.8 权重拉到实验室机器跑个推理样例,比纯调 API 更有说服力。

  3. 别硬凑本地部署 Qwen3.8:显存不够强行量化到 4bit 会掉点严重,学生机建议等 Qwen3.8-27B(承诺同系开源)再本地玩。

  4. 涨价预警:DeepSeek 官方明说近期大幅调价,脚本里把 model 名和价格配置解耦,别把 ¥3/M 写死。

这天值得记一笔:国产大模型第一次在“闭源低价 API”和“开源万亿权重”两条线上同时摸到全球第一梯队门口。对学生来说,作业辅助的性价比拐点到了;对开发者来说,Agent 基座多了一个能跑满 1M 上下文的国产选项。

Logo

欢迎加入DeepSeek 技术社区。在这里,你可以找到志同道合的朋友,共同探索AI技术的奥秘。

更多推荐