DeepSeek V4 Pro 正式版已经上线。根据 DeepSeek 更新日志,正式版已推送至 App、网页端和 API;开发者仍可使用原有的 deepseek-v4-pro 模型名,服务端对应版本则更新为 DeepSeek-V4-Pro-0813。

这次更新的重点并非扩大上下文窗口或调整基础规格,而是进一步强化 Agent 能力,尤其是需要模型调用工具、操作终端、理解代码仓库并连续执行多步任务的场景。DeepSeek 公布的对比数据显示,正式版在多项 Agent 基准上相较 V4 Pro 预览版取得明显提升。
- Terminal Bench 2.1:从 72.1 提升至 87.9;
- NL2Repo:从 38.5 提升至 61.5;
- CyberGym:从 52.7 提升至 83.3;
- DeepSWE:从 12.8 提升至 62.7;
- AutomationBench Public:从 12.8 提升至 31.8;
- DSBench-Hard:从 31.1 提升至 67.2。
在 DeepSeek 给出的横向对比中,V4 Pro 正式版已经在若干项目上逼近或超过 Fable 5。例如,其 Terminal Bench 2.1 得分为 87.9,与对照表中 Fable 5 的 85.0 处于同一水平区间;DeepSWE 为 62.7,高于对照成绩 58.0;AutomationBench Public 为 31.8,高于 27.2。另一方面,V4 Pro 在 NL2Repo、Toolathlon-Verified 和 DSBench-Hard 等项目上仍然落后。
因此,“逼近 Fable 5”更适合被理解为部分 Agent 指标进入相近区间,而不是所有能力已经全面持平。不同模型使用的推理档位、系统提示词、工具集合和 Agent Harness 都可能明显改变结果。上述数字主要来自 DeepSeek 公布的测试,尚不能替代统一环境下的独立评测。
从公开规格看,DeepSeek V4 Pro 采用混合专家架构,总参数量为 1.6T,每个 Token 激活约 49B 参数,支持 100 万 Token 上下文。官方 API 文档列出的最大输出长度为 384K Token,并提供非思考与思考模式,思考模式默认开启。
API 功能也进一步面向编程 Agent 补齐。V4 Pro 目前支持 JSON Output、工具调用、Anthropic 格式接口和 OpenAI Responses API,并针对 Codex 类开发工具提供接入支持。对已经使用 deepseek-v4-pro 的开发者而言,此次升级不需要更换模型名,但生产环境仍应重新测试工具调用稳定性、长任务成功率和 Token 消耗。
DeepSeek V4 系列公开模型卡还显示,该系列采用压缩稀疏注意力与高度压缩注意力组成的混合注意力机制,并引入 mHC 连接和 Muon 优化器。官方称,在百万 Token 上下文条件下,V4 Pro 的单 Token 推理计算量约为 V3.2 的 27%,KV Cache 占用约为后者的 10%。这些设计构成了其处理长代码库和长文档的基础,但正式版 0813 的实际服务表现还会受到后训练、推理配置和 Agent 框架影响。
价格方面,DeepSeek 官方页面显示,API 将从 2026 年 8 月 16 日 16:00 UTC 起采用峰谷计价,对应北京时间为 2026 年 8 月 17 日 00:00。V4 Pro 谷时每百万 Token 的缓存未命中输入与输出价格分别为 0.66 美元和 1.98 美元,峰时分别为 1.32 美元和 3.96 美元。峰时为每日 01:00 至 04:00 UTC、06:00 至 10:00 UTC,其余时段按谷时计费。
总体来看,V4 Pro 正式版最值得关注的变化,是其能力重心进一步转向代码 Agent 和真实工具环境。它在多项官方测试中已进入闭源前沿模型附近,同时保留较长上下文和相对较低的 API 成本。不过,对开发团队而言,更有意义的判断标准仍是模型在自身代码库、工具链和权限约束下能否稳定完成任务,而不是单一排行榜上的接近程度。