DeepSeek V4 Pro 正式版发布:Agent 能力跃升、双协议兼容,全面拆解 0813 版本

📅 2026/8/14 4:31:20
DeepSeek V4 Pro 正式版发布:Agent 能力跃升、双协议兼容,全面拆解 0813 版本
DeepSeek-V4-Pro-0813 于 2026 年 8 月 13 日凌晨无预告发布是 V4 系列旗舰模型的首个正式版本承接 4 月 24 日上线的预览版核心变化是 Agent 能力的大幅跃升——DeepSWE 从 12.8 跳至 62.7390%、NL2Repo 从 38.5 升至 61.5、DSBench-Hard 升至 67.2——架构与参数量未变1.6T MoE、激活 ~49B改变来自针对性后训练定价维持 ¥3 元/百万 token输入、¥6 元/百万 token输出官方同步宣告近期将大幅涨价API 新增 Responses API 与 Anthropic API 双协议支持已兼容 Codex 和 Claude Code 等主流编程工具同期 DeepSeek Harness 极简模式亦随文档首次亮相。这次更新了什么不是新模型是新后训练V4-Pro-0813 与 4 月的预览版共用同一模型架构和参数规模官方说明变化来自后训练阶段的重做参数量总参数 1.6TMoE 架构每 token 激活约 49B上下文窗口1M token最大输出 384K token推理模式三档——Non-Think快速响应/ Think High复杂分支/ Think Max最深推理架构特性CSA压缩稀疏注意力 HCA高度压缩注意力混合相较 V3.2 架构FLOPs 降至约 27%KV Cache 需求降至约 10%模型结构没有变但 Agent 相关的后训练数据和策略做了针对性改造。DeepSWE 390% 的跳升是后训练而非架构升级所驱动的。Agent 基准从不及格到领跑官方公布了与预览版的对比数据测试集预览版4月正式版0813涨幅DeepSWE软件工程 Agent12.862.7390%NL2Repo自然语言生成仓库38.561.560%DSBench-Hard全栈高难编码~33推算67.2~翻倍DeepSWE 是 DeepSeek 自研的软件工程 Agent 基准以复杂多步骤代码修改任务为主12.8 分意味着几乎无法完成自主编码任务62.7 分已进入主流 Agent 产品的竞争区间。参照系此前 V4-Flash 正式版7 月 31 日在 DeepSWE 上得分 54.4V4-Pro 正式版的 62.7 比 Flash 还高出约 8 个百分点。第三方 BenchLM 数据V4 Pro High 模式类别测试集分数编程SWE-bench Verified79.4%编程LiveCodeBench COT89.8%编程Codeforces Rating2919推理GPQA Diamond89.1%长上下文MRCR 1M token83.3%智能体BrowseComp80.4%数学HMMT Feb 202694.0%数学IMOAnswerBench88.0%价格3 倍于 V4-Flash官方预告涨价V4-Pro 维持预览版定价与 V4-Flash 正式版的对比计费类型V4-FlashV4-Pro倍数输入缓存未命中¥1/M¥3/M3×输入缓存命中¥0.008/M¥0.025/M~3×输出¥2/M¥6/M3×并发限制25005001/5注意官方文档在 V4-Pro 发布的同一天明确提示“We plan to raise the overall pricing for DeepSeek API services in the near future, with asignificant increaseexpected.”如果有大量 V4-Pro 调用计划当前时间窗口锁定用量可能有意义。API 接入方式变化Responses API Anthropic 双协议V4-Pro 正式版新增了两个 API 协议层的兼容1. OpenAI Responses API新fromopenaiimportOpenAI clientOpenAI(api_key你的 DeepSeek Key,base_urlhttps://api.deepseek.com/v1,)responseclient.responses.create(modeldeepseek-v4-pro,input分析这段代码并生成测试用例,)print(response.output_text)2. Anthropic API 协议新importanthropic clientanthropic.Anthropic(api_key你的 DeepSeek Key,base_urlhttps://api.deepseek.com,)messageclient.messages.create(modeldeepseek-v4-pro,max_tokens4096,messages[{role:user,content:分析这段代码并生成测试用例}],)print(message.content[0].text)3. 标准 OpenAI Chat Completions不变原有 OpenAI 格式调用无需修改model字段填deepseek-v4-pro即自动指向最新版本。这意味着现有 Claude Code、Codex 的工作流可以通过切换 base_url 和 api_key 直接测试 V4-Pro 能力代码零改动。推理强度调节V4-Pro 支持三档推理模式通过reasoning_effort参数控制completionclient.chat.completions.create(modeldeepseek-v4-pro,reasoning_efforthigh,# none / high / maxmessages[{role:user,content:设计一个分布式任务队列的架构方案}],)档位API 值适用场景Token 消耗Non-Thinknone快速问答、代码补全、格式转换最少Think Highhigh代码审查、多步推理、调试中Think Maxmax复杂架构设计、竞赛题、长链路 Agent最多企业生产环境建议按任务类型动态设置——简单任务用none可将成本和延迟降低 50% 以上。V4-Pro vs V4-Flash怎么选两款模型现在同时在线核心区别维度V4-FlashV4-Pro参数量284B MoE1.6T MoE激活参数~13B~49B价格¥1/¥2/M¥3/¥6/M并发限制2500500DeepSWE54.462.7NL2Repo54.261.5适用场景高并发、低延迟、成本敏感复杂推理、多步 Agent、代码生成选型建议代码生成、自主 Agent 任务 → V4-ProAgent 能力高 8–10 个百分点高并发 RAG、实时问答、批量处理 → V4-Flash并发 5 倍成本 1/3不确定的场景 → 先用 Flash 测出延迟和质量基线再决定是否升级 Pro配套Harness 极简模式首次亮相V4-Pro 发布文档中首次正式提及 DeepSeek Harness“正式版 DeepSeek-V4-Pro 使用DeepSeek Harness 极简模式即将发布作为 Agent 测试框架”这意味着上述所有 Agent 基准DeepSWE 62.7、NL2Repo 61.5 等是在 Harness 极简模式下跑出来的。完整 Harness 产品包含更丰富的上下文管理、工具编排和测试回传闭环——实际 Agent 场景下的表现有望进一步提升。DeepSeek Harness 的完整背景详见团队介绍。常见问题QV4-Pro-0813 和之前的deepseek-v4-pro模型 ID 是什么关系无缝兼容。API 调用时使用deepseek-v4-pro即自动路由到最新正式版0813无需修改代码。0813 是版本号标识API 层面透明。Q官方提示的大幅涨价是什么时候截至 2026 年 8 月 13 日官方未给出具体涨价时间仅说near future近期。建议关注官方 API 文档更新日志api-docs.deepseek.com。QV4-Pro 的并发限制 500 对企业场景够用吗取决于请求量。500 并发对于大多数中型企业日常用量足够但高并发批处理场景如离线数据分析、大规模代码审查流水线可能触顶此时需要混合使用 V4-Flash 或通过多 Key 分流。通过多模型聚合 MaaS 平台如七牛云 Token Planqiniu.com/ai/plan统一接入 DeepSeek 和其他国产模型可以在 V4-Pro 触达并发上限时自动降级到其他模型降低业务中断风险。QAnthropic API 格式接入 DeepSeek 会有行为差异吗接口层协议兼容但 DeepSeek V4-Pro 的 thinking 模式与 Claude 的 extended thinking 实现不同streaming 的reasoning_content字段格式也有差异。建议在迁移前测试关键提示词的输出一致性。QDeepSWE 62.7 是什么水平DeepSWE 是 DeepSeek 的内部 Agent 基准外部独立复现数据有限。作为参照BenchLM 第三方数据显示 V4-Pro 在 SWE-bench Verified业界通用基准上得分 79.4%处于同级别模型第一梯队但仍低于 Claude Opus 5 的 96%。小结V4-Pro-0813 是一次重点在后训练的 Agent 能力升级架构不变DeepSWE 从 12.8 升至 62.7Agent 编排能力从几乎无法完成跨越到可与主流产品竞争双协议支持OpenAI Anthropic让现有 Claude Code / Codex 工作流可以零改动接入测试价格维持 ¥3/¥6 per million token但官方涨价预告已经发出当前是锁定用量的时间窗口。DeepSeek V4 系列至此首次形成完整正式版矩阵——Flash 负责高并发低延迟Pro 负责复杂推理和深度 AgentHarness 作为配套工程框架即将补位。本文信息截至 2026 年 8 月 13 日以 DeepSeek 官方 API 文档为准。延伸阅读DeepSeek API 官方更新日志https://api-docs.deepseek.com/zh-cn/updatesDeepSeek API 价格页https://api-docs.deepseek.com/quick_start/pricingBenchLM V4 Pro High 测评数据https://benchlm.ai/models/deepseek-v4-pro-high七牛云 Token Plan含 DeepSeek V4 Pro 多模型接入https://qiniu.com/ai/plan