DeepSeek V4-Pro 正式版上线,API 8月17日起分时调价

📅 2026/8/15 14:04:18
DeepSeek V4-Pro 正式版上线,API 8月17日起分时调价
8月13日晚DeepSeek 官宣 V4-Pro 正式版在网页端、App、API 全线上线同时公布新定价从北京时间 8月17日0时起V4 系列 API 改为峰谷分时计价高峰时段部分计费项涨幅最高达 12 倍缓存命中输入输出价格涨到 27 元/百万 tokens是原来的 4.5 倍。对天天调 DeepSeek API 的开发者来说这比模型更新本身更值得关注——账单要变了。发生了什么时间线是这样的8月12日晚DeepSeek API 文档里出现 DeepSeek-V4-Pro-0813正式版静默上线随后社区实测陆续出现异常本应长思考的请求思考时间经常不足十秒长流程任务频繁提前收尾据报道21世纪经济报道8月13日白天官网首页通知和开放平台公告一度撤回当晚官方才发推官宣正式版全线上线并同步公布调价方案。官方没有对这 24 小时的波动作出公开说明。模型本身的参数规模没变仍是总参数 1.6 万亿的 MoE 架构激活约 490 亿参数上下文 100 万 tokens最大输出 38.4 万 tokens据报道。变化集中在后训练和 Agent 能力上。官方自测数据显示V4-Pro-0813 在 DeepSWE、Terminal-Bench 等 Agent 基准上大幅超过预览版逼近甚至部分反超 Anthropic 的 Fable 5。注意一个前提这些跑分目前只有 DeepSeek 官方发布第三方基准平台上还没有结果没有独立复现。价格到底涨了多少据报道新价格从 8月17日0时生效首次引入峰谷定价每日 9:00-12:00、14:00-18:00北京时间为高峰时段其余为闲时闲时价格为高峰的一半。以 V4-Pro 为例元/百万 tokens计费项原价高峰价闲时价缓存命中输入0.0250.3012倍0.15缓存未命中输入393倍4.5输出6274.5倍13.5V4-Flash 同步调整高峰时段缓存命中输入 0.10 元、缓存未命中输入 3 元、输出 9 元闲时减半。涨幅最夸张的缓存命中输入虽然比例是 12 倍但绝对价格依然是全表最低。两个没变也值得注意API 的模型名没变还是 deepseek-v4-pro变的只是版本号0813网页端和 App 的免费使用不受影响。官方对涨价的解释是更合理地调配资源据报道。另外V4-Pro 的并发限制是 500 路V4-Flash 是 2500 路——高并发批量场景下Flash 在价格和并发上反而都更合适。对普通开发者意味着什么三个实际动作。第一错峰。批量任务数据清洗、批量生成、日志分析本来就不在乎几小时延迟挪到闲时跑成本直接砍一半。高峰时段留给在线交互。第二算清缓存账。缓存命中输入涨了 12 倍但 0.30 元/百万 tokens 依然是全表最低价。把 system prompt、few-shot 示例这些固定前缀尽量命中缓存多轮对话和 agent 循环里能省不少。可以用这个脚本按新价格快速估算# 按 2026-08-17 起的新价格估算单次调用成本元defcost(price_per_million,tokens):returnprice_per_million*tokens/1_000_000peak{cache_hit_in:0.30,cache_miss_in:9.0,out:27.0}off{cache_hit_in:0.15,cache_miss_in:4.5,out:13.5}defbill(in_tokens,out_tokens,hitTrue,off_peakFalse):poffifoff_peakelsepeak in_pricep[cache_hit_in]ifhitelsep[cache_miss_in]returncost(in_price,in_tokens)cost(p[out],out_tokens)print(bill(2000,500,hitTrue))# 高峰缓存命中print(bill(2000,500,hitTrue,off_peakTrue))# 闲时缓存命中第三别急着信跑分。Agent 基准暴涨的数据目前是孤证且正式版上线当天就出现过服务波动的前科。接生产环境前拿自己的任务集做一轮对比再决定要不要迁移。第四重新评估选型。调价后 Flash 高峰输出 9 元/百万 tokens只有 Pro 的三分之一如果业务大头是结构化抽取、文本摘要这类任务Flash 大概率够用。复杂 agent 循环、长链路代码任务再考虑 Pro但先等第三方复测数据别只信官方跑分。8月17日新价格生效后把 API 账单按时段拆开看一遍确认自己的调用分布落在哪个时段再决定要不要调整调度策略。顺带一提8月13日晚 DeepSeek 还开源了 Agent 框架 DeepSeek Harnessdshv0.1 开发者预览版MIT 协议装好 Node.js 后运行npx deepseek-ai/dsh web就能在本地启动 Web UI默认 127.0.0.1:3080。官方明说后续会有破坏兼容性的改动适合先当试验品别急着上生产。涨价这种事老板看到的是成本优化空间我看到的是又得回去改预算表了。不过换个角度想分时定价本身也是一种信号算力资源越来越贵错峰、缓存这些省着用的技巧正在变成 AI 应用的常规技能。你怎么看评论区聊聊。