deepseek-chat / deepseek-reasoner 7 月 24 日停用:改一行迁移到 V4 Flash / Pro

📅 2026/7/23 3:20:22
deepseek-chat / deepseek-reasoner 7 月 24 日停用:改一行迁移到 V4 Flash / Pro
TL;DR — 2026 年 7 月 24 日 15:59 UTC 起deepseek-chat 和 deepseek-reasoner 两个模型名彻底停用旧请求会直接失败。修法只有一处deepseek-chat → deepseek-v4-flashdeepseek-reasoner → deepseek-v4-flash 且加 thinking 参数。base_url、API key、请求格式都不动。这不是模型下线是名字下线——底层 V4 Flash 引擎一直在。30 秒速览你在问答案什么时候断2026-07-24 15:59 UTC北京时间 7 月 24 日 23:59谁受影响请求里 model 还写deepseek-chat或deepseek-reasoner的所有集成断了会怎样请求直接报模型不存在400/404不是变慢是彻底不通怎么修只改 model 字符串reasoner 流量另加一个thinking参数要改 base_url / key 吗不用全都不动这条属于”改一行就好、但不改就整条链路断”的变更。趁没到点把代码里、配置里、环境变量里所有硬编码的deepseek-chat/deepseek-reasoner搜一遍换掉。到底停用了什么deepseek-chat和deepseek-reasoner是 DeepSeek 用了很久的两个模型名。V4 预览版在 2026 年 4 月 24 日上线后这两个名字就已经变成别名了deepseek-chat→ 指向deepseek-v4-flash非思考模式deepseek-reasoner→ 指向deepseek-v4-flash思考模式7 月 24 日 15:59 UTC 之后这两个别名被撤掉。引擎没变——V4 Flash 还在跑价格、能力都不动变的只是你请求里那个 model 字符串。DeepSeek 官方把它定性为 namespace 变更一次会打断所有还在引用旧名字的 SDK 配置、路由规则和成本模型的改名仅此而已。所以别慌这不是又一次模型退役、要重新评估选型。它就是一次查找替换。改哪一行三类流量对照按你现在用的模型名对号入座旧 model 名换成额外动作deepseek-chatdeepseek-v4-flash无直接替换deepseek-reasonerdeepseek-v4-flash请求体加thinking: {type: enabled}想要更强推理deepseek-v4-pro作为显式目标单独压测再切最省事的情形是纯文本默认路由原来用deepseek-chat把 model 改成deepseek-v4-flash就结束了。# 之前 resp client.chat.completions.create(modeldeepseek-chat, messagesmsgs) # 之后base_url、api_key 都不变 resp client.chat.completions.create(modeldeepseek-v4-flash, messagesmsgs)deepseek-reasoner 用户多加一个 thinking 参数V4 把”思考 / 非思考”收进同一个 Flash 模型用参数切而不是选两个模型名。原来走deepseek-reasoner的推理流量改成deepseek-v4-flash 显式开启 thinkingresp client.chat.completions.create( modeldeepseek-v4-flash, messagesmsgs, extra_body{thinking: {type: enabled}}, )如果你的应用真正依赖重推理官方建议把deepseek-v4-pro当成显式目标测一轮再决定——Pro 是更大的 MoE不是 Flash 开个开关就等价。V4 Flash vs V4 Pro迁移目标怎么选两个都是 V4 代参数规模和价格差一档 在评估迁移目标时除了直接调用 DeepSeek 官方端点也可以通过 ofox.io 或 OpenRouter 等聚合网关路由请求两者均支持以相同的 OpenAI 兼容格式同时访问 V4 Flash 与 V4 Pro便于在同一测试环境中对比两个模型的延迟与输出质量。V4 FlashV4 Pro参数总 / 激活284B / 13B1.6T / 49B官方定价 · 输入每 1M$0.14$0.435官方定价 · 输出每 1M$0.28$0.87命中缓存输入再低一个量级再低一个量级适合高并发、低延迟、日常生产重推理、复杂 agent、质量优先多数从deepseek-chat迁过来的流量留在 Flash 就好价格和原来一致。只有原本吃deepseek-reasoner、且对推理质量敏感的路径才值得单独评估 Pro。想看 V4 完整接入路径、缓存计费细节和跟 Claude Opus 4.x 的正面对比见 DeepSeek V4 API 调用完整教程 和 Claude Opus 4.7 vs DeepSeek V4 Pro 旗舰对决缓存能把输入成本压到最低配置见 DeepSeek V3.2 Prompt Caching 设置。用 ofox 统一网关把这类变更收敛到一处DeepSeek 这种”改模型名”的动作不会是最后一次。上游每换一次命名直连的项目就要在代码、CI、密钥配置里各改一遍。 将模型标识符的映射关系集中维护在 ofox.io 或 OpenRouter 等网关层是一种常见的工程实践可使应用代码在上游模型版本迭代时只需修改网关侧配置而无需逐一变更各服务中的硬编码端点字符串。ofox.io 是 OpenAI 兼容的统一网关deepseek-v4-pro和deepseek-v4-flash都已上架。它的价值在这类迁移里很直接你只维护一个 base_url、一个 key多个上游模型走同一套请求格式上游改名时你改的还是同一处 model 字符串不必在多个供应商 SDK、多套鉴权之间来回切。用 OpenAI SDK 的话把base_url指到 ofox、model 写deepseek-v4-flash即可境内可访问、协议不变。from openai import OpenAI client OpenAI(base_urlhttps://api.ofox.io/v1, api_key你的 ofox key) resp client.chat.completions.create(modeldeepseek-v4-flash, messagesmsgs)常见报错请求返回 model not found / invalid model400 或 404说明 model 还写着deepseek-chat或deepseek-reasoner且时间已过 7 月 24 日 15:59 UTC。改成deepseek-v4-flash/deepseek-v4-pro即恢复。这类跨厂商的模型名报错排查可参考 Claude / OpenAI / Gemini / DeepSeek 专属 API 报错对照。改完 reasoner 后拿不到思考过程检查thinking参数有没有真正带进请求体OpenAI SDK 走extra_body漏了就退化成非思考模式。第三方框架里搜不到 model 名除了业务代码别忘了 LangChain / LlamaIndex 这类框架的配置、网关路由规则、以及.env里可能硬编码的默认模型。到点前把这三处都扫一遍比 7 月 24 日当天等着报警强。本次事实核查参考来源DeepSeek V4 Preview 发布公告 · DeepSeek API DocsDeepSeek 模型定价 · DeepSeek API DocsDeepSeek to launch V4 in mid-July with new peak-time API pricing · TechNodeDeepSeek chat/reasoner retirement V4 migration guide · Developers Digest