OpenAI藏了一手更大的:代号Doug,两年多来第一次换发动机

📅 2026/8/11 9:21:48
OpenAI藏了一手更大的:代号Doug,两年多来第一次换发动机
昨天还在聊Astra主动踩刹车今天又炸出一个更大的瓜。8月9日长期跟踪OpenAI的X用户ChrisGPT爆料了一个代号叫Doug的模型。按他的说法这是OpenAI迄今为止规模最大的一次预训练项目而且——它不是GPT-6。GPT-6大概率就是正在安全审查中的Astra预计8月发布。而Doug是另外一张牌最迟可能11月亮相。这不是孤例。早在7月9日半导体行业研究机构SemiAnalysis就在发给付费客户的备忘录里提到过Doug原话是OpenAI已经克服了预训练方面的问题一个代号为Doug、规模大得多的模型正在积极推进。来源SemiAnalysis两个独立消息源对上了这件事就不只是又一个爆料了。它真正值得说的地方在于OpenAI的底座两年多来可能第一次真的要换代了。一、OpenAI的发动机已经两年没换了先把时间往回拨。2024年5月GPT-4o发布。那是OpenAI最后一次完成真正意义上的全规模预训练换代——从GPT-4的底座换到一个全新的、更大的基础模型。之后发生了什么2024年9月o1-preview发布。它的核心突破不是更大的预训练而是强化学习推理时计算——模型学会了在回答问题时多想几步用更多的推理时间换更好的答案。2025年4月o3发布同样是强化学习驱动。2025年8月GPT-5发布变成了快速模型深度推理模型路由系统的组合架构但底层底座的代际跃迁并没有明确证据表明达到了GPT-4o那个级别的全规模预训练换代。SemiAnalysis有一个很有影响力的判断从GPT-4o至今OpenAI没有完成一轮能够被广泛部署为下一代主力前沿模型的成功全规模预训练。来源36氪/机器之心这话有点绕翻译成大白话就是OpenAI过去两年多的能力增长主要靠的是后训练post-training、强化学习RL和推理时计算inference-time compute而不是基础模型本身的换代。就像一辆车发动机没换但调校越来越极致——ECU刷了一阶又一阶悬挂改了一套又一套轮胎从街胎换到半热熔确实越来越快但发动机的底子还是那个。中间不是没试过。Orion等项目据说因为表现不及预期被降级了。全规模预训练遇到了瓶颈可能是训练稳定性问题可能是scaling到一定规模后面临性能退化也可能是数据和算力的边际收益在下降。总之底座这条路卡住了。二、从Garlic到Doug预训练之墙是怎么被打破的转折点大概在去年年底。2025年11月Google发布Gemini 3。然后12月初Sam Altman在内部宣布Code Red要求团队优先提升ChatGPT并重新配置资源。几乎同时The Information报道了一个代号叫Garlic的新预训练模型。报道里有两个关键信息Garlic在代码和推理评测中表现不错首席研究官Mark Chen告诉团队公司已经解决了此前预训练中的关键问题 来源The Information更值得注意的是同篇报道里的一句话OpenAI已经基于Garlic学到的经验开始开发一个even bigger and better model。那个更大更好的模型很可能就是Doug。Garlic像是一次验证——证明新的训练方法确实有效之前卡住的瓶颈真的被解决了。而Doug是把这些修复和改进放大到更大规模之后的产物。到了2026年1月SemiAnalysis直接说OpenAI已经解决了预训练方面的问题。7月的备忘录里Doug的代号正式出现。8月ChrisGPT把它公之于众。这条时间线串起来逻辑是通的Garlic验证→ Doug全规模放大→ 底座scaling重新启动如果这一切属实那意味着什么意味着scaling laws在预训练维度上远没有到天花板。过去两年大家看到的预训练停滞、推理计算崛起不是scaling laws失效了而是OpenAI暂时卡在了工程问题上。现在问题解决了底座重新开始往上堆。o系列证明了推理时计算可以持续scaling。Doug如果成功就证明了预训练本身也还能继续scaling。两条路都通了。三、为什么是两张牌而不是一张这里有个很有意思的布局Astra可能的GPT-6和Doug不是一个项目的两个阶段而是两条并行的线。Astra走的是智能体/深度推理路线。它被暂停的原因是关键网络能力——具备自主在网络上行动的能力安全框架直接触发了Critical级别的暂停。它的核心看点是Agent能力的边界。Doug走的是底座scaling路线。它的核心看点是基础模型本身的代际跃迁。ChrisGPT的说法很有戏剧性Doug一旦出来Anthropic的Fable都会显得原始。来源凤凰网/新智元当然这是爆料人的说法听听就好。但从产品策略的角度OpenAI手里压两张牌的逻辑很清楚Astra/GPT-68月打当下的仗。对标Anthropic即将发布的Fable 5.1守住智能体和深度推理的阵地给用户一个下一代模型的明确感知。Doug年底/11月打下一轮的仗。用真正的底座换代重新拉开差距把竞争从后训练调校的层面拉回基础模型规模的层面。甚至有分析认为Doug可能使用了英伟达尚未全面铺开的下一代Vera Rubin芯片进行训练——如果是真的那这就是新芯片新训练方法新底座的三重换代。来源AIbase这个节奏像什么像iPhone的S年和数字年交替——数字年换外观换芯片S年打磨体验加功能。OpenAI现在的操作是把两条线并行跑了一条线持续迭代现有体系另一条线偷偷憋下一代底座。等Astra的热度过去Doug接棒。四、三巨头变两强scaling的下半场刚开场把视野再拉大一点。就在8月5日Google的AI版图塌了一角。Jeff Dean——干了27年的首席科学家、Transformer时代的关键人物——带着三位核心研究员出走创业。同一天哈萨比斯卸任DeepMind CEO退居董事长。Alphabet股价当天跌超4%。曾经的ASI三巨头OpenAI、Anthropic、Google DeepMind现在DeepMind越来越不像一个前沿玩家了。发明Transformer的地方正在给对手输送人才。赛道上剩下OpenAI和Anthropic正面刚。Anthropic手里的牌是Fable 5以及即将到来的Fable 5.1。他们的路线很稳持续推进预训练规模Fable系列已经走到了业界最前沿的位置。OpenAI手里的牌更复杂GPT-5.5/5.6系列在快速迭代Astra在安全审查中现在又多了一个Doug。过去两年他们用后训练推理计算这条路证明了自己能打现在如果底座再追上来甚至反超那就是双引擎全开。这才是Doug这个爆料真正的行业意义——它不只是OpenAI又要出一个大模型。它是一个信号AI能力的增长即将从单引擎驱动切换到双引擎驱动。过去两年主要是推理时计算和强化学习在推着能力往前走。接下来如果底座换代成功预训练和后训练会同时往上推。11会等于几没人知道。但有一点是确定的当一个已经被推到极致的后训练体系遇上一个换代后的新底座叠加出来的能力上限不会是简单的加法。结尾回头看这两年挺有意思的。GPT-4o之后很多人说scaling laws到顶了以后要靠算法创新。o1出来之后很多人说预训练不重要了以后是推理时计算的天下。现在Doug的消息出来剧情又反转了——不是预训练不行是OpenAI暂时卡住了现在通了。技术的发展从来不是单线程的。一条路走到瓶颈不代表这条路就到头了可能只是工程问题还没解决。等问题解决了这条路还能继续往前走。OpenAI的发动机两年多没换了。如果Doug真的是换代那接下来的半年会很热闹。Astra只是开胃菜。真正的主菜可能在年底。参考来源SemiAnalysis: Gemini is cooked, but GCP is cooking36氪/机器之心刚刚OpenAI最大预训练模型Doug曝光凤凰网/新智元OpenAI曝光GPT-6!传10万亿参数8月强行发布AIbase: Report: GPT-6 Exposed with 10 Trillion Parameters; OpenAI May Have a Bigger Weapon by Year-End, DougThe Information: OpenAI Developing Garlic Model to Counter Google