如何看待 Codex 与ChatGPT 合并,实际使用体验有什么变化?

📅 2026/8/13 22:17:32
如何看待 Codex 与ChatGPT 合并,实际使用体验有什么变化?
这次我觉得不能简单理解成“OpenAI 把 Codex 的入口塞进 ChatGPT 了。”2026 年 7 月 9 日OpenAI 正式宣布 Codex App 开始与新的 ChatGPT 桌面端合并。Codex 并没有消失它仍然是面向软件开发的 Coding Agent只不过现在和 Chat、Work 放进了同一个 ChatGPT 体系里。我用一句比较直白的话概括这次变化以前 ChatGPT 负责跟你聊“怎么做”Codex 负责真的进去“把它做了”现在这两个东西终于开始长在一起了。而且我觉得这个变化比单纯更新一个 GPT-5.6 模型更值得关注。以前用 ChatGPT Codex其实有一种很明显的割裂感比如我想做一个网站。第一步我可能先打开 ChatGPT“我准备做一个库存管理系统应该怎么设计”然后和 ChatGPT 聊产品需求。数据库结构。页面功能。技术栈。权限设计。聊了半天方案差不多了。接下来真正开始写代码。切到 Codex。然后又得告诉 Codex我要做什么。项目在哪里。技术栈是什么。刚才确定了哪些需求。有哪些地方不能改。虽然两边本来就可以使用同一个 ChatGPT 账号而且 Codex 也早已经包含在 ChatGPT 的相关套餐里但从使用习惯上看很多人还是会把它们理解成两个工具。一个负责想。一个负责干。现在 OpenAI 明显是在把这条线抹掉。合并以后我最大的感受是ChatGPT越来越不像“聊天机器人”了现在新版 ChatGPT 的思路其实已经很清楚。官方目前把它分成三种主要体验Chat聊天、搜索、快速问答。Work长任务、研究、分析、PPT、表格、文档等成品交付。Codex软件开发和技术工作。所以以后你打开ChatGPT思维方式可能不是“我要问AI一个什么问题”而是“我要让AI帮我完成什么事情”这两个思路差别非常大。比如“React里useEffect为什么执行两次”这是Chat。“分析一下这个项目为什么登录偶尔失败。”这是Codex。“分析过去一年的销售数据最后给我做成一份汇报PPT。”这是Work。以前这些事情可能需要三个不同的软件或者工作流。现在OpenAI明显想让它们全部从ChatGPT开始。对程序员来说最明显的变化其实是“少切软件”这个看起来是小事实际体验提升挺明显。以前我的工作可能是浏览器里ChatGPT。VS Code里写代码。Codex App跑Agent。GitHub看PR。浏览器看前端效果。Terminal跑测试。几个窗口来回切。现在Codex并入ChatGPT桌面端以后OpenAI还顺手给Codex增加了不少开发相关能力包括diff里的行内编辑、侧边栏PR Review、更快的Computer Use以及一个项目同时支持多个repository。所以它越来越像一个AI开发工作台。而不是单纯的聊天窗口。尤其是多仓库这个东西对稍微复杂一点的项目其实挺实用。比如frontend一个repo。backend一个repo。内部组件库又一个repo。以前Codex处理这种项目比较容易割裂。现在一个Project可以覆盖多个repository以后就更接近真实公司的项目结构了。第二个变化是“聊天”和“执行”的距离越来越短我觉得这个才是最重要的。以前AI最烦的一件事情就是它特别会告诉你怎么做但最后还是你自己做。比如你问“这个页面为什么加载这么慢”ChatGPT给你分析半天可能是数据库。可能是API。可能是前端bundle。可能是缓存。最后来一句“建议你使用Chrome DevTools进一步排查。”然后你自己去干。Coding Agent出现以后逻辑开始变成你这个页面最近加载特别慢帮我找原因。Codex读取项目。检查相关代码。运行程序。分析请求。查看日志。定位问题。修改代码。跑测试。然后告诉你我找到问题了修改在这里。这才是我觉得“ChatGPT Codex”真正应该发展的方向。不是让ChatGPT回答得越来越长。而是回答完以后它能不能顺手把事情做掉。GPT-5.6 又把这种感觉往前推了一步这次合并恰好又碰上GPT-5.6。目前GPT-5.6 Sol已经可以在Codex里使用OpenAI对它的定位本身就包括复杂Coding、Computer Use以及更长时间的工作流Codex里Plus、Pro、Business、Enterprise等符合条件的方案可以使用Sol、Terra和Luna。这就产生了一个挺有意思的变化以前使用Codex很大一部分精力是在指导AI怎么工作。现在越来越多时候只需要告诉它最后我要什么。比如以前Prompt可能写先读取项目结构找到认证模块不要修改现有API分析依赖以后修改代码然后运行测试如果测试失败继续修复最后总结修改内容。现在我可能直接说重构登录模块保持现有API兼容完成以后跑测试。然后让它自己规划。模型越强这种变化越明显。这其实也和前面很多人开始减少低价值Skills是同一个逻辑我们正在从“教AI每一步怎么做”转向“告诉AI最终要达到什么结果”。第三个变化我觉得很多人会喜欢手机开始真正有用了以前手机上的ChatGPT主要还是聊天。你不太可能拿手机真正写一个大型项目。但Codex现在已经进入ChatGPT手机App。而且不是让你拿手机敲代码。它的思路是电脑干活手机遥控。OpenAI在5月份就开始推出这套体验Codex可以继续在连接的Mac上工作而你在ChatGPT手机端可以查看任务、继续Thread、回答Codex的问题、改变方向、审批操作以及查看diff和测试结果。这个场景其实特别真实。比如你让Codex把后台管理系统升级到新版本顺便修复测试。然后出门吃饭。半小时以后手机弹出来Codex遇到一个需要你决定的问题。你看一下“选方案B。”它继续干。以前这种Agent一旦离开电脑基本就断了。现在越来越接近你不是坐在电脑前陪AI工作而是AI工作需要你的时候再找你。我觉得这个体验上的变化可能比模型Benchmark提高几个百分点更重要。但合并以后也有一个我觉得比较容易误解的地方就是Codex并没有变成普通ChatGPT聊天。OpenAI现在依然把它们分得很清楚。Chat负责快速交流。Work负责长时间知识工作和成品交付。Codex仍然专门负责软件开发和技术任务。所以不是说以后打开ChatGPT随便发一句话它就开始修改你的电脑。权限、工具和任务模式还是有区别的。我反而觉得这样比较合理。否则聊天的时候随口说一句“这个文件看起来没什么用了。”AI“好的已经帮你删除。”那才是真的吓人。对普通人来说这次合并其实比程序员更值得关注很多人看到Codex两个字就觉得和我没关系我又不写代码。但OpenAI这次其实释放了一个很明显的信号。7月发布的新ChatGPT Work已经直接使用了Codex技术让ChatGPT能够处理文件、应用和网页并持续完成复杂任务。OpenAI还披露当时Codex每周用户已经超过500万其中超过100万人会把它用于软件开发之外的工作。这就很有意思了。Codex最早训练出来的是一种能力理解任务 → 使用工具 → 执行 → 检查结果 → 继续执行。这种能力为什么只能写代码完全可以整理Excel。制作PPT。分析资料。修改网站。整理文件。做市场研究。处理重复办公流程。所以我觉得这次所谓的“Codex和ChatGPT合并”真正的重点可能不是Codex进了ChatGPT。而是Codex这种Agent式工作方式开始进入整个ChatGPT。当然现在的体验还远远没到“AI员工”的程度这个也得说。Agent最大的问题一直不是“它能不能做。”而是它能不能连续做几十步都不犯错。一个任务只有3步每一步95%正确率。体验很好。一个任务50步中间任何一步理解错了都可能一路跑偏。所以现在使用Codex我还是会看它改了哪些文件。测试是不是真的通过。有没有偷偷改需求。有没有为了通过测试把测试本身改掉。涉及删除、部署、权限、生产环境的时候更要自己确认。模型变强和产品合并都不意味着从此可以闭着眼睛把项目交给AI。至少现在还远没到这个阶段。所以我怎么看这次合并我觉得这是ChatGPT这几年非常关键的一次产品方向变化。2022年的ChatGPT解决的是“AI能不能听懂我说话”后来解决“AI能不能把问题回答得更聪明”Codex开始解决“AI能不能自己去干活”现在把Codex能力逐渐并进ChatGPT以后OpenAI真正想解决的问题已经变成“我能不能只告诉AI我要什么然后等它把结果交给我”这才是这次合并真正有意思的地方。所以实际体验上的变化我会概括成一句以前我打开ChatGPT是准备和AI聊一件事情现在越来越多时候我打开ChatGPT是准备把一件事情交给AI。从“聊天工具”到“工作入口”我觉得这才是ChatGPT和Codex合并真正要走的方向。至于最后能不能做到所谓的“AI员工”现在还不好说。但至少从Chat、Work、Codex被放进同一个ChatGPT以及Codex开始打通桌面、网页和手机来看OpenAI现在想做的显然已经不只是一个更聪明的聊天机器人了。