GPT-5.6 全员免费:Luna 成为新默认,Sol 合并模式并迎来推理滑块

📅 2026/8/7 15:45:10
GPT-5.6 全员免费:Luna 成为新默认,Sol 合并模式并迎来推理滑块
2026 年 8 月 7 日OpenAI 宣布对 ChatGPT 全系产品进行重要调整免费版和 Go 档用户的默认模型升级为 GPT-5.6 Luna并获得无限量文本聊天权限GPT-5.6 Sol 同步推出 Instant 与 Thinking 模式合并、五档思考滑块下放和更简洁的回答风格三项改进其在金融、医疗、法律等高敏感领域的错误率相比 GPT-5.5 降低 68%三档模型的最大价格差距在 7 月 30 日一轮降价后已从 5 倍扩大至 25 倍Sol $5/$30 不变Luna 降至 $0.20/$1.20Luna 的成本大幅降低但其擅长场景定位不变下一代超大规模模型 Astra 据悉已进入 RC 阶段预计近期发布定位于长时程、多智能体协作任务。Luna 免费开放对免费用户意味着什么GPT-5.6 Luna 是 GPT-5.6 家族中定位快速与廉价的一档主要擅长摘要、分类、字段抽取等不需要复杂推理的结构化任务。这次开放的核心内容替代 GPT-5.5成为 Free 和 Go 档的默认模型文本对话无限量不再有每日次数限制免费版新增“Think” 按钮可以主动触发更高强度的推理不需要切换模型几条需要注意的边界文件上传、图片生成、语音对话仍有额度限制只有文本聊天去掉了上限Luna 本身的能力天花板不变——7 月 30 日 OpenAI 的降价公告里已经说清楚Luna 变便宜了但品质依旧不足的任务品质不会因为降价而改变对大多数日常场景写邮件、快速问答、整理笔记、代码补全Luna 足够用。对需要多步推理、长文档分析或复杂代码生成的场景Plus 及以上用户仍需要切换到 Terra 或 Sol。Sol 的三项改进模式统一 滑块下放 回答更简洁GPT-5.6 Sol 这次没有发布新版本而是在现有基础上做了三项交互层面的改进① Instant 与 Thinking 模式合并过去Sol 有两个入口Instant直接出答案速度快和 Thinking深度推理等待时间更长。两种模式在界面上是分开的用户需要在提问前明确选择。合并之后Sol 统一成一个入口内部根据任务复杂度自动调配推理资源不再需要用户手动判断该用哪种模式。② 五档推理滑块下放原本只对 ChatGPT Work 企业订阅开放的五档推理滑块控制思考时间/深度今天同步开放给 Plus 和 Pro 用户。五个档位从快速响应到深度思考用户可以根据任务性质手动调节相当于在一个模型里获得了粗粒度到细粒度的推理成本控制。③ 回答风格变化Sol 的输出策略做了调整更多直接给出结论和关键判断减少把所有相关信息罗列在一起的信息堆叠模式。这个改变主要影响的是追求简洁输出的场景——不需要看完一大段铺垫才到结论。错误率数据Sol 在高敏感领域的表现这次公告附带了一组错误率对比数据覆盖金融、医疗、法律三个领域GPT-5.6 Sol 相比 GPT-5.5 Instant错误率降低68%GPT-5.6 Luna 相比 GPT-5.5 Instant错误率降低62%这组数据有两点值得注意一是对比基准是 GPT-5.5 Instant不是 GPT-5.5 Thinking。GPT-5.5 Thinking 本身已经在事实准确率上优于 Instant所以这个 68% 的降幅背后部分来自 Sol 天然更偏深度推理的定位而不仅仅是模型迭代的进步。二是三个领域都是高敏感场景这类场景对事实准确性要求极高错误的代价也最大。这个数据更多说明 Sol 在需要精确引用、事实核查的场景下已经可用而不是描述它在日常对话中的改进幅度。三档模型定价与选用逻辑GPT-5.6 三档模型的分工在 7 月 30 日一轮降价后变得更清晰模型输入价格输出价格定位GPT-5.6 Luna$0.20/M tokens$1.20/M tokens快速/廉价摘要、分类、抽取GPT-5.6 Terra$2.00/M tokens$12.00/M tokens日常生产撰写、文件分析GPT-5.6 Sol$5.00/M tokens$30.00/M tokens旗舰推理多步推理、长程任务降价前Luna 输入 $1.00Sol/Luna 价差约 5 倍降价后Luna 降至 $0.20价差扩大到25 倍。三档选用的基本判断Luna适合高频、低复杂度的批量任务——对话分类、字段抽取、摘要生成关键指标是成本Terra适合中等复杂度的内容生产——长文撰写、文档分析、普通代码任务兼顾质量与成本Sol适合需要连续推理的高价值任务——多文档交叉分析、复杂代码重构、需要事实核查的高敏感场景OpenAI 同时为 Sol 推出了Fast mode2.5 倍速度2 倍价格面向需要旗舰智能但对响应速度要求更高的场景。免费版新增的Think按钮这次改动里有一个容易被忽略的细节免费用户拿到了 “Think” 按钮。这意味着免费版用户不再只能使用 Luna 的标准推理在需要的时候可以主动触发更深度的思考——虽然深度上限仍低于付费版的完整滑块但这是 ChatGPT 第一次让免费用户可以主动干预推理深度。这个设计改变了免费版 固定体验的认知。以前免费用户要用更强的推理必须升级套餐现在偶发性的复杂查询可以在免费档内用 Think 按钮临时提升不再必须订阅。下一步Astra与这次升级同期流传的信息是OpenAI 的下一代模型 Astra 已进入 RCRelease Candidate阶段。从流出信息来看Astra 的定位与 Sol 有明显差异规模参数量传闻达 7-10T自 GPT-4.5 以来最大的预训练模型能力定位长时程、多智能体协作可连续运行数小时至数天的复杂任务对标目标据内部说法目标是超越 Anthropic Fable 5如果这些信息属实Astra 的发布会把 ChatGPT 的能力上限再推一层——当前 Sol 的五档滑块和合并模式更多是把已有能力的交互方式做整齐而 Astra 代表的是下一个能力跃迁。怎么用好这次升级免费用户默认模型已升级日常文本对话无需任何操作遇到复杂问题主动点Think按钮。图片生成和文件上传的额度没变原来怎么用现在还是怎么用。Plus 用户可以用五档推理滑块按任务性质调节常规内容生产放在 Terra复杂推理切到 Sol批量处理成本敏感任务用 Luna。Sol 的 Fast mode 对需要快速周转旗舰质量结果的场景是新选项。开发者API 侧Luna 降价 80% 对高频调用的成本影响显著。7 月 30 日的降价已经生效低复杂度任务的批量处理成本已经下来了。通过 API 统一接入三档模型并按场景路由是控制总体推理成本的常见方案。七牛云 AI Token Plan 支持多款主流大模型并发调用对需要在同一工作流里混用不同推理档次的团队可以通过单一 Token 积分池管理 Luna/Terra 等不同强度的调用成本。延伸阅读OpenAI 官方公告openai.com/index/improving-gpt-5-6-sol-in-chatgpt/七牛云 AI Token Planqiniu.com/ai/plan