本文目录 正在整理章节
先说结论:GPT-5.6 Sol、Terra、Luna 不能只按“强、中、弱”来选,还要先确认你使用的是普通 Chat、ChatGPT Work、Codex 还是 OpenAI API。OpenAI 在 2026 年 8 月 6 日更新了普通 Chat:Free 和 Go 正在分批切换到 Luna;符合条件的 Plus 和 Pro 账户可在 GPT-5.6 Sol 推理选项中使用为日常对话优化的新版 Sol;这次更新没有替换 Work 与 Codex 中的 Sol。
本文事实核验日期为 2026 年 8 月 9 日。截至这个日期,OpenAI 只宣布从下一周开始为 Free/Go 提供无限普通文字聊天和 Think,不能写成所有账户已经全面获得;文件上传、图片和其他工具仍然有限额。
如果你主要想判断 Free、Go、Plus、Pro 哪个套餐适合自己,请阅读Free、Go、Plus、Pro 套餐完整对比。本文继续聚焦三模型在不同产品入口的边界、API 价格、Codex credits 与任务选择,避免和套餐文章重复。
2026 年 8 月 6 日后,普通 Chat 的模型边界有什么变化?
过去把 Luna 简单写成“只能在 Work、Codex 与 API 使用”已经不准确。OpenAI 8 月 6 日公告把普通 Chat 的变化分成两条线:
| 入口或套餐 | 官方公布的变化 | 需要保留的边界 |
|---|---|---|
| Free / Go 普通 Chat | Luna 在 8 月 6 日所在周分批成为默认模型;OpenAI 表示从下一周开始提供无限普通文字聊天和 Think | 受滥用防护约束;文件、图片和其他工具仍有限额;不同账户出现时间可能不同 |
| Plus / Pro 普通 Chat | Plus 可使用 Medium、High 推理选项(GPT-5.6 Sol);Pro 还可使用 Extra High(GPT-5.6 Sol)和 Pro(GPT-5.6 Sol Pro) | 推理选项与滑杆只用于 Chat;可见项取决于套餐、账号和分批开放,Instant 的实际默认模型以账号界面为准 |
| ChatGPT Work / Codex | 8 月 6 日没有更换其中的 Sol | 模型入口、套餐权限与 credits 继续按 Work、Codex 的独立规则判断 |
| OpenAI API | 8 月 6 日公告没有发布新的 API checkpoint 或再次调整 API 价格 | 继续使用 7 月 30 日生效的模型价格与 API 计费规则 |
“无限”不等于所有能力不限量。OpenAI 原文限定为 text chats,并单独说明文件上传、图片和其他工具继续有限额。如果账户暂时没有 Think 或仍显示旧默认模型,应先等待分批推送,而不是据此判断公告失效。
OpenAI 还公布了一项内部评测:在需要事实细节的金融、医疗与法律提示中,相比 GPT-5.5 Instant,回答“至少含一个事实错误”的情况在 Luna 上约少 62%,在新版 Sol 上约少 68%。这是特定评测中的相对错误率变化,不是通用准确率,也不代表模型回答无需核验。
2026 年 7 月 30 日价格更新:Luna 降价 80%,Terra 降价 20%
OpenAI 7 月 30 日下调的是 Luna 和 Terra 的 API 价格,并同步降低二者在 Codex 与 ChatGPT Work 中的 credits 消耗;ChatGPT 和 Codex 的订阅价格、套餐 quota budgets 没有下调。因此,“Luna 降价 80%”不能理解成“ChatGPT Plus 月费便宜了 80%”。
| 模型 | 旧输入价 | 旧输出价 | 当前输入价 | 当前输出价 | 官方降幅 |
|---|---|---|---|---|---|
| GPT-5.6 Sol | $5 | $30 | $5 | $30 | 不变 |
| GPT-5.6 Terra | $2.50 | $15 | $2 | $12 | 20% |
| GPT-5.6 Luna | $1 | $6 | $0.20 | $1.20 | 80% |
表中金额单位均为每 100 万 Token 的美元价格,不是每次提问的固定价格。缓存、超长上下文、Fast mode、工具调用和其他能力可能有单独规则,实际账单应以 OpenAI API 控制台和当前模型文档为准。
API 价格、订阅、quota 与 credits 有什么区别?
这四个概念很容易混在一起,但它们对应不同入口和账单。
| 概念 | 7 月 30 日是否变化 | 应该怎样理解 |
|---|---|---|
| OpenAI API Token 价格 | 变化 | Luna、Terra 降价;Sol 标准价不变 |
| ChatGPT / Codex 订阅价格 | 不变 | 不是 Plus、Pro 或其他套餐月费降价 |
| 套餐 quota budgets | 不变 | 套餐总预算没有因 API 降价自动扩大 |
| Codex / Work 的 Terra、Luna credits 消耗 | 降低 | 同样 Token 组合按更低 rate card 扣除,任务总消耗仍取决于实际运行 |
通过 API 调用模型时,美元单价直接影响 Token 账单;通过 ChatGPT 套餐使用 Codex 或 Work 时,通常看到的是 usage 或 credits。想先分清入口,可以阅读ChatGPT Work、普通 Chat 与 Codex 的区别。
如果你已经确定需要 ChatGPT Plus,而问题是订阅方式而不是 API Token 计费,可继续阅读国内如何开通 ChatGPT Plus。这是站内延伸阅读,不代表 Plus 月费随 API 降价改变。
最新 GPT-5.6 API 价格怎么计算?
当前模型文档列出的缓存输入价格为:Sol 每 100 万 Token 0.50 美元、Terra 0.20 美元、Luna 0.02 美元。输入超过 272K Token 的请求会对整次请求按 2 倍输入价和 1.5 倍输出价计费;缓存写入按未缓存输入价的 1.25 倍计费。因此,大上下文任务不能只拿基础输入价做预算。
最简单的基础估算公式是:
输入成本 = 输入 Token 数 ÷ 1,000,000 × 输入单价
输出成本 = 输出 Token 数 ÷ 1,000,000 × 输出单价
基础 Token 成本 = 输入成本 + 输出成本
假设一个任务使用 100 万输入 Token 和 20 万输出 Token,并暂时忽略缓存、工具调用、长上下文附加计费等因素:
- Luna:$0.20 + 0.2 × $1.20 = $0.44;
- Terra:$2 + 0.2 × $12 = $4.40;
- Sol:$5 + 0.2 × $30 = $11。
这个例子能说明基础价格差距,但不能证明 Luna 对所有任务都最省钱。如果模型导致更多重试、人工修正或失败调用,完成同一合格结果的总成本可能上升。模型评估应比较“完成合格结果的成本”,不只是 Token 单价。
Codex 最新 credits:Sol、Terra、Luna 消耗多少?
OpenAI 当前 Codex rate card 对大多数 Plus、Pro、Business、Enterprise、Edu、Health 和 Gov 客户按 Token 计量。每 100 万 Token 的 credits 如下:
| 模型 | 输入 Token | 缓存输入 Token | 输出 Token |
|---|---|---|---|
| GPT-5.6 Sol | 125 credits | 12.5 credits | 750 credits |
| GPT-5.6 Terra | 50 credits | 5 credits | 300 credits |
| GPT-5.6 Luna | 5 credits | 0.5 credits | 30 credits |
沿用“100 万输入 + 20 万输出”的简化例子,并假设输入都不是缓存命中:
- Luna:5 + 0.2 × 30 = 11 credits;
- Terra:50 + 0.2 × 300 = 110 credits;
- Sol:125 + 0.2 × 750 = 275 credits。
这不是“每条消息固定扣多少”。一个 Codex 任务可能包含多轮模型请求、工具调用、测试输出和子智能体工作;输入、缓存命中、输出长度、推理强度和 Fast mode 都会改变最终消耗。Codex 不收取 cache write credits;Codex、ChatGPT Work、ChatGPT for Excel 和 Workspace Agents 在套餐支持时还会共享 agentic usage 与 credits 池。
少量尚未迁移的 Enterprise 工作区可能仍使用 legacy rate card。团队账号如果看到的计量方式与上表不同,应先由管理员确认当前工作区使用哪套 rate card。
Sol、Terra、Luna 在 Chat、Work、Codex 与 API 中怎么分布?
2026 年 8 月之后,不能再用一条“Luna 不在普通 Chat”概括所有产品。更准确的方式是先按入口和套餐判断:
| 产品入口 | 截至 2026 年 8 月 9 日的官方边界 |
|---|---|
| Free / Go 普通 Chat | Luna 正在分批成为默认模型;无限普通文字聊天和 Think 由 OpenAI 宣布从下一周开始提供 |
| Plus / Pro 普通 Chat | 符合条件的付费账户可在 GPT-5.6 Sol 推理选项中使用新版 Sol,并可用推理强度滑杆;这不是任意切换全部三款模型的入口 |
| ChatGPT Work | Plus、Pro、Business、Enterprise 可使用 Sol、Terra、Luna;Work 本身在桌面端的显示与模型权限不是同一件事,具体以账号、平台和工作区设置为准 |
| Codex | Free/Go 可使用 Terra;Plus、Pro、Business、Enterprise 可使用 Sol、Terra、Luna,实际可见项仍受工作区设置影响 |
| OpenAI API | 可调用 Sol、Terra、Luna,并按各模型 API 规则独立计费 |
账户里没有 Luna、Think 或推理滑杆怎么办?
- 先确认入口:普通 Chat、Work、Codex 和 API 的模型列表并不相同。
- 核对套餐:Free/Go 与 Plus/Pro 在普通 Chat 中可用的模型和推理选项不同。
- 核对日期:截至 8 月 9 日,Free/Go 的无限文字与 Think 仍属于“从下一周开始”的分批开放。
- 更新 ChatGPT 客户端并重新登录;web、mobile、desktop 的界面出现时间可能不同。
- 团队账户还要检查管理员模型策略、工作区和账号角色。
- 如果普通文字可继续但文件或图片提示限额,这是官方保留的工具限制,不代表 Luna rollout 失败。
需要了解桌面入口,可参考ChatGPT 桌面版与 Codex 的入口变化。
三款模型应该怎么选?先分普通 Chat 与任务型入口
普通 Chat 中先按套餐使用官方给出的模型与推理选项:Free/Go 重点观察 Luna 与 Think 的 rollout;符合条件的 Plus/Pro 可在 GPT-5.6 Sol 推理选项中使用 Chat 专用 Sol,再通过滑杆调整思考深度。这里不是让用户手动把每条问题在 Sol、Terra、Luna 之间任意切换。
在 Work、Codex 与 API 中再按任务选择:成本、错误代价、是否容易验证和响应速度,通常比“哪款模型名更强”更有决策价值。
Luna:边界清晰、数量大、容易验证
Luna 适合高频、标准化和低错误成本任务,例如格式转换、分类、字段提取、基础测试、批量改文案、日志整理,以及按照明确方案完成低风险实现。它的低价格适合批量工作,但前提是有自动测试、抽样复核或结构化校验。
Terra:日常任务的能力与成本平衡
Terra 适合普通功能开发、代码审查、文档整理、中等复杂度分析和需要工具调用的日常任务。不知道从哪款开始时,可以先用 Terra 跑一组代表性任务,再判断哪些步骤能下放给 Luna、哪些难题需要升级到 Sol。
Sol:高难、长链路或错误代价高
Sol 更适合架构设计、疑难故障、跨仓库修改、复杂推理、科学研究和高风险决策支持。可以让 Sol 先消除不确定性、制定方案,再由 Luna 或 Terra 执行边界清楚的部分。
模型能力不能代替权限治理。只要任务涉及生产数据库、云资源、删除文件或不可逆操作,就应限制权限、保留备份和人工审批。可继续阅读高风险 Codex 任务的权限与备份清单。
用真实任务测试模型:一套六步方法
- 从真实工作中选 10—20 个代表性任务,不要只用演示题。
- 为每个任务写清楚通过标准,例如测试是否通过、字段是否完整、事实能否核验。
- 记录 Luna、Terra、Sol 的成功率、完成时间、Token、credits、重试次数和人工修正时间。
- 先淘汰无法稳定达到质量门槛的模型,再比较剩余方案的总成本。
- 把流程拆阶段:规划可用 Sol,常规实现用 Terra,机械批处理用 Luna。
- 模型、价格或 rate card 更新后,用相同样本重新测试,不沿用旧结论。
第一次使用 Codex 时,可先阅读Codex 的使用方式与适用场景。在 Codex 设置的 Usage 面板观察实际消耗,比根据“每条消息大概多少”做长期预算更可靠。
GPT-5.6 Sol Fast mode 值得开吗?
7 月 30 日的另一项变化是 API Fast mode。OpenAI 表示,GPT-5.6 Sol 的 Fast mode 最高可达到 Standard processing 的 2.5 倍速度,价格为 Standard 的 2 倍,模型智能水平不变。它替代 Priority Processing,已有标记为 priority 的 API 请求会自动使用 Fast mode。
Fast mode 更适合响应时间直接影响业务结果、人工等待成本高或任务处于关键路径的场景。离线批处理、夜间任务和成本敏感流程通常不必为速度支付双倍价格。Codex 的 /fast 与 API 在命名上对齐,但支持模型的 Fast mode 会按更高 credits rate 计量,使用前应查看当前 Usage。
五个常见误区
- 误区一:Free/Go 的“无限”包括文件、图片和全部工具。官方只承诺普通文字聊天,其他工具继续有限额。
- 误区二:8 月 6 日之后每个免费账户都已经有 Think。官方写的是从下一周开始,且为分批开放。
- 误区三:Plus/Pro 的 GPT-5.6 Sol Chat 推理选项同时替换了 Work 与 Codex 的 Sol。官方明确说明 Work、Codex 版本未随本次更新改变。
- 误区四:Luna API 降价 80%,所以 Plus 月费也降价 80%。订阅价格和 quota budgets 没有因这次 API 调价下降。
- 误区五:普通 Chat 可以手动任意选择 Sol、Terra、Luna。普通 Chat 的呈现由套餐决定;Terra 仍主要属于 Work、Codex 与 API 的模型选择范围。
常见问题
Free 和 Go 的无限文字聊天已经全面上线了吗?
截至 2026 年 8 月 9 日,不能这样写。OpenAI 8 月 6 日表示 Luna 会在当周成为 Free/Go 默认模型,而无限普通文字聊天与 Think 从下一周开始提供,并受滥用防护约束。不同账户可能分批出现。
“无限文字聊天”包括上传文件、图片和其他工具吗?
不包括。OpenAI 明确说明文件上传、图片和其他工具继续有限额。普通文字能继续发送,不代表工具配额同时变成无限。
普通 ChatGPT 对话能选择 Luna 或 Terra 吗?
Free/Go 普通 Chat 正在把 Luna 设为默认模型,不一定出现一个供用户任意选择三款模型的列表;符合条件的 Plus/Pro 可在 GPT-5.6 Sol 推理选项中使用 Chat 专用新版 Sol。8 月 6 日公告没有把 Terra 加入普通 Chat,Terra 仍用于 Work、Codex 与 API 等入口。
Plus/Pro Chat 的新版 Sol 和 Work、Codex 中的是同一次更新吗?
不是。OpenAI 明确说这版 Sol 针对日常 Chat 优化,只在 Chat 体验中提供;Work 与 Codex 中的 Sol 没有随 8 月 6 日更新改变。
为什么我还看不到 Luna、Think 或推理滑杆?
先检查套餐、入口、客户端版本和账号工作区。Free/Go 的 Luna、无限文字和 Think 有明确 rollout 时间,web、mobile、desktop 也可能不同步;团队账户还可能受管理员策略影响。
Luna 和 Terra 降价后,ChatGPT Plus 月费会下降吗?
不会这样理解。OpenAI 7 月 30 日明确说明,ChatGPT 和 Codex 的订阅价格与 quota budgets 保持不变;改变的是 Luna、Terra API 单价以及它们在 Codex、ChatGPT Work 中的 credits 消耗。
为什么我的 Codex credits 和文中算例不同?
算例只使用简单的输入和输出 Token。真实任务还会受缓存命中、输出长度、多轮工具调用、推理强度、子智能体、Fast mode 和工作区 rate card 版本影响,应以 Codex Usage 面板记录为准。
日常编程应该默认用 Luna、Terra 还是 Sol?
在可选择模型的 Work、Codex 或 API 中,边界清晰、容易测试、数量大的任务可先评估 Luna;普通功能开发和中等复杂度工作可从 Terra 开始;高难或错误代价高的任务再升级到 Sol。最好用自己的任务集比较成功率、总 credits 和返工时间。
总结
截至 2026 年 8 月 9 日,GPT-5.6 的选择需要同时看产品入口与任务成本:
- Free/Go 普通 Chat 正在切换到 Luna;无限普通文字和 Think 从下一周开始分批提供,工具仍有限额;
- 符合条件的 Plus/Pro 可在普通 Chat 的 GPT-5.6 Sol 推理选项中使用 Chat 专用新版 Sol,Work 与 Codex 中的 Sol 未随之改变;
- Luna API 输入/输出为 $0.20/$1.20,适合经过验证的高频轻量任务;
- Terra API 输入/输出为 $2/$12,适合日常任务的能力与成本平衡;
- Sol API 标准输入/输出为 $5/$30,适合高难、高风险或速度价值高的任务;
- ChatGPT/Codex 订阅价格与 quota budgets 没有因 7 月 30 日降价公告改变。
参考资料与核验日期
本文最后核验于 2026 年 8 月 9 日。价格、模型入口和 rollout 都可能继续变化,使用或做预算前请复核官方页面: