Sol、Terra 还是 Luna?
GPT-5.6 三档选型指南
截至 2026-10-07,GPT-5.6 三档的选法没变:日常 Terra,跑量 Luna,难任务再上 Sol。OpenAI 官方价:Sol $4/$20(促销至少到 2026-11-21)、Terra $2/$12,Luna 是三档里最便宜的。另需注意:OpenAI 之后已发布 GPT-6 Astra(2026-09-03)、GPT-6 Sol 与 GPT-6 Luna(2026-09-22)、GPT-6.1 Sol(2026-09-29),官方模型页现在主推的三款是 GPT-6 Astra、GPT-6.1 Sol 与 GPT-6 Luna。
Luna 现为 $0.20/$1.20(原 $1/$6),Terra $2/$12(原 $2.50/$15),Sol 截至 2026-08-02 仍 $5/$30(官方定价页 2026-09-12 存档:现价 $4/$20,促销至少到 2026-11-21)。Codex/ChatGPT Work 中 Luna/Terra 用量计数变便宜;套餐标价与总配额未降。
三档硬指标对比
数字来自 OpenAI 官方发布与文档(2026-07-10 核对)。
| 指标 | Sol | Terra | Luna |
|---|---|---|---|
| 定位 | 旗舰 —— 应对最难的问题 | 均衡日常档 —— 约一半价格 | 最快、最便宜 |
| Terminal-Bench 2.1 | 88.8% | 84.3% | 82.5% |
| 价格(输入 / 输出,每百万 token) | $5 / $30 | $2 / $12 | $0.20 / $1.20 |
| 缓存读取(−90%) | $0.50 | $0.20 | $0.02 |
| API 上下文 / 最大输出 | 1.05M / 128K | 1.05M / 128K | 1.05M / 128K |
| 速度 | 7 月起可在 Cerebras 上达约 750 tokens/s | 标准推理速度 | 三档中最快 |
注:Sol Ultra 是 Sol 的高算力模式(Terminal-Bench 2.1 91.9%),并非单独的价格档位。
按场景选档
选 Sol:最难的工程与推理任务
跨仓库重构、长程 agent、难 debug。Terminal-Bench 2.1 上 Sol 88.8%。OpenAI 的 @thsottiaux 2026-07-29 帖(2026-08-30 抓取):Sol 消耗 Codex 限额快于预期;更愿意多跑、多打 tool、拉 subagent;High 档可比 GPT-5.5 High 用更多 token;已为全部 ChatGPT Work / Codex 用户重置额度,典型使用大约多撑 18%。要当默认档就先把任务范围写死。
选 Terra:日常编码的默认档
以约 Sol 一半的价格拿到 GPT-5.5 级以上的质量(Terminal-Bench 84.3%,高于 GPT-5.5 的 83.4%)。日常功能开发、代码评审、测试生成,Terra 是性价比最高的默认选择。
选 Luna:高频、低延迟、批量
补全、提交说明、批量、轻 CI。API 价 07-30 后是 $0.20/$1.20。OpenAI Codex 定价页(2026-08-30 抓取)每百万 input credits:Luna 5,Sol 100。OpenAI 的 @thsottiaux 2026-07-29 帖(同日抓取)写明未削减任何订阅套餐用量,并预期典型 Sol 大约多撑 18%。Luna 不是免费,是低 credit 档。
成本示例
典型 agentic 会话(800K 输入 + 60K 输出):按 2026-08-02 短上下文标价,Terra 约 $2.32、Sol 约 $5.80、Luna 约 $0.23(示意)。
随请求切换,无需承诺
三档只是三个 model id:gpt-5.6-sol、gpt-5.6-terra、gpt-5.6-luna。在 Codex CLI 里用 /model 随时切换,在 API 里逐请求指定。截至 2026-10-07,经 QCode 调用时 gpt-5.6-sol 与 gpt-5.6-terra 共用同一个密钥,按 token 计费,各模型单价见 /models;QCode 暂不提供 gpt-6-luna 与 gpt-5.6-luna(均已从 /models 下线),请使用其他 GPT 模型,跑量可选 gpt-5.6-terra。
三档选型常见问题
不确定选哪档时,默认用哪个?
把 Terra 设为默认:质量高于 GPT-5.5、价格只有 Sol 一半。遇到 Terra 卡住的难题再升到 Sol,高频轻任务降到 Luna。这个「Terra 打底、按需升降」的策略对大多数团队成本最优。
三档的上下文窗口和输出上限一样吗?
一样。官方文档确认三档共用 1.05M token 的 API 上下文窗口与 128K 最大输出,知识截止同为 2026 年 2 月 16 日,reasoning effort 选项(none 到 max)也一致。客户端实际发放的会话上限可能低于这个规格;常被引用的「400K」是把 272K 输入预算与 128K 输出相加得出的第三方算术,官方模型页没有这个数。
Sol Ultra 是什么?要单独付费吗?
Sol Ultra 是 Sol 的高算力运行模式(Terminal-Bench 2.1 91.9%),不是单独的价格档位。它消耗更多推理 token,因此同价率下单次任务的实际花费更高。看到 91.9% 的宣传数字时,注意那是 Ultra 模式的分数。
在 QCode 上三档怎么计费?
截至 2026-10-07,gpt-5.6-sol 与 gpt-5.6-terra 共用同一个 QCode 密钥,按 token 计费,各模型单价见 /models;QCode 暂不提供 gpt-6-luna 与 gpt-5.6-luna(均已从 /models 下线),请使用其他 GPT 模型,例如 gpt-6.1-sol、gpt-6-sol 或 gpt-5.6-terra。切换档位不需要任何账户操作 —— 换个 model id 就行。