使用期选型 · 默认档怎么定

Sol、Terra 还是 Luna?
GPT-5.6 三档选型指南

截至 2026-10-07,GPT-5.6 三档的选法没变:日常 Terra,跑量 Luna,难任务再上 Sol。OpenAI 官方价:Sol $4/$20(促销至少到 2026-11-21)、Terra $2/$12,Luna 是三档里最便宜的。另需注意:OpenAI 之后已发布 GPT-6 Astra(2026-09-03)、GPT-6 Sol 与 GPT-6 Luna(2026-09-22)、GPT-6.1 Sol(2026-09-29),官方模型页现在主推的三款是 GPT-6 Astra、GPT-6.1 Sol 与 GPT-6 Luna。

#默认选谁 #额度烧得快 #范围膨胀 #从 5.4 迁过来
价表已按 2026-07-30 更新

Luna 现为 $0.20/$1.20(原 $1/$6),Terra $2/$12(原 $2.50/$15),Sol 截至 2026-08-02 仍 $5/$30(官方定价页 2026-09-12 存档:现价 $4/$20,促销至少到 2026-11-21)。Codex/ChatGPT Work 中 Luna/Terra 用量计数变便宜;套餐标价与总配额未降。

三档硬指标对比

数字来自 OpenAI 官方发布与文档(2026-07-10 核对)。

指标 Sol Terra Luna
定位 旗舰 —— 应对最难的问题 均衡日常档 —— 约一半价格 最快、最便宜
Terminal-Bench 2.1 88.8% 84.3% 82.5%
价格(输入 / 输出,每百万 token) $5 / $30 $2 / $12 $0.20 / $1.20
缓存读取(−90%) $0.50 $0.20 $0.02
API 上下文 / 最大输出 1.05M / 128K 1.05M / 128K 1.05M / 128K
速度 7 月起可在 Cerebras 上达约 750 tokens/s 标准推理速度 三档中最快

注:Sol Ultra 是 Sol 的高算力模式(Terminal-Bench 2.1 91.9%),并非单独的价格档位。

按场景选档

选 Sol:最难的工程与推理任务

跨仓库重构、长程 agent、难 debug。Terminal-Bench 2.1 上 Sol 88.8%。OpenAI 的 @thsottiaux 2026-07-29 帖(2026-08-30 抓取):Sol 消耗 Codex 限额快于预期;更愿意多跑、多打 tool、拉 subagent;High 档可比 GPT-5.5 High 用更多 token;已为全部 ChatGPT Work / Codex 用户重置额度,典型使用大约多撑 18%。要当默认档就先把任务范围写死。

选 Terra:日常编码的默认档

以约 Sol 一半的价格拿到 GPT-5.5 级以上的质量(Terminal-Bench 84.3%,高于 GPT-5.5 的 83.4%)。日常功能开发、代码评审、测试生成,Terra 是性价比最高的默认选择。

选 Luna:高频、低延迟、批量

补全、提交说明、批量、轻 CI。API 价 07-30 后是 $0.20/$1.20。OpenAI Codex 定价页(2026-08-30 抓取)每百万 input credits:Luna 5,Sol 100。OpenAI 的 @thsottiaux 2026-07-29 帖(同日抓取)写明未削减任何订阅套餐用量,并预期典型 Sol 大约多撑 18%。Luna 不是免费,是低 credit 档。

成本示例

典型 agentic 会话(800K 输入 + 60K 输出):按 2026-08-02 短上下文标价,Terra 约 $2.32、Sol 约 $5.80、Luna 约 $0.23(示意)。

随请求切换,无需承诺

三档只是三个 model id:gpt-5.6-sol、gpt-5.6-terra、gpt-5.6-luna。在 Codex CLI 里用 /model 随时切换,在 API 里逐请求指定。截至 2026-10-07,经 QCode 调用时 gpt-5.6-sol 与 gpt-5.6-terra 共用同一个密钥,按 token 计费,各模型单价见 /models;QCode 暂不提供 gpt-6-luna 与 gpt-5.6-luna(均已从 /models 下线),请使用其他 GPT 模型,跑量可选 gpt-5.6-terra。

三档选型常见问题

不确定选哪档时,默认用哪个?

把 Terra 设为默认:质量高于 GPT-5.5、价格只有 Sol 一半。遇到 Terra 卡住的难题再升到 Sol,高频轻任务降到 Luna。这个「Terra 打底、按需升降」的策略对大多数团队成本最优。

三档的上下文窗口和输出上限一样吗?

一样。官方文档确认三档共用 1.05M token 的 API 上下文窗口与 128K 最大输出,知识截止同为 2026 年 2 月 16 日,reasoning effort 选项(none 到 max)也一致。客户端实际发放的会话上限可能低于这个规格;常被引用的「400K」是把 272K 输入预算与 128K 输出相加得出的第三方算术,官方模型页没有这个数。

Sol Ultra 是什么?要单独付费吗?

Sol Ultra 是 Sol 的高算力运行模式(Terminal-Bench 2.1 91.9%),不是单独的价格档位。它消耗更多推理 token,因此同价率下单次任务的实际花费更高。看到 91.9% 的宣传数字时,注意那是 Ultra 模式的分数。

在 QCode 上三档怎么计费?

截至 2026-10-07,gpt-5.6-sol 与 gpt-5.6-terra 共用同一个 QCode 密钥,按 token 计费,各模型单价见 /models;QCode 暂不提供 gpt-6-luna 与 gpt-5.6-luna(均已从 /models 下线),请使用其他 GPT 模型,例如 gpt-6.1-sol、gpt-6-sol 或 gpt-5.6-terra。切换档位不需要任何账户操作 —— 换个 model id 就行。

GPT-5.6 Sol 与 Terra 可在 QCode 调用

gpt-5.6-sol / terra 与 Claude 阵容同一个 Key 直通(QCode 暂不提供 Luna)。套餐 ¥60/月起,付款后 Key 立即生效。

先体验,再决定

不确定选哪档?先买体验版(¥60/月),满意再升级,旧套餐剩余价值按比例退回余额。