GPT-5.6 到底多少钱?
三档价格、缓存与真实成本
现在问的是账单怎么算,不是发布日标价。Sol 现价 $4/$20(官方定价页 2026-09-12 存档,促销至少到 2026-11-21;发布时标价是 $5/$30),Terra $2/$12、Luna $0.20/$1.20(每百万 token);真实成本看缓存命中。Codex 订阅额度是另一条线:OpenAI 的 @thsottiaux 2026-07-29 帖(2026-08-30 抓取)写明,未削减任何订阅套餐用量,Sol 消耗 Codex 限额快于预期,已为全部 ChatGPT Work / Codex 用户重置额度,并预期典型使用下 Sol 大约多撑 18%。
OpenAI 将 Luna 降 80% 至 $0.20/$1.20,Terra 降 20% 至 $2/$12。Sol 截至 2026-08-02 仍为 $5/$30 并提供 Fast mode(官方定价页 2026-09-12 存档:现价 $4/$20,促销至少到 2026-11-21)。后续变化见 Luna 价格追踪页。
打开 GPT-5.6 Luna 价格追踪三档官方价格表(每百万 token)
缓存写入按输入价 1.25 倍计,缓存读取享 90% 折扣。三档同为 1,050,000 API 上下文、128,000 最大输出;输入超过 272K 时整单按 2× 输入、1.5× 输出计。Sol 一列是现价(促销至少到 2026-11-21),发布时的 $5/$30 见下方示例。
| 档位 | 输入 | 输出 | 缓存写入(1.25×) | 缓存读取(−90%) |
|---|---|---|---|---|
| gpt-5.6-sol | $4 | $20 | $5.00 | $0.40 |
| gpt-5.6-terra | $2 | $12 | $2.50 | $0.20 |
| gpt-5.6-luna | $0.20 | $1.20 | $0.25 | $0.02 |
GA 新增的缓存机制,值得专门设计
GPT-5.6 随 GA 引入了更可预测的提示缓存:支持显式缓存断点(你来决定前缀在哪里切分),且缓存至少保留 30 分钟。对智能体工作流意味着:把系统提示与工具定义固定为缓存前缀,长会话的输入成本可以砍掉最多九成。
三个可复算的成本示例
按官方费率逐项计算,你可以代入自己的用量复核。
日常智能体会话(Terra)
80 万输入 + 6 万输出(Terra):0.8 × $2 + 0.06 × $12 = $1.60 + $0.72 = 约 $2.32(截至 2026-08-02 短上下文标价)。若 80% 输入命中缓存读取($0.20/M),输入部分约 0.16 × $2 + 0.64 × $0.20 = $0.448,总价约 $1.17。
攻坚任务(Sol,高缓存命中)
50 万输入(其中 40 万缓存读取)+ 5 万输出,按官方定价页 2026-09-12 存档的 Sol 现价(输入 $4、缓存读 $0.40、输出 $20,促销至少到 2026-11-21):0.1 × $4 + 0.4 × $0.40 + 0.05 × $20 = $0.40 + $0.16 + $1.00 = 约 $1.56(按发布时标价 $5/$30 约 $2.20)。缓存把 Sol 的单次攻坚成本压到了同量 Terra 裸价(约 $1.60)附近。
批量轻任务(Luna)
1000 次调用,每次 1 万输入 + 1 千输出(合计 1000 万输入 + 100 万输出):10 × $0.20 + 1 × $1.20 = 约 $3.20(Luna,2026-07-30 降价后)。同样任务放 Sol 约 $60(现价 $4/$20;按发布时标价 $5/$30 约 $80)—— 轻任务下沉到 Luna 仍是最直接的省钱方式。
放到市场上看这个价格
Sol($5/$30,2026-08 口径)与 Claude Opus 4.8($5/$25)输入同价、输出略高;Terra($2/$12,2026-07-30 降价后)是日常默认档;Luna($0.20/$1.20)约为 Sol 标价的 1/25,适合海量执行。截至 2026-08-02,多数工作负载不必再默认上旗舰价。
在 QCode 上的价格与用法
QCode 的 /models 页展示与 OpenAI 官方一致的实时费率,套餐额度内按官方费率逐 token 计量;单次输入超过 272K 时整单按长上下文价计,与官方规则一致。三档与 GPT-5.5、Claude、国产模型共用同一个 API Key 和同一份配额 —— 中国大陆低延迟直达,支持本地支付,套餐 ¥60/月起。
定价常见问题
缓存具体怎么计费?
缓存写入按输入价的 1.25 倍计(截至 2026-08-02:Sol $6.25、Terra $2.50、Luna $0.25 每百万 token),缓存读取按输入价的 10% 计(Sol $0.50、Terra $0.20、Luna $0.02)。GA 起支持显式缓存断点,缓存至少保留 30 分钟。
长上下文要加价吗?
有加价档。官方 Sol 模型页写明:输入超过 272K 时,整个请求按 2× 输入、1.5× 输出计价(原句 Prompts with >272K input tokens are priced at 2x input and 1.5x output for the full request.)。注意 272K 并不是能塞进去的上限 —— 窗口仍是 1,050,000;它是价格悬崖。控制成本的关键还是把稳定前缀做成缓存命中,而不是截断上下文。QCode 上同样按这条规则计费。
换档位会影响计费或配额吗?
不会。三档只是不同的 model id,各按各的费率计费,共用同一份配额。可以在同一个项目里按请求混用 —— 比如 Sol 规划、Terra 执行、Luna 批处理。
QCode 上的价格和 OpenAI 官方一致吗?
Sol 与 Terra 一致。/models 页按官方费率展示这两档价格(截至 2026-08-02:Sol $5/$30、Terra $2/$12),按量计费;QCode 暂不提供 gpt-6-luna 与 gpt-5.6-luna(均已从 /models 下线),请使用其他 GPT 模型,例如 gpt-6.1-sol、gpt-6-sol 或 gpt-5.6-terra。QCode 的价值在接入体验:本地支付、Claude / GPT / 国产模型一把 Key 通用。