GPT-5.6 到底多少钱?
三档价格、缓存与真实成本
Sol $5/$30、Terra $2/$12、Luna $0.20/$1.20 — 已按 2026-07-30 降价更新。真实成本仍取决于缓存命中率。
OpenAI 将 Luna 降 80% 至 $0.20/$1.20,Terra 降 20% 至 $2/$12。Sol 仍为 $5/$30 并提供 Fast mode。后续变化见 Luna 价格追踪页。
打开 GPT-5.6 Luna 价格追踪三档官方价格表(每百万 token)
缓存写入按输入价 1.25 倍计,缓存读取享 90% 折扣。三档同为 1.05M API 上下文、128K 最大输出。
| 档位 | 输入 | 输出 | 缓存写入(1.25×) | 缓存读取(−90%) |
|---|---|---|---|---|
| gpt-5.6-sol | $5 | $30 | $6.25 | $0.50 |
| gpt-5.6-terra | $2 | $12 | $2.50 | $0.20 |
| gpt-5.6-luna | $0.20 | $1.20 | $0.25 | $0.02 |
GA 新增的缓存机制,值得专门设计
GPT-5.6 随 GA 引入了更可预测的提示缓存:支持显式缓存断点(你来决定前缀在哪里切分),且缓存至少保留 30 分钟。对智能体工作流意味着:把系统提示与工具定义固定为缓存前缀,长会话的输入成本可以砍掉最多九成。
三个可复算的成本示例
按官方费率逐项计算,你可以代入自己的用量复核。
日常智能体会话(Terra)
80 万输入 + 6 万输出(Terra):0.8 × $2 + 0.06 × $12 = $1.60 + $0.72 = 约 $2.32(截至 2026-08-02 短上下文标价)。若 80% 输入命中缓存读取($0.20/M),输入部分约 0.16 × $2 + 0.64 × $0.20 = $0.448,总价约 $1.17。
攻坚任务(Sol,高缓存命中)
50 万输入(其中 40 万缓存读取)+ 5 万输出:0.1 × $5 + 0.4 × $0.50 + 0.05 × $30 = $0.50 + $0.20 + $1.50 = 约 $2.20。缓存把 Sol 的单次攻坚成本压到了 Terra 裸价附近。
批量轻任务(Luna)
1000 次调用,每次 1 万输入 + 1 千输出(合计 1000 万输入 + 100 万输出):10 × $0.20 + 1 × $1.20 = 约 $3.20(Luna,2026-07-30 降价后)。同样任务放 Sol 约 $80 —— 轻任务下沉到 Luna 仍是最直接的省钱方式。
放到市场上看这个价格
Sol($5/$30)与 Claude Opus 4.8($5/$25)输入同价、输出略高;Terra($2/$12,2026-07-30 降价后)是日常默认档;Luna($0.20/$1.20)约为 Sol 标价的 1/25,适合海量执行。截至 2026-08-02,多数工作负载不必再默认上旗舰价。
在 QCode 上的价格与用法
QCode 的 /models 页展示与 OpenAI 官方一致的实时费率,套餐额度内按官方费率逐 token 计量。三档与 GPT-5.5、Claude、Gemini 共用同一个 API Key 和同一份配额 —— 中国大陆低延迟直达,支持本地支付,套餐 ¥60/月起。
定价常见问题
缓存具体怎么计费?
缓存写入按输入价的 1.25 倍计(截至 2026-08-02:Sol $6.25、Terra $2.50、Luna $0.25 每百万 token),缓存读取按输入价的 10% 计(Sol $0.50、Terra $0.20、Luna $0.02)。GA 起支持显式缓存断点,缓存至少保留 30 分钟。
长上下文要加价吗?
官方价目没有长上下文加价档:1.05M API 窗口内统一按上表费率计费。当然,塞进更多 token 本身会线性增加输入费用 —— 控制成本的关键是缓存前缀,而不是截断上下文。
换档位会影响计费或配额吗?
不会。三档只是不同的 model id,各按各的费率计费,共用同一份配额。可以在同一个项目里按请求混用 —— 比如 Sol 规划、Terra 执行、Luna 批处理。
QCode 上的价格和 OpenAI 官方一致吗?
一致。/models 页按官方费率展示三档价格(截至 2026-08-02:Sol $5/$30、Terra $2/$12、Luna $0.20/$1.20),按量计费。QCode 的价值在接入体验:中国大陆低延迟、本地支付、Claude / GPT / Gemini 一 Key 通用。