2026 下半年 AI 编程模型
怎么选:完整格局
不是「哪个最强」,是「你的场景该选哪个」。这里是预算/任务复杂度/上下文三维度的决策框架,三大阵营的现状速览,以及本轮全部选型内容的统一入口。
Claude、OpenAI 均已发布 2026 下半年新一代旗舰并在 QCode 上线;Google 的 Gemini 3.5 Flash 已在售,但同系旗舰 Gemini 3.5 Pro 仍处于受限预览,传闻发布日期已跳票一次。
格局截至:2026-08-08。
决策框架:三个维度
选模型前先回答这三个问题,比直接比基准分数更有效。
| 维度 | 问自己 | 偏向档位 | 典型场景 | 说明 |
|---|---|---|---|---|
| 预算敏感度 | 这个任务量大到需要认真控成本吗? | 预算紧 → Luna / Sonnet 5;预算宽松 → Sol / Fable 5 | 批量补全、CI 脚本、轻量分类 | Luna 标价约为 Sol 的 1/25,海量执行场景差价显著 |
| 任务复杂度 | 这是长程重构 / 高难度推理,还是常规功能开发? | 高难度 → Sol / Fable 5;常规 → Terra / Sonnet 5 | 跨仓库重构、复杂调试、架构决策 | 对最难的一小部分任务,旗舰档的成功率差距远超价差 |
| 上下文需求 | 单次任务要塞进多少上下文? | Fable 5(1M)/ Sol・Terra・Luna(1.05M)/ Gemini 3.5 Flash(1.05M) | 长文档问答、跨文件大范围重构 | 三大阵营当前在售旗舰上下文窗口相近,不是主要分野 |
三大阵营现状速览
Claude(Anthropic)
Fable 5:旗舰,2026-06-09 发布,$10/$50 每百万 token,SWE-Bench Pro 80.3%(官方评测口径)。Sonnet 5:均衡主力,QCode 可用。Opus 4.8:上一代旗舰,仍在售。
OpenAI
GPT-5.6 三档:Sol(旗舰 $5/$30)、Terra(均衡 $2/$12)、Luna(极速 $0.20/$1.20),2026-07-09 全面开放,7/30 已降价。GPT-5.4 与 5.4-mini 将于 2026-08-31 从 Codex 下线(仅影响 ChatGPT 登录态会话,API/Codex 密钥不受影响)。
Gemini 3.5 Flash:已在售,快速多模态档位。Gemini 3.5 Pro:仍处 Vertex AI 受限预览,此前传闻的 7 月发布已跳票,新传闻指向 8 月 12 日,Google 尚未确认——请勿当作既成事实。
本轮内容导航
本页是这批选型内容的枢纽——以下链接覆盖全部新增与更新的选型文章。
GPT-5.4 下线迁移指南
8/31 前该切到哪个档位
Fable 5 vs GPT-5.6 Sol
两大旗舰规格价格对比
Mythos 5 和 Fable 5 什么关系
普通用户能用到的是哪个
Fable 5 定价完全指南
官方单价与订阅制成本
Fable 5 的 SWE-Bench Pro 80.3%
分数来源与争议解读
Sol / Terra / Luna 怎么选
三档基准价格与场景对比(已刷新)
GPT-5.6 完整指南
基准、定价与接入方式
Gemini 3.5 Pro 发布追踪
传闻与已确认事实(已更新 8/12 传闻)
GPT-5.6 定价完全指南
三档价格、缓存计价与成本估算
2026 AI 模型雷达
每款前沿模型的实时可用性状态
GPT-5.4 下线迁移指南
8/31 从 Codex 下线前,该切到 Sol、Terra 还是 Luna。
Claude Fable 5 vs GPT-5.6 Sol
两大旗舰规格、价格、SWE-Bench Pro 分数并排对比。
Claude Mythos 5 和 Fable 5 是什么关系
普通用户实际能用到的是 Fable 5,Mythos 5 无公开商用通路。
近期时间线
三大阵营近两个月内的关键节点。
GPT-5.6 三档全面开放
Sol、Terra、Luna 通过 API 与 Codex 向所有人开放,QCode 同步接入。
GPT-5.6 降价
Luna 降 80% 至 $0.20/$1.20,Terra 降 20% 至 $2/$12,Sol 价格不变。
Gemini 3.5 Pro 新传闻发布日
此前 7 月的传闻发布日期已经跳票,新一轮传闻指向 8 月 12 日,Google 仍未确认,请谨慎看待。
GPT-5.4 从 Codex 下线
仅影响 ChatGPT 登录态会话;API/Codex 密钥访问的用户不受影响,无需迁移。
关于本页
本页是决策框架与内容导航枢纽,不重复展开各模型的一手事实核查——具体数字与来源见下方各专题页。价格数据以 LiteLLM 开源定价 JSON 为准。
常见问题
现在选 AI 编程模型,第一步该看什么?
先别急着比基准分数,先回答三个问题:预算敏感度、任务复杂度、单次任务的上下文需求。三个维度定完,候选范围通常只剩 1-2 档,再去看具体基准分数做最终决定。
GPT-5.4 用户是不是都要迁移?
不是。2026-08-31 的下线只影响 ChatGPT 登录态会话;如果你是通过 API 或 Codex 密钥访问,不受影响,可以继续使用,也可以选择性迁移到 GPT-5.6 的对应档位。
Gemini 3.5 Pro 现在能用了吗?
还不能。截至 2026-08-08,它仍处于 Vertex AI 受限预览阶段。此前传闻的 7 月发布已经跳票,新一轮传闻指向 8 月 12 日,但 Google 尚未确认,请当作传闻对待,不要当作既成事实做决策依据。
这页和「2026 AI 模型雷达」有什么区别?
雷达页做的是「哪些模型已可用/预览/受限」的现状速览;本页做的是「你的场景该选哪个」的决策框架,并汇总本轮新增与更新的选型深度内容。两页目的不同,可以配合看。
相关阅读
2026 AI 模型雷达
每款前沿模型的实时可用性状态追踪,与本页的选型决策框架互补。
SWE-Bench Pro 上的 Claude Fable 5
80.3% 这个分数是怎么来的,以及它的参考价值和局限。
Claude Fable 5 定价完全指南
官方单价、缓存计价、订阅制真实成本。
本页汇总的价格、基准分数与发布日期均已交叉核实,Gemini 3.5 Pro 的发布日期为未经 Google 证实的传闻。信息随时可能变化,请以各厂商官方发布为准。