2026 下半年 AI 编程模型
怎么选:完整格局
不是「哪个最强」,是「你的场景该选哪个」。2026 年 9 月头三天三家连发:Claude Fable 5.1(09-01)、Gemini 3.8 Flash(09-02)、GPT-6 Astra(09-03),顶配档的格局被重排了一次。这里是预算/任务复杂度/上下文三维度的决策框架,三大阵营的现状速览,以及本轮全部选型内容的统一入口。
更新于 2026-09-20
Claude(Opus 5 / Fable 5.1)、OpenAI(GPT-6 Astra 与 GPT-5.6 三档)均在 QCode 上线;开源线 DeepSeek 已经换到 deepseek-v4.1-flash(2026-09-10)与 deepseek-v4-pro(08-13 GA,峰谷计价),GLM-5.3(08-14)、Kimi K3(07-16,权重 07-27 开源)在售。Google 侧目录已列 Gemini 3.8 Flash 与 3.8 Live,而 Gemini 4 Pro 只确认 2026-07-21 开始预训练,官方从未给过日期。
格局截至:2026-09-18。
决策框架:三个维度
选模型前先回答这三个问题,比直接比基准分数更有效。
| 维度 | 问自己 | 偏向档位 | 典型场景 | 说明 |
|---|---|---|---|---|
| 预算敏感度 | 这个任务量大到需要认真控成本吗? | 预算紧 → Luna / deepseek-v4.1-flash / Sonnet 5;预算宽松 → Sol / Fable 5 | 批量补全、CI 脚本、轻量分类 | Luna 标价约为 Sol 的 1/25;DeepSeek 的 V4.1-Flash 低谷 $0.15/$0.6、高峰翻倍,海量执行场景差价显著 |
| 任务复杂度 | 这是长程重构 / 高难度推理,还是常规功能开发? | 高难度 → Sol / Fable 5;常规 → Terra / Sonnet 5 | 跨仓库重构、复杂调试、架构决策 | 对最难的一小部分任务,旗舰档的成功率差距远超价差 |
| 上下文需求 | 单次任务要塞进多少上下文? | Astra / Sol / Terra / Luna(1.05M)· Fable 5.1(1M)· Gemini 3.8 Flash | 长文档问答、跨文件大范围重构 | 三大阵营当前在售旗舰上下文窗口相近,不是主要分野 |
三大阵营现状速览
Claude(Anthropic)
Fable 5.1:现役最高档(2026-09-01 发布,$10/$50,1M 上下文、128K 输出,可靠知识截止 2026 年 6 月,思考为 Adaptive 常时开启)。Opus 5:$5/$25,1M 上下文 —— Anthropic 官方文档明确建议「多数负载从 Opus 5 开始」,Fable 5.1 留给要求高的推理与长链路智能体工作。Sonnet 5:$2/$10,均衡主力。Haiku 4.5:$1/$5,最快一档。
OpenAI
GPT-6 Astra:2026-09-03 发布的最高档(模型 id gpt-6-astra,上下文 1,050,000、输出上限 128,000 含推理 token,标价 $10/$50,推理档 low–max 无 none)。GPT-5.6 三档:Sol(旗舰,官方定价页当前 $4/$20,注明促销价至少持续到 2026-11-21)、Terra(均衡 $2/$12)、Luna(极速 $0.20/$1.20)。Sol 与 Astra 的上下文窗口和输出上限完全相同,分野在推理档与知识截止。另有审核制的 GPT-5.6-Cyber(Daybreak Red 层级,普通渠道不可得)。
Gemini 3.8 Flash 与 3.8 Flash Cyber 于 2026-09-02 发布,官方入门价每 1M token(百万)输入 $0.75、输出 $3.75,写明是优惠价、到 2026-12-31 为止,2027-01-01 起为 $1.50/$7.50;Cyber 版限 Fairwind 计划的受信任防御方。此前的 3.6 Flash(07-21)与 3.7 Flash(08-13 GA)仍在。Gemini 3.5 Pro 至今未广泛提供 —— 官方可核的表述只有「与合作伙伴测试中,准备好就广泛提供」,从未给过日期,此前流传的 7 月与 8-12 两个日期均已跳票,请勿当作既成事实。
开源阵营(DeepSeek / GLM / Kimi)
DeepSeek 的现役两档是 deepseek-v4.1-flash(2026-09-10,发布稿称它是「新架构家族里最小的模型」、带原生视觉理解;1M / 384K、MIT、官方低谷 $0.15/$0.6)与 deepseek-v4-pro(2026-08-13 GA,发布时 $0.435/$0.87)。2026-09-10 起 deepseek-v4-flash 与 vision-exp 退役,同名请求由 V4.1-Flash 应答并按 Flash 价计费(changelog);changelog 的 2026-09-10 条目推翻「V4 Pro 改道」,确认 V4 Pro 继续提供、计费不变。GLM-5.3(2026-08-14)与 Kimi K3(2026-07-16)仍在。对比见 /deepseek-v4-1-flash-vs-v4-pro,定价见 /deepseek-v4-1-flash-pricing。
相关内容的导航
本页是这批选型内容的枢纽——以下链接覆盖全部新增与更新的选型文章。
GPT-5.4 下线迁移指南
8/31 前该切到哪个档位
Fable 5 vs GPT-5.6 Sol
两大旗舰规格价格对比
Mythos 5 和 Fable 5 什么关系
普通用户能用到的是哪个
Fable 5 定价完全指南
官方单价与订阅制成本
Fable 5 的 SWE-Bench Pro 80.3%
分数来源与争议解读
Sol / Terra / Luna 怎么选
三档基准价格与场景对比(已刷新)
GPT-5.6 完整指南
基准、定价与接入方式
Gemini 3.5 Pro 发布追踪
传闻与已确认事实(已更新 8/12 传闻)
GPT-5.6 定价完全指南
三档价格、缓存计价与成本估算
2026 AI 模型雷达
每款前沿模型的实时可用性状态
GPT-5.4 下线迁移指南
GPT-5.6 三档怎么分工,以及什么活值得升到 GPT-6 Astra。
Claude Fable 5 vs GPT-5.6 Sol
两大旗舰规格、价格、SWE-Bench Pro 分数并排对比。
Claude Mythos 5 和 Fable 5 是什么关系
普通用户实际能用到的是 Fable 5,Mythos 5 无公开商用通路。
近期时间线
三大阵营近两个月内的关键节点。
GPT-5.6 三档全面开放
Sol、Terra、Luna 通过 API 与 Codex 向所有人开放,QCode 同步接入。
GPT-5.6 降价
Luna 降 80% 至 $0.20/$1.20,Terra 降 20% 至 $2/$12,Sol 价格不变。
8 月密集发布周
GLM-5.3 发布(与 5.2 同基座,后训练 Scaling,编程 +50%);Qwen3.8-Max 于 08-03 发布、08-12 首次开源 Max 级权重;GPT-5.6-Cyber 于 08-10 进入 Daybreak Red 审核制层级。
三天三家连发,顶配档重排
09-01 Anthropic 发布 Claude Fable 5.1 与 Mythos 5.1;09-02 Google 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber;09-03 OpenAI 发布 GPT-6 Astra。其中 Astra 与 Fable 5.1 的标价完全相同($10/$50),上下文与输出上限也接近,是 2026 年下半年第一次出现同价位的跨阵营正面对撞。
DeepSeek 换档:V4.1-Flash 上线,0731 版退役
2026-09-10 官方发布 V4.1-Flash 并下调 Flash 档价格,同时退役 deepseek-v4-flash 与 deepseek-v4-flash-vision-exp;changelog 的 2026-09-10 条目应需求推翻 V4 Pro 改道。同期官方 API 目录还列出了 Gemini 3.8 Live(id gemini-3.8-live)。
关于本页
本页是决策框架与内容导航枢纽,各模型的完整一手事实核查见下方专题页。本页涉及的 2026 年 9 月发布日期与旗舰价格均已回各家官方文档核对(OpenAI 模型文档与定价页、Anthropic 模型总览、Google 模型目录、DeepSeek news260910 发布稿 / changelog),抓取日期 2026-09-18。其余历史条目沿用各专题页的既有出处。
常见问题
现在选 AI 编程模型,第一步该看什么?
先别急着比基准分数,先回答三个问题:预算敏感度、任务复杂度、单次任务的上下文需求。三个维度定完,候选范围通常只剩 1-2 档,再去看具体基准分数做最终决定。
GPT-5.4 用户是不是都要迁移?
不是。官方写明自 2026-08-31 起的下线只覆盖 ChatGPT 登录态会话(2026-08-30 复核仍是 starting August 31)。API 或 Codex 密钥访问不在这次公告范围内;可以继续用,也可以迁到 GPT-5.6 对应档。
Gemini 3.5 Pro 现在能用了吗?
还不能。截至 2026-08-22 它仍处于受限预览;此前传闻的 7 月与 8 月 12 日两个发布日期都已跳票,Google 未确认任何新日期——请当作传闻对待,不要当作决策依据。
这页和「2026 AI 模型雷达」有什么区别?
雷达页做的是「哪些模型已可用/预览/受限」的现状速览;本页做的是「你的场景该选哪个」的决策框架,并汇总本轮新增与更新的选型深度内容。两页目的不同,可以配合看。
相关阅读
2026 AI 模型雷达
每款前沿模型的实时可用性状态追踪,与本页的选型决策框架互补。
SWE-Bench Pro 上的 Claude Fable 5
80.3% 这个分数是怎么来的,以及它的参考价值和局限。
Claude Fable 5 定价完全指南
官方单价、缓存计价、订阅制真实成本。
本页汇总的价格、基准分数与发布日期均已交叉核实,Gemini 3.5 Pro 的发布日期为未经 Google 证实的传闻。信息随时可能变化,请以各厂商官方发布为准。