2026 AI 模型雷达
GPT-6 Astra、Claude Fable 5.1、DeepSeek V4.1 Flash、Gemini 3.8 Flash 等等 —— 哪些模型已上线、哪些(如 Gemini 4 Pro)仍是传闻、哪些受限,以及如何在它们开放的第一时间用上。
更新于 2026-09-20
前沿模型状态看板
每款主流 2026 模型当前的处境 —— 点击任意卡片查看完整指南。
Anthropic · Claude
Anthropic 的旗舰模型,今天即可在 QCode 上使用。判断更敏锐,遗漏的代码缺陷比上一代约少 4 倍。更晚的 Opus 档是 Claude Opus 5($5/$25,2026-07-24 发布)。
Anthropic 中档 Sonnet,QCode 可用。标准价 $2/$10(原定 2026-09-01 上调至 $3/$15 已取消)。
Mythos 级旗舰,6 月 9 日发布、6 月 12 日在美国出口管制指令下全球暂停,7 月 15 日在 QCode 通道恢复。Anthropic 自家订阅侧自 7 月 19 日起按计划分层;API 侧不受影响。
Fable 5 的限量发布同胞版本(仅限获批组织 / Project Glasswing);不属于普遍可用模型。
OpenAI · GPT / Codex
上一代旗舰 GPT-5.5,仍可在 QCode 上用于 Codex 和 API。
Sol / Terra / Luna 自 2026-07-09 GA。官方定价页当前显示:Luna $0.20/$1.20、Terra $2/$12、Sol $4/$20(页面注明 Sol 的促销价至少持续到 2026-11-21)。QCode 三档均可调用。
并排对比:GPT-5.6 Sol 与 Claude Opus 4.8 在 Terminal-Bench 上的表现及定价。
从未发布。传闻阶段命名在 GPT-6 与 5.7 之间未定,2026-09-03 发布时定名 GPT-6 Astra,这个候选名就此作废。复盘见 /gpt-5-7-guide。
已发布:2026-09-03,API 模型 id 为 gpt-6-astra,上下文 1,050,000、输出 128,000,标价 $10/$50。没有 mini / nano 变体,Codex 直接调这个 id。QCode 已可调用。详见 /gpt-6-guide。
Google · Gemini
缺席 7 月 21 日的三连发。Google 表示其编码与复杂推理未达内部预期,广泛发布延期,目前仍在合作伙伴测试阶段。
于 2026 年 5 月 19 日在 Google I/O 上正式可用 —— 快速且多模态,可通过 QCode 上的 Gemini 使用。
来自 2025 年 11 月的 1M 上下文旗舰(LMArena 1501)。可通过 QCode 上的 Gemini 使用。
2026-07-21 以 gemini-3.6-flash 发布:Paid $1.50/$7.50,上下文 1,048,576/65,536;相对前代 Flash 的编码/多模态 workhorse。
同批发布,定位该档位中成本最低的一款。
同批发布的安全特化款,面向网络安全漏洞的发现与修复。
Google 于 2026-07-21 确认已开始 Gemini 4 预训练,但没有公布日期、规格或 Pro 版本的 SKU。
xAI · Grok
AutomationBench-AA 以 51.4% 居首(Fable 5 48.6%、Opus 4.8 48.5%),Artificial Analysis 智能指数排第 4,每任务约 $0.34 远低于同档。代价是幻觉率从 25% 升至 54%(AA-Omniscience)。QCode 目前未接入 Grok 系列。
xAI 的构建型智能体环境,开源生态与工具链见专页。QCode 目前未接入 Grok 系列。
2026-08-12 发布。Artificial Analysis 智能指数 61,与 GPT-5.6 Sol 持平;$2/$6,500K 上下文,缓存命中 $0.5。QCode 目前未接入 Grok 系列。
2026-08-11 起 early beta:共享云端桌面的「电脑同事」,随 Cursor Ultra($200/月)或 Teams Premium($120/席/月)提供。第三方产品,非模型端点。
已发布(2026-09-22 核):docs.x.ai 的模型页已列 grok-4.7,上下文 500k、输入 $2.00 / 输出 $6.00 每百万 token、推理档可配;官方仍未公布基准。创始人此前提到的 2.1T 规模没有官方确认。跳票时间线(09-02 / 09-11 / 09-14)见 /grok-4-7-status-tracker。
官方 Opus 现役仍是 claude-opus-5 那一行;「Opus 5.1 / 5.2」都找不到官方行,在控制台里见过 slug 也不算发布证据。追踪页 /claude-opus-5-2-status-tracker。
官方对比表当前列出的 Fable 只有 claude-fable-5-1 一行(2026-09-01),旧型号 claude-fable-5 在同页 Legacy 列表里;5.2 没有行、没有 id、没有日期、没有价格。追踪页 /claude-fable-5-2-status-tracker。
OpenAI 于 2026-09-22 正式发布(与 GPT-6 Luna 同一篇公告)。官方 id gpt-6-sol,$2/$10,缓存输入 $0.20,上下文 1,050,000、最大输出 128,000;按官方价表换算是 gpt-5.6-sol($4/$20)的一半。QCode 已可调用。追踪页 /gpt-6-sol-status-tracker。
Google 官方 API 目录 2026-09-17 版同时列出 Gemini 3.8 Flash 与 3.8 Live(id gemini-3.8-live);各自的 GA 日期官方没有单独公告,本页不写。本站 /models 已列 gemini-3.8-flash 与 gemini-3.8-live,说明见 /gemini-3-8-flash-guide。
Anthropic 官方总表把 releasedOn 标为 2026-09-01、lifecycle active,就是 Fable 一代的现役版本。QCode 在售 id 是 claude-fable-5-1,说明见 /claude-fable-5-1-guide。
中国开放权重模型
最强的开放权重编程模型之一(MIT,2026 年 6 月发布,744B/40B 激活,1M 上下文)。QCode 可用(glm-5.2、glm-5.1)。
V4 家族现在的现役两档是 deepseek-v4.1-flash(2026-09-10)与 deepseek-v4-pro(2026-08-13 GA),均 MIT 权重、1M 上下文。两个 id 都在本站 /models 且近 30 天有真实调用。
2026-07-31 的 post-training 更新:MIT 权重、1M / 384K、当时 $0.14/$0.28、Terminal-Bench 2.1 达 82.7。官方 2026-09-10 发布 V4.1-Flash 并让 deepseek-v4-flash 退役,同名请求改由 deepseek-v4.1-flash 应答。历史页 /deepseek-v4-flash-0731。
2026-08-13 GA,1.7T 参数,MIT 权重,发布时 $0.435/$0.87,Terminal-Bench 2.1 达 87.9,Artificial Analysis 智能指数 53。changelog 的 2026-09-10 条目确认 V4 Pro 继续提供、计费方式不变。QCode 可用(deepseek-v4-pro)。
2026-08-14 发布(与 5.2 同基座,后训练 Scaling,编程 +50%,CyberGym 84.5% 登顶),08-19 API 上线。QCode /models 已列 glm-5.3($1.40/$4.40)且近 30 天有真实调用。说明见 /glm-5-3-guide。 同代低成本档 GLM-5.3-Flash 已于 08-26 发布(320B-A18B、1M 上下文、MIT 开源权重,五折价 $0.075/$0.25 至 09-09),QCode 尚未接入,资料见 /glm-5-3-flash-guide。
Kimi K3 与 K2.6、Qwen 3.7 系列现已在 QCode 可用;MiniMax 等仍在评估中。
官方只在 2026-09-10 的发布稿里点过一次 V4.1-Pro,而它所属的「V4 Pro 改道」计划已被 changelog 的 2026-09-10 条目推翻;没有发布日期、id 或价格。追踪页 /deepseek-v4-1-pro-status-tracker。
2026-09-10 官方发布 V4.1-Flash,发布稿称它是「新架构家族里最小的模型」、带原生视觉理解。QCode 在售 id deepseek-v4.1-flash,1M / 384K,峰谷两档价。说明见 /deepseek-v4-1-flash-guide。
状态截至 2026-09-18。可用性与基准变化很快;预览、延期与传闻类信息均已标注。
✅ 你现在就能在 QCode 上用的模型
一个 API 密钥,三个平台 —— 挑选今天真正已上线的模型。
Claude Fable 5.1
Anthropic 官方总表标 releasedOn 2026-09-01、lifecycle active。QCode 在售 id 是 claude-fable-5-1。
GPT-6 Astra
2026-09-03 发布,API id gpt-6-astra,标价 $10/$50。Codex 直接调这个 id,本站 30 天有真实调用。
DeepSeek V4.1 Flash 与 Gemini 3.8 Flash
deepseek-v4.1-flash(2026-09-10,官方称它是新架构家族里最小的模型)与 gemini-3.8-flash 都已在本站 /models 上架。
如何在新模型开放的第一时间用上它们
创建一个 QCode 账户(注册本身免费)。只要套餐在有效期内,新模型一旦可用我们就为你开启 —— 无需额外注册、无需换 Key。同一份余额和 API 密钥在 Claude、Codex 和 Gemini 之间通用。
常见问题
我今天能在 QCode 上使用 GPT-5.6、Fable 5 或 Gemini 3.5 Pro 吗?
GPT-5.6:是 —— 7 月 9 日 GA,QCode 已接入 Sol / Terra / Luna。Claude Fable 5:是 —— API 侧可用(我们的通道 7 月 15 日恢复),Anthropic 订阅侧自 7 月 19 日起按计划分层。Gemini 3.5 Pro 仍在企业预览,一旦发布我们立刻开放。Claude Opus 4.8、Codex(GPT-5.6)与 Gemini 3 Pro / 3.5 Flash 也都可用。
Claude Fable 5 为什么被下线了?
两件事要分开看。其一是上游可用性:Anthropic 于 2026 年 6 月 12 日为遵守美国出口管制指令,将 Fable 5 与 Mythos 5 全球暂停(其他 Claude 模型未受影响),Fable 5 的访问于 7 月 15 日恢复并在 QCode 上重新可用;Mythos 5 仍仅限获批组织。其二是订阅计划规则:Anthropic 自 7 月 19 日起把 Fable 5 在自家订阅上按计划分层 —— Max 与 Team/Enterprise premium 席位为计划内标配,Pro 与 Team 标准席位走按量 usage credits。API 与按量计费型 Enterprise 不受第二条影响。
2026 年哪款模型最适合编程?
在正式可用的模型中,GPT-5.6 Sol 以 Terminal-Bench 2.1 88.8% 领跑终端智能体编程,Claude Opus 4.8 在深度重构与判断力要求高的任务上依然常被当作对照。GLM-5.2 是最强的开放权重模型之一,QCode /models 已列出 glm-5.2。随着新的基准测试出炉,我们会持续更新此雷达。
QCode 会自动添加新模型吗?
会的。当某款模型大范围可用且我们确保了产能后,我们会为所有账户启用它 —— 你现有的密钥和余额可立即使用。
深入了解
DeepSeek V4.1 Flash vs V4 Pro
官方称 Flash 多项超过 Pro,但 changelog 的 2026-09-10 条目又推翻「Pro 改道」(写明 2026-09-14 之后继续提供) —— 两档怎么按价格、并发和 vision 选。
GPT-6 Sol 状态追踪
GPT-6 Sol 已于 2026-09-22 由 OpenAI 正式发布:id 是 gpt-6-sol,$2 / $10,上下文 1,050,000;QCode 同一把 key 即可调用。
DeepSeek V4.1 Flash 定价追踪
六档价、缓存命中 1/50、峰谷时段的北京/东京/莫斯科三地换算,以及与 V4 Pro 的价差。
2026 下半年 AI 编程模型选型指南
预算/复杂度/上下文三维度决策框架,汇总本轮全部选型内容。