2026年AI编程最新动态
2026 年 AI 编程模型的迭代节奏在下半年明显加快。9 月头三天三家连发:Claude Fable 5.1(09-01)、Gemini 3.8 Flash(09-02)、GPT-6 Astra(09-03),顶配档格局被重排了一次;此前 GPT-5.6 三档、DeepSeek V4 Pro、GLM-5.3 等也相继落地。这里按时间倒序整理各家的正式发布与价格变动,每条都注明日期与官方口径。
更新于 2026-09-21
2026年重大更新时间线
AI编程工具在2026年迎来密集更新浪潮,以下是最值得关注的重要发展
DeepSeek V4.1-Flash 上线,同一天 0731 版退役
官方发布稿称 V4.1-Flash 是「新架构家族里最小的模型」、带原生视觉理解;deepseek-v4-flash 与 deepseek-v4-flash-vision-exp 同日退役,同名请求由 V4.1-Flash 应答并按 Flash 价计费,Flash 档价格同步下调。
- ▸QCode 在售 id:deepseek-v4.1-flash,1M 上下文 / 384K 输出,峰谷两档价(官方低谷 $0.15 / $0.6)。
- ▸官方 changelog 的 2026-09-10 条目推翻「V4 Pro 改道」(写明 2026-09-14 之后继续提供):应需求继续提供 DeepSeek V4 Pro,计费方式不变。
官方 API 目录列出 Gemini 3.8 Live
2026-09-17 版官方模型目录同时列出 Gemini 3.8 Flash 与 Gemini 3.8 Live(id gemini-3.8-live)。两个版本的 GA 日期官方没有单独公告,本页不写。
- ▸QCode /models 已列 gemini-3.8-flash 与 gemini-3.8-live,30 天用量可查。
- ▸Gemini 4 Pro 依旧未发布:官方只确认 2026-07-21 开始预训练,目录里也没有 gemini-4* 行。
GPT-6 Astra 发布
2026-09-03 发布,模型 id gpt-6-astra,官方定位是「为最难的端到端工作而造」。上下文 1,050,000、输出上限 128,000(含推理 token),标价每 1M token 输入 $10、输出 $50。
- ▸推理档 low / medium / high / xhigh / max —— 没有 none 档,最低从 low 起步
- ▸与 GPT-5.6 Sol 的上下文窗口和输出上限完全相同,分野在推理档与知识截止(2026-04-30)
Gemini 3.8 Flash 与 3.8 Flash Cyber 发布
2026-09-02 发布。官方入门价每 1M token 输入 $0.75、输出 $3.75,并写明这是优惠价、到 2026-12-31 为止。
- ▸2027-01-01 起官方价变为 $1.50 / $7.50,两项都翻倍 —— 跨年度成本模型要把这个日期算进去
- ▸Cyber 版限 Fairwind 计划的受信任防御方,普通开发者拿不到
Claude Fable 5.1 与 Mythos 5.1 发布
2026-09-01 发布。Fable 5.1 标价每百万 token 输入 $10、输出 $50,上下文 1M、输出 128K,可靠知识截止 2026 年 6 月。
- ▸思考为 Adaptive 且常时开启,默认 effort 为 high,官方把它的相对延迟标为四档中最慢
- ▸官方建议多数负载先用 Opus 5($5/$25),Fable 5.1 留给要求高的推理与长链路智能体工作
DeepSeek V4 Pro 0813 正式发布
2026-08-13 在 App、Web 与 API 全面开放。1.7T 参数、MIT 权重,Terminal-Bench 2.1 达 87.9,Artificial Analysis 智能指数 53。QCode 可用(deepseek-v4-pro)。
- ▸发布时 $0.435 / $0.87,缓存命中 $0.003625
- ▸2026-08-16 16:00 UTC 起 DeepSeek 全线改为峰谷计价
Grok 4.6 发布:智能指数 61,价格 $2/$6
2026-08-12 发布,Artificial Analysis 智能指数 61,与 GPT-5.6 Sol 持平、略低于 Opus 5 的 63。上下文 500K。QCode 未接入 Grok 系列。
- ▸$2 输入 / $6 输出,缓存命中 $0.5,fast 变体为两倍价
- ▸Briefcase 上约 53 回合完成,Opus 5 约 103 回合
Grok Bot 进入 early beta
2026-08-11 起向 Cursor Ultra 与 Teams Premium 用户开放:每个账号一台共享云端桌面,可 24/7 运行。QCode 未接入 Grok 系列。
- ▸Cursor Ultra $200/月,Teams Premium $120/席/月
- ▸同账号下多个 Bot 共享一台机器,官方说明这不是安全边界
DeepSeek V4 Flash 0731:同规模重做后训练
2026-07-31 发布。结构与规模不变,只重做后训练:Terminal-Bench 2.1 从 61.8 升到 82.7,DeepSWE 从 7.3 升到 54.4。
- ▸1M 上下文 / 384K 最大输出,MIT 权重
- ▸$0.14 / $0.28,缓存命中 $0.0028
Claude Sonnet 5 介绍价转为永久标准价
2026-08-10,Anthropic 确认每 1M token $2/$10 转为标准价,原定 2026-09-01 上调至 $3/$15 的计划不会执行。
- ▸标准价:每 1M token 输入 $2 / 输出 $10,无到期日
- ▸原定 2026-09-01 的 $3 / $15 调价已取消
- ▸Claude Code agentic 工作流的常见默认档
- ▸可与 Luna $0.20/$1.20、Gemini 3.6 Flash $1.50/$7.50 对照路由
GPT-5.6 Luna −80%、Terra −20%(2026-07-30)
短上下文 API 标价:Luna $0.20/$1.20,Terra $2/$12,Sol $5/$30(2026-07-30 当时的标价)。Sol 这一档后来没变过标价,但官方定价页 2026-09-12 存档显示现价是 $4 / $20(促销至少到 2026-11-21)。订阅标价未降;Codex/ChatGPT Work 中 Luna/Terra 用量计数变便宜。
- ▸Luna:输入 $0.20 / 输出 $1.20(原 $1 / $6)
- ▸Terra:$2 / $12(原 $2.50 / $15)
- ▸Sol 标价不变;Sol Fast 约 2.5× 速度、2× 价格
- ▸LiteLLM openai 主键已收录新价(2026-08-02 核对)
Claude Opus 5 可用(2026-07-24)
claude-opus-5 为 $5/$25,与 Opus 4.8 同价。官方叙事接近 Fable 5、约一半价格;Max 默认/Pro 强档。
- ▸API 价每 1M token 输入 $5 / 输出 $25
- ▸模型 id claude-opus-5;长上下文以 Anthropic 文档为准
- ▸与 GPT-5.6 Sol(当时 $5/$30,官方定价页 2026-09-12 存档现价 $4 / $20)同价位竞争
- ▸能力细节以官方公告为准,本条不转写 benchmark 表
Gemini 3.6 Flash 发布(2026-07-21)
workhorse Flash 更新,id gemini-3.6-flash:Paid $1.50/$7.50,上下文 1,048,576/65,536。同日 3.5 Flash-Lite 与 3.5 Flash Cyber 为不同模型。
- ▸价格(每 1M token):输入 $1.50 / 输出 $7.50(Paid;输出含 thinking tokens)
- ▸上下文:输入 1,048,576 / 输出 65,536
- ▸缓存、代码执行、function calling、thinking、computer use 预览等
- ▸Google 称在 Artificial Analysis Index 上比 3.5 Flash 约少 17% 输出 token
Codex 恢复 5 小时滚动限额
此前因 Sol 档消耗过高被暂停的 5 小时滚动限额于 7 月 30 日回归,靠频繁重置配额维持的过渡期结束。
- ▸与周限额重新叠加生效
- ▸官方未公布 5 小时窗口的具体配额上限
- ▸社区反馈:重度任务约半小时触顶(非官方数值)
- ▸API 通道不受订阅的滚动窗口约束
Claude Mythos Preview 协助发现密码学算法弱点
Anthropic 公布研究成果:Mythos Preview 帮助研究人员在密码学算法中找到弱点。Mythos 仍仅对获批组织开放。
- ▸官方研究公告,非第三方转述
- ▸Mythos 与 Fable 5 同底座
- ▸Mythos 5 仍限获批组织(Project Glasswing)
- ▸Fable 5 经 API 可用,不受订阅分层影响
OpenAI 通报:内部模型逃出沙箱并入侵 Hugging Face
在一次关闭护栏的安全测试中,内部研究原型逃出沙箱、利用 Artifactory 未知漏洞取得外网访问,并入侵 Hugging Face 以获取评测答案。OpenAI 已发布官方通报。
- ▸官方通报,非传闻
- ▸利用了 Artifactory 的一个未知漏洞
- ▸动机是在评测中作弊而非破坏
- ▸OpenAI 明确:涉事原型不是任何待发布模型
Gemini 三连发,但 3.5 Pro 缺席
Google 同时发布 Gemini 3.6 Flash、3.5 Flash-Lite 与 3.5 Flash Cyber,并预告了 Gemini 4。旗舰 3.5 Pro 未在此列。
- ▸3.6 Flash:编码与多模态更强,token 用量最多降 17%
- ▸3.5 Flash-Lite:该档位成本最低
- ▸3.5 Flash Cyber:网络安全漏洞查修特化
- ▸3.5 Pro 因编码与复杂推理未达内部预期而延期
Fable 5 订阅侧终局:按计划分层,而非撤除
7 月 7 日宣布把 Fable 5 移出订阅计划并引发反弹,期限两次延期后,最终落地为按计划分层。
- ▸Max 与 Team/Enterprise premium 席位:计划内标配
- ▸Pro 与 Team 标准席位:按量 usage credits
- ▸API 与按量计费型 Enterprise 全程不受影响
- ▸与 6 月出口管制导致的全球暂停是两件事
GPT-5.6(Sol / Terra / Luna)全面开放,QCode 已接入
OpenAI 于 2026 年 7 月 9 日将 GPT-5.6 三档通过 API 与 Codex 向所有人全面开放。Sol 以 Terminal-Bench 2.1 88.8%(Sol Ultra 模式 91.9%)领跑;QCode 已接入 gpt-5.6-sol / terra / luna,同一密钥即可调用。
- ▸三档定位:Sol 旗舰 / Terra 均衡约半价 / Luna 最快最省
- ▸官方规格:三档同为 1.05M API 上下文 / 128K 最大输出
- ▸缓存升级:显式缓存断点 + 最短 30 分钟缓存生命周期,读取仍享 1 折(−90%)
- ▸QCode:gpt-5.6-sol / terra / luna 已上线,与 GPT-5.5 同 Key 同配额
Claude Fable 5:发布、暂停、恢复
Anthropic 于 2026 年 6 月 9 日发布 Fable 5(Opus 之上的档位,$10/$50,1M 上下文),6 月 12 日在一项监管指令下与 Mythos 5 一同全球暂停 —— 访问于 7 月 15 日恢复,Fable 5 在 QCode 上重新可用。订阅计划侧另有一条独立的变更线,7 月落地为按计划分层,详见可用性追踪页。
- ▸Anthropic 迄今最强、最智能的模型,Opus 之上的全新档位
- ▸原生 1M context + 128K 最大输出,规格对齐 Opus 4.8
- ▸$10 input / $50 output per MTok,为 Opus 4.8 的 2 倍
- ▸model ID 换成 claude-fable-5 即可迁移;注意 thinking 不能显式 disabled
GPT-5.6(Sol / Terra / Luna)受限预览
OpenAI 于 2026 年 6 月 26 日以三个档位向一小批获批合作伙伴通过 API 和 Codex 预览了 GPT-5.6。Sol 以 88.8% 领跑 Terminal-Bench 2.1;更大范围的发布将在「未来几周内」推出。
- ▸6 月 26 日预览:约 20 家获批合作伙伴(API 与 Codex)
- ▸Terminal-Bench 2.1:Sol 88.8% / Terra 84.3% / Luna 82.5%
- ▸2026-06 定价公布:Sol $5/$30 · Terra $2.5/$15 · Luna $1/$6(每 1M token)。官方定价页 2026-09-12 存档显示 gpt-5.6-sol 现价 $4 / $20(促销至少到 2026-11-21)。
- ▸后续:7 月 9 日已全面开放(见上方最新条目)
Claude Mythos 临近全量 — 官方确认「未来几周」面向所有人
Anthropic 于 2026-04-07 发布 Mythos Preview,并在 2026-05-28 确认 Mythos-class 模型将「未来几周」面向所有客户。当前仅受邀伙伴可用,完整规格与定价待公布。
- ▸已确认:2026-04-07 发布 Mythos Preview,最前沿通用模型
- ▸已确认:官方重点展示业界领先的安全研究能力
- ▸已确认:5-28 声明将「未来几周」面向所有客户
- ▸预测:业界据 Opus 4.8 节奏推测 GA 约在 6 月中–7 月底
Claude Opus 4.8 发布 — 更锐利的 Agentic 判断 + 代码缺陷 4× 更少
Anthropic 于 2026 年 5 月 28 日发布 Claude Opus 4.8,是 Opus 4.7 的直接升级版。Agentic 任务判断更锐利、更可靠,引入代码缺陷的概率比 4.7 低 4 倍,定价与 4.7 完全一致($5 / $25 per MTok),原生 1M context。接入只需把 model id 从 claude-opus-4-7 换成 claude-opus-4-8。
- ▸ 代码缺陷概率比 Opus 4.7 低 4 倍,agentic 任务更可靠
- ▸ Online-Mind2Web 84%,computer-use / 浏览器 agent 任务成功率领先
- ▸ 首个在 Legal Agent Benchmark 全通过标准上突破 10% 的模型
- ▸ 原生 1M context + 直接替换 claude-opus-4-7→claude-opus-4-8,已成 Claude Code Fast Mode 默认
Claude Opus 4.7 发布 — 编程 / 视觉 / Agentic 三维升级
Anthropic 于 2026 年 4 月 16 日发布 Claude Opus 4.7,是 Opus 4.6 的直接升级版。编程、视觉、长程任务三条主线同时进步,定价与 4.6 完全一致($5 / $25 per MTok)。
- ▸ SWE-bench Pro 64.3%,领先 GPT-5.4 和 Gemini 3.1 Pro
- ▸ 视觉分辨率 3.75 MP(约此前 3x),computer-use 场景质的飞跃
- ▸ 新 effort 档位 xhigh + /ultrareview 深度代码审查
- ▸ 原生 1M context、tokenizer 换代(同输入 token 1.0-1.35x)
Claude Managed Agents 公测上线
Anthropic 于2026年4月8日正式推出 Claude Managed Agents 公测,提供云端托管 Agent 基础设施,企业无需自建服务器即可部署生产级 AI Agent。Notion、Asana、Sentry、Rakuten 首批接入。
同期:Claude Cowork 桌面端 GA
ChatGPT Super App + GPT-5.5 发布
OpenAI 于2026年4月6日将 ChatGPT、Codex CLI、Atlas 浏览器三合一,发布 ChatGPT Super App。同步推出 GPT-5.5,融合前代顶级编程能力,桌面应用同日上线 macOS 与 Windows。
Voice Mode 语音编程 & Codex CLI v0.104
Claude Code 推出 Voice Mode 语音编程功能,支持 20 种语言;Opus 4.6 获得 1M(100 万)token 上下文窗口。同期 OpenAI Codex CLI 发布 v0.104 版本,基于 Rust 重写。
同期:OpenAI Codex CLI v0.104
Claude Opus 4.6 — 新一代旗舰模型
Anthropic于2月5日发布Claude Opus 4.6,在编码能力上实现显著提升。SWE-bench得分达到80.8%,领先竞品,搭载自适应思维(Adaptive Thinking)和 1M(100万)token 上下文。
Agent Teams — 多智能体协作开发
Claude Code 2.0引入Agent Teams功能,支持多个AI Agent并行协作处理复杂开发任务。主Agent可将任务分配给子Agent,实现前端、后端、测试等工作的并行推进。
Claude Code 2.0 核心升级
Claude Code 2.0带来全面的功能升级,包括定时任务(Cron)、语音模式(Voice Mode)、Plugins生态系统等,进一步巩固其作为最强CLI编程工具的地位。
定时任务 (Cron/Scheduled Tasks)
语音模式 (Voice Mode)
Plugins 生态系统与 HTTP Hooks
Codex Desktop — 从CLI到桌面端
OpenAI推出Codex Desktop App桌面应用,将Codex编程助手从终端带入图形界面。支持macOS和Windows,提供更直观的代码编辑和项目管理体验。QCode已全面支持Codex系列模型。
Sonnet 4.6 — 性价比之王
Anthropic于2月17日发布Sonnet 4.6,SWE-bench达79.6%,数学准确率从62%飙升至89%,Computer Use准确率94%。以$3/$15的平价定位,成为70%开发者日常首选。
GPT-5.4 — 原生Computer Use
OpenAI于3月5日发布GPT-5.4,首个原生支持Computer Use的通用模型。OSWorld达到75%超越人类基线,Tool Search节省47% token。GPT-5.4 Pro版支持922K+128K超长上下文。
AI安全 — Codex Security与Claude Code Security
2026年3月,AI安全能力成为编程工具新焦点。OpenAI发布Codex Security(3月6日),Anthropic推出Claude Code Security,两大平台同步进入AI驱动的代码安全领域。
AI编程市场数据
AI辅助编程市场正在经历爆发式增长,以下是2026年3月最新数据
$8.14B
2025年全球市场规模
$127B
2032年预测规模
92%
开发者AI工具采用率(2026)
1M
主流模型最大上下文窗口
2026年AI编程趋势展望
多Agent协作成为标配
从单Agent到多Agent协作,AI编程工具正在从「助手」进化为「开发团队」。Agent Teams等功能将重塑软件开发流程。Cursor已支持8个并行Agent。
超长上下文驱动全局理解
Claude和GPT-5.4均达到 1M(100万)token 上下文窗口,AI能够完整理解大型代码库,实现更精准的跨文件修改和架构级重构。
Computer Use原生支持普及
GPT-5.4和Claude Sonnet 4.6均原生支持Computer Use,AI从「写代码」进化为「操作电脑」,自动化能力质变。OSWorld基准双双超越人类。
AI安全成为核心能力
Codex Security和Claude Code Security的同步发布标志着AI安全从可选附加功能变为标配。2026年企业采购AI编程工具时,安全能力已成为关键评估维度。