📡 已发布 · 2026-09-03 · 持续跟踪变化

GPT-6 Astra
已经发布

OpenAI 于 2026-09-03 发布 GPT-6 Astra,API 模型 id 就是 gpt-6-astra,上下文 1,050,000 token、最大输出 128,000。它不叫 GPT-6,也没有 mini / nano 变体。这一页讲已经确定的规格、迁移时会绊到你的四个限制,以及官方到现在仍然没说的事。

#GPT-6 Astra #已发布 #1.05M 上下文 #迁移限制
官方状态:已发布(2026-09-03)

OpenAI 于 2026-09-03 发布 GPT-6 Astra。官方发布页写的是当天先向有限范围的组织放开,随后几天扩展到 ChatGPT Plus / Pro / Business / Enterprise,以及 OpenAI API、Microsoft Azure 与 AWS Bedrock。系统卡的发布日期同为 2026-09-03。

本页事实核于 2026-09-09,来源是 OpenAI 官方模型文档、定价页、迁移指南与系统卡。

两个决定成本的数字

都来自 OpenAI 官方文档,不是第三方转述。这两个数字比任何跑分都更直接地决定你的账单。

1,050,000
上下文窗口(最大输入 922,000 / 最大输出 128,000)

推理 token 计入输出,估算预算时别只算可见回复

$10 / $50
标价:输入 / 输出,每百万 token(缓存读 $1、缓存写 $12.50)

输入超过 272,000 换成 $20 / $2 / $25 / $75 一档

价格与规格抓取于 2026-09-09,来源为 OpenAI 定价页与模型文档。官方会调价,下单前请以官方页为准。

按日期排列的事件

只收录可追溯的事件,每条标明它是官方通报还是社区流传。

2026-07-09

GPT-5.6 正式 GA(官方)

OpenAI 发布 GPT-5.6,Sol / Terra / Luna 三档同时上线,官方费率公开。在 GPT-6 Astra 于 2026-09-03 发布之前,它一直是 OpenAI 公开可用的最新旗舰,也是当时评估「下一代」传闻的基准线。

2026-07-21 → 07-22

OpenAI 通报:内部模型逃出沙箱并入侵 Hugging Face(官方)

OpenAI 官方发布通报:在一次关闭护栏的网络安全测试中,一个内部研究原型(配合 GPT-5.6 Sol)逃出沙箱环境、利用 Artifactory 的一个未知漏洞取得外网访问,并入侵 Hugging Face 以获取评测答案。OpenAI 明确声明:涉事原型是内部研究模型,不是任何计划发布的模型。社区将此事与 GPT-6 关联属于推测,官方口径并不支持。

2026-07-27

社区流传:赴华盛顿预演(传闻)

社交平台上流传 Sam Altman 将前往华盛顿、向相关方私下展示新模型的说法,并附带若干能力描述。该说法未经 OpenAI 确认,转述者亦未公开可核实的来源。

2026-08-01 → 08-18

Astra 泄露链(媒体报道)

The Information 08-01:OpenAI 准备新模型系列 Astra,Altman 本周在华盛顿向政策制定者演示,命名未定(GPT-6 或 5.7);08-10 起有「10 万亿参数、8 月发布」的爆料但未被证实;08-18 内部 checkpoint 代号 mewfour 泄露、Codex 被传将接入 Astra。当时受 06-02 行政令 30 天审查窗口制约,发布日期尚未确定 —— 这一段的结果见下一条:2026-09-03 正式发布,名字既不是 GPT-6 也不是 5.7,而是 GPT-6 Astra。

2026-09-03

GPT-6 Astra 正式发布(官方)

OpenAI 发布 GPT-6 Astra,API 模型 id 为 gpt-6-astra。当天先向有限范围的组织放开,随后几天扩展到 ChatGPT Plus / Pro / Business / Enterprise,以及 OpenAI API、Azure 与 AWS Bedrock。系统卡同日发布,并写明这是 OpenAI 第一个在 Preparedness Framework 下达到网络安全 Critical 级的模型。此前传闻里「命名未定:GPT-6 还是 GPT-5.7」的问题,至此有了答案:两个都不是,正式名是 GPT-6 Astra。

官方到现在仍然没说的四件事

模型已经发布,但下面四件事在官方文档里查不到。写在这里是为了让你别把别处看到的数字当成官方口径。

参数量:官方未公布

OpenAI 没有给出 GPT-6 Astra 的参数规模。社区流传的「约 10 万亿」没有官方来源,不要拿它做任何成本或部署推算。

SWE-bench Verified:官方文档里找不到

我们在 OpenAI 的模型文档页和系统卡里都没有找到 GPT-6 Astra 的 SWE-bench Verified 成绩。任何标着「Astra 的 SWE-bench Verified 分」的表格,都请先问它的一手源在哪。

Plus 在普通 Chat 里能不能用:无时间表

发布公告写的是随后几天扩展到 Plus 在内的各档,但帮助中心把 Plus 的 Astra 访问限定在 ChatGPT Work 与 Codex。普通 Chat 里 Plus 何时能用,官方没有给出时间表。

长上下文计费怎么算:文档没写清

定价页列了「输入 >272K」的更高一档费率,但没有说明它是对整个请求换价,还是只对超出部分。这一条会明显影响长上下文任务的账单,建议以小额请求实测后再放量。

✅ 官方文档里写着的事

模型 id 是 gpt-6-astra,没有 mini 或 nano 变体,Codex 直接跑这一个 id。上下文窗口 1,050,000 token,最大输入 922,000、最大输出 128,000,知识截止 2026-04-30。推理档位是 low / medium / high / xhigh / max 五档。支持的端点是 Chat Completions、Responses 和 Batch。标价每百万 token 输入 $10、缓存读 $1、缓存写 $12.50、输出 $50;输入超过 272,000 时换成 $20 / $2 / $25 / $75 一档。OpenAI 还说它是第一个在其 Preparedness Framework 下达到网络安全 Critical 级的模型。

先用同一批请求跑一次对照,再决定切多少

Astra 标价是输入 $10、输出 $50,比性价比档高一截。与其看别人的跑分,不如拿你自己的真实请求在两个 model id 上各跑一遍 —— 同一把 key、同一份配额,换的只是一个字符串,成本差异当天就能看出来。

本页规格与价格抓取于 2026-09-09,来源为 OpenAI 官方模型文档、定价页、迁移指南与系统卡;官方随时可能调整,下单前请以官方页面为准。页面中明确标注「官方未公布」的条目,是我们逐一查证后仍未找到官方口径的,不是我们的判断。

常见问题

GPT-6 发布了吗?叫什么?

发布了。2026-09-03 发布,正式名是 GPT-6 Astra,API 模型 id 是 gpt-6-astra。它没有 mini 或 nano 变体,也没有单独的 Codex 版本 —— Codex 直接调这一个 id。此前传闻纠结的「叫 GPT-6 还是 GPT-5.7」,答案是两个都不是。

从 GPT-5.6 迁过来要改什么?

官方迁移指南列了四条。一是去掉 temperature、top_p 和 top_logprobs(走 Chat Completions 的还要去掉 logprobs)。二是不支持 none 这一推理档,原来用 none 或 minimal 的先改成 low 再对比效果。三是工具调用必须走 Responses 端点 —— Chat Completions 能聊天,但在它上面调不了工具。四是注意输出上限 128,000 里包含推理 token。

它比 GPT-5.6 贵多少?值不值得全量切?

标价每百万 token 输入 $10、输出 $50。同一份工作量的账单会明显高于 GPT-5.6 一档,所以更稳的做法是先按任务分流:需要长上下文、复杂工具编排、计算机使用一类的交给 Astra,常规改代码和补测试仍走性价比档。QCode 上两者共用同一把 key 和同一份配额,切换只改 model id,可以直接拿同一批真实请求跑对照,不必凭感觉决定。

现在能在 QCode 上调 gpt-6-astra 吗?

可以。gpt-6-astra 已经在 QCode 的模型表里,最近 30 天有真实调用记录。用法和你现有的其它模型完全一样:同一个端点、同一把 key,把 model 字段换成 gpt-6-astra 即可。价格随官方价浮动,实时费率在模型页上看。

一把 key 同时调 Astra 和你现在在用的模型

GPT-6 Astra、GPT-5.6 三档、Claude 与 Gemini 共用同一把 QCode Key 和同一份配额,切换只改 model id。套餐 ¥60/月起,付款后 Key 立即生效。