价格追踪 · 截至 2026-10-07

1M 长上下文价格对比 2026:谁加价、从哪儿开始加

截至 2026-10-07,Anthropic 定价页写明 1M 上下文按标准价计费:Claude Opus 5.5 与 Sonnet 5.5 的 900K token 请求和 9K token 请求单价相同。OpenAI 的 GPT-6 Sol 与 GPT-6.1 Sol 在输入超过 272K 时整单按 2 倍输入与缓存价、1.5 倍输出价计;xAI 的 Grok 4.7 在 prompt 达到 200K 时,请求里所有 token 改按高价档;DeepSeek V4.1 Flash 的官方价表未列出长上下文附加档(截至 2026-10-07),只列高峰与非高峰两档价。下面附三个按官方价表换算的算例。

更新于 2026-10-07

#1M 上下文#272K 门槛#200K 门槛#长上下文加价

四个关键数字

标准价

Claude 的 1M 上下文

官方定价页:Claude 4.6 及之后的模型以标准价提供完整 1M 上下文,900K token 的请求与 9K token 的请求按同一单价计。Opus 5.5 为输入 $4 / 输出 $20,Sonnet 5.5 为 $2 / $10。

>272K

GPT-6 Sol 与 GPT-6.1 Sol 的门槛

输入超过 272K,整单按 2x 输入与缓存价、1.5x 输出价计:GPT-6.1 Sol 从 $2 / $10 变成 $4 / $15。

≥200K

Grok 4.7 的门槛

prompt 达到 200K,请求里所有 token 按高价档计:$2 / $6 变成 $4 / $12。Grok 4.7 的上下文是 500K,不是 1M。

$0.3 / $1.2

DeepSeek V4.1 Flash 高峰价

上下文 1M;未命中缓存的输入与输出每百万 token 高峰 $0.3 / $1.2,非高峰减半为 $0.15 / $0.6。官方价表未列出长上下文附加档(截至 2026-10-07)。

四家官方价表怎么写长上下文

截至 2026-10-07,四家官方页面对长上下文计价的写法分三类。第一类写明不加价:Anthropic 定价页写明 Claude 4.6 及之后的模型以标准价提供完整 1M 上下文;上下文窗口文档把 Opus 5.5 与 Sonnet 5.5 列为 1M 模型,并写明 1M 是默认值、不需要 beta header、长上下文请求按标准价计费。第二类写明过门槛整单加价:OpenAI 的 GPT-6 Sol 与 GPT-6.1 Sol 门槛是输入超过 272K,xAI 的 Grok 4.7 门槛是 prompt 达到 200K;过了门槛不是只对超出的部分加价,而是整单所有 token 都换到高价档。第三类是官方价表未列出长上下文附加档:DeepSeek V4.1 Flash 上下文 1M,价表只列高峰与非高峰两档价,官方写的计费公式是 token 数 × 单价。

9 月以来的价表变化

2026-09-29,OpenAI changelog 发布 GPT-6.1 Sol,写明 272K 输入以内的标准价是输入 $2、缓存读 $0.10、缓存写 $2.50、输出 $10;模型页上「超过 272K 整单加价」那条规则,与 2026-09-22 发布的 GPT-6 Sol 一字不差。Anthropic 在 2026-09-22 与 2026-09-28 先后发布 Opus 5.5 与 Sonnet 5.5,两者都是 1M 上下文、单次最多 128K 输出。xAI 的 release notes 写 Grok 4.7 上下文 500K,200K prompt token 以下 $2 / $0.50 / $6,以上 $4 / $1 / $12。DeepSeek 在 2026-09-10 发布 V4.1 Flash 并相应下调 API 价格;高峰与非高峰两档价则自 2026-08-16 16:00(UTC)起生效。

时间线

2026-09-10

DeepSeek 发布 V4.1 Flash,上下文 1M,API 价格随之下调,仍按高峰与非高峰两档计价。

2026-09-22

Claude Opus 5.5 与 GPT-6 Sol 同日发布:前者 1M 上下文按标准价,后者输入超过 272K 整单按高价档。

2026-09-29

GPT-6.1 Sol 发布:272K 以内输入 $2 / 输出 $10,超过 272K 变成 $4 / $15,缓存读从 $0.10 变成 $0.20。

已确认 vs 官方没写清的

已确认(官方页逐字可核)

以下都能在官方页面逐字核到:Claude 4.6 及之后的模型 1M 上下文按标准价,900K 与 9K 请求同一单价,缓存与 Batch 折扣在整个窗口内照常适用;Opus 5.5 $4 / $20、Sonnet 5.5 $2 / $10,Batch 分别为 $2 / $10 与 $1 / $5;GPT-6 Sol 与 GPT-6.1 Sol 输入超过 272K 时整单 2x 输入与缓存、1.5x 输出,两者上下文窗口 1,050,000、最大输入 922,000;Grok 4.7 上下文 500K,200K 前后两行价;DeepSeek V4.1 Flash 上下文 1M、高峰与非高峰价、高峰时段。各算例的总额是我们按官方价表换算的,不是厂商公布的数字。

官方没写清的

三处官方没写清,本页不替厂商下结论:① OpenAI 没有写明 272K 是否恰好指 272,000 token,也没单独说明缓存命中的 token 是否计入门槛,所以本页算例用 270,000 与 280,000,刻意避开边界;② xAI 价表写 ≥ 200k、脚注写 reaches,release notes 写 above,Fast 一节写 exceeds,刚好 200K 的请求落在哪一档,以实际扣费为准;③ DeepSeek 官方价表未列出长上下文附加档(截至 2026-10-07),本页算例按价表单价换算;同页写明 DeepSeek 保留调价的权利。

怎么选:先看输入通常落在哪一段

输入多在 200K 到 272K 之间

这一段 Grok 4.7 已进高价档,GPT-6 Sol 与 GPT-6.1 Sol 还在标准档,Claude 官方写明按标准价,DeepSeek 官方价表未列出长上下文附加档。按官方价表换算一次 250,000 输入 + 8,000 输出:Sonnet 5.5 与 GPT-6.1 Sol 都是 $0.58,Opus 5.5 $1.16,Grok 4.7 $1.096,DeepSeek V4.1 Flash 高峰 $0.0846。

输入常超过 272K

过了 272K,OpenAI 也换到高价档;Claude 官方写明仍按标准价,DeepSeek 官方价表未列出长上下文附加档,算例按其价表单价换算。按官方价表换算一次 400,000 输入 + 8,000 输出:Sonnet 5.5 $0.88,Opus 5.5 $1.76,GPT-6.1 Sol $1.72,Grok 4.7 $1.696,DeepSeek V4.1 Flash 高峰 $0.1296、非高峰 $0.0648。这时 GPT-6.1 Sol 的输入单价($4)已与 Opus 5.5 持平。

三个可复算的算例

全部按官方价表换算。① 400,000 输入 + 8,000 输出(输入都未命中缓存):Sonnet 5.5 = 0.4 × $2 + 0.008 × $10 = $0.88;Opus 5.5 = 0.4 × $4 + 0.008 × $20 = $1.76;GPT-6.1 Sol 与 GPT-6 Sol 按长上下文档 = 0.4 × $4 + 0.008 × $15 = $1.72;Grok 4.7 按 200K 以上档 = 0.4 × $4 + 0.008 × $12 = $1.696;DeepSeek V4.1 Flash 高峰 = 0.4 × $0.3 + 0.008 × $1.2 = $0.1296,非高峰 $0.0648。② GPT-6.1 Sol 的 272K 门槛:270,000 输入 + 8,000 输出 = 0.27 × $2 + 0.008 × $10 = $0.62;280,000 输入 + 8,000 输出 = 0.28 × $4 + 0.008 × $15 = $1.24,只多 10,000 输入,账单翻倍;同样两单放在 Sonnet 5.5 上是 $0.62 与 $0.64。③ Grok 4.7 的 200K 门槛:250,000 输入 + 8,000 输出 = 0.25 × $4 + 0.008 × $12 = $1.096,若按 200K 以下档会是 $0.548。以上都不含 Batch、缓存与区域加价。

在 QCode 上

QCode 按 token 计费,各模型单价见 /models。本页涉及的模型里,claude-opus-5-5、claude-sonnet-5-5、gpt-6.1-sol、gpt-6-sol 与 deepseek-v4.1-flash 可以用同一把 key 调用,Grok 4.7 不在其中。本页算例只按各家官方价表换算,不是 QCode 的报价,也不代表 QCode 的计费方式。

常见问题

Claude Opus 5.5 和 Sonnet 5.5 用满 1M 上下文要加价吗?

不加价。官方定价页对 Claude 4.6 及之后的模型写的是 include the full 1M token context window at standard pricing,并举例 900K token 的请求与 9K token 的请求按同一单价计费;上下文窗口文档也写明 1M 是默认值,不需要 beta header,长上下文请求按标准价计费。缓存与 Batch 折扣在整个窗口内照常适用;不论请求长短,Opus 5.5 的标准价都是 $4 / $20,Sonnet 5.5 都是 $2 / $10。

GPT-6.1 Sol 超过 272K,是只对超出的部分加价吗?

不是,是整单。模型页原句:Prompts with more than 272K input tokens are priced at 2x input and cache rates and 1.5x output for the full request。按官方价表,GPT-6.1 Sol 在 272K 以内是输入 $2、缓存读 $0.10、缓存写 $2.50、输出 $10,超过 272K 是 $4、$0.20、$5、$15;GPT-6 Sol 只有缓存读不同($0.20 与 $0.40)。两者上下文窗口都是 1,050,000,最大输入 922,000 token。

Grok 4.7 支持 1M 上下文吗?超过 200K 怎么算?

不支持,xAI 价表里 Grok 4.7 的上下文是 500K。价格分两行:prompt 低于 200K 时输入 $2、缓存输入 $0.50、输出 $6;达到 200K 时是 $4、$1、$12,脚注写明这时请求里的所有 token 都按高价计。xAI 价表里标 1M 上下文的是 grok-4.3 与 grok-4.20 系列,它们 200K 以上那一行同样是 200K 以下的两倍(如 grok-4.3 从 $1.25 / $2.50 到 $2.50 / $5.00)。

DeepSeek V4.1 Flash 的 1M 上下文怎么收费?

官方价表未列出长上下文附加档(截至 2026-10-07),只列高峰与非高峰两档价。V4.1 Flash(API 模型名 deepseek-flash)上下文 1M,每百万 token:缓存命中的输入高峰 $0.006、非高峰 $0.003;未命中的输入高峰 $0.3、非高峰 $0.15;输出高峰 $1.2、非高峰 $0.6。高峰时段是 UTC 周一至周五 01:00–04:00 与 06:00–10:00(中国法定节假日除外),其余时间,包括周末与中国法定节假日全天,都按非高峰计。

Batch 和区域端点会和长上下文价叠加吗?

各家写法不同。Anthropic 写明缓存与 Batch 折扣在整个上下文窗口内照常适用,Batch 价 Opus 5.5 为 $2 / $10、Sonnet 5.5 为 $1 / $5;用 inference_geo 指定仅在美国推理时,所有 token 类别乘 1.1。OpenAI 的 Batch 价表里 GPT-6.1 Sol 超过 272K 那一档是输入 $2、输出 $7.50,区域处理在可用处加 10%。xAI 的 Batch 折扣名单里没有 Grok 4.7(名单外的模型没有 Batch 折扣);美国区域端点按 1.1x 计且包含长上下文档,Grok 4.7 在 200K 以上是 $4.40 / $1.10 / $13.20。DeepSeek 官方价表未列出 Batch 与区域价(截至 2026-10-07)。

这些模型能在 QCode 上调吗?

claude-opus-5-5、claude-sonnet-5-5、gpt-6.1-sol、gpt-6-sol 与 deepseek-v4.1-flash 可以用同一把 key 调用,Grok 4.7 不行。QCode 按 token 计费,各模型单价见 /models;本页的数字都是按各家官方价表换算的,不是 QCode 的报价。

信息来源

Anthropic:官方定价页(模型价表、长上下文计价、Batch 与数据驻留价)、上下文窗口文档、模型总览,以及 Opus 5.5 与 Sonnet 5.5 的模型页(发布日期)。OpenAI:开发者文档定价页(Standard 与 Batch 价表、短长上下文的定义)、GPT-6.1 Sol 与 GPT-6 Sol 模型页(272K 规则、上下文窗口与最大输入)、API changelog(发布日期与 272K 以内标准价)。xAI:文档的 Models 页、Pricing 页(Batch、美国区域端点与 Fast 几节)与 Release Notes。DeepSeek:API 文档的 Models & Pricing 页与 Change Log。以上均于 2026-10-07 抓取。

同一把 key,换 model 自己比

QCode 按 token 计费,各模型单价见 /models;claude-sonnet-5-5、gpt-6.1-sol 与 deepseek-v4.1-flash 都能用同一把 key 调用。

相关阅读

本页数字与原句核对于 2026-10-07,以各家官方页面为准,各家调价可能不另行通知。所有「一次请求多少钱」都是按官方价表换算的结果,不是报价,也不是承诺。模型可用性以 /models 为准。

先体验,再决定

不确定选哪档?先买体验版(¥60/月),满意再升级,旧套餐剩余价值按比例退回余额。