价格追踪 · 截至 2026-10-07

2026 提示词缓存价格:Claude、GPT、DeepSeek 怎么收、怎么省

截至 2026-10-07,Claude Opus 5.5 与 Sonnet 5.5 的缓存读都是每百万 token $0.20,5 分钟缓存写按基础输入价 1.25 倍($5 / $2.50),1 小时缓存写按 2 倍($8 / $4);GPT-6.1 Sol 缓存输入 $0.10、GPT-6 Sol $0.20,两者缓存写都是 $2.50;DeepSeek-V4-Pro 缓存命中闲时 $0.022、忙时 $0.044。本页把三家的计价规则、TTL 与最小缓存长度放在一起,并给出两个按官方价表换算的算例。

更新于 2026-10-07

#缓存读 $0.20#1 小时缓存写#GPT-6.1 Sol $0.10#DeepSeek 缓存命中

四个先记住的数

$0.20

Opus 5.5 / Sonnet 5.5 缓存读(每百万 token)

两者同为 $0.20。官方价表脚注写明 Opus 5.5 的缓存命中与刷新按基础输入价 0.05 倍计($4 的 5%),Sonnet 5.5 用标准的 0.1 倍($2 的 10%)。

1.25× / 2×

Claude 缓存写:5 分钟 / 1 小时

官方倍率表:5 分钟缓存写是基础输入价的 1.25 倍,1 小时是 2 倍。落到单价:Opus 5.5 是 $5 / $8,Sonnet 5.5 是 $2.50 / $4。

$0.10 / $0.20

GPT-6.1 Sol / GPT-6 Sol 缓存输入

输入不超过 272K token 时的标准价。两者输入都是 $2、缓存写都是 $2.50(1.25 倍);缓存输入在 GPT-6.1 Sol 上是未缓存价的 5%,在 GPT-6 Sol 上是 10%。

$0.022 / $0.044

DeepSeek-V4-Pro 缓存命中:闲时 / 忙时

官方价表把输入分成缓存命中与未命中两档,未命中是 $0.66 / $1.32。DeepSeek-V4.1-Flash 的命中价是 $0.003 / $0.006。

缓存是怎么计费的

截至 2026-10-07,三家的提示词缓存都是「重复的前缀命中缓存后,这部分 token 按折扣价计」,差别在有没有写入加价、读取折扣多大和缓存能活多久。Anthropic:默认缓存寿命 5 分钟,每次命中都会刷新寿命且不另收费;也可以选 1 小时,写入价从基础输入价的 1.25 倍升到 2 倍。官方自己的算法是:5 分钟档读一次就回本,1 小时档读两次回本。OpenAI:官方写明提示词缓存对支持的模型默认开启;GPT-5.6 及以后的模型缓存写是未缓存输入价的 1.25 倍,读取在多数模型上是 0.1 倍、GPT-6.1 Sol 上是 0.05 倍。写入价不是额外附加费,一个输入 token 只按未缓存、缓存读、缓存写三者之一计。DeepSeek:官方称硬盘缓存对所有用户默认开启、不用改代码,价表直接按缓存命中与未命中两档收费。

官方口径:Opus 5.5 与 GPT-6.1 Sol 缓存读只要 0.05 倍

眼下 Anthropic 与 OpenAI 都有模型的缓存读倍率低于常规的 0.1 倍。Anthropic 价表脚注写明 Opus 5.5 的缓存命中与刷新按基础输入价 0.05 倍计,即输入 $4、缓存读 $0.20;其余多数模型是标准 0.1 倍,Fable 5.1 是 0.025 倍。OpenAI 的缓存指南写明,GPT-5.6 及以后的模型缓存写是未缓存输入价的 1.25 倍,读取多数是 0.1 倍、GPT-6.1 Sol 是 0.05 倍;更早的模型在官方对照表里写的是不另收缓存写入费。DeepSeek 的价表则只分缓存命中与未命中两档输入价。

与缓存价相关的三个日期

2026-09-22

Claude Opus 5.5 发布,标价 $4 / $20(现行价表缓存读 $0.20);同一天 OpenAI 发布 GPT-6 Sol,输入不超过 272K token 时标准价为输入 $2、缓存输入 $0.20、输出 $10。

2026-09-28

Claude Sonnet 5.5 发布;现行价表这一行是输入 $2、5 分钟缓存写 $2.50、1 小时缓存写 $4、缓存读 $0.20、输出 $10。

2026-09-29

OpenAI 发布 GPT-6.1 Sol:输入不超过 272K token 时输入 $2、缓存输入 $0.10、缓存写 $2.50、输出 $10,缓存输入是未缓存价的 5%。

已确认 vs 没有核实到的

已确认(官方页逐字可核)

以下各项都能在官方文档与价表里逐字核到:Opus 5.5 与 Sonnet 5.5 的缓存读 $0.20、5 分钟写 $5 与 $2.50、1 小时写 $8 与 $4;Opus 5.5 缓存读 0.05 倍;Claude 默认缓存寿命 5 分钟,寿命从请求开始时算起;Opus 5.5 与 Sonnet 5.5 最小可缓存长度 512 token、Sonnet 5 是 1,024 token,不够长时直接不缓存、也不报错;GPT-6.1 Sol 缓存输入 $0.10、GPT-6 Sol $0.20,缓存写都是 $2.50;GPT-5.6 及以后最小可缓存 1,024 token、缓存寿命至少 30 分钟;输入超过 272K token 时,GPT-6 Sol 与 GPT-6.1 Sol 整单的输入与缓存价按 2 倍、输出按 1.5 倍;DeepSeek-V4-Pro 与 DeepSeek-V4.1-Flash 的命中与未命中价及忙时时段。本页两个算例是按这些官方价换算的,不是实测账单。

未证实与官方未公布

三件事没有核实到,别按它们做预算:① DeepSeek 没有公布固定的缓存寿命,官方只说缓存按 best-effort 工作、不保证命中率,不再使用后通常在几小时到几天内清除;② OpenAI 官方称缓存输入最多便宜 95%,文档里示例部署的命中率约 70% 与 90% 以上,这些是厂商举例,不是对你工作负载的承诺;③ 网上流传的各家「实测缓存命中率」截图与对比数字,一手源里没有,本页一律不写。

两个可复算的算例

算例一:编程代理长会话,100K 前缀重复 20 轮

按官方价表换算,输入写死:100K token 的固定前缀(系统提示词、工具定义、项目上下文),连续 20 轮、每轮间隔都不到 5 分钟,只算这 100K 前缀,不含每轮新增内容与输出。Sonnet 5.5:不缓存 20 × 0.1M × $2 = $4.00;缓存后 1 次 5 分钟写 $0.25 加 19 次读 19 × $0.02 = $0.38,共 $0.63。Opus 5.5:$8.00 对 $0.88(写 $0.50 + 读 $0.38)。GPT-6 Sol:$4.00 对 $0.63;GPT-6.1 Sol:$4.00 对 $0.44(写 $0.25 + 读 19 × $0.01)。跨厂商比较时注意:上面按相同 token 数换算,但同一段文本在各家模型上的 token 数不一定相同;例如 Anthropic 价表称,Claude 4.7 及以后的新分词器对同样文本比旧分词器约多出 30% token,具体随内容而变。

算例二:5 分钟还是 1 小时 TTL

按官方价表换算,输入写死:Sonnet 5.5,100K 前缀,6 轮,每轮间隔 10 分钟。不缓存 6 × $0.20 = $1.20;5 分钟档每轮都已过期、重新写入,6 × $0.25 = $1.50,比不缓存还贵;1 小时档写一次 $0.40 加 5 次读 $0.10,共 $0.50。同样条件下 Opus 5.5 分别是 $2.40、$3.00、$0.90。官方建议:调用间隔一直短于 5 分钟就继续用 5 分钟档,因为每次命中都会不另收费地续期;间隔在 5 分钟到 1 小时之间才换 1 小时档。作为对照,OpenAI GPT-5.6 及以后的缓存前缀在最近一次写入或复用后至少 30 分钟内都可复用,10 分钟的间隔按官方规则仍在复用期内。

怎么开、怎么省:五步

① Claude API:在请求顶层加一个 cache_control 就是自动缓存,系统把断点放在最后一个可缓存块上,并随对话增长前移;要 1 小时就在 cache_control 里把 ttl 设为 1h,一个提示词最多 4 个断点。② 排顺序:缓存前缀按 tools、system、messages 的顺序计算,哪一层改了,这一层和后面全部失效,所以把不变的工具定义、系统提示词、长文档放最前,时间戳等易变内容放最后。③ Claude Code:用 API key 时主对话默认 5 分钟 TTL;官方文档写明可把 promptCacheTtl 设为 1h(或用环境变量 CLAUDE_CODE_PROMPT_CACHE_TTL),需要 Claude Code v2.1.242 及以上;用 /model 切换模型后,第一次请求会把整段对话按未缓存重读。④ OpenAI GPT-5.6 及以后:官方称开箱即用的隐式模式会把断点放在最近一条符合条件的消息末尾;显式模式下,最后一个断点之后的内容按未缓存价计、不收写入费,可以避免把每次都变的内容写进缓存。⑤ 看 usage 字段:Claude 看 cache_creation_input_tokens 与 cache_read_input_tokens,两者都为 0 就是没缓存上;OpenAI 看 usage.input_tokens_details.cached_tokens 与 cache_write_tokens;DeepSeek 看 prompt_cache_hit_tokens 与 prompt_cache_miss_tokens。

在 QCode 上

QCode 按 token 计费,各模型单价见 /models。本页列的是厂商官方价表上的数,用来理解缓存的计价结构和省钱做法;在 QCode 上实际怎么扣,以 /models 与控制台的模型调用明细为准。

常见问题

Claude 缓存读多少钱?

截至 2026-10-07,Claude Opus 5.5 与 Sonnet 5.5 的缓存读都是每百万 token $0.20。倍率不同:Opus 5.5 按基础输入价 0.05 倍($4 的 5%),Sonnet 5.5 按标准 0.1 倍($2 的 10%),Fable 5.1 是 0.025 倍($0.25)。官方价表里这一栏叫 Cache hits and refreshes,指从缓存读出前缀、同时刷新它的寿命。

Claude 1 小时缓存写入多少钱?值不值?

1 小时缓存写是基础输入价的 2 倍:每百万 token Sonnet 5.5 $4、Opus 5.5 $8(5 分钟档是 $2.50 与 $5)。官方按 0.1 倍读价的算法是:5 分钟档读一次就回本,1 小时档要读两次。按官方价表换算,Sonnet 5.5 上 100K 前缀每轮间隔 10 分钟跑 6 轮,1 小时档共 $0.50,5 分钟档因为每轮过期重写要 $1.50。调用间隔一直短于 5 分钟时,官方建议继续用 5 分钟档。

OpenAI 的缓存要手动开吗?写入收钱吗?

不用手动开:官方写明提示词缓存对支持的模型默认开启。GPT-5.6 及以后的模型收写入费,为未缓存输入价的 1.25 倍(GPT-6 Sol 与 GPT-6.1 Sol 都是 $2.50),但不是叠加费,一个输入 token 只按未缓存、缓存读、缓存写之一计。缓存寿命用 prompt_cache_options.ttl 控制,唯一可选值 30m 也是默认值;复用会刷新寿命,且不再收写入费。最小可缓存长度为 1,024 token。

DeepSeek 缓存命中多少钱?

截至 2026-10-07,官方价表每百万输入 token:DeepSeek-V4-Pro 命中闲时 $0.022、忙时 $0.044,未命中 $0.66 / $1.32;DeepSeek-V4.1-Flash(API 模型名 deepseek-flash)命中 $0.003 / $0.006,未命中 $0.15 / $0.3。忙时是周一至周五 UTC 01:00–04:00 与 06:00–10:00(中国法定节假日除外),闲时价是忙时的一半。按官方价表换算,V4-Pro 忙时 100K 前缀跑 20 轮:全部未命中 $2.64;首轮未命中、其后 19 轮命中为 $0.2156。

缓存命中算不算速率限制?

两家不一样。Anthropic 在 1 小时缓存的适用场景里写明 cache hits are not deducted against your rate limit,即缓存命中不扣速率限额;OpenAI 的常见问题写明,缓存输入 token 仍计入每分钟 token 限额,提示词缓存不改变速率限制的计算方式。

在 QCode 上缓存怎么计?

QCode 按 token 计费,各模型单价见 /models。本页的数字来自厂商官方价表。每次调用的模型、token 数量与费用,可以在控制台「使用统计」页的模型调用明细里核对。

信息来源

Claude 价格与缓存规则:Anthropic 官方定价页与 Prompt caching 文档(2026-10-07 抓取,含各模型缓存读写单价、倍率与脚注、TTL、最小可缓存长度、失效规则与 usage 字段);发布日期:Anthropic 官方发布说明。Claude Code 的 TTL 设置:Claude Code 官方文档的 prompt caching 页与费用管理页。OpenAI:官方定价页、GPT-6 Sol 与 GPT-6.1 Sol 模型页、Prompt caching 指南与 API 变更日志(同日抓取)。DeepSeek:官方 Models & Pricing 页与 Context Caching 指南(同日抓取)。QCode:docs.qcode.cc 的计费说明与费用优化文档。

按 token 计费,单价看 /models

QCode 按 token 计费,各模型单价见 /models。缓存怎么计价、怎么省,可以先看本页的官方价表与两个算例。

相关阅读

本页价格与规则核对于 2026-10-07,以 Anthropic、OpenAI、DeepSeek 官方页面为准,上游调整不另行通知。两个算例是按官方价表换算的示意,只计重复前缀的输入费用,不含新增内容与输出,也不是实测账单。厂商给出的折扣比例与示例命中率是厂商自述。模型可用性以 /models 为准。

先体验,再决定

不确定选哪档?先买体验版(¥60/月),满意再升级,旧套餐剩余价值按比例退回余额。