新模型已上线

Claude Opus 5 完全指南

与 Opus 4.8 同价、同上下文窗口,可以直接切换。真正的差别在提示缓存:门槛从 2048 token 降到 512,短系统提示和工具定义也能被缓存命中。

#Opus 5 #claude-opus-5 #Agentic 编码 #提示缓存 #长上下文 #平滑迁移
🟢
已上线,所有套餐可直接调用

claude-opus-5 与 claude-opus-5[1m] 均已开放,无需额外申请或加价。Opus 4.8 同时继续提供服务,两者定价与上下文窗口完全一致,可以按需来回切换。

关键参数

$5 / $25
每百万 token 价格

输入 $5、输出 $25,与 Opus 4.8 相同;QCode 服务费率 ×1.0

1M
输入上下文

100 万 token,使用 claude-opus-5[1m] 显式启用

512
提示缓存门槛

512 token 即可缓存,Opus 4.8 需要 2048

128K
最大输出

单次响应最多 12.8 万 token

与 Opus 4.8 到底差在哪

先说结论:价格、上下文窗口、支持的能力三项完全一致。唯一有实质区别的是提示缓存的最小长度。

价格与窗口:完全相同

输入 $5 / 输出 $25 每百万 token,缓存写入 $6.25、缓存读取 $0.50,输入 100 万 / 输出 12.8 万 token —— 两个型号逐项一致。所以切换不会带来任何账单意外,也不需要重新做成本测算。

提示缓存门槛:512 vs 2048

这是两者唯一的实质差异。提示缓存有一个最小长度,短于这个长度的内容不会被缓存。Opus 5 把门槛降到了 512 token,是 Opus 4.8 的四分之一。

claude-opus-5
512 tokens
claude-opus-4-8 / 4-7
2048 tokens

缓存单价两者相同(写入 $6.25、读取 $0.50 每百万 token);变的只是「多短的内容才值得缓存」这条线。对系统提示较短、但工具定义多、轮次密集的 agentic 工作流,这一条最容易被感知到。

能力集:一致

视觉输入、工具调用(function calling)、PDF 输入、computer use、提示缓存 —— 两个型号在模型能力表上的标记完全相同。也就是说,为 Opus 4.8 写的集成代码不需要任何改动。

怎么调用

在 Claude Code 里切换

会话中直接输入 /model 命令即可切换,不需要重启。

/model claude-opus-5

用环境变量指定默认模型

适合固定用某个型号的场景,写进 shell profile 即可长期生效。

ANTHROPIC_MODEL=claude-opus-5 claude

启用 100 万 token 上下文

带 [1m] 后缀的型号名用于显式请求长上下文窗口。

/model claude-opus-5[1m]

Claude 阵容怎么选

以下为官方挂牌价(每百万 token),QCode 的 Claude 服务费率为 ×1.0。

模型 输入 $/M 输出 $/M 上下文 / 输出 适合场景
claude-opus-5 $5.00 $25.00 1M / 128K 新旗舰;缓存门槛更低,适合工具多、轮次密的 agentic 流程
claude-opus-4-8 $5.00 $25.00 1M / 128K 同价同窗口的成熟选择,目前平台上仍是主力承载
claude-fable-5 $10.00 $50.00 1M / 128K 定价高于 Opus 的档位,面向长文与创意写作
claude-sonnet-5 $2.00 $10.00 1M / 128K 日常编码的性价比之选
claude-haiku-4-5 $1.00 $5.00 200K / 64K 格式化、简单问答、批量操作

价格数据来自 LiteLLM 模型价格库,与模型页同源、实时同步。完整清单见 模型与价格页

常见问题

Opus 5 和 Opus 4.8 应该用哪个?

两者同价同窗口,可以直接互换,不存在「用错了更贵」的问题。如果你的工作流是工具定义多、单轮内容偏短的 agentic 场景,Opus 5 更低的缓存门槛可能带来更好的缓存命中;其余场景两者可按习惯选择。Opus 4.8 并未下线,仍在正常提供服务。

从 Opus 4.8 迁过来要改代码吗?

不需要。两者的能力标记(视觉、工具调用、PDF、computer use、提示缓存)完全一致,只需要把模型名从 claude-opus-4-8 换成 claude-opus-5。定价相同,也不必重新估算成本。

对外可用的模型名有哪些?

claude-opus-5 和 claude-opus-5[1m] 两个。后者用于显式启用 100 万 token 输入窗口。请使用这两个名称,带日期后缀的写法不在开放范围内。

价格是多少?包含缓存吗?

输入 $5、输出 $25 每百万 token;提示缓存写入 $6.25、读取 $0.50 每百万 token。QCode 的 Claude 服务费率为 ×1.0,即按官方挂牌价计费。实时价格以模型页为准。

支持哪些能力?

视觉输入、工具调用(function calling)、PDF 输入、computer use、提示缓存,与 Opus 4.8 相同。

需要单独开通吗?

不需要。所有套餐都可以调用本页列出的全部模型,模型访问权限在各套餐之间没有差别,也不需要额外付费或提交申请。

在 QCode 上使用 Opus 5

一个 Key 三平台

同一个 API Key 在 Claude Code、OpenAI Codex CLI 与 Gemini 客户端之间通用,不必分别购买。

全部模型开放

所有套餐均可调用全部模型,不按套餐限制型号,也没有额外解锁费用。

价格与官方同源

模型单价取自 LiteLLM 价格库并持续同步,Claude 系服务费率 ×1.0。

国内直连

国内网络环境下可直接使用,无需自行处理网络问题。

现在就试试 Claude Opus 5

注册即可用同一个 Key 调用 Claude、Codex 与 Gemini 全部模型。