价格 · 规格 · 用法

Claude Haiku 5.5 完整指南:价格、规格与平台

截至 2026-10-08,Claude Haiku 5.5(模型 ID claude-haiku-5-5)已于 2026-10-07 发布:上下文 1M、最大输出 128K,价格按 prompt 长度分两档——prompt 不超过 100,000 token 时输入 $0.10 / 输出 $0.50 每百万 token,超过 100,000 token 时输入 $0.50 / 输出 $2.50。Anthropic 称它是面向大批量、对延迟敏感工作调校的能力最强的模型。本页把 ID、两档价表、适用场景、与 Haiku 4.5 的区别和平台可用性一次说清。

更新于 2026-10-08

#2026-10-07 发布#1M 上下文#按 prompt 长度两档价#claude-haiku-5-5

四个关键数字

2026-10-07

发布日期

官方模型页写明 Released October 7, 2026,Claude API 发布说明同日收录。状态为 Active,退役不早于 2027-10-07。

$0.10 / $0.50

输入 / 输出(prompt ≤100K,每百万 token)

prompt 不超过 100,000 token 时的单价;缓存读 $0.01,5 分钟缓存写 $0.125,1 小时缓存写 $0.20。

$0.50 / $2.50

输入 / 输出(prompt >100K)

prompt 超过 100,000 token 时,输入与输出都按这一档计:缓存读 $0.05,5 分钟缓存写 $0.625,1 小时缓存写 $1。

1M / 128K

上下文窗口 / 最大输出

Haiku 4.5 是 200K / 64K。输入支持文本与图片,输出为文本。

Haiku 5.5 是什么、适合做什么

截至 2026-10-08,Claude Haiku 5.5 是 Anthropic 于 2026-10-07 发布的 Haiku 级新模型,官方发布说明称它是「our most capable model tuned for high-volume and latency-sensitive work」。官方模型页列出的典型用途是分类、请求分派、信息抽取与子代理任务;发布页还写它能稳定处理摘要、上下文压缩、数据库查询与分类请求这类快速重复的工作,并适合在编程任务里给 Opus 5.5 与 Sonnet 5.5 当子代理。同一页也写明,复杂的 agentic 编程仍是 Sonnet 5.5 与 Opus 5.5 更合适。它是第一款带 effort 调节的 Haiku:默认 medium,思考默认开启。

官方口径(2026-10-07 发布)

发布页称 Haiku 5.5 比 Haiku 4.5 便宜得多:「On average, it now costs around 75% less to run」。脚注给出算法:prompt 不超过 100,000 token 的请求比 Haiku 4.5 便宜 90%,超过的便宜 50%,Haiku 4.5 上约 90% 的请求属于前者,且已计入新分词器多用 token 的影响——这是 Anthropic 自己的测算。官方价表页另写明,Claude 4.6 及之后的模型里只有 Haiku 5.5 按 prompt 长度分档,其余型号整个 1M 上下文都按标准价。面向终端用户:Free、Pro、Max、Team 与 Enterprise 用户可以在 Claude.ai 的网页、iOS 与 Android 上选用 Haiku 5.5,Claude Code 里也能用。

Haiku 5.5 时间线

2025-10-15

Claude Haiku 4.5 发布(模型 ID claude-haiku-4-5-20251001),上下文 200K、最大输出 64K。

2026-10-07

Claude Haiku 5.5 以 claude-haiku-5-5 发布:1M / 128K,按 prompt 长度两档计价。

2026-10-15

官方给 Haiku 4.5(claude-haiku-4-5-20251001)写的退役时间是「Not sooner than October 15, 2026」,即不早于这一天:这是下限,不是关停日。状态仍为 Active,实际退役以官方弃用页的公告为准。

已确认 vs 没有核实到的

已确认(官方页逐字可核)

以下都能在官方页逐字核到:2026-10-07 发布;模型 ID claude-haiku-5-5(固定 ID,无日期后缀、无单独 alias),Amazon Bedrock 上为 anthropic.claude-haiku-5-5;上下文 1M、最大输出 128K;两档价格(≤100K 输入 $0.10 / 输出 $0.50,>100K 输入 $0.50 / 输出 $2.50);缓存读 $0.01 / $0.05;Batch API 输入输出五折;默认 effort 为 medium;同样文本约多 30% token;手动 budget_tokens、非默认的 temperature / top_p / top_k、assistant 预填都返回 400;退役不早于 2027-10-07。「约便宜 75%」与适用场景是官方自述。

未证实与官方未公布

四件事官方页没写,别按猜测排计划:① 价表没说明 100,000 token 的门槛怎么计(例如是否包含缓存写入与缓存命中部分),本页不做推断,以你的 usage 数据对照官方价表为准;② 「约便宜 75%」是 Anthropic 按 Haiku 4.5 的请求分布自算的,你实际省多少取决于自己 prompt 长度的分布;③ 发布页里的跑分与客户评价是厂商自测与客户自述,本页一律不转录;④ QCode 是否、何时上架 claude-haiku-5-5 都没有公布,以 /models 为准。

和 Haiku 4.5、Sonnet 5.5 怎么比

对 Haiku 4.5

Haiku 4.5(claude-haiku-4-5-20251001)是输入 $1 / 输出 $5、上下文 200K、最大输出 64K。按官方价表换算:prompt 不超过 100,000 token 时,Haiku 5.5 的输入输出单价是 Haiku 4.5 的十分之一($0.10 / $0.50 对 $1 / $5);超过 100,000 token 时是一半($0.50 / $2.50 对 $1 / $5)。但官方写明同样文本在 Haiku 5.5 上约多 30% token,比成本前要用新模型重新计数。Haiku 5.5 还多了 effort 与自适应思考,上下文与输出上限扩到 1M 与 128K。

对 Sonnet 5.5

Sonnet 5.5(claude-sonnet-5-5)是 1M / 128K、输入 $2 / 输出 $10,不按 prompt 长度分档。按官方价表换算:prompt 不超过 100,000 token 时 Haiku 5.5 的单价是它的二十分之一,超过时是四分之一。官方的分工说法是:复杂的 agentic 编程 Sonnet 5.5 与 Opus 5.5 仍是更好的选择,Haiku 5.5 最适合范围较窄、以往用 Claude 做成本过高的任务,如上下文压缩、摘要或子代理工作。

从 Haiku 4.5 换过来要改的几处

官方发布说明写明「Code written for Claude Haiku 4.5 can break on Claude Haiku 5.5」。迁移指南的要点:① model 改为 claude-haiku-5-5(Bedrock 上为 anthropic.claude-haiku-5-5);② 用新模型重新计数 prompt,复查 max_tokens 与成本估算——同样文本约多 30% token,思考 token 也计入 max_tokens;③ 把 thinking 的 enabled 加 budget_tokens 换成 adaptive,用 effort 控制思考深浅(关思考只在 low、medium、high 三档可行,xhigh 与 max 会返回 400);④ 去掉 temperature、top_p、top_k,非默认值返回 400;⑤ messages 以 user 轮结尾,assistant 预填即使关了思考也返回 400;⑥ 按 type 选内容块,因为回复可能以 thinking 块开头。

在 QCode 上

QCode 是否上架 claude-haiku-5-5 以 /models 为准。目前可以用 /models 里在售的 claude-haiku-4-5-20251001 或 claude-sonnet-5-5:用你的 QCode API Key,把 Anthropic 协议的接口地址填成 https://api.qcode.cc/api(Claude Code 的 ANTHROPIC_BASE_URL 填同一值),model 填对应 ID。QCode 文档写明 Claude 模型只能走 Anthropic 协议的端点,不能走 OpenAI 兼容端点。按 token 计费,各模型单价见 /models。若日后 /models 列出 claude-haiku-5-5,切换前先按上一节处理约 30% 的 token 差异与破坏性变更。

常见问题

Claude Haiku 5.5 什么时候发布的?

2026-10-07。官方模型页写明 Released October 7, 2026,Claude API 发布说明与 Anthropic 发布页同日上线;状态为 Active,退役不早于 2027-10-07。

Claude Haiku 5.5 多少钱?

按 prompt 长度分两档。prompt 不超过 100,000 token:输入 $0.10、输出 $0.50、缓存读 $0.01、5 分钟缓存写 $0.125、1 小时缓存写 $0.20(每百万 token)。超过 100,000 token:输入 $0.50、输出 $2.50、缓存读 $0.05、5 分钟缓存写 $0.625、1 小时缓存写 $1。Batch API 的输入与输出再打五折。

prompt 超过 100K 会贵多少?

按官方价表换算,每一项单价都是低档的 5 倍。以输出都是 2,000 token 为例:输入 50,000 token 的请求是 $0.005 + $0.001 = $0.006;输入 150,000 token 的请求整次按高一档,是 $0.075 + $0.005 = $0.08。

各平台的模型 ID 怎么写?

Claude API、Google Cloud、Microsoft Foundry 与 Claude Platform on AWS 上都是 claude-haiku-5-5,Amazon Bedrock 上是 anthropic.claude-haiku-5-5。迁移指南写明 claude-haiku-5-5 是固定 ID,没有日期后缀,也没有单独的 alias。

Haiku 5.5 和 Haiku 4.5 有什么区别?

主要四处:价格(按官方价表换算,≤100K 时单价是 4.5 的十分之一,>100K 时是一半)、上限(1M / 128K 对 200K / 64K)、思考(自适应思考默认开启,支持 effort,默认 medium;手动 budget_tokens 返回 400)、分词(同样文本约多 30% token)。Haiku 4.5 的官方退役时间写的是不早于 2026-10-15,这是下限、不是关停日,状态仍为 Active。

QCode 上有 Haiku 5.5 吗?

以 /models 为准:QCode 是否上架 claude-haiku-5-5,看 /models 的实时清单。目前可以用 /models 里的 claude-haiku-4-5-20251001 或 claude-sonnet-5-5,Anthropic 协议接口地址填 https://api.qcode.cc/api,按 token 计费,单价见 /models。

信息来源

规格、各平台 ID、两档价格与退役承诺:Anthropic 官方文档的 Claude Haiku 5.5 概览页、What's new in Claude Haiku 5.5 与迁移指南(2026-10-08 抓取)。完整价表、长上下文计价说明与 Batch 折扣:官方定价页,同日抓取。发布日与平台:Claude Platform 发布说明 2026-10-07 条目与 Anthropic 新闻页。定位、适用场景与「约便宜 75%」的算法脚注:官方发布页 Introducing Claude Haiku 5.5 与 Claude Haiku 产品页。effort 默认值与关思考的限制:官方 effort 文档与 Prompting Claude Haiku 5.5。Haiku 4.5 的规格与退役时间:官方 Claude Haiku 4.5 概览页。Sonnet 5.5 规格:官方 Claude Sonnet 5.5 概览页。QCode 接入地址:QCode 文档的接入点与 API 格式页(更新于 2026-09-25)。

先用在售的 Claude 型号

一把 key 调 claude-haiku-4-5-20251001、claude-sonnet-5-5 等 Claude 型号,按 token 计费;Haiku 5.5 是否上架以 /models 为准。

相关阅读

本页数字与引语核对于 2026-10-08,以 Anthropic 官方文档、价表与发布页为准,上游调整不另行通知。「约便宜 75%」等成本说法是厂商自述与自算,不构成对你具体工作负载的承诺。模型可用性以 /models 为准。

先体验,再决定

不确定选哪档?先买体验版(¥60/月),满意再升级,旧套餐剩余价值按比例退回余额。