Claude Fable 5.1
完全指南
2026-09-01 发布。输入 $10、输出 $50 每百万 token 与 Fable 5 一致,变的是缓存读取:$1.00 → $0.25,官方原文「Cache reads now cost 75% less」。上下文 1M、最大输出 128K。QCode 上的 model id 是 claude-fable-5-1。
四个价格与规格数
缓存读取(每百万 token)
Fable 5 是 $1.00,降了 75%。长上下文反复调用的工作负载受益最直接。
输入 / 输出(每百万 token)
与 Fable 5 完全一致,标价没动。变的只有缓存这一项。
上下文窗口 / 最大输出
与 Fable 5 相同。缓存写入 5 分钟档 $12.50、1 小时档 $20,也未变。
官方给的典型账单降幅
官方原文:典型负载相对 Fable 5 成本下降约 25%;复杂编码与高度 agentic 的任务降幅更大。
这次真正变的是什么
标价没动:输入 $10、输出 $50 每百万 token,和 Fable 5 一模一样。动的是缓存读取,从 $1.00 降到 $0.25。这不是一个营销数字——它决定了「长上下文 + 反复调用」这一类工作负载的实际账单。agent 每一轮都要把整个上下文重新读一遍,缓存读取往往是账单里最大的一项,把它砍掉四分之三,效果比降输入价明显得多。
官方口径与价目(2026-09-02 核)
公告原文写着「Cache reads now cost 75% less, or $0.25 per million tokens」,以及「costs are reduced by around 25% relative to Fable 5」,复杂编码与高度 agentic 的任务降幅更大。价目表侧核对一致:输入 $10、输出 $50、缓存读 $0.25、缓存写 5 分钟档 $12.50 / 1 小时档 $20,上下文 1M、最大输出 128K。同期发布的 Mythos 5.1 与 Fable 5.1 同源但护栏更松,仅面向经过审核的机构,不是公开可调用的模型。
Fable 系的时间线
Fable 5 与 Mythos 5 发布。
Fable 5 因美国出口管制指令一度对全部客户关闭,7 月 1 日恢复。其余 Claude 模型当时不受影响。
Fable 5.1 与 Mythos 5.1 发布。Fable 5.1 全渠道可用;Mythos 5.1 仅限经审核的机构。
已确认 vs 需要你自己测
已确认(有一手源)
① 缓存读取 $1.00 → $0.25,官方原文写明降 75%;② 输入 $10 / 输出 $50 未变;③ 上下文 1M、最大输出 128K;④ 官方给的典型负载成本降幅约 25%;⑤ Mythos 5.1 不是公开可调用的模型。
需要你自己测
「实际能省多少」取决于你的缓存命中率,而命中率取决于你的提示结构与调用节奏。官方那个 25% 是「典型负载」的估算,不是承诺。测法:固定同一段较长输入连打至少 3 发、丢掉第 1 发,看后面几发 usage 里缓存读取的占比——那个比例才决定这次降价对你值多少钱。
Fable 5.1 vs Fable 5
账单结构不同
两者输入输出同价,差别集中在缓存读取($0.25 vs $1.00)。缓存命中率越高、上下文越长、轮次越多,5.1 的优势越大;一次性短问答几乎看不出差别。
规格与迁移
上下文 1M、最大输出 128K 两者相同,换 model id 即可。注意 5.1 在开发者侧有一些行为变化(例如对早期轮次思考内容的处理),迁移长链路 agent 前值得先跑一遍你自己的回归用例。
怎么判断值不值得换
① 先在现有负载上量一次缓存读取占总成本的比例——这一步不需要换模型,看现在的账单构成就行。② 如果缓存读取占比很低(比如短对话、每次输入都不同),这次降价对你几乎没影响,不必急着换。③ 如果占比很高(长上下文 agent、反复读同一份代码库),换过去的收益基本就是那一项 × 75%。④ 换之前跑一遍你自己的回归用例,别只看价格。
在 QCode 上
model id 是 claude-fable-5-1(带点号的 claude-fable-5.1 会被归一到同一个模型)。按官方牌价 × 服务费率计价,缓存读取的降价会直接反映在你的扣减里——因为扣减依据就是响应里的 usage。想验证的话:固定输入连打几发,看 usage 里缓存读取那一项的单价是不是按 $0.25 的档在算。
常见问题
Fable 5.1 比 Fable 5 便宜多少?
标价上只有缓存读取变了:$1.00 → $0.25 每百万 token,降 75%。输入 $10、输出 $50 都没动。官方给的整体估算是典型负载约降 25%,复杂 agentic 任务更多——但实际值完全取决于你的缓存命中率。
上下文和最大输出有变化吗?
没有。上下文窗口 1M、最大输出 128K,与 Fable 5 相同。缓存写入的两档价格(5 分钟 $12.50、1 小时 $20)也未变。
Mythos 5.1 我能调吗?
不能。Mythos 5.1 与 Fable 5.1 同源但护栏更松,仅面向经过审核的机构开放,不是公开可调用的模型。任何声称「可以给你开 Mythos」的渠道都值得追问依据。
model id 到底写哪个?
写 claude-fable-5-1。带点号的写法会被归一到同一个模型,但建议统一用连字符形式,避免你自己的日志和账单里出现两种写法难以对账。
从 Fable 5 迁过来要改代码吗?
接口层面换 model id 即可。但 5.1 在开发者侧有一些行为变化(例如对早期轮次思考内容的处理方式),长链路 agent 迁移前建议先跑一遍你自己的回归用例,不要只看价格就整体切换。
我怎么知道降价真的落到我的账单上了?
看 usage。固定一段较长的输入连打至少 3 发,丢掉第 1 发(冷启动),看后面几发里缓存读取的 token 数与对应扣减,反算单价是不是按 $0.25 的档。这比任何转述都直接。
信息来源
缓存读降价与整体降幅:Anthropic 官方公告页(2026-09-02 抓取,原文含「Cache reads now cost 75% less, or $0.25 per million tokens」与「costs are reduced by around 25% relative to Fable 5」)。逐项单价、上下文与最大输出:站内定价所依据的 litellm 牌价快照(2026-09-02 核对:输入 1e-05、输出 5e-05、缓存读 2.5e-07、缓存写 1.25e-05 / 2e-05 每 token,max_input 1,000,000、max_output 128,000)。Mythos 5.1 的可用范围见同一份官方公告。价格随上游调整,以官方页面与站内定价页为准。
相关阅读
Claude Fable 5 完全指南
上一代的规格、定价与适用场景。
Claude Fable 5 定价指南
逐项单价与缓存计价的算法。
怎么判断一个 AI API 中转值不值得用
含缓存命中率的实测方法——正是判断这次降价对你值多少的那个测法。
本页价格与规格核对于 2026-09-02,随上游调整。官方给出的成本降幅是典型负载的估算,不是对你具体工作负载的承诺。模型可用性以 /models 与你的实测为准。