モデルガイド

Claude Fable 5.1
完全ガイド

2026-09-01 リリース。入力 $10・出力 $50(100 万トークンあたり)は Fable 5 と同じで、変わったのはキャッシュ読み取り:$1.00 → $0.25。公式は「Cache reads now cost 75% less」と明記。コンテキスト 1M、最大出力 128K。QCode での model id は claude-fable-5-1 です。

#キャッシュ読み −75%#1M コンテキスト#128K 出力#claude-fable-5-1

価格と仕様の 4 数字

$0.25

キャッシュ読み取り(100 万トークン)

Fable 5 は $1.00 なので 75% 減。長いコンテキストを繰り返し読む処理が最も直接的に恩恵を受けます。

$10 / $50

入力 / 出力(100 万トークン)

Fable 5 と同一で、表示価格は動いていません。変わったのはキャッシュの行だけです。

1M / 128K

コンテキスト窓 / 最大出力

Fable 5 と同じ。キャッシュ書き込みも 5 分档 $12.50、1 時間档 $20 のまま変わりません。

約 −25%

公式が示す典型的な請求の下げ幅

公式は、典型的なワークロードで Fable 5 比 約 25% のコスト減、複雑で高度にエージェント的なタスクではさらに大きいとしています。

実際に変わったのはどこか

表示価格は動いていません。入力 $10、出力 $50(100 万トークンあたり)は Fable 5 とまったく同じです。動いたのはキャッシュ読み取りで、$1.00 から $0.25 へ。これは宣伝用の数字ではなく、「長いコンテキスト × 多いターン」型のワークロードの実際の請求額を決める項目です。エージェントは毎ターンでコンテキスト全体を読み直すため、キャッシュ読み取りが請求書で最大の行になることも珍しくありません。その行を 4 分の 1 に減らす効果は、入力単価を下げるよりずっと大きく出ます。

公式の記載と価格(2026-09-02 照合)

公告の原文には「Cache reads now cost 75% less, or $0.25 per million tokens」および「costs are reduced by around 25% relative to Fable 5」とあり、複雑で高度にエージェント的なタスクではさらに下がるとされています。価格表側とも一行ずつ一致:入力 $10、出力 $50、キャッシュ読み $0.25、キャッシュ書き込み 5 分档 $12.50 / 1 時間档 $20、コンテキスト 1M、最大出力 128K。同時に発表された Mythos 5.1 は Fable 5.1 と同一基盤でガードレールが緩く、審査を経た組織のみが対象で、公開して呼び出せるモデルではありません。

Fable 系の時系列

2026-06-09

Fable 5 と Mythos 5 がリリース。

2026-06-12 → 07-01

Fable 5 は米国の輸出管理指令により一時全顧客に対して停止され、7 月 1 日に復旧。当時ほかの Claude モデルは影響を受けませんでした。

2026-09-01

Fable 5.1 と Mythos 5.1 がリリース。Fable 5.1 は広く利用可能、Mythos 5.1 は審査を経た組織限定です。

確定していること vs 自分で測るべきこと

確定(一次情報あり)

① キャッシュ読み取りが $1.00 → $0.25、公式が 75% 減と明記。② 入力 $10 / 出力 $50 は変更なし。③ コンテキスト 1M、最大出力 128K。④ 公式の典型ワークロードでのコスト減は約 25%。⑤ Mythos 5.1 は公開して呼び出せるモデルではない。

自分で測るべきこと

実際にどれだけ下がるかはキャッシュ命中率次第で、命中率はプロンプト構造と呼び出しの間隔で決まります。公式の 25% は「典型的なワークロード」の見積もりであって約束ではありません。測り方:ある程度長い入力を固定して 3 回以上連投し、1 回目を捨てて残りの usage でキャッシュ読み取りが占める割合を見ます。その割合が、この値下げがあなたにとっていくらの価値かを決めます。

Fable 5.1 と Fable 5 の比較

請求の構造が違う

入力と出力は同価格で、差はすべてキャッシュ読み取り($0.25 対 $1.00)に集中します。命中率が高く、コンテキストが長く、ターンが多いほど 5.1 の優位が大きくなります。単発の短い問い合わせではほとんど差が出ません。

仕様と移行

コンテキスト 1M と最大出力 128K は同一なので、切り替えは model id の変更で足ります。ただし 5.1 には開発者側の挙動変更(たとえば前のターンの思考内容の扱い)があるため、長い連鎖のエージェントを移す前にご自身の回帰ケースを一度通すことを勧めます。

乗り換える価値があるかの判断

① まず現在のワークロードで、キャッシュ読み取りが総コストに占める割合を測ります。モデルを変える必要はなく、今の請求の内訳を見るだけです。② その割合が小さければ(短い対話、毎回異なる入力)今回の値下げはほとんど効かず、急いで乗り換える必要はありません。③ 割合が大きければ(長コンテキストのエージェント、同じコードベースを繰り返し読む処理)、得られる節約はほぼその行 × 75% です。④ 乗り換える前に自分の回帰ケースを通すこと。価格だけで決めないでください。

QCode では

model id は claude-fable-5-1 です(ドット表記の claude-fable-5.1 は同じモデルに正規化されます)。公式価格 × サービス料率で計算するため、キャッシュ読み取りの値下げはそのまま差し引きに反映されます。差し引きの根拠がレスポンスの usage だからです。確かめたい場合:固定入力を数回連投し、usage のキャッシュ読み取りの行が $0.25 の档で計算されているかを見てください。

よくある質問

Fable 5.1 は Fable 5 よりどれだけ安いですか?

表示価格ではキャッシュ読み取りだけが変わりました。100 万トークンあたり $1.00 → $0.25 で 75% 減。入力 $10、出力 $50 は据え置きです。公式の全体見積もりは典型的なワークロードで約 25%、複雑なエージェント処理ではそれ以上ですが、実際の値はキャッシュ命中率で決まります。

コンテキスト窓や最大出力は変わりましたか?

変わっていません。コンテキスト窓 1M、最大出力 128K で Fable 5 と同じです。キャッシュ書き込みの 2 段階(5 分 $12.50、1 時間 $20)も据え置きです。

Mythos 5.1 は呼び出せますか?

呼び出せません。Mythos 5.1 は Fable 5.1 と同一基盤ですがガードレールが緩く、審査を経た組織にのみ開放されており、公開して呼び出せるモデルではありません。「Mythos を開放できる」と謳う経路があれば、その根拠を確認する価値があります。

model id はどちらを書けばよいですか?

claude-fable-5-1 と書いてください。ドット表記も同じモデルに正規化されますが、ハイフン形に統一しておくと、自分のログや請求に 2 通りの表記が混ざって突合しにくくなる事態を避けられます。

Fable 5 からの移行にコード変更は必要ですか?

インターフェース上は model id の変更で足ります。ただし 5.1 には開発者側の挙動変更(前のターンの思考内容の扱いなど)があるため、長い連鎖のエージェントを価格だけで一括切り替えせず、先にご自身の回帰ケースを通してください。

値下げが本当に自分の請求に効いているかはどう確認しますか?

usage を見ます。ある程度長い固定入力を 3 回以上連投し、1 回目(コールドスタート)を捨てて、残りのキャッシュ読み取りのトークン数と対応する差し引きから単価を逆算し、$0.25 の档になっているかを確認します。どんな伝聞よりも直接的です。

情報源

キャッシュ読み取りの値下げと全体の下げ幅:Anthropic 公式公告ページ(2026-09-02 取得。原文に「Cache reads now cost 75% less, or $0.25 per million tokens」「costs are reduced by around 25% relative to Fable 5」を含む)。項目別の単価・コンテキスト・最大出力:当社の料金が依拠する litellm 価格スナップショット(2026-09-02 照合:入力 1e-05、出力 5e-05、キャッシュ読み 2.5e-07、キャッシュ書き込み 1.25e-05 / 2e-05(トークンあたり)、max_input 1,000,000、max_output 128,000)。Mythos 5.1 の提供範囲は同じ公告に記載。価格は上流の変更に追随し、公式ページと当社料金ページが優先します。

まずキャッシュの比率を測る

キャッシュ読み取りが請求に占める割合が高いほど、この値下げの価値は大きくなります。低ければ急ぐ必要はありません。

関連記事

本ページの価格と仕様は 2026-09-02 に照合したもので、上流の変更に追随します。公式が示すコスト減は典型的なワークロードの見積もりであり、個別のワークロードに対する約束ではありません。モデルの利用可否は /models とご自身の実測が優先します。