価格トラッカー · 2026-10-07 時点

2026 年プロンプトキャッシュ料金:Claude・GPT・DeepSeek の課金方法と節約術

2026-10-07 時点で、Claude Opus 5.5 と Sonnet 5.5 のキャッシュ読み取りはどちらも百万トークンあたり $0.20、5 分のキャッシュ書き込みは基本入力単価の 1.25 倍($5 / $2.50)、1 時間は 2 倍($8 / $4)です。GPT-6.1 Sol のキャッシュ入力は $0.10、GPT-6 Sol は $0.20 で、キャッシュ書き込みはどちらも $2.50。DeepSeek-V4-Pro のキャッシュヒットはオフピーク $0.022、ピーク $0.044 です。本ページでは三社の課金ルール、TTL、最小キャッシュ長をまとめ、公式価格表から換算した二つの計算例を載せています。

更新日 2026-10-07

#キャッシュ読み取り $0.20#1 時間キャッシュ書き込み#GPT-6.1 Sol $0.10#DeepSeek キャッシュヒット

まず覚えたい四つの数字

$0.20

Opus 5.5 / Sonnet 5.5 のキャッシュ読み取り(百万トークンあたり)

どちらも $0.20 です。公式価格表の脚注では、Opus 5.5 のキャッシュヒットとリフレッシュは基本入力単価の 0.05 倍($4 の 5%)、Sonnet 5.5 は標準の 0.1 倍($2 の 10%)です。

1.25× / 2×

Claude のキャッシュ書き込み:5 分 / 1 時間

公式の倍率表では、5 分のキャッシュ書き込みが基本入力単価の 1.25 倍、1 時間が 2 倍です。単価にすると Opus 5.5 は $5 / $8、Sonnet 5.5 は $2.50 / $4 です。

$0.10 / $0.20

GPT-6.1 Sol / GPT-6 Sol のキャッシュ入力

入力 272K トークン以下の標準料金です。どちらも入力 $2、キャッシュ書き込み $2.50(1.25 倍)で、キャッシュ入力は GPT-6.1 Sol が非キャッシュ単価の 5%、GPT-6 Sol が 10% です。

$0.022 / $0.044

DeepSeek-V4-Pro のキャッシュヒット:オフピーク / ピーク

公式価格表は入力をキャッシュヒットとキャッシュミスの二段階で示し、ミスは $0.66 / $1.32 です。DeepSeek-V4.1-Flash のヒットは $0.003 / $0.006 です。

キャッシュはどう課金されるか

2026-10-07 時点で、三社のプロンプトキャッシュはいずれも「繰り返されるプレフィックスがキャッシュにヒットすると、その部分のトークンが割引単価で計算される」仕組みで、違いは書き込みの上乗せの有無、読み取りの割引率、キャッシュの寿命です。Anthropic:既定のキャッシュ寿命は 5 分で、ヒットするたびに追加料金なしで更新されます。1 時間も選べ、その場合は書き込みが基本入力単価の 1.25 倍から 2 倍になります。公式の試算では、5 分のキャッシュは一回の読み取りで、1 時間は二回の読み取りで元が取れます。OpenAI:公式ドキュメントによれば、サポート対象モデルではプロンプトキャッシュが既定で有効です。GPT-5.6 以降はキャッシュ書き込みが非キャッシュ入力単価の 1.25 倍、読み取りは多くのモデルで 0.1 倍、GPT-6.1 Sol で 0.05 倍です。書き込み料金は上乗せではなく、入力トークンは非キャッシュ・キャッシュ読み取り・キャッシュ書き込みのいずれか一つの単価で計算されます。DeepSeek:公式によればディスクキャッシュは全ユーザーで既定で有効、コードの変更は不要で、価格表はキャッシュヒットとミスの二段階だけです。

公式の記述:Opus 5.5 と GPT-6.1 Sol のキャッシュ読み取りは 0.05 倍

現在、Anthropic と OpenAI にはどちらも、キャッシュ読み取り倍率が通常の 0.1 倍より低いモデルがあります。Anthropic の価格表脚注は Opus 5.5 のキャッシュヒットとリフレッシュを基本入力単価の 0.05 倍としており、入力 $4 に対してキャッシュ読み取りは $0.20 です。他の多くのモデルは標準の 0.1 倍、Fable 5.1 は 0.025 倍です。OpenAI のキャッシュガイドによれば、GPT-5.6 以降はキャッシュ書き込みが非キャッシュ入力単価の 1.25 倍、読み取りは多くのモデルで 0.1 倍、GPT-6.1 Sol で 0.05 倍で、それより前のモデルは公式の比較表でキャッシュ書き込みの追加料金なしとされています。一方、DeepSeek の価格表にある入力単価はキャッシュヒットとキャッシュミスの二つだけです。

キャッシュ料金に関わる三つの日付

2026-09-22

Claude Opus 5.5 がリリース、定価 $4 / $20(現行の価格表ではキャッシュ読み取り $0.20)。同じ日に OpenAI が GPT-6 Sol をリリースし、入力 272K トークン以下の標準料金は入力 $2、キャッシュ入力 $0.20、出力 $10 です。

2026-09-28

Claude Sonnet 5.5 がリリース。現行の価格表の行は入力 $2、5 分のキャッシュ書き込み $2.50、1 時間のキャッシュ書き込み $4、キャッシュ読み取り $0.20、出力 $10 です。

2026-09-29

OpenAI が GPT-6.1 Sol をリリース。入力 272K トークン以下では入力 $2、キャッシュ入力 $0.10、キャッシュ書き込み $2.50、出力 $10 で、キャッシュ入力は非キャッシュ単価の 5% です。

確認済み vs 未確認

確認済み(公式ページで一文字ずつ照合可)

以下はすべて公式ドキュメントと価格表で一文字ずつ照合できます:Opus 5.5 と Sonnet 5.5 のキャッシュ読み取り $0.20、5 分の書き込み $5 と $2.50、1 時間の書き込み $8 と $4。Opus 5.5 のキャッシュ読み取り 0.05 倍。Claude の既定キャッシュ寿命 5 分と、寿命がリクエストの開始時点から数えられること。Opus 5.5 と Sonnet 5.5 の最小キャッシュ長 512 トークン、Sonnet 5 は 1,024 トークンで、足りない場合はキャッシュされずエラーも返らないこと。GPT-6.1 Sol のキャッシュ入力 $0.10、GPT-6 Sol の $0.20、キャッシュ書き込みはどちらも $2.50。GPT-5.6 以降の最小キャッシュ長 1,024 トークンとキャッシュ寿命 30 分以上。入力 272K トークン超ではリクエスト全体で GPT-6 Sol と GPT-6.1 Sol の入力とキャッシュが 2 倍、出力が 1.5 倍になること。DeepSeek-V4-Pro と DeepSeek-V4.1-Flash のヒット・ミス単価とピーク時間帯。本ページの二つの計算例はこれらの公式単価からの換算で、実際の課金額ではありません。

未確認と公式未発表

次の三点は確認できていないため、予算の前提にしないでください:① DeepSeek は固定のキャッシュ寿命を公表しておらず、キャッシュはベストエフォートでヒット率の保証はなく、使われなくなると通常数時間から数日で消去されるとしか述べていません。② OpenAI はキャッシュ入力が最大 95% 安くなると述べ、ドキュメントの導入例ではヒット率約 70% と 90% 超が報告されていますが、これは公式の例示であり、お客様のワークロードへの約束ではありません。③ ネット上に出回っている各社の「実測キャッシュヒット率」のスクリーンショットや比較数値は一次情報がなく、本ページでは扱いません。

再計算できる二つの計算例

計算例 1:コーディングエージェントの長いセッションで 100K のプレフィックスを 20 ターン繰り返す

公式価格表から換算、入力は固定です:100K トークンの固定プレフィックス(システムプロンプト、ツール定義、プロジェクトのコンテキスト)、各ターンの間隔はすべて 5 分未満で 20 ターン連続、この 100K のプレフィックスだけを数え、毎ターンの新しい内容と出力は含めません。Sonnet 5.5:キャッシュなしは 20 × 0.1M × $2 = $4.00。キャッシュありは 5 分の書き込み 1 回 $0.25 と読み取り 19 回 19 × $0.02 = $0.38 で計 $0.63。Opus 5.5:$8.00 に対して $0.88(書き込み $0.50 + 読み取り $0.38)。GPT-6 Sol:$4.00 に対して $0.63、GPT-6.1 Sol:$4.00 に対して $0.44(書き込み $0.25 + 読み取り 19 × $0.01)。社をまたいで比べる際の注意点として、上の換算は同じトークン数を前提にしていますが、同じテキストでもトークン数は各社のモデルで同じとは限りません。たとえば Anthropic の価格表は、Claude 4.7 以降の新しいトークナイザーが同じテキストで従来のトークナイザーより約 30% 多くトークンを生成し、増え方は内容によって異なるとしています。

計算例 2:TTL は 5 分か 1 時間か

公式価格表から換算、入力は固定です:Sonnet 5.5、100K のプレフィックス、6 ターン、各ターンの間隔 10 分。キャッシュなしは 6 × $0.20 = $1.20。5 分の TTL では毎回期限切れで書き直しになり 6 × $0.25 = $1.50 と、キャッシュなしより高くなります。1 時間の TTL なら書き込み 1 回 $0.40 と読み取り 5 回 $0.10 で計 $0.50。同じ条件で Opus 5.5 はそれぞれ $2.40、$3.00、$0.90 です。公式の推奨は、呼び出し間隔が常に 5 分未満なら、ヒットのたびに追加料金なしで延長される 5 分キャッシュを使い続け、間隔が 5 分から 1 時間の間なら 1 時間キャッシュに切り替える、というものです。比較として、OpenAI の GPT-5.6 以降ではキャッシュされたプレフィックスが直近の書き込みか再利用から少なくとも 30 分は再利用対象のままなので、10 分の間隔は公式ルール上まだその期間内です。

有効化と節約:五つの手順

① Claude API:リクエストのトップレベルに cache_control を一つ加えると自動キャッシュになり、ブレークポイントは最後のキャッシュ可能ブロックに置かれ、会話が伸びるにつれて前へ移動します。1 時間にするには cache_control の ttl を 1h にします。ブレークポイントは一つのプロンプトに最大 4 個です。② 並び順:キャッシュのプレフィックスは tools、system、messages の順で、どの層を変えてもその層以降はすべて無効になります。変わらないツール定義、システムプロンプト、長い資料を先頭に、タイムスタンプなど変わりやすい内容を末尾に置きます。③ Claude Code:API キー利用時、メインの会話の既定 TTL は 5 分です。公式ドキュメントは promptCacheTtl を 1h にする方法(または環境変数 CLAUDE_CODE_PROMPT_CACHE_TTL)を示しており、Claude Code v2.1.242 以降が必要です。/model でモデルを切り替えると、最初のリクエストは会話全体をキャッシュなしで読み直します。④ OpenAI の GPT-5.6 以降:公式が多くの用途でそのまま使えるとする暗黙モードでは、条件を満たす最新メッセージの末尾にブレークポイントが置かれます。明示モードでは最後のブレークポイント以降の内容が非キャッシュ単価で処理され書き込み料金がかからないため、毎回変わる内容をキャッシュに書き込まずに済みます。⑤ usage フィールドの確認:Claude は cache_creation_input_tokens と cache_read_input_tokens(どちらも 0 ならキャッシュされていません)、OpenAI は usage.input_tokens_details.cached_tokens と cache_write_tokens、DeepSeek は prompt_cache_hit_tokens と prompt_cache_miss_tokens を見ます。

QCode では

QCode はトークン課金で、各モデルの単価は /models に掲載しています。本ページの数値はメーカーの公式価格表からのもので、キャッシュの課金構造と節約方法を理解するためのものです。QCode で実際にどう課金されるかは、/models とコンソールの呼び出し明細を基準にしてください。

よくある質問

Claude のキャッシュ読み取りはいくら?

2026-10-07 時点で、Claude Opus 5.5 と Sonnet 5.5 のキャッシュ読み取りはどちらも百万トークンあたり $0.20 です。倍率は異なり、Opus 5.5 は基本入力単価の 0.05 倍($4 の 5%)、Sonnet 5.5 は標準の 0.1 倍($2 の 10%)、Fable 5.1 は 0.025 倍($0.25)です。公式価格表ではこの列を Cache hits and refreshes と呼び、キャッシュからプレフィックスを読み取ると同時にその寿命を更新するものとしています。

Claude の 1 時間キャッシュ書き込みはいくら?使う価値は?

1 時間のキャッシュ書き込みは基本入力単価の 2 倍で、百万トークンあたり Sonnet 5.5 は $4、Opus 5.5 は $8 です(5 分は $2.50 と $5)。0.1 倍の読み取り単価での公式の試算では、5 分のキャッシュは一回の読み取りで、1 時間は二回で元が取れます。公式価格表から換算すると、Sonnet 5.5 で 100K のプレフィックスを 10 分間隔で 6 ターン使う場合、1 時間キャッシュは計 $0.50、毎ターン期限切れで書き直しになる 5 分キャッシュは $1.50 です。呼び出し間隔が常に 5 分未満なら、公式は 5 分キャッシュを使い続けるよう勧めています。

OpenAI のキャッシュは手動で有効にする必要がある?書き込みは有料?

有効化は不要です。公式ドキュメントはサポート対象モデルでプロンプトキャッシュが既定で有効だとしています。GPT-5.6 以降は書き込みに非キャッシュ入力単価の 1.25 倍(GPT-6 Sol と GPT-6.1 Sol はどちらも $2.50)がかかりますが、上乗せ料金ではなく、入力トークンは非キャッシュ・キャッシュ読み取り・キャッシュ書き込みのどれか一つの単価だけで計算されます。寿命は prompt_cache_options.ttl で制御し、唯一の値 30m が既定値でもあります。再利用すると書き込み料金なしで寿命が更新されます。最小キャッシュ長は 1,024 トークンです。

DeepSeek のキャッシュヒットはいくら?

2026-10-07 時点の公式価格表(百万入力トークンあたり)では、DeepSeek-V4-Pro のキャッシュヒットはオフピーク $0.022、ピーク $0.044、ミスは $0.66 / $1.32、DeepSeek-V4.1-Flash(API のモデル名は deepseek-flash)のヒットは $0.003 / $0.006、ミスは $0.15 / $0.3 です。ピーク時間帯は月曜から金曜の UTC 01:00〜04:00 と 06:00〜10:00(中国の祝日を除く)で、オフピーク料金はピークの半額です。公式価格表から換算すると、V4-Pro のピーク時間帯に 100K のプレフィックスで 20 ターン回す場合、すべてミスなら $2.64、初回ミスで残り 19 回ヒットなら $0.2156 です。

キャッシュヒットはレート制限にカウントされる?

二社で異なります。Anthropic は 1 時間キャッシュの用途の中で、キャッシュヒットはレート制限から差し引かれないと明記しています。OpenAI のよくある質問では、キャッシュされた入力トークンも 1 分あたりのトークン上限に引き続きカウントされ、プロンプトキャッシュはレート制限の計算方法を変えないとしています。

QCode ではキャッシュはどう課金される?

QCode はトークン課金で、各モデルの単価は /models に掲載しています。本ページの数値はメーカーの公式価格表からのものです。各呼び出しのモデル、トークン数、費用は、コンソールの使用統計ページにある呼び出し明細で確認できます。

情報源

Claude の料金とキャッシュのルール:Anthropic 公式の価格ページと Prompt caching ドキュメント(2026-10-07 取得。各モデルのキャッシュ読み書き単価、倍率と脚注、TTL、最小キャッシュ長、無効化ルール、usage フィールドを含む)。リリース日:Anthropic 公式のリリースノート。Claude Code の TTL 設定:Claude Code 公式ドキュメントの prompt caching とコスト管理のページ。OpenAI:公式の価格ページ、GPT-6 Sol と GPT-6.1 Sol のモデルページ、Prompt caching ガイド、API 変更履歴(同日取得)。DeepSeek:公式の Models & Pricing ページと Context Caching ガイド(同日取得)。QCode:docs.qcode.cc の課金説明と費用最適化のページ。

トークン課金、単価は /models で

QCode はトークン課金で、各モデルの単価は /models に掲載しています。キャッシュの課金の仕組みと節約方法は、まず本ページの公式単価と二つの計算例でご確認ください。

関連記事

本ページの料金とルールは 2026-10-07 に照合したもので、Anthropic・OpenAI・DeepSeek の公式ページが優先されます。上流の変更は予告なく行われることがあります。二つの計算例は公式価格表から換算した例示で、繰り返されるプレフィックスの入力費用だけを数え、新しい内容と出力は含まず、実際の課金額でもありません。メーカーが示す割引率や導入例のヒット率はメーカー自身の申告です。モデルの提供状況は /models を基準にしてください。

まず試して、それから決める

どのプランか迷ったら、まずスターター($8.57/月)から。満足したらアップグレードし、旧プランの残り価値は按分で残高に戻ります。