1M 長コンテキストの料金比較 2026:どこが割増しで、どこから上がるか
2026-10-07 時点で、Anthropic の価格ページは 1M コンテキストを標準価格で課金すると明記しています。Claude Opus 5.5 と Sonnet 5.5 では、900K トークンのリクエストも 9K トークンのリクエストもトークン単価は同じです。OpenAI の GPT-6 Sol と GPT-6.1 Sol は入力が 272K を超えるとリクエスト全体が入力・キャッシュ 2 倍、出力 1.5 倍になり、xAI の Grok 4.7 はプロンプトが 200K に達するとリクエスト内の全トークンが高い料金帯に移ります。DeepSeek V4.1 Flash の公式価格表には長コンテキストの追加料金帯が載っておらず(2026-10-07 時点)、ピークとオフピークの 2 区分だけが示されています。公式価格表から換算した計算例を三つ載せています。
更新日 2026-10-07
押さえるべき四つの数字
Claude の 1M コンテキスト
公式価格ページによれば、Claude 4.6 以降のモデルは 1M コンテキスト全体を標準価格で提供し、900K トークンのリクエストも 9K トークンと同じトークン単価です。Opus 5.5 は入力 $4 / 出力 $20、Sonnet 5.5 は $2 / $10。
GPT-6 Sol と GPT-6.1 Sol の閾値
入力が 272K を超えるとリクエスト全体が入力・キャッシュ 2 倍、出力 1.5 倍で課金され、GPT-6.1 Sol は $2 / $10 から $4 / $15 になります。
Grok 4.7 の閾値
プロンプトが 200K に達すると、リクエスト内の全トークンが高い料金帯に移り、$2 / $6 が $4 / $12 になります。Grok 4.7 のコンテキストは 1M ではなく 500K です。
DeepSeek V4.1 Flash のピーク料金
コンテキストは 1M。キャッシュミスの入力と出力は百万トークンあたりピーク時 $0.3 / $1.2、オフピーク時はその半額の $0.15 / $0.6 です。公式価格表に長コンテキストの追加料金帯は載っていません(2026-10-07 時点)。
4 社の公式価格表は長コンテキストをどう扱っているか
2026-10-07 時点で、長コンテキストの課金について 4 社の公式ページの書き方は三つに分かれます。一つ目は割増しなしと明記しているもの。Anthropic の価格ページは Claude 4.6 以降のモデルが 1M コンテキスト全体を標準価格で提供すると明記し、コンテキストウィンドウのドキュメントは Opus 5.5 と Sonnet 5.5 を 1M モデルとして挙げたうえで、1M が既定で beta header は不要、長コンテキストのリクエストは標準価格で課金されるとしています。二つ目は閾値を超えるとリクエスト全体の料金帯が変わると明記している方式で、OpenAI の GPT-6 Sol と GPT-6.1 Sol は入力 272K 超、xAI の Grok 4.7 はプロンプト 200K 到達が境目です。超えた部分だけでなく、リクエスト内の全トークンが高い料金帯に移ります。三つ目は公式価格表に長コンテキストの追加料金帯が載っていないもので、DeepSeek V4.1 Flash はコンテキスト 1M、価格表に示されているのはピークとオフピークの料金だけで、公式の計算式はトークン数 × 単価です。
9 月以降の価格表の動き
2026-09-29、OpenAI の changelog が GPT-6.1 Sol を発表し、入力 272K までの標準価格を入力 $2、キャッシュ入力 $0.10、キャッシュ書き込み $2.50、出力 $10 と明記しました。モデルページにある 272K 超でリクエスト全体を割増しする規則は、2026-09-22 にリリースされた GPT-6 Sol のものと一字一句同じです。Anthropic は 2026-09-22 に Opus 5.5、2026-09-28 に Sonnet 5.5 をリリースし、どちらもコンテキスト 1M、1 リクエストあたり最大 128K 出力です。xAI のリリースノートは Grok 4.7 のコンテキストを 500K とし、プロンプト 200K 未満で $2 / $0.50 / $6、それ以上で $4 / $1 / $12 としています。DeepSeek は 2026-09-10 に V4.1 Flash をリリースして API 価格を引き下げました。ピークとオフピークの 2 区分は 2026-08-16 16:00(UTC)から適用されています。
タイムライン
DeepSeek が V4.1 Flash をリリース。コンテキストは 1M で API 価格は引き下げられ、引き続きピークとオフピークの 2 区分です。
Claude Opus 5.5 と GPT-6 Sol が同じ日にリリース。前者は 1M コンテキストを標準価格で、後者は入力 272K 超でリクエスト全体を高い料金帯で課金します。
GPT-6.1 Sol がリリース。272K までは入力 $2 / 出力 $10、超えると $4 / $15 で、キャッシュ入力は $0.10 から $0.20 になります。
確認済み vs 公式が明記していない点
確認済み(公式ページで一字一句照合可)
以下はすべて公式ページで一字一句照合できます。Claude 4.6 以降のモデルは 1M コンテキストを標準価格で提供し、900K と 9K のリクエストは同じトークン単価、キャッシュと Batch の割引はウィンドウ全体で通常どおり適用。Opus 5.5 は $4 / $20、Sonnet 5.5 は $2 / $10、Batch はそれぞれ $2 / $10 と $1 / $5。GPT-6 Sol と GPT-6.1 Sol は入力 272K 超でリクエスト全体が入力・キャッシュ 2 倍、出力 1.5 倍で、両者ともコンテキストウィンドウ 1,050,000、最大入力 922,000。Grok 4.7 はコンテキスト 500K で、200K を境に 2 行の価格。DeepSeek V4.1 Flash はコンテキスト 1M、ピークとオフピークの料金とピーク時間帯。計算例の合計額は公式価格表から当サイトが換算したもので、各社が公表した数字ではありません。
公式が明記していない点
次の三点は公式ページでは決着しておらず、本ページも各社に代わって結論を出しません。① OpenAI は 272K がちょうど 272,000 トークンを指すのか、キャッシュヒットしたトークンが閾値に数えられるのかを明記していないため、計算例では境界を避けて 270,000 と 280,000 を使っています。② xAI は価格表で ≥ 200k、脚注で reaches、リリースノートで above、Fast の節で exceeds と書いており、ちょうど 200K のリクエストがどちらの料金帯になるかは実際の課金額で確かめてください。③ DeepSeek の公式価格表には長コンテキストの追加料金帯が載っていないため(2026-10-07 時点)、計算例は掲載単価で換算しています。同じページには価格を調整する権利を留保するとも書かれています。
選び方:まず入力がどの範囲に収まることが多いか
入力が主に 200K〜272K
この範囲では Grok 4.7 はすでに高い料金帯、GPT-6 Sol と GPT-6.1 Sol はまだ標準料金で、Claude は標準価格のままと明記され、DeepSeek の公式価格表には長コンテキストの追加料金帯が載っていません。公式価格表から換算すると、入力 250,000 + 出力 8,000 のリクエスト 1 回は Sonnet 5.5 と GPT-6.1 Sol がともに $0.58、Opus 5.5 が $1.16、Grok 4.7 が $1.096、DeepSeek V4.1 Flash がピーク時 $0.0846 です。
入力が 272K を超えることが多い
272K を超えると OpenAI も高い料金帯に移ります。Claude は標準価格のままと明記されており、DeepSeek は公式価格表に長コンテキストの追加料金帯が載っていないため掲載単価で換算しています。公式価格表から換算すると、入力 400,000 + 出力 8,000 のリクエスト 1 回は Sonnet 5.5 が $0.88、Opus 5.5 が $1.76、GPT-6.1 Sol が $1.72、Grok 4.7 が $1.696、DeepSeek V4.1 Flash がピーク時 $0.1296、オフピーク時 $0.0648 です。この時点で GPT-6.1 Sol の入力単価($4)は Opus 5.5 と並びます。
再計算できる三つの計算例
すべて公式価格表からの換算です。① 入力 400,000 + 出力 8,000(キャッシュヒットなし):Sonnet 5.5 = 0.4 × $2 + 0.008 × $10 = $0.88、Opus 5.5 = 0.4 × $4 + 0.008 × $20 = $1.76、GPT-6.1 Sol と GPT-6 Sol は長コンテキスト料金で 0.4 × $4 + 0.008 × $15 = $1.72、Grok 4.7 は 200K 以上の料金で 0.4 × $4 + 0.008 × $12 = $1.696、DeepSeek V4.1 Flash はピーク時 0.4 × $0.3 + 0.008 × $1.2 = $0.1296、オフピーク時 $0.0648。② GPT-6.1 Sol の 272K の閾値:入力 270,000 + 出力 8,000 = 0.27 × $2 + 0.008 × $10 = $0.62、入力 280,000 + 出力 8,000 = 0.28 × $4 + 0.008 × $15 = $1.24 で、入力が 10,000 増えただけで料金が倍になります。同じ 2 件を Sonnet 5.5 で送ると $0.62 と $0.64 です。③ Grok 4.7 の 200K の閾値:入力 250,000 + 出力 8,000 = 0.25 × $4 + 0.008 × $12 = $1.096 で、200K 未満の料金なら $0.548。いずれも Batch、キャッシュ、リージョンの割増しは含みません。
QCode では
QCode はトークン課金で、各モデルの単価は /models に掲載しています。本ページに出てくるモデルのうち、claude-opus-5-5、claude-sonnet-5-5、gpt-6.1-sol、gpt-6-sol、deepseek-v4.1-flash は同じキーで呼び出せますが、Grok 4.7 は対象外です。本ページの計算例は各社の公式価格表からの換算であり、QCode の見積もりでも QCode の課金方式の説明でもありません。
よくある質問
Claude Opus 5.5 と Sonnet 5.5 で 1M コンテキストを使い切ると割増しになりますか?
なりません。公式価格ページは Claude 4.6 以降のモデルについて include the full 1M token context window at standard pricing と書き、900K トークンのリクエストは 9K トークンのリクエストと同じトークン単価で課金されると例示しています。コンテキストウィンドウのドキュメントも、1M が既定で beta header は不要、長コンテキストのリクエストは標準価格で課金されると明記しています。キャッシュと Batch の割引もウィンドウ全体で通常どおり適用され、リクエストの長さにかかわらず標準価格は Opus 5.5 が $4 / $20、Sonnet 5.5 が $2 / $10 です。
GPT-6.1 Sol は 272K を超えた部分だけが割増しになるのですか?
いいえ、リクエスト全体です。モデルページの原文は Prompts with more than 272K input tokens are priced at 2x input and cache rates and 1.5x output for the full request です。公式価格表では GPT-6.1 Sol は 272K までが入力 $2、キャッシュ入力 $0.10、キャッシュ書き込み $2.50、出力 $10、272K 超が $4、$0.20、$5、$15 で、GPT-6 Sol はキャッシュ入力だけが異なります($0.20 と $0.40)。どちらもコンテキストウィンドウは 1,050,000、最大入力は 922,000 トークンです。
Grok 4.7 は 1M コンテキストに対応していますか? 200K を超えるとどう課金されますか?
対応していません。xAI の価格表では Grok 4.7 のコンテキストは 500K です。料金は 2 行に分かれ、プロンプト 200K 未満は入力 $2、キャッシュ入力 $0.50、出力 $6、200K 以上は $4、$1、$12 で、脚注にはその場合リクエスト内の全トークンに高い料金が適用されると書かれています。xAI の価格表で 1M コンテキストとされているのは grok-4.3 と grok-4.20 系で、200K 以上の行はやはり 200K 未満の 2 倍です(grok-4.3 は $1.25 / $2.50 から $2.50 / $5.00)。
DeepSeek V4.1 Flash の 1M コンテキストはどう課金されますか?
公式価格表には長コンテキストの追加料金帯が載っておらず(2026-10-07 時点)、ピークとオフピークの料金だけが示されています。V4.1 Flash(API のモデル名は deepseek-flash)はコンテキスト 1M で、百万トークンあたりキャッシュヒット入力がピーク $0.006・オフピーク $0.003、キャッシュミス入力がピーク $0.3・オフピーク $0.15、出力がピーク $1.2・オフピーク $0.6 です。ピーク時間帯は UTC の月曜から金曜の 01:00〜04:00 と 06:00〜10:00(中国の祝日を除く)で、週末と中国の祝日の終日を含むそれ以外の時間はすべてオフピークです。
Batch やリージョンのエンドポイントは長コンテキスト料金と重なりますか?
各社で書き方が異なります。Anthropic はキャッシュと Batch の割引がコンテキストウィンドウ全体で通常どおり適用されると明記しており、Batch は Opus 5.5 が $2 / $10、Sonnet 5.5 が $1 / $5、inference_geo で米国のみの推論を指定するとすべてのトークン区分に 1.1 倍がかかります。OpenAI の Batch 表では GPT-6.1 Sol の 272K 超の料金帯が入力 $2、出力 $7.50 で、リージョン処理は提供されている場合に 10% 加算です。xAI の Batch 割引の一覧に Grok 4.7 はなく、一覧外のモデルには Batch 割引がありません。米国リージョンのエンドポイントは長コンテキスト料金も含めて 1.1 倍で、Grok 4.7 の 200K 以上は $4.40 / $1.10 / $13.20 です。DeepSeek の公式価格表には Batch とリージョンの料金は載っていません(2026-10-07 時点)。
これらのモデルは QCode で呼び出せますか?
claude-opus-5-5、claude-sonnet-5-5、gpt-6.1-sol、gpt-6-sol、deepseek-v4.1-flash は同じキーで呼び出せますが、Grok 4.7 は呼び出せません。QCode はトークン課金で、各モデルの単価は /models にあります。本ページの数字はすべて各社の公式価格表からの換算で、QCode の見積もりではありません。
情報源
Anthropic:公式価格ページ(モデル価格表、長コンテキスト料金、Batch とデータレジデンシーの料金)、コンテキストウィンドウのドキュメント、モデル概要、Opus 5.5 と Sonnet 5.5 のモデルページ(リリース日)。OpenAI:開発者ドキュメントの価格ページ(Standard と Batch の表、短・長コンテキストの定義)、GPT-6.1 Sol と GPT-6 Sol のモデルページ(272K の規則、コンテキストウィンドウと最大入力)、API changelog(リリース日と 272K までの標準価格)。xAI:ドキュメントの Models ページ、Pricing ページ(Batch、米国リージョンのエンドポイント、Fast の節)、Release Notes。DeepSeek:API ドキュメントの Models & Pricing ページと Change Log。いずれも 2026-10-07 に取得。
関連記事
長コンテキスト AI プログラミングガイド 2026
ウィンドウは大きくなったが、問題も変わった。1M+ の中で効率的にコーディングする実践テクニック。
GPT-6 Sol / Luna 価格トラッカー
2つの OpenAI 推論モデルの公式単価・課金規則・再計算できる例。
Context Length Exceeded トラブルシューティング
コンテキスト超過の3つの偽装形態と見分け方。
本ページの数字と引用は 2026-10-07 に照合したもので、各社の公式ページが優先します。各社の価格は予告なく変わることがあります。1 リクエストあたりの金額はすべて公式価格表からの換算で、見積もりでも約束でもありません。モデルの提供状況は /models をご確認ください。