2026-10-08 時点 · モデル別対照

Claude の適応型思考と effort パラメータ:モデル別ガイド

2026-10-08 時点で、Claude 5.x の各モデルは適応型思考(adaptive thinking)が既定でオンです。Opus 5.5、Fable 5.1、Fable 5 は思考をオフにできません。Sonnet 5.5 は disabled を受け付けず、最も低い設定は between_tools です。Opus 5 と Haiku 5.5 は effort が high 以下のときだけオフにでき、Sonnet 5 はそのままオフにできます。思考の深さは output_config.effort(low / medium / high / xhigh / max)で調整し、既定は Opus 5.5 と Haiku 5.5 が medium、それ以外が high です。budget_tokens は Claude 4.7 以降のモデルではすべて 400 エラーになります。

更新日 2026-10-08

#adaptive thinking#effort は 5 段階#budget_tokens は 400#Claude Code の /effort

まず押さえる 4 つの結論

常時オン

Opus 5.5 / Fable 5.1 の思考

公式ドキュメントによると Opus 5.5、Fable 5.1、Fable 5 は thinking disabled を拒否し、思考をオフにできません。Opus 5.5 ではどの effort でも disabled を送ると 400 エラーです。

medium / high

API の既定 effort

公式には多くのモデルが high、Opus 5.5 と Haiku 5.5 が medium です。既定値を明示的に渡しても省略と同じ動作で、プロンプトキャッシュも崩れません。

5 段階

effort の値

low、medium、high、xhigh、max。Opus 5.5、Sonnet 5.5、Haiku 5.5 は 5 段階すべてに対応します。公式は max に対応するモデルが必ずしも xhigh に対応するわけではないと注記しています。

400

budget_tokens の現状

公式には Claude 4.7 以降のモデルは type enabled と budget_tokens を拒否します。Claude 4.6 では成功しますが非推奨で、4.5 以前ではこの手動モードしか使えません。

adaptive thinking と effort の役割

2026-10-08 時点の公式の定義では、適応型思考はモデルがリクエストごとに考えるかどうか、どれだけ考えるかを判断する仕組みで、effort パラメータは Claude が応答に使うトークン量を制御します。役割は別で、thinking は thinking ブロックで先に考えるかどうかを決め、effort は思考・本文・ツール呼び出しを含む応答全体にどれだけ労力をかけるかを決めます。公式は adaptive は思考モードであって effort の値ではないので effort に入れないよう注意しています。effort は thinking オブジェクトの中ではなく output_config.effort に書きます。厳密なトークン予算ではなく振る舞いのシグナルなので、どの段階でも毎回 thinking ブロックが出るとは限りません。

最近の公式の変更

2026-09-22 公開の Opus 5.5 は既定の effort を medium に下げました。公式によると Opus 5 以前の Opus は既定が high なので、effort を省略すると Opus 5.5 は Opus 5 より一段低く動き、思考は常時オンでオフにできません。2026-09-28 の Sonnet 5.5 は disabled を拒否するようになり、事前の思考を切るには between_tools を送ります(high 以下でのみ有効)。2026-10-05 から Models API が capabilities.thinking.types.disabled を返すようになり、送信前にそのモデルが disabled を受け付けるかを確認できます(拒否するモデルでは supported が false)。2026-10-07 公開の Haiku 5.5 は既定で思考し、手動の budget_tokens は 400 エラーになり、応答が thinking ブロックから始まることがあります。

タイムライン

2026-09-22

Claude Opus 5.5(claude-opus-5-5)公開。思考は常時オンで、thinking の disabled も enabled も 400 エラー。既定の effort は medium。

2026-09-28

Claude Sonnet 5.5(claude-sonnet-5-5)公開。事前の思考を切るには between_tools を送り、effort が high 以下のときだけ受け付けます。

2026-10-07

Claude Haiku 5.5(claude-haiku-5-5)公開。適応型思考が既定でオン、budget_tokens は 400 エラー、high 以下なら disabled で思考をオフにできます。

確認済み vs 公式に記載なし

確認済み(公式ページで逐語確認可)

以下はいずれも Anthropic と Claude Code の公式ドキュメントで逐語的に確認できます。Opus 5.5、Fable 5.1、Fable 5 は思考をオフにできない。Sonnet 5.5 は disabled を拒否し、between_tools は high 以下でのみ有効。Opus 5 と Haiku 5.5 の disabled は high 以下でのみ有効。Sonnet 5 はオフにできる。Opus 4.8、Opus 4.7、Opus 4.6、Sonnet 4.6 は adaptive を明示するまで思考しない。effort 各段階の公式説明と各モデルの既定値。budget_tokens は Claude 4.7 以降で 400。思考トークンは出力トークンとして課金され max_tokens に含まれる。Claude Code では Opus 5.5、Sonnet 5.5、Haiku 5.5、Fable 系の思考をオフにできない。

公式に書かれていないこと

次の 3 点は公式に示されていないので、予算の前提にしないでください。1 つ目は、各 effort でトークンや費用がどれだけ増減するかで、公式は effort は振る舞いのシグナルであり厳密な予算ではないとするだけで倍率は示していません。2 つ目は、同じ名前の段階でもモデル間で同等ではないことで、公式は effort の尺度はモデルごとに調整されているとし、Sonnet 5.5 の段階も再調整されています。旧モデルの設定をそのまま移す根拠はありません。3 つ目に、「ある effort は budget_tokens いくつ分」という換算は一次情報になく、公式の移行手順は budget_tokens を削除して effort を使うことだけを求めています。

選び方:effort、max_tokens、思考オフ

effort と max_tokens

公式の言葉では effort はソフトな指針で、max_tokens が厳密な上限です。max_tokens は 1 リクエストの出力全体(思考と本文の合計)を上限で区切り、effort はそのうちどれだけを思考に回すかを左右するだけでトークン数は保証しません。コストやレイテンシを下げたいなら、公式はまず effort を下げるよう勧めています(思考を含む応答全体が小さくなります)。厳密な上限が必要なら max_tokens を使います。high 以上では思考が長くなりやすく、max_tokens を使い切る可能性が高まります。

effort を下げる vs 思考をオフ

思考をオフにできるモデル(Sonnet 5、high 以下の Opus 5 と Haiku 5.5)は disabled を受け付けますが、Haiku 5.5 について公式は、品質と速度・コストの調整には effort を使うほうがよいとしています。Opus 5.5 と Fable 5.1 はオフにできないので effort だけが手段で、Sonnet 5.5 の最低設定は between_tools です。thinking の設定やトップレベルの effort を変えるとプロンプトキャッシュは最初からになります。Opus 5.5、Sonnet 5.5、Haiku 5.5 などではメッセージ単位の effort(ベータ、mid-conversation-output-config-2026-07-01 ヘッダー)で途中から段階を変え、キャッシュを保てます。ただし Sonnet 5.5 で between_tools、Haiku 5.5 で disabled を使っている場合、メッセージ単位で effort を変えると 400 エラーになります。

budget_tokens から effort へ移る 3 ステップ

① budget_tokens を削除:公式の移行手順によると、Claude 4.7 以降のモデル(Opus 5.5、Sonnet 5、Sonnet 5.5、Fable 5.1、Haiku 5.5 など)では type enabled が 400 エラーになるため、thinking を省略するか thinking type adaptive を送ります(Opus 4.8 と Opus 4.7 は thinking を省略すると思考しないため、adaptive を明示します)。② 深さは output_config.effort で制御:省略時は Opus 5.5 と Haiku 5.5 が medium、他のモデルが high です。公式は旧モデルの設定を引き継がず、自分の評価で effort を改めて試すよう勧めています。③ max_tokens を広げ、コンテンツブロックは type で選ぶ:思考は max_tokens に含まれ、応答が thinking ブロックから始まることがあります。これらのモデルでは display の既定が omitted(thinking 欄は空で signature だけ)なので、要約を見たい場合は display を summarized にします。応答の usage.output_tokens_details.thinking_tokens で、課金対象の出力トークンのうち推論に使われた量がわかります。

QCode での使い方

QCode のドキュメントによると、Claude モデルは Anthropic プロトコルのエンドポイントでのみ使えます。Claude Code では ANTHROPIC_BASE_URL を https://api.qcode.cc/api に設定します(SDK が /api/v1/messages を組み立てます)。QCode で呼び出せる Claude 5.x モデルは claude-sonnet-5-5、claude-opus-5-5、claude-sonnet-5、claude-opus-5、claude-fable-5-1 で、同じキーのまま model を変えるだけで切り替えられます。Haiku 5.5(claude-haiku-5-5)の掲載は /models をご確認ください。課金はトークン単位で、各モデルの単価は /models に掲載しています。

よくある質問

思考をオフにできない Claude モデルはどれですか?

Opus 5.5、Fable 5.1、Fable 5 です。公式ドキュメントはこれらのモデルが thinking type disabled を拒否するとし、原文は「Thinking can't be turned off on these models」です。Sonnet 5.5 も disabled を拒否しますが、between_tools で事前の思考を切れます。Opus 5 と Haiku 5.5 は effort が high 以下のときだけ disabled を受け付け、Sonnet 5 はそのままオフにできます。送信前に Models API の capabilities.thinking.types.disabled で確認できます。

effort にはどんな段階があり、既定はどれですか?

low、medium、high、xhigh、max の 5 段階です。公式には多くのモデルの既定が high、Opus 5.5 と Haiku 5.5 が medium、Sonnet 5.5 は Claude API で high です。公式の説明では、max はトークン消費に制約のない最大能力、xhigh は長時間の作業向けの拡張能力、high はタスクに必要なだけトークンを使う段階、medium は適度に節約するバランス型、low は最も効率的で能力がやや下がります。

effort を下げるとどれくらい節約できますか?

公式は倍率を示していません。公式の説明では effort は厳密なトークン予算ではなく振る舞いのシグナルで、本文・ツール呼び出し・思考を含むすべての出力トークンに作用し、low は大きくトークンを節約できる代わりに能力がやや下がります。思考トークンは思考テキストが返されなくても出力トークンとして課金されます。推論に使われた量は応答の usage.output_tokens_details.thinking_tokens で確認できます。厳密な上限を設けられるのは max_tokens だけです。

budget_tokens はまだ使えますか?

Claude 4.7 以降のモデルでは使えず、type enabled と budget_tokens を送ると 400 エラーです。Claude 4.6 のモデルでは成功しますが非推奨です。Sonnet 4.5、Opus 4.5、Haiku 4.5 など手動の拡張思考だけに対応するモデルでは引き続き budget_tokens を使います。そのうち effort にも対応するのは Opus 4.5 だけで、両方を組み合わせて効きます。移行は budget_tokens を削除し、adaptive にして effort で深さを制御します。

Haiku 5.5 は思考の扱いで他の 5.x モデルとどう違いますか?

公式の設定表によると、5.5 世代の 3 モデルで thinking disabled を受け付けるのは Haiku 5.5 だけです。effort が high 以下なら思考をオフにでき、xhigh や max では 400 エラーになります。Opus 5.5 と同じく既定の effort は medium で、既定で思考します。思考テキストは既定で返されず、Haiku 4.5 は既定で要約を返していました。それでも公式は、品質と速度・コストの調整には思考オフより effort を優先するよう勧めています。

Claude Code で effort はどう変えますか?思考はオフにできますか?

/effort(引数なしでスライダーを開き、段階名を付けると直接設定、/effort auto で現在のモデルの保存値を解除)、起動時の --effort、環境変数 CLAUDE_CODE_EFFORT_LEVEL、または /model で左右キーを使います。Claude Code では Opus 5.5、Sonnet 5.5、Haiku 5.5 の既定が medium です。設定ファイルは max を受け付けず、環境変数で指定しない限り max は現在のセッションだけに適用されます。公式は Claude Code で Opus 5.5、Sonnet 5.5、Haiku 5.5、Fable 系の思考をオフにできず、MAX_THINKING_TOKENS=0 も効かないとしています。プロンプトに ultrathink と書くとコンテキスト内の指示が 1 つ加わるだけで、API に送る effort は変わりません。

情報源

Anthropic 公式ドキュメント(platform.claude.com、2026-10-08 取得):Thinking の概要(モデル別の設定表、思考オフの規則、display の既定値)、Troubleshooting thinking(モデルごとに受け付ける設定と拒否する設定)、Steering thinking(effort の各段階が思考に与える影響、コスト管理と課金)、Effort(5 段階の説明、モデル別の既定値と推奨)、Extended thinking(budget_tokens の非推奨化と移行)、Claude Haiku 5.5 の What's new と移行ガイド、モデル概要、Claude Platform のリリースノート(Opus 5.5、Sonnet 5.5、Haiku 5.5、Models API の新フィールドの日付)。Claude Code 公式ドキュメント Model configuration(code.claude.com、同日取得)。QCode ドキュメントのエンドポイントと API 形式のページ(docs.qcode.cc、同日取得)。

1 つのキーで Claude 5.x を呼び出す

Claude Code の ANTHROPIC_BASE_URL を https://api.qcode.cc/api にし、model に claude-sonnet-5-5 や claude-opus-5-5 などを入れるだけです。課金はトークン単位、各モデルの単価は /models に掲載しています。

関連記事

本ページは 2026-10-08 に Anthropic と Claude Code の公式ドキュメントの公開版と照合しています。上流の変更は予告なく行われることがあります。effort がトークン使用量に与える影響はタスクによって異なり、公式は固定の倍率を示していないため、本ページの内容はお客様の個別のワークロードを保証するものではありません。モデルの提供状況は /models をご確認ください。

まず試して、それから決める

どのプランか迷ったら、まずスターター($8.57/月)から。満足したらアップグレードし、旧プランの残り価値は按分で残高に戻ります。