Adaptive thinking и параметр effort в Claude: разбор по моделям
На 2026-10-08 у всех моделей Claude 5.x адаптивное мышление (adaptive thinking) включено по умолчанию: на Opus 5.5, Fable 5.1 и Fable 5 его нельзя отключить; Sonnet 5.5 не принимает disabled, и самый низкий режим у неё — between_tools; Opus 5 и Haiku 5.5 принимают disabled только при effort high и ниже; Sonnet 5 отключает мышление без условий. Глубину мышления теперь задают через output_config.effort (low / medium / high / xhigh / max): по умолчанию medium на Opus 5.5 и Haiku 5.5 и high на остальных, а budget_tokens на Claude 4.7 и всех более новых моделях возвращает ошибку 400.
Обновлено 2026-10-08
Четыре вывода, которые стоит запомнить
Мышление на Opus 5.5 / Fable 5.1
По официальной документации Opus 5.5, Fable 5.1 и Fable 5 отклоняют thinking disabled, поэтому мышление не отключается; на Opus 5.5 запрос с disabled возвращает 400 на любом уровне effort.
Effort по умолчанию в API
Официально у большинства моделей по умолчанию high, у Opus 5.5 и Haiku 5.5 — medium. Явная передача значения по умолчанию равносильна его отсутствию и не сбрасывает кэш промптов.
Значения effort
low, medium, high, xhigh и max. Opus 5.5, Sonnet 5.5 и Haiku 5.5 поддерживают все пять; в документации отмечено, что не каждая модель с max поддерживает xhigh.
Статус budget_tokens
Документация прямо говорит: Claude 4.7 и более новые модели отклоняют type enabled с budget_tokens; на моделях Claude 4.6 запрос проходит, но режим устарел; на 4.5 и ранее это единственный ручной режим.
За что отвечают adaptive thinking и effort
На 2026-10-08 официальные определения такие: при адаптивном мышлении модель для каждого запроса сама решает, думать ли и сколько, а параметр effort управляет тем, сколько токенов Claude тратит на ответ. Задачи у них разные: thinking определяет, будет ли Claude сначала рассуждать в блоках thinking, а effort — сколько работы уйдёт на весь ответ, включая мышление, текст и вызовы инструментов. Документация предупреждает, что adaptive — это режим мышления, а не уровень effort, и передавать его в effort нельзя. Effort задаётся в output_config.effort, а не внутри объекта thinking; это поведенческий сигнал, а не строгий бюджет токенов, поэтому ни один уровень не гарантирует блок thinking в каждом запросе.
Последние официальные изменения
Opus 5.5, вышедшая 2026-09-22, снизила effort по умолчанию до medium: в документации сказано, что Opus 5 и более ранние Opus по умолчанию работают на high, поэтому без effort запрос на Opus 5.5 идёт на уровень ниже, чем на Opus 5, а мышление у неё всегда включено и не отключается. Sonnet 5.5 от 2026-09-28 отклоняет disabled: чтобы выключить предварительное мышление, отправляют between_tools, и это работает только при effort high и ниже. С 2026-10-05 Models API сообщает capabilities.thinking.types.disabled, так что ещё до запроса можно проверить, принимает ли модель disabled (если нет, supported равно false). Haiku 5.5 от 2026-10-07 думает по умолчанию, на ручной budget_tokens отвечает ошибкой 400, а ответ может начинаться с блоков thinking.
Хронология
Выходит Claude Opus 5.5 (claude-opus-5-5): мышление всегда включено, thinking disabled и enabled возвращают 400, effort по умолчанию medium.
Выходит Claude Sonnet 5.5 (claude-sonnet-5-5): предварительное мышление выключают через between_tools, и только при effort high и ниже.
Выходит Claude Haiku 5.5 (claude-haiku-5-5): адаптивное мышление включено по умолчанию, budget_tokens даёт 400, а disabled выключает мышление при high и ниже.
Подтверждено vs не указано производителем
Подтверждено (дословно в официальной документации)
Всё перечисленное можно дословно проверить в официальной документации Anthropic и Claude Code: на Opus 5.5, Fable 5.1 и Fable 5 мышление не отключается; Sonnet 5.5 отклоняет disabled, а between_tools работает только при high и ниже; Opus 5 и Haiku 5.5 принимают disabled только при high и ниже; Sonnet 5 мышление отключает; Opus 4.8, Opus 4.7, Opus 4.6 и Sonnet 4.6 не думают, пока не задан adaptive; официальное описание каждого уровня effort и значения по умолчанию для моделей; budget_tokens возвращает 400 на Claude 4.7 и новее; токены мышления оплачиваются как выходные и входят в max_tokens; в Claude Code мышление на Opus 5.5, Sonnet 5.5, Haiku 5.5 и моделях Fable не отключается.
Чего производитель не сообщает
Три вещи официально не опубликованы, поэтому не стройте на них бюджет. Во-первых, насколько больше или меньше токенов и денег уходит на каждом уровне effort: документация лишь называет effort поведенческим сигналом, а не строгим бюджетом, и коэффициентов не даёт. Во-вторых, одноимённые уровни у разных моделей не равнозначны: по словам производителя, шкала effort откалибрована под каждую модель, а уровни Sonnet 5.5 перекалиброваны, так что переносить старые настройки между моделями оснований нет. В-третьих, официального пересчёта вида такой-то effort равен стольким-то budget_tokens в первоисточниках нет; официальная инструкция по миграции требует только убрать budget_tokens и перейти на effort.
Что выбрать: effort, max_tokens или отключение мышления
effort против max_tokens
По формулировке документации effort — мягкий ориентир, а max_tokens — жёсткий предел: max_tokens ограничивает весь вывод запроса, мышление и текст вместе, а effort лишь влияет на то, какая доля этого объёма уйдёт на мышление, и количества токенов не гарантирует. Чтобы снизить стоимость или задержку, документация советует сначала понизить effort — это уменьшает весь ответ, включая мышление; для жёсткого потолка нужен max_tokens. На high и выше Claude может долго рассуждать и с большей вероятностью исчерпает max_tokens.
Понизить effort или отключить мышление
Модели, где мышление отключается (Sonnet 5, а также Opus 5 и Haiku 5.5 при high и ниже), принимают disabled, но для Haiku 5.5 документация называет effort лучшим способом балансировать качество, скорость и стоимость. На Opus 5.5 и Fable 5.1 мышление не отключить, так что остаётся только effort; у Sonnet 5.5 самый низкий режим — between_tools. Смена настроек thinking или effort верхнего уровня сбрасывает кэш промптов; на Opus 5.5, Sonnet 5.5, Haiku 5.5 и ряде других моделей можно менять effort на уровне сообщения (бета, заголовок mid-conversation-output-config-2026-07-01) и сохранять кэш. Но при between_tools на Sonnet 5.5 или disabled на Haiku 5.5 смена effort на уровне сообщения возвращает 400.
Три шага от budget_tokens к effort
Шаг 1 — уберите budget_tokens: в официальной инструкции по миграции сказано, что на Claude 4.7 и более новых моделях, например Opus 5.5, Sonnet 5, Sonnet 5.5, Fable 5.1 и Haiku 5.5, type enabled возвращает 400, поэтому опустите thinking или отправьте thinking type adaptive (на Opus 4.8 и Opus 4.7 без поля thinking модель не думает, поэтому задайте adaptive явно). Шаг 2 — управляйте глубиной через output_config.effort: без него Opus 5.5 и Haiku 5.5 работают на medium, остальные модели на high, а документация советует заново прогнать уровни effort на своих тестах, а не переносить настройки со старой модели. Шаг 3 — увеличьте max_tokens и выбирайте блоки контента по type: мышление входит в max_tokens, и ответ может начинаться с блоков thinking; на этих моделях display по умолчанию omitted (пустое поле thinking и только signature), поэтому для сводки задайте display summarized. Поле usage.output_tokens_details.thinking_tokens в ответе показывает, сколько оплачиваемых выходных токенов ушло на рассуждения.
В QCode
Согласно документации QCode, модели Claude работают только через эндпоинт с протоколом Anthropic: в Claude Code задайте ANTHROPIC_BASE_URL равным https://api.qcode.cc/api (SDK сам достроит /api/v1/messages). Через QCode можно вызывать модели Claude 5.x claude-sonnet-5-5, claude-opus-5-5, claude-sonnet-5, claude-opus-5 и claude-fable-5-1; один ключ переключается между ними сменой поля model. Появление Haiku 5.5 (claude-haiku-5-5) смотрите на странице /models. Оплата за токены, цена каждой модели указана на /models.
Частые вопросы
На каких моделях Claude нельзя отключить мышление?
На Opus 5.5, Fable 5.1 и Fable 5. Документация говорит, что эти модели отклоняют thinking type disabled, дословно: «Thinking can't be turned off on these models». Sonnet 5.5 тоже отклоняет disabled, но between_tools выключает её предварительное мышление; Opus 5 и Haiku 5.5 принимают disabled только при effort high и ниже; Sonnet 5 отключает мышление напрямую. Проверить заранее можно по полю capabilities.thinking.types.disabled в Models API.
Какие уровни effort существуют и какой стоит по умолчанию?
Пять: low, medium, high, xhigh и max. По документации у большинства моделей по умолчанию high, у Opus 5.5 и Haiku 5.5 — medium, у Sonnet 5.5 в Claude API — high. Официальные описания: max — абсолютный максимум возможностей без ограничений на расход токенов, xhigh — расширенные возможности для долгой работы, high тратит столько токенов, сколько нужно задаче, medium — сбалансированный вариант с умеренной экономией, low — самый экономный, с некоторым снижением возможностей.
Сколько можно сэкономить, понизив effort?
Производитель коэффициентов не приводит. В документации effort назван поведенческим сигналом, а не строгим бюджетом токенов; он действует на все выходные токены, включая текст, вызовы инструментов и мышление, а low даёт заметную экономию токенов ценой некоторого снижения возможностей. Токены мышления оплачиваются как выходные, даже если текст мышления вам не возвращается; сколько ушло на рассуждения, видно в usage.output_tokens_details.thinking_tokens. Жёсткий потолок задаёт только max_tokens.
Можно ли ещё пользоваться budget_tokens?
На Claude 4.7 и более новых моделях нельзя: type enabled с budget_tokens возвращает 400. На моделях Claude 4.6 запрос проходит, но режим устарел. Модели, поддерживающие только ручное расширенное мышление, такие как Sonnet 4.5, Opus 4.5 и Haiku 4.5, продолжают работать с budget_tokens; из них только Opus 4.5 поддерживает ещё и effort, и оба параметра действуют вместе. Для миграции уберите budget_tokens, переключитесь на adaptive и управляйте глубиной через effort.
Чем Haiku 5.5 отличается от других моделей 5.x в части мышления?
По официальной таблице настроек Haiku 5.5 — единственная из трёх моделей поколения 5.5, которая принимает thinking disabled: при effort high и ниже мышление выключается, а при xhigh или max запрос возвращает 400. Как и Opus 5.5, она по умолчанию работает на medium и думает по умолчанию; текст мышления по умолчанию не возвращается, тогда как Haiku 4.5 возвращала сводку. Документация всё равно советует балансировать качество, скорость и стоимость через effort, а не отключением мышления.
Как задать effort в Claude Code и можно ли там отключить мышление?
Через /effort (без аргумента открывается ползунок, с названием уровня он задаётся сразу, /effort auto сбрасывает сохранённый уровень для текущей модели), флаг запуска --effort, переменную окружения CLAUDE_CODE_EFFORT_LEVEL или стрелки влево и вправо в /model. В Claude Code у Opus 5.5, Sonnet 5.5 и Haiku 5.5 по умолчанию medium; файлы настроек не принимают max, и если max не задан через переменную окружения, он действует только в текущей сессии. Документация прямо говорит, что в Claude Code на Opus 5.5, Sonnet 5.5, Haiku 5.5 и моделях Fable мышление не отключается, а MAX_THINKING_TOKENS=0 на них не действует; слово ultrathink в промпте лишь добавляет инструкцию в контекст, а effort, отправляемый в API, не меняется.
Источники
Официальная документация Anthropic (platform.claude.com, загружено 2026-10-08): обзор Thinking (таблица настроек по моделям, правила отключения мышления, значения display по умолчанию), Troubleshooting thinking (поддерживаемые и отклоняемые настройки для каждой модели), Steering thinking (как уровни effort влияют на мышление, контроль затрат и тарификация), Effort (пять уровней, значения по умолчанию и рекомендации по моделям), Extended thinking (вывод budget_tokens из употребления и миграция), страница What's new и руководство по миграции для Claude Haiku 5.5, обзор моделей и примечания к выпускам Claude Platform (даты для Opus 5.5, Sonnet 5.5, Haiku 5.5 и нового поля Models API). Официальная документация Claude Code, раздел Model configuration (code.claude.com, в тот же день). Страница документации QCode об эндпоинтах и путях API (docs.qcode.cc, в тот же день).
Claude 5.x по одному ключу
Задайте в Claude Code ANTHROPIC_BASE_URL равным https://api.qcode.cc/api и укажите в model claude-sonnet-5-5, claude-opus-5-5 или другую модель; оплата за токены, цены моделей на /models.
Читайте также
Claude ultracode и max: в чём разница
Ultracode — отдельный переключатель Claude Code, а не уровень effort: как включить и когда выбирать max.
Миграция на Claude Sonnet 5.5: ошибка отключения thinking и between_tools
Точный текст ошибки disabled, ограничения between_tools и effort, computer_20251124.
Полное руководство по Claude Sonnet 5.5
Характеристики, прайс, effort по умолчанию и пять ломающих изменений.
Страница сверена 2026-10-08 с актуальными версиями официальной документации Anthropic и Claude Code; изменения на стороне вендора возможны без предупреждения. Влияние effort на расход токенов зависит от задачи, фиксированных коэффициентов производитель не публикует, поэтому ничто здесь не является обещанием для вашей конкретной нагрузки. Доступность моделей смотрите на /models.