Параллельные агенты: пул лимитов один, контекстов N
Когда агенты идут параллельно, что расходуется: 5-часовое окно и недельный лимит подписки Claude или собственный дневной API-лимит этого сайта? Двое часов считаются раздельно: цену за токен берём из открытого прайса Anthropic на 2026-09-22, чтение и запись кэша считаем отдельно, число агентов и длину контекста помечаем как допущение, арифметику расписываем целиком — чтобы пересчитали сами (сверено 2026-09-22).
Обновлено 2026-09-22
Четыре ключевых пункта
У каждого агента свой контекст
Обе страницы читаются линейно: «Token costs scale linearly», «token usage is roughly proportional to team size». Единственный множитель, который документация даёт (agent teams в plan mode), назван в токенах: «approximately 7x more tokens than standard sessions» — токены, а не счёт. От ×N его уводит лишь фиксированный префикс запроса: teammate подгружают CLAUDE.md, MCP servers и skills, число токенов не указано. Сверено 2026-09-22.
Отдельная запись кэша для worktree
«The API caches by matching the start of each request, called the prefix» — попадание это совпадение префикса. В Claude Code кэш идёт на машину и каталог: «each worktree has its own working directory», поэтому N worktree одного репозитория — это N префиксов и N записей в кэш. Строка Claude Sonnet 5 в прайсе Anthropic (на 2026-09-22): вход $2, чтение из кэша $0.20, запись $2.50 за MTok, тариф 5 минут. Деление входа на чтение даёт 10 раз — это отношение двух чисел из прайса, а не счёт, выросший в 10 раз. Сверено 2026-09-22.
Строка показывает только активный аккаунт
В usage-tracking: «Orca reads the local usage state each agent maintains on disk», следом «No API calls, no extra auth.», вывод — «numbers update when the agent writes, not in real time». Строка состояния показывает только активный аккаунт, а оценка помечена самим документом: «not a live bill from the provider». Названы только Claude Code, Codex, Gemini, OpenCode, Kimi Code и MiniMax; на всех агентов это не распространяем. Сверено 2026-09-22.
Параллельный учёт не выделяют
Начнём со страницы errors: «A single burst of heavy activity, such as a large workflow fanout, can exhaust the weekly allowance before the session window resets». Оба лимита считаются одновременно — «Usage counts against the session and weekly allowances at the same time», — и параллельный запуск не заводит второй счётчик. Всё под одним аккаунтом (claude.ai, Claude Code, Claude Desktop) расходуется из одной квоты. Вендор описывает её через «сколько сообщений» и «сколько времени», формулы в токенах нет — мы её не додумываем. Проверено 2026-09-22.
Как считается этот лимит
Лимит считается не по числу сессий и не по ширине параллелизма: по официальной модели токены накапливаются в двух окнах — 5-часовом session и недельном лимите со сбросом в закреплённое за аккаунтом время, и оба слоя охватывают все модели. В одном аккаунте claude.ai, Claude Code и Claude Desktop тратят один и тот же лимит, поэтому N параллельных агентов не заводят вторую книгу — тот же фиксированный контекст засчитывается несколько раз. Разделяйте субъектов: эти окна — сторона подписки Claude Code; в API с оплатой за запрос ёмкость пополняется, rather than being reset at fixed intervals. Сверено 2026-09-22.
Недельный слой за полгода
База лимитов за полгода сдвигалась дважды, и то и другое — в одной официальной статье. Временная надбавка: From May 13, 2026 through September 13, 2026, your weekly usage limit in Claude Code was 50% higher, а 5-часовой слой в неё не входил; с 2026-09-14 недельный слой стоит выше, чем до акции — starting September 14, 2026, weekly limits in Claude Code are 25% higher than they were before the promotion — и только для Claude Code. Значит, после 2026-09-14 fan-out попадает на слой, который не акционный и не прежний, поэтому кратные здесь — это сама официальная фраза того дня, а не проценты. Цены даны как текущие: Sonnet 5 — вход $2, чтение кэша $0.20, запись $2.50 (на 2026-09-22); сноска предупреждает, что цены и планы могут меняться по усмотрению вендора. Сверено 2026-09-22.
Даты сверки
2026-05-13: статья в центре помощи гласит "From May 13, 2026 through September 13, 2026, your weekly usage limit in Claude Code was 50% higher. 5-hour usage limits were not affected by this promotion." Надбавка легла только на недельный слой, 5-часовое окно не затронуто, действовала лишь в Claude Code (CLI, расширения IDE, десктоп, веб) и закончилась 2026-09-13. Сверено 2026-09-22.
2026-09-14: та же статья делает часть надбавки постоянной — "starting September 14, 2026, weekly limits in Claude Code are 25% higher than they were before the promotion for Pro, Max, Team, and seat-based Enterprise plans". Все фразы про недельный лимит на этой странице сверены с формулировкой после этой даты. Страница проверена 2026-09-22.
2026-09-22: цены и фразы про лимиты сняты с официальных архивов в тот же день и сверены дословно. Строка Claude Sonnet 5 на claude.com/pricing даёт вход, вывод, чтение и запись кэша, там же оговорка «Price and plans are subject to change at Anthropic's discretion.» Поэтому цены корректны только с этой датой; без неё они неверны. Сверено 2026-09-22.
Дословно в документации vs слухи
Подтверждено дословно
Четыре блока, каждый дословно совпал с официальными текстами, снятыми 2026-09-22. Лимиты: Your session-based usage limit will reset every five hours и Max plans also have a weekly usage limit that applies across all models; недельный слой сбрасывается в закреплённое за аккаунтом время; claude.ai, Claude Code и Claude Desktop делят один лимит. Параллельность: Each teammate runs its own context window, so token usage is roughly proportional to team size; единственное кратное от вендора — Agent teams use approximately 7x more tokens than standard sessions when teammates run in plan mode, и это про токены, а не про деньги. Потолок: Claude Code blocks further requests until the reset time shown in the message, смена модели не возвращает доступ. У оркестратора: Orca reads the local usage state each agent maintains on disk, No API calls, no extra auth.
⚠️ Слухи, без официальной базы
Три утверждения без опоры в снятых официальных текстах. Первое: «параллельность пробивает кэш, счёт вырастает до 10x или 50x». Таких кратных нет: это отклик сообщества, без официальной формулировки. Официальная фраза смотрит в иную сторону: запоздалых агентов Claude Code придержит, so their first requests read the shared prefix instead of each processing it uncached. Единственная «10» здесь — $2, делённое на $0.20: два числа из прайса, а не рост счёта. Второе: «предупреждение на 80%». 80% — порог статус-бара (у Orca: A warning chip when you cross 80% of a limit.), а в примере Claude Code написано You've used 85% of your session limit. Третье: «при исчерпании лимита аккаунт переключится сам». Такой функции нет; Usage Policy запрещает несколько аккаунтов ради обхода. Задокументировано иное: блокировка до сброса либо продолжение в открытой сессии. Сверено 2026-09-22.
Параллельно или одна сессия
N агентов параллельно
Параллельная сторона умножается на число копий. Допущение наше: вендор не публикует число токенов. Каждый агент заново отправляет фиксированный префикс 40000 токенов, агентов 5, по 20 раундов, ценим только этот префикс. В строке Sonnet 5 вход стоит $2 за миллион токенов: один раунд = 40000 / 1000000 × $2 = $0.08, итого = $0.08 × 5 × 20 = $8.00. Запись в кэш — один раз на агента, в первом раунде, как верхняя граница (вендор пишет и о том, что агенты одной волны перечитывают общий префикс), по $2.50: 40000 / 1000000 × $2.50 = $0.10, на 5 агентов это $0.50. Цены по состоянию на 2026-09-22.
Одна длинная сессия
Односессионная сторона платит фиксированную часть один раз: после записи префикса каждый раунд считается как чтение из кэша по $0.20, а списочная цена входа $2 в делении на неё даёт 10 — это два числа из прайса, а не счёт, умноженный на 10. Болеть начинает на паузе: Cached prefixes automatically expire after a minimum of 5 minutes of inactivity, строки кэша идут с пометкой Prompt caching pricing reflects 5-minute TTL, а после смены модели the next request re-reads the whole conversation with no cache hits. Сверено 2026-09-22.
Три шага расчёта параллельного запуска
1) Измеряем фиксированный префикс P задачи: системный промпт, инструменты, CLAUDE.md — то, что уходит заново. Anthropic не публикует число токенов, поэтому P = 40,000 — помеченное допущение, не официальная цифра. 2) Умножаем на параллельность и ходы: each teammate has its own context window and consumes tokens independently и token usage is roughly proportional to team size; берём N = 5 и T = 20. 3) Считаем по строке Sonnet 5 на claude.com/pricing (2026-09-22): вход $2 / MTok, чтение кэша $0.20 / MTok, запись кэша на 5 минут $2.50 / MTok. Холодный ход: 40,000 ÷ 1,000,000 × 2 = $0.08, далее × 5 × 20 = $8.00. Целиком из кэша: 40,000 ÷ 1,000,000 × 0.20 = $0.008, итого $0.80. Запись на агента: 40,000 ÷ 1,000,000 × 2.50 = $0.10, на 5 = $0.50. Цена входа ÷ цена чтения кэша = 10 ($2 ÷ $0.20): два числа из прайса, не умножение счёта в 10 раз. Вывод и результаты инструментов вне примера.
Что видно со стороны вашего ключа
Сначала разведём двое часов. Пятичасовое окно и недельный лимит — механизм подписки Claude, не наш. Мы продаём API, и единственная оставшаяся ось расхода для личных тарифов — дневной лимит. Ключ показывает срок действия, расход за сегодня, месячную квоту и процент использования по активным API-ключам; интерфейс только для чтения — ничего не создаёт и не тратит, — а у токена есть лимиты в минуту и в сутки плюс секунды кэша, так что бесконечно его не опросишь. Для личного ключа разрешено 5 одновременных запросов (по состоянию на 2026-09-22): лишние агенты ждут очереди, шестого канала нет. Оркестратор тоже не агрегирует счёт: полоса следует за активным аккаунтом, а расчёт — not a live bill from the provider. Не обещаем экономию, только пересчитываемость (сверено 2026-09-22).
Частые вопросы
Если лимит исчерпан, можно автоматически переключить аккаунт?
Как обещание — нет. Официальное поведение: Claude Code blocks further requests until the reset time shown in the message, а разрешённый способ продолжить — In an interactive session signed in with a claude.ai subscription, Claude Code can also wait in the open session and continue the interrupted task shortly after the reset, то есть та же подписка ждёт сброса, а не перескакивает на другой аккаунт. Смена модели не помогает: session and weekly limits are shared across all models. И главное: официальная usage policy прямо запрещает Create or manage multiple accounts to evade detection or circumvent platform safeguards. Недельный слой, по документации, resets at a fixed time each week that is assigned to your account, независимо от того, когда вы начали (сверено 2026-09-22).
Почему смена модели или аккаунта выбивает кэш?
По моделям есть прямая цитата: Each model has its own prompt cache, so the next request re-reads the whole conversation with no cache hits. По аккаунтам документация говорит другое: Caches are isolated between organizations. Different organizations never share caches, even if they use identical prompts — в другую организацию тот же префикс пишется заново, а цена — 5-minute cache write tokens are 1.25 times the base input tokens price. И даже на месте нужно, чтобы выполнялось Cache hits require 100% identical prompt segments: имя ветки или путь конкретного worktree внутри префикса ломают попадание. Расхожая цифра «счёт вырастет в 10–50 раз» в снятых официальных текстах не подтверждается: это обратная связь сообщества без официальной формулировки, и на этой странице она не подаётся как утверждение о стоимости (сверено 2026-09-22).
Дробить задачу на больше агентов — выйдет дешевле?
Не обязательно, чаще наоборот. Каждый агент несёт свою копию фиксированного префикса: Each subagent starts with a fresh, isolated context window, дальше — each teammate has its own context window and consumes tokens independently, и token usage is roughly proportional to team size; на странице workflows добавлено, что a single run can use meaningfully more tokens than working through the same task in conversation. При нашем допущении P = 40,000 разбиение одной работы на K частей означает K оплат того же префикса — это наша арифметика, а не официальная цифра. Единственный множитель, который Anthropic называет сам, — plan mode agent teams at 7x more tokens than standard sessions, и это токены, а не счёт в 7 раз больше. Порог один: превышает ли экономия на повторных чтениях величину (K − 1) × P × цена входа (сверено 2026-09-22).
Предупреждение «80 процентов» — чью цифру оно смотрит?
Начнём с происхождения: 80 процентов — собственный порог оркестратора, в его usage-tracking прямо: A warning chip when you cross 80% of a limit; у Anthropic в примере другая цифра — 85% of your session limit, это не одно и то же. Слой, за которым он следит, — две полосы, five-hour session and weekly usage limits, машинное определение: Percentage of the 5-hour or 7-day rate limit consumed, from 0 to 100, причём эти окна appears only for claude.ai Pro and Max subscribers, у API-ключа их нет. И сам показатель не живой: numbers update when the agent writes, not in real time. Годится как подсказка «притормози», не годится как основа сверки (сверено 2026-09-22).
Параллельный запуск сразу даёт 429?
Опять двое часов. На стороне API лимиты считаются по классам моделей в RPM, ITPM и OTPM, при превышении приходит 429 с retry-after; две официальные фразы бьют по параллелизму: Short bursts of requests can exceed the limit and trigger rate limit errors, а резкий скачок расхода упирается в acceleration limits. Размер пула задан там, где Limits are set at the organization level, поэтому fan-out его не увеличивает, а ёмкость пополняется постоянно, без фиксированных сбросов. На стороне подписки потолок — не 429: Claude Code blocks further requests until the reset time shown in the message. Для ключа, облака и оплаты по мере использования документация говорит usage there is metered per request, so there is no reset to wait for — ждать нечего. У нашего ключа разрешено 5 одновременных запросов (по состоянию на 2026-09-22); очередь — это не блокировка (сверено 2026-09-22).
Как оценить реальную стоимость параллельного прогона?
Держитесь трёх шагов и добавьте три рамки. Во-первых, даты у цен: официальная страница прайса сама пишет Price and plans are subject to change at Anthropic's discretion, а слой кэша дополняет Prompt caching pricing reflects 5-minute TTL. Во-вторых, попадания проверяйте сами: Cache hits require 100% identical prompt segments — один иной байт в префиксе, и попадания нет. В-третьих, не сверяйтесь с оркестратором: он покрывает 6 провайдеров (Claude Code, Codex, Gemini, OpenCode, Kimi Code, MiniMax), читает ту локальную бухгалтерию, которую каждый агент пишет на диск (No API calls, no extra auth), его расчёт — not a live bill from the provider, и документация сама говорит Prefer the provider console for authoritative spend. Раз claude.ai, Claude Code и Desktop на одном аккаунте уходят в один пул, собирать нужно счёт провайдера или ключа, а не сумму индикаторов (сверено 2026-09-22).
Источники
Официальные источники Anthropic: https://claude.com/pricing (строки 700–710 снятого текста — блок Sonnet 5, строки 121 и 724 — оговорка об изменениях и TTL); https://code.claude.com/docs/en/errors, /costs, /agent-teams, /workflows, /statusline, /interactive-mode, /sub-agents; https://platform.claude.com/docs/en/api/rate-limits; https://platform.claude.com/docs/en/build-with-claude/prompt-caching; статьи справки 11049741, 11647753, 12005017, 9797557. Сторонний оркестратор: https://www.onorca.dev/docs/agents/usage-tracking. Внутри сайта: https://qcode.cc/pricing, /enterprise, /api-key-usage-query-guide, /claude-code-cost-optimization, /multi-tool-quota-rotation. Всё сверено 2026-09-22; по каждому внешнему утверждению сохранены датированный оригинал и дословная опорная строка — их можно перепроверить по дате, указанной на странице.
Сверьте цены и параллельность первыми
Цены и формулировки лимитов здесь сверены 2026-09-22; объём токенов, число агентов и число ходов в примере — явно помеченные допущения самой страницы. Нигде не обещаем, что смена аккаунта или модели позволит продолжить прогон, и не обещаем экономию по тем же расчётам: подставьте свой измеренный префикс и пересчитайте.
Похожие материалы
Ротация лимитов между инструментами
У каждого инструмента свой механизм лимитов; ротация и границы соответствия описаны там, отдельного подхода эта страница не добавляет.
Запрос расхода и срока действия ключей
Как запросить срок, расход за сегодня и месячную квоту по вашим ключам: три эндпоинта только для чтения.
Гид по ADE Orca для разработки агентов
Что это и чем не является, как запускать агентов в отдельных worktree, а также установка и ловушки с одинаковыми именами — на той странице.
Страница пересказывает документацию, которую публикуют Anthropic и сторонний оркестратор; мы ни с кем из них не связаны и одобрения не имеем. Цены моделей, формулировки лимитов, охват и поведение индикатора ограничены текстами, снятыми 2026-09-22, причём официальная страница прайса сама оставляет право менять цены и планы. Объём токенов, число агентов и число ходов в примере — явно помеченные допущения самой страницы; опору в источнике имеют только цены и множители. Распространённые в сообществе оценки «счёт вырастет во много раз» в снятых официальных текстах не подтверждаются, поэтому остаются мнением сообщества и не подаются как утверждение о стоимости. QCode — один из поставщиков ключа читателя и не отвечает за поведение и показания стороннего оркестратора (сверено 2026-09-22).