利用枠とコスト · 確認日 2026-09-22

並列エージェントの利用枠とコスト:プールは一つ、コンテキストは N 個

エージェントを同時に動かすと、何が消費されるのか。Claude 契約側の 5 時間窓と週上限なのか、それとも当サイトの API 日次上限なのか。このページでは二つの時計を分けて数える:単価は Anthropic が 2026-09-22 に公開している表示価格、キャッシュの読みと書きは別々に計上し、同時数とコンテキスト長は仮定として明示、計算式はそのまま並べるので誰でも再計算できる。

更新日 2026-09-22

#5 時間枠と週上限#N 個の並列エージェント#キャッシュヒットと書き込み#検算できる計算例

まず押さえて四点

ほぼ比例

エージェントごとに別々のコンテキスト

二頁とも線形の書き方だ。「Token costs scale linearly」「token usage is roughly proportional to team size」。公式が挙げる唯一の倍率(agent teams を plan mode で)にも単位が付く。「approximately 7x more tokens than standard sessions」——token の話で請求額ではない。×N からずらすのは各依頼の固定接頭辞だけ。teammate は各自 CLAUDE.md、MCP servers、skills を読むが、token 数は出ていない。確認日 2026-09-22。

接頭辞の一致

worktree ごとにキャッシュ書き込み

当たりは接頭辞しだい。「The API caches by matching the start of each request, called the prefix」。Claude Code ではキャッシュがマシンとディレクトリ単位に隔離され、公式は「each worktree has its own working directory」と名指しする。同一リポジトリで N 個の worktree を使えば、接頭辞もキャッシュ書き込みも N ずつだ。Anthropic 価格表の Claude Sonnet 5 の行(2026-09-22 時点)は入力 $2、キャッシュ読み $0.20、書き込み $2.50(MTok 当たり、5 分枠)。入力価格を読み価格で割ると 10 倍——これは表の二つの数の比で、請求が 10 倍になる話ではない。確認日 2026-09-22。

ローカルの記帳

バーは有効アカウントだけを示す

usage-tracking 頁には「Orca reads the local usage state each agent maintains on disk」、続けて「No API calls, no extra auth.」、結語が「numbers update when the agent writes, not in real time」。ステータスバーは有効アカウントだけを示し、見積行は自分で「not a live bill from the provider」と注記する。名指しは Claude Code、Codex、Gemini、OpenCode、Kimi Code、MiniMax のみ。全 agent の話にはしない。確認日 2026-09-22。

積算される同じ枠

並列用に別枠はない

まず errors ページのあの一文:A single burst of heavy activity, such as a large workflow fanout, can exhaust the weekly allowance before the session window resets. 二つの枠は同時に集計されます(公式原句 Usage counts against the session and weekly allowances at the same time)。並列でもう一本メーターが増えるわけではない。同一アカウントの claude.ai・Claude Code・Claude Desktop は同じ上限を共有します。公式はサブスクの上限を「何通送れるか、いつまで使えるか」で説明し、token 換算の式は示さないため、本記事では補いません。2026-09-22 照合。

この帳簿の数え方

限度額はセッション数でも並列数でも数えられない。公式の型は token を二つの窓に累計で積む方式で、5 時間の session と、アカウントごとに固定時刻が決まっている週次限度がそれにあたり、両方とも全モデルで共有される。同一アカウントなら claude.ai、Claude Code、Claude Desktop も同じ限度に紐づく。だから agent を N 個並列にしても帳簿は増えず、同じ固定コンテキストが繰り返し計上されるだけだ。主体は分ける必要がある。この二つの窓は Claude Code のサブスク側の仕組みだ。API 従量課金は容量が回復し続ける側の話だ。2026-09-22 に確認。

この半年の週次上限

限度額の基準はこの半年で二回動いた。どちらも公式ヘルプセンターの記事に書かれている。一時的な上乗せは From May 13, 2026 through September 13, 2026, your weekly usage limit in Claude Code was 50% higher の三か月で、5 時間の層は入っていない。2026-09-14 以降は週枠がプロモーション前より高い位置で止まり、同じ記事の原文は starting September 14, 2026, weekly limits in Claude Code are 25% higher than they were before the promotion、適用範囲は Claude Code に限られる。日付は下のタイムラインに並べるので、ここでは並列計算例への意味だけ残す。2026-09-14 以降の同じ fan-out が当たる週枠は、プロモーション期の口径でもプロモーション前でもなく、だから本ページの倍率は当日取り直した公式の文どおりにしか書かず、パーセントには換算しない。価格側は現在値としてだけ引く。Sonnet 5 は入力 $2、キャッシュ読み $0.20、キャッシュ書き $2.50(2026-09-22 時点)で、同じページの脚注は価格とプランが変更され得ると告げている。2026-09-22 に確認。

確認した日付

2026-05-13

2026-05-13:公式ヘルプセンターの記事に「From May 13, 2026 through September 13, 2026, your weekly usage limit in Claude Code was 50% higher. 5-hour usage limits were not affected by this promotion.」とある。上乗せは週上限の層だけで、5 時間窓は対象外、適用も Claude Code(CLI、IDE 拡張、デスクトップ、ウェブ)に限られ、2026-09-13 に終わった。確認日 2026-09-22。

2026-09-14

2026-09-14:同じ記事が上乗せの一部を恒久化している。「starting September 14, 2026, weekly limits in Claude Code are 25% higher than they were before the promotion for Pro, Max, Team, and seat-based Enterprise plans」だから、本ページの週上限に関する記述はこの日以降の口径を前提にする。確認日は 2026-09-22。

2026-09-22

2026-09-22:このページが引く価格と上限の文は当日に公式アーカイブへ取り、一語ずつ照合した。claude.com/pricing の Claude Sonnet 5 の行は入力・出力・キャッシュ読み・書き込みの四つを返し、同じ頁に「Price and plans are subject to change at Anthropic's discretion.」の但し書きがある。価格はこの日付付きでのみ成立し、外すと壊れる。確認日 2026-09-22。

公式逐語 vs コミュニティ説

公式で逐語確認できる

四塊すべて、2026-09-22 に取得した公式本文と一字一句一致する。限度:Your session-based usage limit will reset every five hours、Max plans also have a weekly usage limit that applies across all models。週枠は resets at a fixed time each week that is assigned to your account のとおりにリセットされ、claude.ai、Claude Code、Claude Desktop は同一の限度を共有する。並列:Each teammate runs its own context window, so token usage is roughly proportional to team size。公式が出る唯一の倍率は Agent teams use approximately 7x more tokens than standard sessions when teammates run in plan mode で、この文は token の話であり金額ではない。上限到達:Claude Code blocks further requests until the reset time shown in the message、モデルを替えても解けない。オーケストレーター側:Orca reads the local usage state each agent maintains on disk、No API calls, no extra auth。

⚠️ コミュニティ説、公式基準なし

よく回る三つの説で、今回取得した公式本文には裏付けがない。一、「並列だとキャッシュが破綻して明細が 10x や 50x になる」:この倍率は本文のどこにも出ないので、コミュニティの反応であって公式の言い方は存在しないとしか書けない。公式の文はむしろ逆を指す。後発エージェントは一旦待たされ、their first requests read the shared prefix instead of each processing it uncached が成り立つ。本ページで 10 と書いた唯一の場所は $2 を $0.20 で割った値、価格表の二つの数の割り算だ。二、「80% で警告」:80% はオーケストレーターの状態バーが自分で置いた閾値(Orca のドキュメントの原文 A warning chip when you cross 80% of a limit.)で、Claude Code の例は You've used 85% of your session limit。主体が違う二つの数だ。三、「上限に当たると自動でアカウントを切り替えて続ける」:この機能は公式文書になく、Usage Policy はむしろ複数アカウント作成による回避を禁止項に挙げている。公式が書くのは、リセット時刻まで遮る、またはサブスク状態で開いたままのセッションで続ける、という挙動だ。2026-09-22 に確認。

並列か単一会話か

N 個の並列 agent

並列側は個数分に乗算する。仮定は本ページのもので、公式に token 数の発表はない:各 agent が毎回 40000 token の固定プレフィックスを再送し、agent は 5 個、各 20 回、計算するのはこの分だけ。Sonnet 5 の行の入力定価は百万 token あたり $2 だから、一回 = 40000 / 1000000 × $2 = $0.08、合計 = $0.08 × 5 × 20 = $8.00。キャッシュ書き込みは各 agent の初回に一度だけと上界で数える(公式は同批 agent が互いのプレフィックスを再読できることも書く)、単価 $2.50、40000 / 1000000 × $2.50 = $0.10、5 個で $0.50。三つの単価とも 2026-09-22 時点。

一つの長会話

単一会話側は固定分を一度だけ払う:プレフィックスを書き終えれば、各回はキャッシュ読み $0.20 で計上され、入力定価 $2 をそれで割ると 10 になる——これは価格表の二つの数を割った値で、明細が 10 倍になるという意味ではない。効くのは途切れの方だ。公式は Cached prefixes automatically expire after a minimum of 5 minutes of inactivity と書き、キャッシュの行には Prompt caching pricing reflects 5-minute TTL という注記が付き、モデルを替えると the next request re-reads the whole conversation with no cache hits とも書かれる。2026-09-22 に確認。

三ステップで並列コストを出す

1)まず一タスク分の固定プレフィックス P を測る。システムプロンプト、ツール定義、CLAUDE.md など毎ターン送り直す部分だ。公式は token 数を示していないので、下の P = 40,000 は明示した仮定入力であり公式の数字ではない。2)並列数とターン数を掛ける。公式は each teammate has its own context window and consumes tokens independently、同じページに token usage is roughly proportional to team size。よって本ページは N = 5、T = 20 とする。3)公式の価格表で段階別に計算する。2026-09-22 時点の claude.com/pricing の Sonnet 5 の行より、入力 $2 / MTok、キャッシュ読み $0.20 / MTok、5 分キャッシュ書き込み $2.50 / MTok。初回(当たりなし)= 40,000 ÷ 1,000,000 × 2 = $0.08、さらに × 5 × 20 = $8.00。全ヒット = 40,000 ÷ 1,000,000 × 0.20 = $0.008 で計 $0.80。agent ごとの書き込み一回 = 40,000 ÷ 1,000,000 × 2.50 = $0.10、5 で $0.50。定価入力をキャッシュ読みで割ると 10 倍($2 ÷ $0.20)だが、これは価格表の二つの数であり、請求が 10 倍になる話ではない。出力とツール結果はこの例の外。

key 側で見えるもの

まず時計を二つに分ける。5 時間窓と週上限は Claude サブスクリプション側の仕組みで、当サイトのスイッチではない。当サイトが売るものは API であり、個人プランに残った唯一の使用量の軸は日次上限である。key 側では、すべての有効 API Key の期限・本日の使用量・月次クォータ・使用率が見える。ただしインターフェースは読み取り専用で、作成・変更・残高消費はできず、照会トークン自身にも分あたりと日あたりの上限と数秒のキャッシュがあるので、無限に照会してよい残高計ではない。並列には別の縛りがある。個人プランの API Key の同時実行数は 5(2026-09-22 時点)で、超過分は待機するだけで六本目の回線は開かない。オーケストレータも台帳を自動で集約しない:バーはアクティブなアカウントに追随し、推定価額は not a live bill from the provider。必ず安くなるとは言わない。このページの数字はすべて自分で再計算できる、そこだけ保証する(照合 2026-09-22)。

よくある質問

上限に達したら自動でアカウントを切り替えて続けられる?

実行方法として約束はできない。公式が書く挙動は Claude Code blocks further requests until the reset time shown in the message で、許された続き方の表記は In an interactive session signed in with a claude.ai subscription, Claude Code can also wait in the open session and continue the interrupted task shortly after the reset —— つまり同じサブスクリプションでリセットを待つのであって、アカウントを乗り換えるのではない。モデルを替えても無意味で、session and weekly limits are shared across all models。さらに重要なのは、公式の Usage Policy が Create or manage multiple accounts to evade detection or circumvent platform safeguards を禁止事項に挙げていること。週の層は resets at a fixed time each week that is assigned to your account と書かれ、作業開始時刻とは無関係に決まる(照合 2026-09-22)。

モデルやアカウントを変えるとキャッシュが壊れるのはなぜ?

モデルについては公式原句がある:Each model has its own prompt cache, so the next request re-reads the whole conversation with no cache hits。アカウント/組織については、公式は Caches are isolated between organizations. Different organizations never share caches, even if they use identical prompts と書く——別の組織に移れば同じプレフィックスをもう一度書くことになり、単価は 5-minute cache write tokens are 1.25 times the base input tokens price。そもそも命中には Cache hits require 100% identical prompt segments が必要で、ブランチ名や worktree ごとのパスが冒頭に混ざれば当たらない。コミュニティで流れる「10 倍から 50 倍の請求」は、今回取得した公式本文では確認できない ⇒ コミュニティの意見であり公式の基準はないので、本ページではコスト主張として書かない(照合 2026-09-22)。

タスクを分割して agent を増やすと安くなる?

必ずしも安くはならない、むしろ高くなることが多い。agent は each subagent starts with a fresh, isolated context window と公式に書かれる通り、固定プレフィックスを各自で抱える。だから each teammate has its own context window and consumes tokens independently、token usage is roughly proportional to team size。workflows ページも a single run can use meaningfully more tokens than working through the same task in conversation と同じ方向を示す。本ページの仮定 P = 40,000 では、一つのことを K 分割すればそのプレフィックスを K 回払う——これは本ページの算式の帰結で公式の数字ではない。公式が出す唯一の倍率は plan mode の agent teams が 7x more tokens than standard sessions という点で、これは token 数であり、請求が 7 倍になる話ではない。分岐点はただ一つ、避けられる重複読み込みが (K − 1) × P × 入力単価を上回るか否かだ(照合 2026-09-22)。

あの 80% 警告は誰の数値を見ている?

出所を先に書く。80% はオーケストレータ自身の閾値で、公式 usage-tracking の原句は A warning chip when you cross 80% of a limit。いっぽう Anthropic 自身の例文は 85% of your session limit で、二つの数は別物。見張っている層は二つの進捗バー、five-hour session and weekly usage limits のことで、項目定義は Percentage of the 5-hour or 7-day rate limit consumed, from 0 to 100。しかもこの二つの窓は appears only for claude.ai Pro and Max subscribers とあり、API key には存在しない。読み取り自体もリアルタイムではない:numbers update when the agent writes, not in real time。ゆえに 80% は減速の合図には使えるが、台帳の照合基準にはできない(照合 2026-09-22)。

並列実行は 429 を直接引き起こす?

また時計を分ける。API 側はモデルクラスごとに RPM、ITPM、OTPM で測られ、超えると 429 に retry-after が付く。公式の二文はまさに並列を突く:Short bursts of requests can exceed the limit and trigger rate limit errors、そして使用量の急増は acceleration limits に当たる。その池の大きさは Limits are set at the organization level で決まり、fan-out で容量は増えない。しかも上限は定点リセットではなく継続的に回復する。サブスク側は上限到達=429 ではなく、Claude Code blocks further requests until the reset time shown in the message。API key・クラウド・従量課金側は usage there is metered per request, so there is no reset to wait for —— 待つリセット自体がない。当サイトの key の同時実行数は 5(2026-09-22 時点)、待機は封じ込みではない(照合 2026-09-22)。

並列タスクの実コストはどう見積もる?

手順は三步、それに三つの限定を足す。第一に、単価へ日付を付ける:公式価格表自身が Price and plans are subject to change at Anthropic's discretion と書き、キャッシュの段は Prompt caching pricing reflects 5-minute TTL. を伴う。第二に、当たりは自分で検証する:Cache hits require 100% identical prompt segments だから、プレフィックスの一バイトでも違えば当たらない。第三に、オーケストレータで台帳を合わせない:カバーするのは Claude Code、Codex、Gemini、OpenCode、Kimi Code、MiniMax の 6 で、読むのは各 agent がローカルディスクに落とす記帳そのもの(No API calls, no extra auth)、推定額は not a live bill from the provider、そして公式自身が Prefer the provider console for authoritative spend を勧める。同じアカウントの claude.ai・Claude Code・Desktop は同じプールを消費するので、組み立てるのはプロバイダまたは自分の key の請求書であって、ステータスバーを足した合算ではない(照合 2026-09-22)。

出典

Anthropic 公式:https://claude.com/pricing(本文の 700 行から 710 行が Sonnet 5 の塊、121 と 724 行が変更留保と TTL の注記)、https://code.claude.com/docs/en/errors、/costs、/agent-teams、/workflows、/statusline、/interactive-mode、/sub-agents、https://platform.claude.com/docs/en/api/rate-limits、https://platform.claude.com/docs/en/build-with-claude/prompt-caching、ヘルプセンターの記事 11049741、11647753、12005017、9797557。第三者オーケストレータ:https://www.onorca.dev/docs/agents/usage-tracking。当サイト内:https://qcode.cc/pricing、/enterprise、/api-key-usage-query-guide、/claude-code-cost-optimization、/multi-tool-quota-rotation。すべて 2026-09-22 に照合。外部に向けた主張には日付付きの原本と一字単位の引用文がそれぞれ残っており、ページに記した日付で確かめられる。

単価と同時実行数を先に突き合わせる

このページの単価と上限の表記は 2026-09-22 に照合した値で、算例の token 量・並列数・ターン数は本ページが置いたと明示した仮定である。アカウントやモデルを替えれば続けられるとは書かないし、この計算どおりに安くなるとも書かない。自分の実測プレフィックスを持ってきて再計算してほしい。

関連記事

このページは Anthropic と第三者オーケストレータがそれぞれ公開している文書を言い直したもので、どちらとも資本・提携関係になく、推薦も受けていない。モデルの単価、上限の表記、適用範囲とステータス欄の挙動は 2026-09-22 に取得した本文が範囲で、公式価格表自身が価格と契約内容の変更権を留保している。算例の token 量・並列数・ターン数は本ページが置いたと明示した仮定で、出典があるのは単価と倍率だけ。コミュニティで流通する「何倍もの請求」という言い分は今回取得した公式本文では確認できず、コミュニティの意見として扱い、コスト主張としては書かない。QCode は読者の key の供給元のひとつにすぎず、第三者オーケストレータの挙動や読み取りに責任を負わない(照合 2026-09-22)。