Трекер цен · на 2026-10-07

Цены на кэширование промптов в 2026 году: сколько берут Claude, GPT и DeepSeek и как сэкономить

На 2026-10-07 чтение кэша у Claude Opus 5.5 и Sonnet 5.5 стоит одинаково — $0.20 за миллион токенов; запись в 5-минутный кэш обходится в 1,25 базовой цены ввода ($5 / $2.50), в часовой — в 2 базовые цены ($8 / $4). У GPT-6.1 Sol кэшированный ввод стоит $0.10, у GPT-6 Sol — $0.20, запись в кэш у обеих — $2.50. Попадание в кэш у DeepSeek-V4-Pro стоит $0.022 вне пика и $0.044 в пиковые часы. Здесь собраны правила тарификации трёх вендоров, TTL и минимальная длина кэшируемого промпта, плюс два примера, пересчитанных по официальным прайсам.

Обновлено 2026-10-07

#Чтение кэша $0.20#Часовая запись в кэш#GPT-6.1 Sol $0.10#Попадания в кэш DeepSeek

Четыре цифры, которые стоит запомнить

$0.20

Чтение кэша Opus 5.5 / Sonnet 5.5 (за миллион токенов)

У обеих $0.20. Сноска в официальном прайсе: попадания и обновления кэша у Opus 5.5 тарифицируются по 0,05 от базовой цены ввода (5% от $4), у Sonnet 5.5 — по стандартному множителю 0,1 (10% от $2).

1.25× / 2×

Запись в кэш Claude: 5 минут / 1 час

По официальной таблице множителей запись в 5-минутный кэш стоит 1,25 базовой цены ввода, в часовой — 2. В ценах это $5 / $8 у Opus 5.5 и $2.50 / $4 у Sonnet 5.5.

$0.10 / $0.20

Кэшированный ввод GPT-6.1 Sol / GPT-6 Sol

Стандартные ставки для промптов до 272K входных токенов. У обеих ввод $2 и запись в кэш $2.50 (1,25 от ввода); кэшированный ввод у GPT-6.1 Sol — 5% некэшированной ставки, у GPT-6 Sol — 10%.

$0.022 / $0.044

Попадание в кэш DeepSeek-V4-Pro: вне пика / в пик

Официальный прайс делит ввод на две ставки — попадание и промах кэша; промах стоит $0.66 / $1.32. У DeepSeek-V4.1-Flash попадание стоит $0.003 / $0.006.

Как тарифицируется кэш

На 2026-10-07 кэширование промптов у всех трёх вендоров устроено в главном одинаково: когда повторяющийся префикс попадает в кэш, эти токены тарифицируются по сниженной ставке. Различаются наличие наценки за запись, размер скидки на чтение и срок жизни кэша. Anthropic: по умолчанию кэш живёт 5 минут, и каждое попадание продлевает его без доплаты; можно выбрать 1 час, тогда запись дорожает с 1,25 до 2 базовых цен ввода. По расчёту самого вендора 5-минутный кэш окупается после одного чтения, часовой — после двух. OpenAI: в официальной документации сказано, что для поддерживаемых моделей кэширование промптов включено по умолчанию; у GPT-5.6 и новее запись в кэш стоит 1,25 некэшированной ставки ввода, чтение — 0,1 у большинства моделей и 0,05 у GPT-6.1 Sol. Плата за запись не добавляется сверху: каждый входной токен тарифицируется ровно по одной ставке — некэшированный ввод, чтение кэша или запись в кэш. DeepSeek: по словам вендора, дисковый кэш включён по умолчанию для всех пользователей и не требует правок в коде, а в прайсе всего две ставки — попадание и промах.

Позиция вендоров: чтение кэша у Opus 5.5 и GPT-6.1 Sol — всего 0,05

Сейчас и у Anthropic, и у OpenAI есть модели с множителем чтения кэша ниже привычного 0,1. Сноска в прайсе Anthropic: попадания и обновления кэша у Opus 5.5 тарифицируются по 0,05 от базовой цены ввода — при вводе $4 чтение кэша стоит $0.20; у большинства других моделей стандартные 0,1, у Fable 5.1 — 0,025. В руководстве OpenAI по кэшированию сказано, что у GPT-5.6 и новее запись в кэш стоит 1,25 некэшированной ставки ввода, а чтение — 0,1 у большинства моделей и 0,05 у GPT-6.1 Sol; для более ранних моделей официальная сравнительная таблица указывает, что отдельной платы за запись в кэш нет. В прайсе DeepSeek, напротив, всего две ставки ввода: попадание и промах кэша.

Три даты, важные для цен на кэш

2026-09-22

Выходит Claude Opus 5.5 по $4 / $20 (в текущем прайсе чтение кэша $0.20); в тот же день OpenAI выпускает GPT-6 Sol: для промптов до 272K входных токенов ввод $2, кэшированный ввод $0.20, вывод $10.

2026-09-28

Выходит Claude Sonnet 5.5; его строка в текущем прайсе: ввод $2, запись в 5-минутный кэш $2.50, в часовой $4, чтение кэша $0.20, вывод $10.

2026-09-29

OpenAI выпускает GPT-6.1 Sol: для промптов до 272K входных токенов ввод $2, кэшированный ввод $0.10, запись в кэш $2.50, вывод $10; кэшированный ввод — 5% некэшированной ставки.

Подтверждено vs не подтверждено

Подтверждено (дословно по официальным страницам)

Всё перечисленное дословно сверяется по официальной документации и прайсам: чтение кэша $0.20 у Opus 5.5 и Sonnet 5.5, запись на 5 минут $5 и $2.50, на час $8 и $4; множитель чтения 0,05 у Opus 5.5; срок жизни кэша Claude по умолчанию 5 минут, отсчитываемый от начала запроса; минимальная кэшируемая длина 512 токенов у Opus 5.5 и Sonnet 5.5 и 1024 токена у Sonnet 5, причём более короткие промпты обрабатываются без кэша и без ошибки; кэшированный ввод $0.10 у GPT-6.1 Sol и $0.20 у GPT-6 Sol, запись в кэш $2.50 у обеих; минимум 1024 токена и срок жизни кэша не менее 30 минут у GPT-5.6 и новее; свыше 272K входных токенов GPT-6 Sol и GPT-6.1 Sol считают весь запрос по двойной ставке ввода и кэша и по 1,5 ставки вывода; ставки попадания и промаха DeepSeek-V4-Pro и DeepSeek-V4.1-Flash и пиковые часы. Два примера на этой странице — пересчёт по этим официальным ценам, а не реальные списания.

Не подтверждено и официально не опубликовано

Три вещи не подтверждены, не стройте на них бюджет: во-первых, DeepSeek не публикует фиксированный срок жизни кэша — вендор лишь пишет, что кэш работает по принципу best-effort без гарантии попаданий и после прекращения использования обычно очищается в течение от нескольких часов до нескольких дней; во-вторых, OpenAI заявляет скидку на кэшированный ввод до 95%, а примеры внедрений в документации показывают долю попаданий около 70% и выше 90% — это иллюстрации вендора, а не обещание для вашей нагрузки; в-третьих, гуляющие по сети скриншоты с «реальной долей попаданий» и сравнительные цифры не имеют первоисточника, и на этой странице их нет.

Два примера, которые можно пересчитать

Пример 1: долгая сессия агента для программирования, префикс 100K повторяется 20 ходов

Пересчёт по официальным прайсам, входные данные фиксированы: неизменный префикс на 100K токенов (системный промпт, определения инструментов, контекст проекта), 20 ходов подряд с интервалом меньше 5 минут; считаем только этот префикс, без нового содержимого каждого хода и без вывода. Sonnet 5.5: без кэша 20 × 0.1M × $2 = $4.00; с кэшем одна 5-минутная запись $0.25 плюс 19 чтений 19 × $0.02 = $0.38, итого $0.63. Opus 5.5: $8.00 против $0.88 (запись $0.50 + чтения $0.38). GPT-6 Sol: $4.00 против $0.63; GPT-6.1 Sol: $4.00 против $0.44 (запись $0.25 + чтения 19 × $0.01). Сравнивая вендоров, учтите: расчёт исходит из одинакового числа токенов, а один и тот же текст у моделей разных вендоров может давать разное число токенов; например, в прайсе Anthropic сказано, что новый токенизатор Claude 4.7 и новее выдаёт на том же тексте примерно на 30% больше токенов, чем прежний, а точный прирост зависит от содержимого.

Пример 2: TTL 5 минут или 1 час

Пересчёт по официальным прайсам, входные данные фиксированы: Sonnet 5.5, префикс 100K, 6 ходов с интервалом 10 минут. Без кэша 6 × $0.20 = $1.20. С 5-минутным TTL кэш каждый раз успевает истечь и записывается заново, 6 × $0.25 = $1.50 — дороже, чем без кэша. С часовым TTL одна запись $0.40 плюс 5 чтений $0.10, итого $0.50. В тех же условиях у Opus 5.5 выходит $2.40, $3.00 и $0.90. Совет вендора: если запросы всегда идут чаще чем раз в 5 минут, оставайтесь на 5-минутном кэше — каждое попадание продлевает его без доплаты; на часовой переходите, когда интервалы составляют от 5 минут до часа. Для сравнения: у OpenAI GPT-5.6 и новее кэшированный префикс остаётся пригодным для повторного использования не менее 30 минут после последней записи или использования, так что 10-минутный интервал по официальным правилам ещё укладывается в это окно.

Как включить и сэкономить: пять шагов

Во-первых, в Claude API одно поле cache_control на верхнем уровне запроса включает автоматическое кэширование: система ставит точку кэширования на последний кэшируемый блок и сдвигает её вперёд по мере роста диалога. Для часового кэша задайте в cache_control ttl со значением 1h; в одном промпте допускается до 4 таких точек. Во-вторых, следите за порядком: префикс кэша идёт в порядке tools, system, messages, и изменение на любом уровне делает недействительным этот уровень и всё, что после него, поэтому стабильные определения инструментов, системные промпты и длинные документы ставьте в начало, а метки времени и прочее изменчивое — в конец. В-третьих, в Claude Code при работе с API-ключом основной диалог по умолчанию получает TTL в пять минут; официальная документация предлагает задать promptCacheTtl равным 1h (или переменную окружения CLAUDE_CODE_PROMPT_CACHE_TTL), для этого нужен Claude Code v2.1.242 или новее. После смены модели через /model первый запрос перечитывает весь диалог без кэша. В-четвёртых, у OpenAI GPT-5.6 и новее неявный режим, который, по словам вендора, подходит большинству сценариев из коробки, ставит точку кэширования в конце последнего подходящего сообщения; в явном режиме всё после последней точки тарифицируется по некэшированной ставке без платы за запись, так что можно не записывать в кэш содержимое, которое меняется каждый раз и вряд ли будет использовано повторно. В-пятых, проверяйте поля usage: у Claude — cache_creation_input_tokens и cache_read_input_tokens (если оба равны 0, ничего не закэшировано); у OpenAI — usage.input_tokens_details.cached_tokens и cache_write_tokens; у DeepSeek — prompt_cache_hit_tokens и prompt_cache_miss_tokens.

В QCode

QCode тарифицирует по токенам; цены каждой модели — на странице /models. Цифры на этой странице взяты из официальных прайсов вендоров и нужны, чтобы понять устройство тарификации кэша и способы сэкономить; что именно списывается в QCode, смотрите на /models и в детализации вызовов в консоли.

Частые вопросы

Сколько стоит чтение кэша у Claude?

На 2026-10-07 чтение кэша у Claude Opus 5.5 и Sonnet 5.5 стоит $0.20 за миллион токенов. Множители разные: у Opus 5.5 — 0,05 от базовой цены ввода (5% от $4), у Sonnet 5.5 — стандартные 0,1 (10% от $2), у Fable 5.1 — 0,025 ($0.25). В прайсе эта колонка называется Cache hits and refreshes: чтение префикса из кэша, которое заодно продлевает его срок жизни.

Сколько стоит часовая запись в кэш Claude и есть ли в ней смысл?

Часовая запись в кэш стоит 2 базовые цены ввода: $4 за миллион токенов у Sonnet 5.5 и $8 у Opus 5.5 (5-минутная — $2.50 и $5). Расчёт вендора при ставке чтения 0,1: 5-минутный кэш окупается после одного чтения, часовой — после двух. По официальному прайсу префикс 100K на Sonnet 5.5, 6 ходов с интервалом 10 минут, обходится в $0.50 с часовым кэшем и в $1.50 с 5-минутным, который каждый ход истекает и записывается заново. Если запросы всегда идут чаще чем раз в 5 минут, вендор советует оставаться на 5-минутном кэше.

Нужно ли включать кэш у OpenAI и платная ли запись?

Включать ничего не нужно: в официальной документации сказано, что кэширование промптов включено по умолчанию для поддерживаемых моделей. У GPT-5.6 и новее запись тарифицируется по 1,25 некэшированной ставки ввода ($2.50 и у GPT-6 Sol, и у GPT-6.1 Sol), но это не надбавка сверху: каждый входной токен считается только по одной ставке — некэшированной, чтения или записи. Срок жизни задаётся через prompt_cache_options.ttl; единственное допустимое значение — 30m, оно же значение по умолчанию; повторное использование продлевает срок без новой платы за запись. Минимальная кэшируемая длина — 1024 токена.

Сколько стоит попадание в кэш DeepSeek?

На 2026-10-07 по официальному прайсу за миллион входных токенов: у DeepSeek-V4-Pro попадание в кэш стоит $0.022 вне пика и $0.044 в пик, промах — $0.66 / $1.32; у DeepSeek-V4.1-Flash (имя модели в API — deepseek-flash) попадание $0.003 / $0.006, промах $0.15 / $0.3. Пиковые часы — 01:00–04:00 и 06:00–10:00 UTC с понедельника по пятницу, кроме государственных праздников Китая; непиковые ставки вдвое ниже пиковых. По официальному прайсу префикс 100K на 20 ходов у V4-Pro в пиковые часы стоит $2.64 без попаданий или $0.2156, если первый ход — промах, а следующие 19 — попадания.

Учитываются ли попадания в кэш в лимитах скорости?

У двух вендоров по-разному. Anthropic, перечисляя случаи для часового кэша, прямо пишет, что попадания в кэш не списываются с вашего лимита скорости. В FAQ OpenAI сказано, что кэшированные входные токены по-прежнему учитываются в лимите токенов в минуту и что кэширование промптов не меняет расчёт лимитов.

Как тарифицируется кэш в QCode?

QCode тарифицирует по токенам; цены каждой модели — на странице /models. Цифры на этой странице взяты из официальных прайсов вендоров. Модель, число токенов и стоимость каждого вызова можно сверить в детализации вызовов на странице статистики использования в консоли.

Источники

Цены и правила кэширования Claude: официальная страница цен Anthropic и документация Prompt caching (получены 2026-10-07; там цены чтения и записи кэша по моделям, множители и сноски, TTL, минимальная кэшируемая длина, правила инвалидации и поля usage); даты выхода — официальные release notes Anthropic. Настройки TTL в Claude Code: страницы о prompt caching и об управлении расходами в официальной документации Claude Code. OpenAI: официальная страница цен, страницы моделей GPT-6 Sol и GPT-6.1 Sol, руководство Prompt caching и журнал изменений API (получены в тот же день). DeepSeek: официальная страница Models & Pricing и руководство Context Caching (получены в тот же день). QCode: страницы о тарификации и оптимизации расходов на docs.qcode.cc.

Оплата за токены, цены — на /models

QCode тарифицирует по токенам; цены каждой модели — на странице /models. Как тарифицируется кэш и как на нём сэкономить, смотрите в официальных ценах и двух примерах на этой странице.

Читайте также

Цены и правила на этой странице сверены 2026-10-07; приоритет у официальных страниц Anthropic, OpenAI и DeepSeek, изменения у вендоров возможны без предупреждения. Два примера — иллюстрации, пересчитанные по официальным прайсам: они учитывают только стоимость ввода повторяющегося префикса, без нового содержимого и вывода, и не являются реальными списаниями. Проценты скидок и доли попаданий из примеров — заявления самих вендоров. Доступность моделей — по странице /models.

Сначала попробуйте, потом решайте

Не уверены, какой тариф выбрать? Начните со «Стартового» ($8.57/мес), а при апгрейде остаток старого тарифа вернётся на баланс.