Цены на длинный контекст 1M в 2026 году: кто берёт надбавку и с какого порога
По состоянию на 2026-10-07 Anthropic на странице цен прямо пишет, что контекст 1M тарифицируется по стандартной цене: у Claude Opus 5.5 и Sonnet 5.5 запрос на 900K токенов стоит за токен столько же, сколько запрос на 9K. У OpenAI для GPT-6 Sol и GPT-6.1 Sol при вводе больше 272K токенов весь запрос считается по 2x за ввод и кэш и 1.5x за вывод; у xAI в Grok 4.7, как только промпт достигает 200K, все токены запроса переходят на старший тариф; в официальном прайсе DeepSeek для V4.1 Flash ступень с надбавкой за длинный контекст не указана (на 2026-10-07), приведены только пиковые и внепиковые цены. Ниже три расчёта по официальным прайсам.
Обновлено 2026-10-07
Четыре ключевых числа
Claude при контексте 1M
Согласно официальной странице цен, модели Claude 4.6 и новее получают полный контекст 1M по стандартной цене: запрос на 900K токенов стоит за токен столько же, сколько на 9K. Opus 5.5 — $4 за ввод и $20 за вывод, Sonnet 5.5 — $2 / $10.
Порог GPT-6 Sol и GPT-6.1 Sol
При вводе больше 272K токенов весь запрос считается по 2x за ввод и кэш и 1.5x за вывод: у GPT-6.1 Sol $2 / $10 превращаются в $4 / $15.
Порог Grok 4.7
Как только промпт достигает 200K, все токены запроса идут по старшему тарифу: $2 / $6 превращаются в $4 / $12. Контекст Grok 4.7 — 500K, а не 1M.
Пиковая цена DeepSeek V4.1 Flash
Контекст 1M; ввод без попадания в кэш и вывод стоят $0.3 / $1.2 за миллион токенов в пиковые часы и вдвое меньше, $0.15 / $0.6, вне пика. Ступень с надбавкой за длинный контекст в официальном прайсе не указана (на 2026-10-07).
Как прайсы четырёх вендоров описывают длинный контекст
По состоянию на 2026-10-07 официальные страницы четырёх вендоров описывают тарификацию длинного контекста тремя способами. Надбавки нет, и это сказано прямо: на странице цен Anthropic сказано, что модели Claude 4.6 и новее включают полный контекст 1M по стандартной цене, а документация по контекстному окну относит Opus 5.5 и Sonnet 5.5 к моделям с 1M, где 1M включён по умолчанию, beta header не нужен, а запросы с длинным контекстом тарифицируются по стандартной цене. Прямо указанный порог, после которого дорожает весь запрос: у GPT-6 Sol и GPT-6.1 Sol от OpenAI это ввод больше 272K, у Grok 4.7 от xAI — промпт от 200K; в обоих случаях на старший тариф переходят все токены запроса, а не только часть сверх порога. Ступень с надбавкой за длинный контекст в официальном прайсе не указана: у DeepSeek V4.1 Flash контекст 1M, в прайсе приведены только пиковые и внепиковые цены, а официальная формула — число токенов × цена.
Изменения в прайсах с сентября
2026-09-29 в changelog OpenAI вышла GPT-6.1 Sol со стандартными ценами для промптов до 272K входных токенов: $2 за ввод, $0.10 за кэшированный ввод, $2.50 за запись в кэш и $10 за вывод; правило о пересчёте всего запроса при вводе больше 272K на её странице модели дословно совпадает с правилом GPT-6 Sol, вышедшей 2026-09-22. Anthropic выпустила Opus 5.5 2026-09-22 и Sonnet 5.5 2026-09-28; у обеих контекст 1M и до 128K токенов вывода на запрос. В release notes xAI у Grok 4.7 контекстное окно 500K, цены $2 / $0.50 / $6 ниже 200K токенов промпта и $4 / $1 / $12 выше. DeepSeek выпустила V4.1 Flash 2026-09-10 и соответственно снизила цены API; пиковый и внепиковый тарифы действуют с 16:00 UTC 2026-08-16.
Хронология
DeepSeek выпускает V4.1 Flash с контекстом 1M; цены API снижаются, деление на пиковые и внепиковые часы сохраняется.
В один день выходят Claude Opus 5.5 и GPT-6 Sol: первая тарифицирует контекст 1M по стандартной цене, вторая пересчитывает весь запрос при вводе больше 272K.
Выходит GPT-6.1 Sol: до 272K — $2 за ввод и $10 за вывод, выше — $4 / $15, кэшированный ввод дорожает с $0.10 до $0.20.
Подтверждено vs не прописано
Подтверждено (дословно на официальных страницах)
Всё ниже сверяется дословно по официальным страницам: модели Claude 4.6 и новее получают полный контекст 1M по стандартной цене, запрос на 900K стоит за токен столько же, сколько на 9K, а скидки за кэш и Batch действуют на всём окне; Opus 5.5 — $4 / $20, Sonnet 5.5 — $2 / $10, в Batch — $2 / $10 и $1 / $5; GPT-6 Sol и GPT-6.1 Sol при вводе больше 272K считают весь запрос по 2x за ввод и кэш и 1.5x за вывод, у обеих контекстное окно 1,050,000 токенов и максимум ввода 922,000; у Grok 4.7 контекст 500K и две строки цен до и после 200K; у DeepSeek V4.1 Flash контекст 1M, пиковые и внепиковые цены и опубликованные пиковые часы. Итоговые суммы в расчётах — наш пересчёт по официальным прайсам, а не цифры, опубликованные вендорами.
Что официально не прописано
Три момента официальные страницы не проясняют, и эта страница не делает выводов за вендоров: во-первых, OpenAI не пишет, означает ли 272K ровно 272,000 токенов и учитываются ли в пороге токены из кэша, поэтому в расчётах взяты 270,000 и 280,000, чтобы не попасть на границу; во-вторых, у xAI в таблице написано ≥ 200k, в сноске — reaches, в release notes — above, в разделе Fast — exceeds, так что для запроса ровно на 200K ориентируйтесь на фактическое списание; в-третьих, в официальном прайсе DeepSeek ступень с надбавкой за длинный контекст не указана (на 2026-10-07), поэтому расчёты сделаны по указанным ценам, а на той же странице сказано, что DeepSeek оставляет за собой право менять цены.
Как выбирать: сначала посмотрите, где обычно оказывается ваш ввод
Ввод в основном от 200K до 272K
В этом диапазоне Grok 4.7 уже на старшем тарифе, GPT-6 Sol и GPT-6.1 Sol ещё на стандартном, Claude, по официальным данным, остаётся на стандартной цене, а в прайсе DeepSeek ступень с надбавкой за длинный контекст не указана. По официальным прайсам один запрос на 250,000 токенов ввода + 8,000 вывода стоит $0.58 и у Sonnet 5.5, и у GPT-6.1 Sol, $1.16 у Opus 5.5, $1.096 у Grok 4.7 и $0.0846 у DeepSeek V4.1 Flash в пиковые часы.
Ввод часто больше 272K
После 272K на старший тариф переходит и OpenAI; Claude, по официальным данным, остаётся на стандартной цене, а для DeepSeek, в прайсе которого ступень с надбавкой за длинный контекст не указана, взяты указанные цены. По официальным прайсам один запрос на 400,000 токенов ввода + 8,000 вывода стоит $0.88 у Sonnet 5.5, $1.76 у Opus 5.5, $1.72 у GPT-6.1 Sol, $1.696 у Grok 4.7 и $0.1296 в пик или $0.0648 вне пика у DeepSeek V4.1 Flash. В этой точке ставка ввода GPT-6.1 Sol ($4) сравнивается со ставкой Opus 5.5.
Три расчёта, которые можно проверить
Все цифры пересчитаны по официальным прайсам. Первый: 400,000 токенов ввода + 8,000 вывода без попаданий в кэш: Sonnet 5.5 = 0.4 × $2 + 0.008 × $10 = $0.88; Opus 5.5 = 0.4 × $4 + 0.008 × $20 = $1.76; GPT-6.1 Sol и GPT-6 Sol по тарифу длинного контекста = 0.4 × $4 + 0.008 × $15 = $1.72; Grok 4.7 по тарифу от 200K = 0.4 × $4 + 0.008 × $12 = $1.696; DeepSeek V4.1 Flash в пик = 0.4 × $0.3 + 0.008 × $1.2 = $0.1296, вне пика $0.0648. Второй, порог 272K у GPT-6.1 Sol: 270,000 ввода + 8,000 вывода = 0.27 × $2 + 0.008 × $10 = $0.62, а 280,000 ввода + 8,000 вывода = 0.28 × $4 + 0.008 × $15 = $1.24 — всего 10,000 лишних токенов ввода удваивают сумму; те же два запроса на Sonnet 5.5 стоят $0.62 и $0.64. Третий, порог 200K у Grok 4.7: 250,000 ввода + 8,000 вывода = 0.25 × $4 + 0.008 × $12 = $1.096 против $0.548 по тарифу ниже 200K. Batch, кэш и региональные надбавки не учтены.
На QCode
QCode тарифицирует по токенам, цены каждой модели — на странице /models. Из моделей на этой странице claude-opus-5-5, claude-sonnet-5-5, gpt-6.1-sol, gpt-6-sol и deepseek-v4.1-flash вызываются одним ключом; Grok 4.7 в их число не входит. Расчёты здесь — пересчёт по официальным прайсам вендоров, а не предложение цены от QCode и не описание того, как тарифицирует QCode.
Частые вопросы
Берут ли Claude Opus 5.5 и Sonnet 5.5 надбавку за полный контекст 1M?
Нет. На официальной странице цен сказано, что модели Claude 4.6 и новее include the full 1M token context window at standard pricing, и приведён пример: запрос на 900k токенов тарифицируется по той же цене за токен, что и запрос на 9k. Документация по контекстному окну добавляет, что 1M включён по умолчанию, beta header не нужен, а запросы с длинным контекстом тарифицируются по стандартной цене. Скидки за кэш и Batch действуют на всём окне, а стандартная цена при любой длине запроса — $4 / $20 у Opus 5.5 и $2 / $10 у Sonnet 5.5.
GPT-6.1 Sol берёт больше только за токены сверх 272K?
Нет, пересчитывается весь запрос. На странице модели написано: Prompts with more than 272K input tokens are priced at 2x input and cache rates and 1.5x output for the full request. По официальному прайсу GPT-6.1 Sol стоит до 272K $2 за ввод, $0.10 за кэшированный ввод, $2.50 за запись в кэш и $10 за вывод, а выше — $4, $0.20, $5 и $15; у GPT-6 Sol отличается только кэшированный ввод ($0.20 и $0.40). У обеих контекстное окно 1,050,000 токенов и максимум ввода 922,000.
Есть ли у Grok 4.7 контекст 1M и как считается всё, что выше 200K?
Нет, в таблице цен xAI у Grok 4.7 контекст 500K. Цены даны двумя строками: ниже 200K токенов промпта — $2 за ввод, $0.50 за кэшированный ввод и $6 за вывод, от 200K — $4, $1 и $12, и в сноске сказано, что тогда по старшей ставке считаются все токены запроса. Контекст 1M в прайсе xAI указан у grok-4.3 и семейства grok-4.20; их строки от 200K тоже вдвое дороже нижних (у grok-4.3 — с $1.25 / $2.50 до $2.50 / $5.00).
Как тарифицируется контекст 1M у DeepSeek V4.1 Flash?
В официальном прайсе ступень с надбавкой за длинный контекст не указана (на 2026-10-07), приведены только пиковые и внепиковые цены. У V4.1 Flash (имя модели в API — deepseek-flash) контекст 1M, а за миллион токенов она стоит: ввод с попаданием в кэш — $0.006 в пик и $0.003 вне пика, ввод без попадания — $0.3 и $0.15, вывод — $1.2 и $0.6. Пиковые часы — 01:00–04:00 и 06:00–10:00 UTC с понедельника по пятницу, кроме государственных праздников Китая; всё остальное время, включая выходные и праздники Китая целиком, считается внепиковым.
Складываются ли Batch и региональные эндпоинты с ценой длинного контекста?
У каждого вендора по-своему. Anthropic пишет, что скидки за кэш и Batch действуют на всём контекстном окне; в Batch Opus 5.5 стоит $2 / $10, Sonnet 5.5 — $1 / $5, а инференс только в США через inference_geo добавляет множитель 1.1x ко всем категориям токенов. В таблице Batch у OpenAI тариф GPT-6.1 Sol выше 272K — $2 за ввод и $7.50 за вывод, а региональная обработка там, где она есть, добавляет 10%. В списке скидок Batch у xAI нет Grok 4.7, а моделям вне списка скидка не положена; региональный эндпоинт США считается по 1.1x, включая тарифы длинного контекста, — для Grok 4.7 выше 200K это $4.40 / $1.10 / $13.20. В официальном прайсе DeepSeek тарифы Batch и региональные цены не указаны (на 2026-10-07).
Можно ли вызвать эти модели в QCode?
claude-opus-5-5, claude-sonnet-5-5, gpt-6.1-sol, gpt-6-sol и deepseek-v4.1-flash вызываются одним ключом, Grok 4.7 — нет. QCode тарифицирует по токенам, цены каждой модели — на странице /models. Все цифры на этой странице пересчитаны по официальным прайсам вендоров и не являются предложением цены от QCode.
Источники
Anthropic: официальная страница цен (таблица моделей, цены длинного контекста, Batch и резидентность данных), документация по контекстному окну, обзор моделей и страницы Opus 5.5 и Sonnet 5.5 (даты выхода). OpenAI: страница цен в документации для разработчиков (таблицы Standard и Batch, определения короткого и длинного контекста), страницы моделей GPT-6.1 Sol и GPT-6 Sol (правило 272K, контекстное окно и максимум ввода) и changelog API (даты выхода и стандартные цены до 272K). xAI: страницы Models и Pricing в документации (разделы Batch, региональный эндпоинт США и Fast) и Release Notes. DeepSeek: страница Models & Pricing и Change Log в документации API. Всё получено 2026-10-07.
Один ключ: меняйте model и сравнивайте сами
QCode тарифицирует по токенам, цены каждой модели — на /models; claude-sonnet-5-5, gpt-6.1-sol и deepseek-v4.1-flash работают с одним ключом.
Читайте также
Гид по длинному контексту в ИИ-кодинге 2026
Окна стали больше, проблемы тоже изменились: практические приёмы эффективного кодинга внутри 1M+.
Трекер цен GPT-6 Sol / Luna
Официальные тарифы, правила биллинга и пересчитываемые примеры для двух моделей OpenAI.
Диагностика Context Length Exceeded
Три маскировки переполнения контекста и как их различать.
Цифры и цитаты на этой странице сверены 2026-10-07; приоритет у официальных страниц вендоров, цены могут меняться без предупреждения. Все суммы за запрос — пересчёт по официальным прайсам, а не предложение цены и не обещание. Доступность моделей — по странице /models.