Трекер цен · скидка 50% до 9 сентября

Цена GLM-5.3-Flash
$0.075/$0.25 до 9 сентября

Прайс — $0.15 за вход и $0.50 за выход на миллион токенов, на старте всё вдвое дешевле до 2026-09-09 24:00 (UTC+8). Экономия реальная, но строку «чтение из кэша» стоит посчитать отдельно.

#$0.075 / $0.25#−50% до 9.09#кэш $0.015#1/40 от Opus 4.8

Четыре строки прайса

$0.075

Вход · по акции

За миллион токенов. Прайс — $0.15, после окончания акции вернётся к нему.

$0.25

Выход · по акции

За миллион токенов. Прайс — $0.50. Соотношение вход/выход 1:3.3 — мягче, чем у большинства моделей этого уровня.

$0.015

Чтение из кэша · по акции

Прайс — $0.03. ⚠️ Именно эта строка определяет реальную стоимость для агентов с длинным контекстом, см. сравнение ниже.

1/40

Против Opus 4.8

Обе модели на уровне индекса AA 57; по акции это примерно одна сороковая от цены Claude Opus 4.8.

Как устроен официальный прайс

Z.ai и bigmodel.cn указывают для GLM-5.3-Flash $0.15 за миллион входных токенов, $0.50 за миллион выходных и $0.03 за чтение из кэша. Стартовая акция уменьшает все три вдвое — $0.075 / $0.25 / $0.015, — а хранение кэша на время акции бесплатно. Это примерно одна десятая от флагмана того же поколения GLM-5.3 (одна двадцатая по акции) и одна сороковая от Claude Opus 4.8. Дедлайн назван прямо: 9 сентября 2026 года, 24:00 (UTC+8).

Сколько просят агрегаторы

На OpenRouter у z-ai/glm-5.3-flash сейчас показана акционная цена $0.075 / $0.25 при чтении из кэша $0.015. Novita отдаёт zai-org/glm-5.3-flash на своём serverless по $0.15 / $0.50. AIHubMix подключил модель со скидкой 50% на ограниченный срок. QuickSilver Pro заявляет примерно на 20% ниже официальной акции ($0.06 / $0.20). Разброс объясняется субсидиями и условиями расчётов у каждого поставщика — прежде чем переходить, убедитесь, что там действительно те же 1M контекста и та же тарификация кэша.

Хронология цен

2026-08-26

Релиз и открытие API, акция −50% с первого дня: $0.075 / $0.25, чтение из кэша $0.015.

2026-08-26

OpenRouter снимает бесплатный слаг stealth/ox-alpha и выставляет z-ai/glm-5.3-flash по акционной цене.

2026-09-09

В 24:00 (UTC+8) акция заканчивается. Возврат к $0.15 / $0.50, чтение из кэша — $0.03.

Подтверждено vs проверьте сами

Подтверждено

Прайс $0.15/$0.50, акционные $0.075/$0.25, чтение из кэша $0.03 ($0.015 по акции), дедлайн 2026-09-09 24:00 (UTC+8) и бесплатное хранение кэша на время акции — всё это есть в документации и релизных анонсах Z.ai и bigmodel.cn.

Проверьте сами

Цены у агрегаторов меняются постоянно и не всегда включают тот же лимит контекста и ту же политику кэша; если площадка идёт ниже официальной акции, разберитесь, это субсидия или урезанная конфигурация. Пересчёт квоты в Coding Plan (у Flash примерно втрое больше, чем у GLM-5.3) тоже зависит от тарифа — смотрите официальную страницу для своего региона.

Дёшево на бумаге — сначала посчитайте кэш

Заявленная цена действительно низкая

$0.075 / $0.25 — почти минимум для всего, что находится на уровне индекса AA 57. На одиночных запросах, коротком контексте и пакетной обработке экономия видна сразу.

С кэшем всё иначе

Чтение из кэша стоит $0.03 ($0.015 по акции). Один разработчик замерил, что это примерно вчетверо дороже внепиковой цены DeepSeek V4 Flash. Агентные циклы перечитывают один и тот же длинный контекст снова и снова, поэтому плата за кэш способна перекрыть выигрыш от прайса. Посчитайте на своём проценте попаданий и средней длине контекста.

Как посчитать свои расходы

Разложите типичный запрос на три части: новые входные токены, попавшие в кэш входные токены и выходные токены. По акции формула такая: (новые × $0.075 + кэш × $0.015 + выход × $0.25) / 1 000 000. У агентных сценариев попадание в кэш обычно 60–90%, и чем выше процент, тем больше веса у строки кэша — именно поэтому смотреть только на заявленную цену нельзя. После 9 сентября просто удвойте все три числа, чтобы получить долгосрочную стоимость.

На QCode

Из моделей Z.ai на QCode маршрутизируются GLM-5.3, GLM-5.2 и GLM-5.1 — по официальной цене с сервисным коэффициентом, с автоматическим отслеживанием изменений у поставщика. GLM-5.3-Flash не подключена, эта страница — справка по ценам. Чтобы сравнить реальную стоимость китайских моделей уже сегодня, начните с GLM-5.3 или семейства DeepSeek V4, у которого вдобавок есть внепиковая цена вдвое ниже.

Частые вопросы

Когда именно закончится скидка?

9 сентября 2026 года в 24:00 по UTC+8. После этого вход возвращается к $0.15, выход — к $0.50, чтение из кэша — к $0.03, всё за миллион токенов.

Есть ли бесплатный тариф?

Постоянного бесплатного публичного эндпоинта нет. Бесплатным был анонимный предпросмотр stealth/ox-alpha, снятый из продакшн-каталога OpenRouter в день раскрытия. Новым аккаунтам на платформе Z.ai начисляют пробные кредиты — это пробный период, а не бесплатный тариф.

Как тарифицируется кэш?

Чтение из кэша — $0.03 за миллион токенов ($0.015 по акции), хранение кэша на время акции бесплатно. Учтите: хотя чтение из кэша стоит впятеро дешевле входа, при высоком проценте попаданий и длинном контексте именно на него приходится основная масса оплаченных токенов.

Дешевле ли она, чем DeepSeek V4 Flash?

Зависит от профиля нагрузки. На чистом вводе-выводе акционная цена GLM ниже. На чтении из кэша один разработчик намерил у GLM примерно вчетверо больше внепиковой цены DeepSeek V4 Flash, а DeepSeek вдобавок вдвое дешевле вне пика. Для агентов с длинным контекстом и высоким попаданием в кэш считать нужно отдельно по каждой.

Coding Plan или оплата по факту?

В Coding Plan от Z.ai квота Flash примерно втрое больше, чем у GLM-5.3 — это подходит при стабильно высоком ежедневном объёме. Если нагрузка скачет или вам параллельно нужны Claude, GPT и Gemini, оплата по факту через один шлюз гибче и избавляет от пополнений на каждой площадке отдельно.

Можно ли доверять площадке, которая дешевле официальной?

Пользоваться можно, но проверьте три вещи: действительно ли там полный контекст 1M, совпадает ли тарификация кэша и какие лимиты запросов. Площадки с ценой ниже официальной акции (например $0.06 / $0.20) обычно работают на временной субсидии, которая может закончиться.

Источники

Официальная документация по ценам Z.ai и bigmodel.cn, релизный анонс Z.ai (2026-08-26), цены на страницах моделей OpenRouter и Novita, анонсы подключения AIHubMix и QuickSilver Pro, замер стоимости кэша, опубликованный разработчиком в X (собрано 2026-08-26—27).

Китайские модели — одним ключом

GLM-5.3, DeepSeek V4, Kimi K3 и Qwen переключаются на одном эндпоинте QCode по официальной цене с сервисным коэффициентом — не нужно пополнять баланс на каждой платформе отдельно.