Почему GPT-6 Astra
так быстро съедает лимит
По официальной таблице credits OpenAI, Astra стоит 250 (вход) / 25 (чтение кэша) / 1 250 (выход) credits за 1M токенов, а GPT-5.6 Sol — 100 / 10 / 500. Все три соотношения — ровно 2,5×. То есть на том же объёме подписки Astra проходит примерно 40% той работы, что Sol. Здесь официальные цифры, лимиты сообщений по тарифам и как распределять задачи.
Обновлено 2026-09-09
Четыре числа, которые решают, надолго ли хватит
Расход относительно Sol
Вход 250 против 100, чтение кэша 25 против 10, выход 1 250 против 500 credits за 1M. Все три соотношения совпадают точно — это не оценка.
Сообщений за 5 часов на Plus
В той же официальной таблице Sol — 10–100, Terra — 25–200, Luna — 250–2 000. У Astra ровно половина от Sol.
Максимум на выходе, вместе с рассуждениями
Токены рассуждений учитываются в выходе, а выход по credits стоит в 5 раз дороже входа. Считать бюджет по одному видимому ответу — сильно занизить.
Порог входа для длинного контекста
Выше этого объёма тарифы API становятся $20 / $2 / $25 / $75. На странице цен не сказано, пересчитывается ли весь запрос или только превышение.
Это не сбой, это прайс
Первая реакция после перехода на Astra обычно «у меня сломался лимит?». По официальной таблице credits — нет: три ставки Astra аккуратно в 2,5 раза выше, чем у Sol. В рамках одной и той же подписки Astra проходит примерно 40% той работы, что сделал бы Sol. Если у вас длительный агентный процесс, пятичасовое окно закончится заметно раньше — так задумано, а не сломано.
Что говорит официальная таблица по тарифам
Документация OpenAI по ценам даёт диапазоны локальных сообщений за 5 часов: Astra — 5–45 на Plus и Business, 25–225 на Pro 5x, 100–900 на Pro 20x. В той же таблице Sol — 10–100 / 50–500 / 200–2 000, а Luna — 250–2 000 / 1 250–10 000 / 5 000–40 000. Диапазоны широкие, потому что стоимость одного сообщения зависит от длины контекста и объёма рассуждений.
Хронология
Выходит GPT-6 Astra с идентификатором модели gpt-6-astra. В тот же день публикуется системная карта, где сказано, что это первая модель OpenAI, достигшая уровня Critical по кибербезопасности в рамках Preparedness Framework.
Astra появляется в Codex. В анонсе сказано, что в день выхода доступ получил ограниченный круг организаций, а в течение следующих дней — Plus, Pro, Business и Enterprise, а также OpenAI API, Azure и AWS Bedrock.
Страница сверена с официальной таблицей credits и страницей цен в этот день: Astra 250 / 25 / 1 250 против Sol 100 / 10 / 500, соотношение 2,5×. Прайс API для Astra — $10 за вход и $50 за выход на 1M токенов.
Что официально, а что нет
✅ Из официальной документации
Ставки credits 250 / 25 / 1 250 и диапазоны сообщений по тарифам — из документации OpenAI по ценам. Прайс API $10 / $1 / $12,50 / $50 и тариф $20 / $2 / $25 / $75 при входе свыше 272 000 токенов — со страницы цен API. Контекст 1 050 000, потолок выхода 128 000 с учётом токенов рассуждений и уровни reasoning — из официальной документации по модели.
⚠️ Наблюдения сообщества, а не официальные цифры
В сообществе ходят разные «измеренные» коэффициенты: что сессия с очень высоким попаданием в кэш всё равно быстро съедает пятичасовое окно, или что реальный разрыв с Sol больше, чем следует из прайса. Это наблюдения пользователей; OpenAI не подтверждала ни одного конкретного множителя. Чтобы оценить собственный расход, прогоните одни и те же реальные запросы через оба model id и посмотрите счёт, а не доверяйте пересказанному числу.
Одна работа, два способа
Перевести всё на Astra
Действительно сильнее на длинном контексте, оркестрации инструментов и работе с интерфейсом, но в рамках той же подписки проходит около 40% объёма Sol. Подходит, когда сложной работы немного.
Распределять по задачам
Длинный контекст и сложные цепочки инструментов — на Astra, рутинные правки и написание тестов — на бюджетном уровне. У большинства команд суммарный выход выше, а счёт предсказуемее.
Как расходовать меньше
Помогают три вещи. Первое — снизить уровень рассуждений: Astra поддерживает low, medium, high, xhigh и max и не поддерживает none; если вы были на none или minimal, начните с low и сравните. Второе — контролировать выход: в потолок 128 000 входят токены рассуждений, а выход стоит в 5 раз дороже входа, поэтому заставить модель меньше писать выгоднее, чем меньше читать. Третье — следить за порогом входа 272 000: за ним API переходит на более дорогой тариф.
В QCode
gpt-6-astra есть в таблице моделей QCode, и за последние 30 дней по ней были реальные вызовы. Она использует тот же ключ и ту же квоту, что три уровня GPT-5.6, Claude и Gemini, поэтому переключение — это смена поля model. Значит, можно прогнать одни и те же реальные запросы через оба model id и увидеть разницу в стоимости напрямую, а не гадать по чужому бенчмарку.
Частые вопросы
Насколько Astra дороже Sol?
По официальной таблице credits: 250 против 100 на входе, 25 против 10 на кэше и 1 250 против 500 на выходе за 1M токенов — все три в 2,5 раза. В рамках одной подписки Astra проходит примерно 40% работы.
Почему моё пятичасовое окно кончается быстрее, чем у других?
Официальная величина — диапазон, а не константа: 5–45 сообщений на Plus. Стоимость одного сообщения зависит от длины контекста и объёма рассуждений, поэтому длинные сессии на высоком уровне reasoning оказываются у нижней границы.
Снижение уровня рассуждений действительно помогает?
Да, но измерьте сами. Astra поддерживает low, medium, high, xhigh и max и не поддерживает none. Официальное руководство по переходу советует всем, кто был на none или minimal, начать с low и сравнить. Токены рассуждений идут в выход, а выход стоит в 5 раз дороже входа, поэтому снижение экономит на самой дорогой части.
При входе свыше 272 000 пересчитывается весь запрос?
На странице цен есть повышенный тариф для входа свыше 272 000, но не сказано, пересчитывается ли весь запрос или только превышение. На длинных задачах это заметно меняет счёт, поэтому измерьте на небольшом запросе, прежде чем масштабировать.
Стоит ли переводить всё на Astra?
Большинству команд — нет. Безопаснее распределять по задачам: длинный контекст, сложная оркестрация инструментов и работа с интерфейсом — на Astra, рутинные правки и тесты — на бюджетном уровне. В QCode обе модели под одним ключом и одной квотой, так что сравнить можно на одних и тех же реальных запросах.
Можно ли вызывать gpt-6-astra в QCode?
Да. Она есть в таблице моделей, и за последние 30 дней по ней были реальные вызовы. Работает как любая другая модель: тот же эндпоинт, тот же ключ, в поле model укажите gpt-6-astra. Цена следует официальной; актуальный тариф — на странице моделей.
Источники
Ставки credits и диапазоны сообщений по тарифам: документация OpenAI по ценам. Прайс API и порог длинного контекста: страница цен API OpenAI. Контекст, потолок выхода и уровни рассуждений: документация по модели. Дата выхода и уровень Critical: системная карта GPT-6 Astra. Всё получено 2026-09-09. Всё, что помечено как наблюдение сообщества, не является официальной цифрой.
Измерьте один раз на своих запросах
Astra, три уровня GPT-5.6, Claude и Gemini используют один ключ QCode и одну квоту, а переключение — это смена model id. Тарифы от ¥60 в месяц, ключ активен сразу после оплаты.
Читайте также
GPT-6 Astra: полное руководство
Характеристики, цены, четыре ограничения перехода и то, что OpenAI не опубликовала.
Пятичасовой лимит Codex
Как считается окно, когда сбрасывается и что делать, если упёрлись.
Как выбрать между Sol, Terra и Luna
Позиционирование, цена и сценарии для трёх уровней GPT-5.6 рядом.
Цифры на этой странице получены 2026-09-09 из документации OpenAI по ценам, страницы цен API, документации по модели и системной карты; OpenAI может их изменить, поэтому перед оплатой сверьтесь с официальной страницей. Всё, помеченное как наблюдение сообщества, не является официальной цифрой и не гарантирует производительность.