GPT-6 Astra стоит $10 за миллион входных токенов и $50 за миллион выходных — ровно в 2,5 раза дороже предыдущего флагмана GPT-5.6 Sol. Столько же берёт Anthropic за Claude Fable 5.1: двух флагманов развели по возможностям, но не по прайсу. Ниже — из чего складывается счёт, где OpenAI даёт скидку, а где берёт двойную ставку.

Базовые ставки

Что оплачиваетсяЦена за 1 млн токенов
Вход$10
Чтение из кэша$1
Запись в кэш$12,50
Выход$50

Кэшированный вход в десять раз дешевле обычного — это и есть главный рычаг экономии. Повторно отправленная часть переписки или уже загруженный документ читаются по $1 вместо $10.

Скидки и наценки

РежимМножительКогда применяется
Batch и Flex×0,5задачи без спешки, обработка пачкой
Fast×2когда важна скорость ответа
Запрос свыше 272 000 токенов×2 на вход, ×1,5 на выход — то есть $20 и $75очень длинный контекст

Что это в рублях на типовых задачах

Расчёт по базовым ставкам, без скидок и наценок, по курсу порядка 90 ₽ за доллар. Цифры ориентировочные — они нужны, чтобы понимать порядок величины.

ЗадачаПримерный объёмСтоимость
Вопрос с коротким ответом2 тыс. вход, 0,5 тыс. выход≈ 4 ₽
Разбор договора на 30 страниц15 тыс. вход, 2 тыс. выход≈ 22 ₽
Комплект документов на 150 страниц75 тыс. вход, 4 тыс. выход≈ 86 ₽
Исследование с длинным отчётом200 тыс. вход, 30 тыс. выход≈ 315 ₽

Для сравнения: та же работа на Gemini 3.8 Flash — модели с ценой $0,75 и $3,75 за миллион — обойдётся примерно в тринадцать раз дешевле. Разница в счёте огромная, поэтому вопрос не «какая модель лучше», а «на какой задаче флагман окупается».

Когда флагман окупается

  • Задача автономная. Модель работает час без человека — экономия времени сотрудника перекрывает разницу в цене на порядок.
  • Ошибка дорогая. Юридический разбор, финансовая модель, миграция базы — переделка стоит дороже запроса.
  • Нужна работа за компьютером. Заполнение форм, обход интерфейсов, действия в браузере — здесь у Astra отрыв, а не проценты.
  • Очень длинный контекст с точностью. На отрезке от 512 тысяч токенов до миллиона она удерживает 96,3% против 73,8% у предшественницы.

Когда не окупается

  • Поток однотипных коротких запросов — переплата в разы без выигрыша в результате.
  • Черновики и переписывание текста — с этим справляются модели дешевле на порядок.
  • Задачи, где ответ всё равно проверяет человек — тогда важнее скорость и цена, а не последние проценты качества.

Сколько это будет стоить на СуперИнтеллекте

На платформе расход считается в нейронах — единой единице для всех моделей, около 3 ₽ за штуку. Точная цена Astra появится в карточке модели, когда мы её подключим. Ориентир уже есть: у Claude Fable 5.1 такая же вендорская цена, и на платформе это 1 800 нейронов за миллион входных токенов и 9 000 за миллион выходных.

МодельВходВыходС какого тарифа
Claude Fable 5.11 8009 000Про
Claude Opus 56503 250Про
GPT-5.6 Sol3201 600Про
GPT-5.6 Terra3001 800Старт
Gemini 3.8 Flash113563бесплатный
Флагманы каталога для сравнения, нейронов за 1 млн токенов

Что дальше

👉 Посчитать на своих задачах — 100 нейронов при регистрации, карта не нужна.