GPT-6 Astra стоит $10 за миллион входных токенов и $50 за миллион выходных — ровно в 2,5 раза дороже предыдущего флагмана GPT-5.6 Sol. Столько же берёт Anthropic за Claude Fable 5.1: двух флагманов развели по возможностям, но не по прайсу. Ниже — из чего складывается счёт, где OpenAI даёт скидку, а где берёт двойную ставку.
Базовые ставки
| Что оплачивается | Цена за 1 млн токенов |
|---|---|
| Вход | $10 |
| Чтение из кэша | $1 |
| Запись в кэш | $12,50 |
| Выход | $50 |
Кэшированный вход в десять раз дешевле обычного — это и есть главный рычаг экономии. Повторно отправленная часть переписки или уже загруженный документ читаются по $1 вместо $10.
Скидки и наценки
| Режим | Множитель | Когда применяется |
|---|---|---|
| Batch и Flex | ×0,5 | задачи без спешки, обработка пачкой |
| Fast | ×2 | когда важна скорость ответа |
| Запрос свыше 272 000 токенов | ×2 на вход, ×1,5 на выход — то есть $20 и $75 | очень длинный контекст |
Что это в рублях на типовых задачах
Расчёт по базовым ставкам, без скидок и наценок, по курсу порядка 90 ₽ за доллар. Цифры ориентировочные — они нужны, чтобы понимать порядок величины.
| Задача | Примерный объём | Стоимость |
|---|---|---|
| Вопрос с коротким ответом | 2 тыс. вход, 0,5 тыс. выход | ≈ 4 ₽ |
| Разбор договора на 30 страниц | 15 тыс. вход, 2 тыс. выход | ≈ 22 ₽ |
| Комплект документов на 150 страниц | 75 тыс. вход, 4 тыс. выход | ≈ 86 ₽ |
| Исследование с длинным отчётом | 200 тыс. вход, 30 тыс. выход | ≈ 315 ₽ |
Для сравнения: та же работа на Gemini 3.8 Flash — модели с ценой $0,75 и $3,75 за миллион — обойдётся примерно в тринадцать раз дешевле. Разница в счёте огромная, поэтому вопрос не «какая модель лучше», а «на какой задаче флагман окупается».
Когда флагман окупается
- Задача автономная. Модель работает час без человека — экономия времени сотрудника перекрывает разницу в цене на порядок.
- Ошибка дорогая. Юридический разбор, финансовая модель, миграция базы — переделка стоит дороже запроса.
- Нужна работа за компьютером. Заполнение форм, обход интерфейсов, действия в браузере — здесь у Astra отрыв, а не проценты.
- Очень длинный контекст с точностью. На отрезке от 512 тысяч токенов до миллиона она удерживает 96,3% против 73,8% у предшественницы.
Когда не окупается
- Поток однотипных коротких запросов — переплата в разы без выигрыша в результате.
- Черновики и переписывание текста — с этим справляются модели дешевле на порядок.
- Задачи, где ответ всё равно проверяет человек — тогда важнее скорость и цена, а не последние проценты качества.
Сколько это будет стоить на СуперИнтеллекте
На платформе расход считается в нейронах — единой единице для всех моделей, около 3 ₽ за штуку. Точная цена Astra появится в карточке модели, когда мы её подключим. Ориентир уже есть: у Claude Fable 5.1 такая же вендорская цена, и на платформе это 1 800 нейронов за миллион входных токенов и 9 000 за миллион выходных.
| Модель | Вход | Выход | С какого тарифа |
|---|---|---|---|
| Claude Fable 5.1 | 1 800 | 9 000 | Про |
| Claude Opus 5 | 650 | 3 250 | Про |
| GPT-5.6 Sol | 320 | 1 600 | Про |
| GPT-5.6 Terra | 300 | 1 800 | Старт |
| Gemini 3.8 Flash | 113 | 563 | бесплатный |
Что дальше
- GPT-6 Astra против Claude Fable 5.1 — одна цена, разные профили
- Бенчмарки честно
- Как тратить меньше нейронов
👉 Посчитать на своих задачах — 100 нейронов при регистрации, карта не нужна.

