Редкий случай: два флагмана разных компаний стоят ровно одинаково — $10 за миллион входных токенов и $50 за миллион выходных. Значит, выбор идёт не по цене, а по профилю. И профили у них разошлись сильнее, чем обычно бывает у моделей одного поколения.

GPT-6 AstraClaude Fable 5.1
Цена у вендора за 1 млн$10 / $50$10 / $50
Цена на платформе, нейроновбудет объявлена1 800 / 9 000
Сводный индекс интеллекта61,265,7
Работа за компьютеромсильная сторонаесть, по замерам Anthropic — не слабее
Доступпока ограниченныйв каталоге, тариф Про
Главное в одной таблице

Где впереди Claude Fable 5.1

ТестFable 5.1Astra
Artificial Analysis Intelligence Index v4.1.165,761,2
Humanity's Last Exam с инструментами65,0%57,2%
Индекс кодовых агентов Artificial Analysis67,267,0

Первая строка — независимый агрегат из множества тестов, и он не подтверждает формулу «самая умная модель в мире». Вторая — единственный академический тест, который Astra проигрывает, и в анонсе OpenAI его нет. Третья — фактически ничья.

К этому добавляется то, что бенчмарками не мерят: на длинном связном тексте, редактуре и формулировках модели Anthropic по-прежнему считаются сильнее. Публичных сравнений по качеству русского слога нет ни у кого — это проверяется только на своих текстах.

Где впереди Astra — и с большим отрывом

ТестAstraFable 5.1Что мерит
SRE-Bench88,0%12,5%разбор аварий в инфраструктуре
FrontierMath Tier 497,6%87,8%сложная математика
Terminal-Bench Science64,6%52,6%научные задачи в терминале
AutomationBench41,431,4автоматизация процессов
ExploitBench100%70,0%кибербезопасность
HealthBench Professional63,4%56,6%медицинские задачи
BenchCAD95,9%84,3%инженерное проектирование

Как это выглядит по-человечески

  • Fable 5.1 — модель, которая лучше думает и формулирует. Разобрать спорную ситуацию, написать документ, который пойдёт наружу, выдержать длинное рассуждение без срезанных углов.
  • Astra — модель, которая лучше делает. Пройти по интерфейсам, собрать данные из десяти мест, довести многошаговую задачу до результата, разобрать аварию по логам. С оговоркой: на OSWorld 2.0 OpenAI даёт Astra 72,6%, а Anthropic на том же тесте заявляет у Fable 5.1 77,9% — замеры разных сторон не сведены.
  • Разрыв на SRE-Bench — 88% против 12,5% — не про «чуть лучше». Это про то, что одна модель умеет разбирать инциденты, а другая по сути нет.

Что выбрать под задачу

ЗадачаМодель
Договор, регламент, письмо наружуClaude Fable 5.1
Спорная ситуация, где важно рассуждениеClaude Fable 5.1
Автономный прогон в браузере и таблицахGPT-6 Astra
Разбор аварии, миграция, инфраструктураGPT-6 Astra
Сложная математика и научные расчётыGPT-6 Astra
Инженерное проектированиеGPT-6 Astra
Ежедневный поток документовни та ни другая — хватит модели дешевле

Практический вывод

При одинаковой цене выбор между ними — это выбор между «подумать» и «сделать». Хорошая новость в том, что выбирать навсегда не нужно: на СуперИнтеллекте обе модели живут в одном окне и на одном балансе, переключение не теряет историю диалога.


Что дальше

👉 Попробовать Claude Fable 5.1 сегодня — 100 нейронов при регистрации, карта не нужна.