Редкий случай: два флагмана разных компаний стоят ровно одинаково — $10 за миллион входных токенов и $50 за миллион выходных. Значит, выбор идёт не по цене, а по профилю. И профили у них разошлись сильнее, чем обычно бывает у моделей одного поколения.
| GPT-6 Astra | Claude Fable 5.1 | |
|---|---|---|
| Цена у вендора за 1 млн | $10 / $50 | $10 / $50 |
| Цена на платформе, нейронов | будет объявлена | 1 800 / 9 000 |
| Сводный индекс интеллекта | 61,2 | 65,7 |
| Работа за компьютером | сильная сторона | есть, по замерам Anthropic — не слабее |
| Доступ | пока ограниченный | в каталоге, тариф Про |
Где впереди Claude Fable 5.1
| Тест | Fable 5.1 | Astra |
|---|---|---|
| Artificial Analysis Intelligence Index v4.1.1 | 65,7 | 61,2 |
| Humanity's Last Exam с инструментами | 65,0% | 57,2% |
| Индекс кодовых агентов Artificial Analysis | 67,2 | 67,0 |
Первая строка — независимый агрегат из множества тестов, и он не подтверждает формулу «самая умная модель в мире». Вторая — единственный академический тест, который Astra проигрывает, и в анонсе OpenAI его нет. Третья — фактически ничья.
К этому добавляется то, что бенчмарками не мерят: на длинном связном тексте, редактуре и формулировках модели Anthropic по-прежнему считаются сильнее. Публичных сравнений по качеству русского слога нет ни у кого — это проверяется только на своих текстах.
Где впереди Astra — и с большим отрывом
| Тест | Astra | Fable 5.1 | Что мерит |
|---|---|---|---|
| SRE-Bench | 88,0% | 12,5% | разбор аварий в инфраструктуре |
| FrontierMath Tier 4 | 97,6% | 87,8% | сложная математика |
| Terminal-Bench Science | 64,6% | 52,6% | научные задачи в терминале |
| AutomationBench | 41,4 | 31,4 | автоматизация процессов |
| ExploitBench | 100% | 70,0% | кибербезопасность |
| HealthBench Professional | 63,4% | 56,6% | медицинские задачи |
| BenchCAD | 95,9% | 84,3% | инженерное проектирование |
Как это выглядит по-человечески
- Fable 5.1 — модель, которая лучше думает и формулирует. Разобрать спорную ситуацию, написать документ, который пойдёт наружу, выдержать длинное рассуждение без срезанных углов.
- Astra — модель, которая лучше делает. Пройти по интерфейсам, собрать данные из десяти мест, довести многошаговую задачу до результата, разобрать аварию по логам. С оговоркой: на OSWorld 2.0 OpenAI даёт Astra 72,6%, а Anthropic на том же тесте заявляет у Fable 5.1 77,9% — замеры разных сторон не сведены.
- Разрыв на SRE-Bench — 88% против 12,5% — не про «чуть лучше». Это про то, что одна модель умеет разбирать инциденты, а другая по сути нет.
Что выбрать под задачу
| Задача | Модель |
|---|---|
| Договор, регламент, письмо наружу | Claude Fable 5.1 |
| Спорная ситуация, где важно рассуждение | Claude Fable 5.1 |
| Автономный прогон в браузере и таблицах | GPT-6 Astra |
| Разбор аварии, миграция, инфраструктура | GPT-6 Astra |
| Сложная математика и научные расчёты | GPT-6 Astra |
| Инженерное проектирование | GPT-6 Astra |
| Ежедневный поток документов | ни та ни другая — хватит модели дешевле |
Практический вывод
При одинаковой цене выбор между ними — это выбор между «подумать» и «сделать». Хорошая новость в том, что выбирать навсегда не нужно: на СуперИнтеллекте обе модели живут в одном окне и на одном балансе, переключение не теряет историю диалога.
Что дальше
👉 Попробовать Claude Fable 5.1 сегодня — 100 нейронов при регистрации, карта не нужна.



