Разница между Grok 4.6 и Claude Opus 5 по индексу Artificial Analysis — два пункта: 61 против 63. Разница в цене на нашей платформе — 270/810 нейронов против 650/3250, то есть в 2,4 раза по входу и в 4 раза по выходу. И главное: Opus 5 открывается только на тарифе PRO за 4 990 ₽, а Grok 4.6 — уже на «Старте» за 890 ₽.
Дальше — сравнение по цифрам, которые можно проверить: бенчмарки из релиза, расход ходов и токенов на задачу, цена в нейронах и рублях, уровни доступа в каталоге. Универсального ответа, какая нейросеть лучше, тут нет — есть ответ под конкретный сценарий, и в конце он собран в таблицу.
Grok 4.6 против Claude Opus 5: цифры лицом к лицу
| Показатель | Grok 4.6 | Claude Opus 5 |
|---|---|---|
| Artificial Analysis Intelligence Index | 61 | 63 |
| GDPval-AA v2 | 1753 Elo, второе место | первое место (Elo не приводится) |
| Контекст | 500 000 токенов | 1 000 000 токенов |
| Ходов на задачу (замер из релиза) | около 53 | около 103 |
| Входных токенов на задачу | около 0,5 млрд | около 2,0 млрд |
| Уровень доступа в каталоге | STANDARD — с тарифа «Старт», 890 ₽ | MAX — с тарифа PRO, 4 990 ₽ |
| Цена, нейронов за 1 млн вход/выход | 270 / 810 | 650 / 3 250 |
Сразу уберём натяжку, которую любят в обзорах: Grok 4.6 — не лучшая модель. По индексу Artificial Analysis она третья: выше только Claude Opus 5 с 63 и Claude Fable 5, у которой ещё выше. Ровно те же 61 набирает GPT-5.6 Sol Max, так что даже за третью строчку идёт спор.
Прибавка при этом честная: у Grok 4.5 было 56, у Grok 4.3 — на 23 пункта меньше нынешних 61. Пять пунктов за месяц для модели, вышедшей 12 августа 2026 года, — заметный рывок. Но рывок специфический, и вот в чём.
Цена: где разница становится кратной
| Модель | Нейронов за 1 млн входных | Нейронов за 1 млн выходных | Примерно в рублях (вход / выход) | С какого тарифа |
|---|---|---|---|---|
| Grok 4.6 | 270 | 810 | 810 ₽ / 2 430 ₽ | «Старт», 890 ₽ |
| Claude Sonnet 5 | 290 | 1 450 | 870 ₽ / 4 350 ₽ | «Старт», 890 ₽ |
| Claude Opus 5 | 650 | 3 250 | 1 950 ₽ / 9 750 ₽ | PRO, 4 990 ₽ |
| GPT-5.6 Sol | 800 | 4 800 | 2 400 ₽ / 14 400 ₽ | PRO, 4 990 ₽ |
Рубли в таблице посчитаны по курсу «нейрон примерно 3 ₽» — это ориентир, чтобы почувствовать масштаб, а не цена в кассе. Цена Grok 4.6 в нейронах ровно повторяет официальные 2 и 6 долларов за миллион токенов у xAI, так что наценка платформы тут прозрачна и цифры сходятся.
Ключевое тут не сами суммы, а уровень доступа. У Grok 4.6 он STANDARD: модель открывается на тарифе «Старт» за 890 ₽ вместе с 81 моделью из 96. У Opus 5 — MAX: её не видно ни на «Старте», ни на «Стандартном» за 2 690 ₽, нужен PRO за 4 990 ₽ и полный каталог из 96 моделей, где 29 флагманских. Это разница не в 2,4 раза за токен, а в порог входа.
Отсюда вывод, который стоит держать в голове: Grok 4.6 — самый умный вариант, доступный за 890 ₽. Всё, что выше её по индексу, живёт на уровне MAX. Если вы прикидываете, куда двигаться с бесплатного тарифа, ступени разобраны в материале какой тариф выбрать.
Что дают 300 нейронов «Старта» и 1 650 нейронов PRO
Посчитаем по прайсу. 300 нейронов «Старта» — это около 1,1 млн входных токенов Grok 4.6 или примерно 370 000 выходных, если тратить всё в одну сторону. 1 650 нейронов PRO на выходе Opus 5 — около 500 000 токенов. Получается так: PRO дороже «Старта» в 5,6 раза, а выходных токенов в нём примерно на треть больше.
Это арифметика по одной стороне счёта — живой диалог тратит и вход, и выход, а бесплатные модели нейроны не расходуют вовсе. Как токены превращаются в нейроны, разобрано в материале нейроны и токены.
Второй лимит, о который упираются чаще, — сообщения. На «Старте» это 50 обращений к платным моделям каждые 4 часа, на «Стандартном» за 2 690 ₽ — 150 при 750 нейронах, на PRO лимита сообщений нет. Grok 4.6 — платная модель, так что каждый запрос к ней идёт в этот счётчик.
Эффективность: разрыв больше, чем в прайсе
В релизе есть цифра интереснее прайса. На агентных задачах Grok 4.6 доходит до результата примерно за 53 хода и 0,5 млрд входных токенов, Claude Opus 5 — примерно за 103 хода и 2,0 млрд. Замеренная стоимость задачи для Grok — 0,84 доллара.
Сложите два множителя. Токен Opus 5 дороже в 2,4 раза по входу, и этих токенов уходит примерно вчетверо больше. В счёте за длинную агентную задачу разница выходит сильно больше, чем видно в прайс-листе. Поэтому сравнивать модели по цене за миллион токенов — полдела: считать надо цену за решённую задачу.
Где Grok 4.6 действительно сильна
- GDPval-AA v2 — 1753 Elo против 1526 у Grok 4.5. Второе место в замере, впереди только Claude Opus 5.
- AA-Briefcase — 1577 Elo против 1313 у 4.5: плюс 264 пункта за одну итерацию.
- τ³-Banking — 50,7% — в числе двух лучших результатов.
- В собственной таблице xAI из десяти строк Grok 4.6 забирает первые места в работе со знаниями и в юридических задачах.
- reasoning_effort — управление глубиной размышления. У Grok 4.5 такого параметра нет: там глубину не покрутить, а здесь простую задачу можно не гонять на максимуме.
Прочие цифры для полноты: CursorBench v3.2 — 69,9%, FrontierCode v1.1 Extended — 61,3%, APEX-Agents — 57,5%, Terminal-Bench v2.1 (более старая и простая версия) — 88,4%. Вход — текст, изображения и файлы, выход — только текст. Идентификатор в каталоге — x-ai/grok-4.6-20260810.
Где Opus 5 всё равно остаётся нужным
- Первое место в GDPval-AA v2. Grok 4.6 с 1753 Elo подобралась близко, но не обошла.
- Контекст 1 000 000 токенов против 500 000. Если вы кладёте в диалог свод документов или репозиторий целиком, вдвое больший контекст решает вопрос надёжнее, чем два пункта индекса.
- 63 против 61 по индексу. Верхняя точка качества в этой паре — у Opus 5, и там, где ошибка дороже подписки, платят именно за неё.
- Claude Fable 5 Max в той же таблице xAI берёт больше всего первых мест из десяти строк, а по индексу Artificial Analysis она выше Opus 5. Потолок качества сейчас всё-таки у Anthropic — но уровень доступа у Fable 5 тоже MAX, при цене 2000/10000 нейронов.
Если вы выбираете между флагманами верхнего уровня и не экономите, сравнивать Opus 5 логичнее не с Grok, а с прямым конкурентом по классу — это отдельный разбор Claude Opus 5 против GPT-5.6. Общая расстановка сил — в рейтинге нейросетей.
Слабые места Grok 4.6 без смягчения
Terminal-Bench v3.0 — 26%. Да, это почти вдвое больше, чем 15,7% у Grok 4.5. Но в абсолюте 26% — плохой результат: три четверти терминальных задач модель не доводит до конца. Если ваш сценарий — автономная работа в консоли, это дисквалифицирующая цифра, а не «есть куда расти».
DeepSWE v1.1 — 65,9%. Рост на 11,9 пункта, но GPT-5.6 Sol Max берёт 73%. По этому бенчмарку Grok уступает прямо и заметно, так что автоматическим победителем в подборе модели под код она не становится: подборка по коду собрана в лучших нейросетях для кода, а лоб в лоб две модели разобраны в Grok 4.6 против GPT-5.6.
И третье, о чём в анонсах говорят вскользь: контекст не вырос, цена в нейронах не изменилась, базовая модель прежняя. Единственное, что стало дороже, — кэширование на стороне xAI: с 0,3 до 0,5 доллара за миллион токенов.
Проверьте сами: один промпт на две модели
Спор о двух пунктах индекса решается одним прогоном. Возьмите задачу из своей работы, отправьте одинаковый промпт в обе модели и смотрите не на бенчмарки, а на результат и на историю списаний нейронов.
Промпт для сравнения моделей
Ты выступаешь ведущим инженером. Задача: подготовь план работ по переносу внутреннего сервиса на новую схему данных.
Входные условия (замени на свои, 5–7 строк):
— язык и стек сервиса:
— объём данных и допустимое время простоя:
— кто ещё зависит от этих данных:
— что уже пробовали и почему не получилось:
Требования к ответу:
1. Разбей работу на этапы. Для каждого — цель, проверяемый результат, главный риск.
2. Отдельным блоком перечисли, каких данных тебе не хватает, чтобы не додумывать за меня.
3. В конце — таблица: этап / что может пойти не так / как откатить.
Без вступления и заключения, начни сразу с первого этапа. Если условие противоречиво — скажи об этом прямо, а не выбирай молча.Сравнивайте три вещи: сколько уточняющих вопросов модель задала вместо догадок, сколько ходов ушло до пригодного плана и сколько нейронов списалось. Первые два пункта — ваша личная проверка индекса и GDPval, третий — та самая разница 270/810 против 650/3250. Если разрыва в качестве на своих задачах вы не видите, платить в 2,4 и 4 раза больше незачем.
Какая нейросеть лучше: прямой ответ по сценариям
| Что вы делаете | Что брать | Почему |
|---|---|---|
| Аналитика, документы, юридические тексты | Grok 4.6 | 1753 Elo в GDPval и первые места xAI в знаниях и праве при цене 270/810 |
| Длинные агентные цепочки, много итераций | Grok 4.6 | около 53 ходов и 0,5 млрд входных токенов против 103 и 2,0 млрд |
| Максимальное качество на сложной многоходовке | Claude Opus 5 | 63 по индексу и первое место в GDPval-AA v2 |
| Репозиторий или свод документов целиком в контекст | Claude Sonnet 5 или Claude Opus 5 | 1 000 000 токенов против 500 000; Sonnet 5 при 290/1450 доступен со «Старта» |
| Большой контекст при скромном бюджете | Gemini 3.7 Flash | 1 048 576 токенов за 56/281 нейрона, уровень доступа BASIC |
| Автономная работа в терминале | Не Grok 4.6 | 26% на Terminal-Bench v3.0; по Opus 5 в этом замере данных нет |
| Бюджет до 1 000 ₽ в месяц | Grok 4.6 | самый умный вариант на уровне доступа STANDARD |
Коротко: Opus 5 стоит своих денег там, где ошибка дороже подписки, и там, где нужен миллион токенов контекста. В остальных случаях два пункта индекса не оправдывают четырёхкратную цену выхода и переход с 890 ₽ на 4 990 ₽.
Если контекста в 500 000 токенов мало, а бюджет держится на STANDARD, посмотрите на соседей по каталогу: Gemini 3.1 Pro — 1 048 576 токенов при 250/1500, Gemini 3.7 Flash — те же 1 048 576 за 56/281. У grok-4.20-beta контекст вообще 2 000 000 при 200/400, но модель помечена категорией LEGACY, и брать её под новую работу смысла мало.
Grok 4.6 в каталоге подписана как «SpaceXAI: Grok 4.6», лежит в категории FLAGSHIP и открывается с тарифа «Старт» за 890 ₽ — параметры и точную цену видно в карточке модели. На бесплатном тарифе её нет: там 52 модели из 96 и 100 нейронов, которые начисляются один раз при регистрации, зато бесплатные модели нейроны не тратят и лимит сообщений не расходуют. Этого хватит, чтобы посмотреть, как устроена платформа, и уже потом решать, нужен вам «Старт» за 890 ₽ или PRO за 4 990 ₽.


