Разница между Grok 4.6 и Claude Opus 5 по индексу Artificial Analysis — два пункта: 61 против 63. Разница в цене на нашей платформе — 270/810 нейронов против 650/3250, то есть в 2,4 раза по входу и в 4 раза по выходу. И главное: Opus 5 открывается только на тарифе PRO за 4 990 ₽, а Grok 4.6 — уже на «Старте» за 890 ₽.

Дальше — сравнение по цифрам, которые можно проверить: бенчмарки из релиза, расход ходов и токенов на задачу, цена в нейронах и рублях, уровни доступа в каталоге. Универсального ответа, какая нейросеть лучше, тут нет — есть ответ под конкретный сценарий, и в конце он собран в таблицу.

Grok 4.6 против Claude Opus 5: цифры лицом к лицу

ПоказательGrok 4.6Claude Opus 5
Artificial Analysis Intelligence Index6163
GDPval-AA v21753 Elo, второе местопервое место (Elo не приводится)
Контекст500 000 токенов1 000 000 токенов
Ходов на задачу (замер из релиза)около 53около 103
Входных токенов на задачуоколо 0,5 млрдоколо 2,0 млрд
Уровень доступа в каталогеSTANDARD — с тарифа «Старт», 890 ₽MAX — с тарифа PRO, 4 990 ₽
Цена, нейронов за 1 млн вход/выход270 / 810650 / 3 250

Сразу уберём натяжку, которую любят в обзорах: Grok 4.6 — не лучшая модель. По индексу Artificial Analysis она третья: выше только Claude Opus 5 с 63 и Claude Fable 5, у которой ещё выше. Ровно те же 61 набирает GPT-5.6 Sol Max, так что даже за третью строчку идёт спор.

Прибавка при этом честная: у Grok 4.5 было 56, у Grok 4.3 — на 23 пункта меньше нынешних 61. Пять пунктов за месяц для модели, вышедшей 12 августа 2026 года, — заметный рывок. Но рывок специфический, и вот в чём.

Цена: где разница становится кратной

МодельНейронов за 1 млн входныхНейронов за 1 млн выходныхПримерно в рублях (вход / выход)С какого тарифа
Grok 4.6270810810 ₽ / 2 430 ₽«Старт», 890 ₽
Claude Sonnet 52901 450870 ₽ / 4 350 ₽«Старт», 890 ₽
Claude Opus 56503 2501 950 ₽ / 9 750 ₽PRO, 4 990 ₽
GPT-5.6 Sol8004 8002 400 ₽ / 14 400 ₽PRO, 4 990 ₽

Рубли в таблице посчитаны по курсу «нейрон примерно 3 ₽» — это ориентир, чтобы почувствовать масштаб, а не цена в кассе. Цена Grok 4.6 в нейронах ровно повторяет официальные 2 и 6 долларов за миллион токенов у xAI, так что наценка платформы тут прозрачна и цифры сходятся.

Ключевое тут не сами суммы, а уровень доступа. У Grok 4.6 он STANDARD: модель открывается на тарифе «Старт» за 890 ₽ вместе с 81 моделью из 96. У Opus 5 — MAX: её не видно ни на «Старте», ни на «Стандартном» за 2 690 ₽, нужен PRO за 4 990 ₽ и полный каталог из 96 моделей, где 29 флагманских. Это разница не в 2,4 раза за токен, а в порог входа.

Отсюда вывод, который стоит держать в голове: Grok 4.6 — самый умный вариант, доступный за 890 ₽. Всё, что выше её по индексу, живёт на уровне MAX. Если вы прикидываете, куда двигаться с бесплатного тарифа, ступени разобраны в материале какой тариф выбрать.

Что дают 300 нейронов «Старта» и 1 650 нейронов PRO

Посчитаем по прайсу. 300 нейронов «Старта» — это около 1,1 млн входных токенов Grok 4.6 или примерно 370 000 выходных, если тратить всё в одну сторону. 1 650 нейронов PRO на выходе Opus 5 — около 500 000 токенов. Получается так: PRO дороже «Старта» в 5,6 раза, а выходных токенов в нём примерно на треть больше.

Это арифметика по одной стороне счёта — живой диалог тратит и вход, и выход, а бесплатные модели нейроны не расходуют вовсе. Как токены превращаются в нейроны, разобрано в материале нейроны и токены.

Второй лимит, о который упираются чаще, — сообщения. На «Старте» это 50 обращений к платным моделям каждые 4 часа, на «Стандартном» за 2 690 ₽ — 150 при 750 нейронах, на PRO лимита сообщений нет. Grok 4.6 — платная модель, так что каждый запрос к ней идёт в этот счётчик.

Эффективность: разрыв больше, чем в прайсе

В релизе есть цифра интереснее прайса. На агентных задачах Grok 4.6 доходит до результата примерно за 53 хода и 0,5 млрд входных токенов, Claude Opus 5 — примерно за 103 хода и 2,0 млрд. Замеренная стоимость задачи для Grok — 0,84 доллара.

Сложите два множителя. Токен Opus 5 дороже в 2,4 раза по входу, и этих токенов уходит примерно вчетверо больше. В счёте за длинную агентную задачу разница выходит сильно больше, чем видно в прайс-листе. Поэтому сравнивать модели по цене за миллион токенов — полдела: считать надо цену за решённую задачу.

Где Grok 4.6 действительно сильна

  • GDPval-AA v2 — 1753 Elo против 1526 у Grok 4.5. Второе место в замере, впереди только Claude Opus 5.
  • AA-Briefcase — 1577 Elo против 1313 у 4.5: плюс 264 пункта за одну итерацию.
  • τ³-Banking — 50,7% — в числе двух лучших результатов.
  • В собственной таблице xAI из десяти строк Grok 4.6 забирает первые места в работе со знаниями и в юридических задачах.
  • reasoning_effort — управление глубиной размышления. У Grok 4.5 такого параметра нет: там глубину не покрутить, а здесь простую задачу можно не гонять на максимуме.

Прочие цифры для полноты: CursorBench v3.2 — 69,9%, FrontierCode v1.1 Extended — 61,3%, APEX-Agents — 57,5%, Terminal-Bench v2.1 (более старая и простая версия) — 88,4%. Вход — текст, изображения и файлы, выход — только текст. Идентификатор в каталоге — x-ai/grok-4.6-20260810.

Где Opus 5 всё равно остаётся нужным

  • Первое место в GDPval-AA v2. Grok 4.6 с 1753 Elo подобралась близко, но не обошла.
  • Контекст 1 000 000 токенов против 500 000. Если вы кладёте в диалог свод документов или репозиторий целиком, вдвое больший контекст решает вопрос надёжнее, чем два пункта индекса.
  • 63 против 61 по индексу. Верхняя точка качества в этой паре — у Opus 5, и там, где ошибка дороже подписки, платят именно за неё.
  • Claude Fable 5 Max в той же таблице xAI берёт больше всего первых мест из десяти строк, а по индексу Artificial Analysis она выше Opus 5. Потолок качества сейчас всё-таки у Anthropic — но уровень доступа у Fable 5 тоже MAX, при цене 2000/10000 нейронов.

Если вы выбираете между флагманами верхнего уровня и не экономите, сравнивать Opus 5 логичнее не с Grok, а с прямым конкурентом по классу — это отдельный разбор Claude Opus 5 против GPT-5.6. Общая расстановка сил — в рейтинге нейросетей.

Слабые места Grok 4.6 без смягчения

Terminal-Bench v3.0 — 26%. Да, это почти вдвое больше, чем 15,7% у Grok 4.5. Но в абсолюте 26% — плохой результат: три четверти терминальных задач модель не доводит до конца. Если ваш сценарий — автономная работа в консоли, это дисквалифицирующая цифра, а не «есть куда расти».

DeepSWE v1.1 — 65,9%. Рост на 11,9 пункта, но GPT-5.6 Sol Max берёт 73%. По этому бенчмарку Grok уступает прямо и заметно, так что автоматическим победителем в подборе модели под код она не становится: подборка по коду собрана в лучших нейросетях для кода, а лоб в лоб две модели разобраны в Grok 4.6 против GPT-5.6.

И третье, о чём в анонсах говорят вскользь: контекст не вырос, цена в нейронах не изменилась, базовая модель прежняя. Единственное, что стало дороже, — кэширование на стороне xAI: с 0,3 до 0,5 доллара за миллион токенов.

Проверьте сами: один промпт на две модели

Спор о двух пунктах индекса решается одним прогоном. Возьмите задачу из своей работы, отправьте одинаковый промпт в обе модели и смотрите не на бенчмарки, а на результат и на историю списаний нейронов.

Промпт для сравнения моделей

Ты выступаешь ведущим инженером. Задача: подготовь план работ по переносу внутреннего сервиса на новую схему данных.

Входные условия (замени на свои, 5–7 строк):
— язык и стек сервиса:
— объём данных и допустимое время простоя:
— кто ещё зависит от этих данных:
— что уже пробовали и почему не получилось:

Требования к ответу:
1. Разбей работу на этапы. Для каждого — цель, проверяемый результат, главный риск.
2. Отдельным блоком перечисли, каких данных тебе не хватает, чтобы не додумывать за меня.
3. В конце — таблица: этап / что может пойти не так / как откатить.

Без вступления и заключения, начни сразу с первого этапа. Если условие противоречиво — скажи об этом прямо, а не выбирай молча.

Сравнивайте три вещи: сколько уточняющих вопросов модель задала вместо догадок, сколько ходов ушло до пригодного плана и сколько нейронов списалось. Первые два пункта — ваша личная проверка индекса и GDPval, третий — та самая разница 270/810 против 650/3250. Если разрыва в качестве на своих задачах вы не видите, платить в 2,4 и 4 раза больше незачем.

Какая нейросеть лучше: прямой ответ по сценариям

Что вы делаетеЧто братьПочему
Аналитика, документы, юридические текстыGrok 4.61753 Elo в GDPval и первые места xAI в знаниях и праве при цене 270/810
Длинные агентные цепочки, много итерацийGrok 4.6около 53 ходов и 0,5 млрд входных токенов против 103 и 2,0 млрд
Максимальное качество на сложной многоходовкеClaude Opus 563 по индексу и первое место в GDPval-AA v2
Репозиторий или свод документов целиком в контекстClaude Sonnet 5 или Claude Opus 51 000 000 токенов против 500 000; Sonnet 5 при 290/1450 доступен со «Старта»
Большой контекст при скромном бюджетеGemini 3.7 Flash1 048 576 токенов за 56/281 нейрона, уровень доступа BASIC
Автономная работа в терминалеНе Grok 4.626% на Terminal-Bench v3.0; по Opus 5 в этом замере данных нет
Бюджет до 1 000 ₽ в месяцGrok 4.6самый умный вариант на уровне доступа STANDARD

Коротко: Opus 5 стоит своих денег там, где ошибка дороже подписки, и там, где нужен миллион токенов контекста. В остальных случаях два пункта индекса не оправдывают четырёхкратную цену выхода и переход с 890 ₽ на 4 990 ₽.

Если контекста в 500 000 токенов мало, а бюджет держится на STANDARD, посмотрите на соседей по каталогу: Gemini 3.1 Pro — 1 048 576 токенов при 250/1500, Gemini 3.7 Flash — те же 1 048 576 за 56/281. У grok-4.20-beta контекст вообще 2 000 000 при 200/400, но модель помечена категорией LEGACY, и брать её под новую работу смысла мало.


Grok 4.6 в каталоге подписана как «SpaceXAI: Grok 4.6», лежит в категории FLAGSHIP и открывается с тарифа «Старт» за 890 ₽ — параметры и точную цену видно в карточке модели. На бесплатном тарифе её нет: там 52 модели из 96 и 100 нейронов, которые начисляются один раз при регистрации, зато бесплатные модели нейроны не тратят и лимит сообщений не расходуют. Этого хватит, чтобы посмотреть, как устроена платформа, и уже потом решать, нужен вам «Старт» за 890 ₽ или PRO за 4 990 ₽.