У Grok 4.6 и GPT-5.6 Sol Max одинаковый балл в Artificial Analysis Intelligence Index — 61. Разница в другом: Grok стоит 270 нейронов за миллион входных токенов и 810 за миллион выходных и открывается на тарифе «Старт» за 890 ₽, а Sol в каталоге — это 800/4800 и уровень доступа MAX, то есть тариф PRO за 4 990 ₽. Одинаковый индекс, почти шестикратный разрыв в цене выхода и разница в тарифе в 5,6 раза.

Поэтому вопрос «Grok 4.6 или ChatGPT» на практике распадается на два разных. Первый — сравнение с топовой Sol, где по индексу счёт равный, а по деньгам нет. Второй — сравнение с Luna за 14/87 нейронов, где расклад разворачивается в обратную сторону. Ниже оба, с цифрами и без умалчиваний: у Grok 4.6 есть что признать, и это тоже будет в тексте.

Grok 4.6 и GPT-5.6: цена, контекст и тариф в одной таблице

МодельИндекс AAНейронов за 1М (вход / выход)КонтекстУровень доступа
Grok 4.661270 / 810500 000STANDARD — с «Старта», 890 ₽
GPT-5.6 Sol61 — замер для варианта Sol Max800 / 48001 050 000MAX — с PRO, 4 990 ₽
GPT-5.6 Terraнет данных150 / 9001 050 000STANDARD — с «Старта», 890 ₽
GPT-5.6 Luna Proнет данных14 / 871 050 000STANDARD — с «Старта», 890 ₽
GPT-5.6 Lunaнет данных14 / 871 050 000BASIC — самый низкий уровень
Grok 4.6 и линейка GPT-5.6 в каталоге СуперИнтеллекта

И сразу про место Grok в общем зачёте: 61 — третий результат, а не первый. Выше только Claude Opus 5 с 63 и Claude Fable 5, и обе на уровне MAX, то есть от PRO за 4 990 ₽. При этом Opus 5 (650/3250 нейронов) дороже Grok 4.6 в 2,4 раза по входу и в 4 раза по выходу — за два пункта индекса. Подробный разбор этой пары — в материале Grok 4.6 против Claude Opus 5.

Одно число вообще стоит держать в уме как грубый ориентир. Две модели с равным индексом расходятся на конкретных задачах довольно сильно — следующий раздел как раз про такой случай.

Где GPT-5.6 Sol честно впереди

Код в сложных сценариях. На DeepSWE v1.1 у Grok 4.6 — 65,9% (рост на 11,9 пункта к версии 4.5), у GPT-5.6 Sol Max — 73%. Семь с небольшим пунктов разрыва на тесте, который ближе всего к настоящей работе с репозиторием: если основная нагрузка — правки в чужом коде, это аргумент не в пользу Grok. Общая картина по кодовым моделям — в подборке лучших нейросетей для кода.

Контекст. У линейки GPT-5.6 в каталоге — 1 050 000 токенов, у Grok 4.6 — 500 000, и относительно 4.5 он не вырос ни на токен. Разница в два с лишним раза начинает мешать там, где в один запрос надо положить свод документов или большую часть кодовой базы: у Grok в такой работе раньше кончается место.

Если упор именно в объём, внутри семейства Grok есть grok-4.20-beta: контекст 2 000 000 токенов за 200/400 нейронов на уровне STANDARD. Оговорка существенная — в каталоге она в категории LEGACY, как и сами Grok 4.5 (270/810) и Grok 4.3 (163/325). Строить на LEGACY-модели новый рабочий процесс — плохая идея, но для разового разбора огромного документа вариант рабочий.

Терминал: слабое место, которое видно в цифрах

На Terminal-Bench v3.0 у Grok 4.6 — 26% против 15,7% у 4.5. Рост почти вдвое, а в абсолюте всё равно мало: три четверти задач до конца не доходят. Сравнимой цифры для линейки GPT-5.6 xAI не приводил, поэтому честная формулировка звучит не как «GPT здесь лучше», а как «у Grok здесь тонко, проверяйте на своём сценарии».

И не путайте это с 88,4% на Terminal-Bench v2.1: версия более старая и простая, числа оттуда с v3.0 не сравниваются. Если в чужом обзоре вам показывают «88% в терминале» — почти наверняка это v2.1.

Где Grok 4.6 забирает своё

Работа со знаниями и с документами. На GDPval-AA v2 у Grok 4.6 — 1753 Elo против 1526 у 4.5, впереди только Claude Opus 5. На AA-Briefcase — 1577 против 1313. Плюс 50,7% на τ³-Banking, что входит в число двух лучших результатов.

При этом в собственной сводной таблице xAI из десяти строк больше всего первых мест берёт Claude Fable 5 Max, а Grok 4.6 выигрывает в работе со знаниями и в юридических задачах. Это её профиль, а не «везде лучшая» — такую формулировку стоит держать при себе, когда кто-то показывает вам одну выбранную строку.

БенчмаркGrok 4.6Grok 4.5GPT-5.6 Sol Max
Artificial Analysis Index615661
GDPval-AA v2, Elo17531526нет данных
AA-Briefcase, Elo15771313нет данных
DeepSWE v1.165,9% (+11,9 пункта к 4.5)нет данных73%
Terminal-Bench v3.026%15,7%нет данных
Terminal-Bench v2.188,4%нет данныхнет данных
CursorBench v3.269,9%нет данныхнет данных
FrontierCode v1.1 Extended61,3%нет данныхнет данных
APEX-Agents57,5%нет данныхнет данных
τ³-Banking50,7%нет данныхнет данных
Бенчмарки: Grok 4.6, Grok 4.5 и GPT-5.6 Sol Max

Второй аргумент — экономность на длинных задачах. Grok 4.6 доходит до результата в среднем за 53 хода и около 0,5 млрд входных токенов, тогда как Claude Opus 5 тратит примерно 103 хода и 2,0 млрд. Замеренная стоимость задачи — 0,84 доллара. Оговорка: сравнение здесь именно с Opus 5, по линейке GPT-5.6 таких замеров ходов и токенов не публиковали.

Для агентного сценария, где модель ходит по кругу десятки раз, это влияет на счёт напрямую: меньше ходов — меньше повторно перечитанного контекста, а вход тоже стоит нейроны. Как одно переводится в другое, разобрано в материале про нейроны и токены.

Что не изменилось: это доработка, а не новая модель

Grok 4.6 вышла 12 августа 2026. Разработчик — xAI; в релизе и в нашем каталоге компания фигурирует ещё и как SpaceXAI, это одна и та же организация. В списке моделей строка подписана «SpaceXAI: Grok 4.6», идентификатор — x-ai/grok-4.6-20260810.

Официально это доработка после обучения, а не новая большая модель: удлинённое дополнительное обучение, заново собранные SFT и обучение с подкреплением в агентных средах. Базовая модель та же, что у 4.5. Формулировка не придирка — от неё зависит, чего ждать: профиль поведения остаётся узнаваемым, ломающихся привычек мало.

Отсюда и совпадения: контекст остался 500 000, цена в каталоге — те же 270/810 нейронов, знания — до 1 февраля 2026, вход текст и изображения (в каталоге ещё и файлы), выход только текст. В официальном прайсе xAI вход и выход тоже не двигались — 2 и 6 долларов за миллион токенов; подорожал только кэш, с 0,3 до 0,5 доллара.

Изменилось другое. Индекс поднялся с 56 до 61, Grok 4.6 стоит в категории FLAGSHIP — одна из 29 флагманских моделей каталога, — а 4.5 и 4.3 переехали в LEGACY. В каталоге у неё включены reasoning, reasoning_effort, вызов инструментов и строгие форматы ответа. Если вы работали с предыдущей версией, полезно перечитать обзор Grok 4.5: большая часть привычек переносится без изменений.

Если решает цена, сравнивать надо не с Sol, а с Luna

В семействе GPT-5.6 есть Luna за 14/87 нейронов с контекстом 1 050 000 — это в 19 раз дешевле по входу и в 9 раз по выходу, чем Grok 4.6, при более низком уровне доступа (BASIC). Рядом Luna Pro с той же ценой на уровне STANDARD и Terra за 150/900. Terra и есть прямой сосед Grok по тарифу: обе открываются на «Старте» за 890 ₽.

Только это не «Luna лучше». Индекса для Luna не публиковали, поэтому ставить её вместо модели с 61 на сложной задаче — размен качества на цену вслепую. Рабочая схема другая: массовые однотипные запросы гоните на Luna, а узкие места, где нужен уровень 61, отдавайте Grok 4.6. По какому признаку делить поток, разобрано в материале какую нейросеть выбрать: Grok, GPT или Gemini.

Ещё несколько ориентиров из того же каталога — просто чтобы понимать, куда 270/810 попадают по деньгам. Индексов Artificial Analysis для этих моделей нет, поэтому сравниваем только цену, контекст и уровень доступа.

МодельНейронов за 1М (вход / выход)КонтекстУровень доступа
Gemini 3.7 Flash56 / 2811 048 576BASIC
GPT-5.6 Terra150 / 9001 050 000STANDARD
Gemini 3.1 Pro250 / 15001 048 576STANDARD
Grok 4.6270 / 810500 000STANDARD
Claude Sonnet 5290 / 14501 000 000STANDARD
Qwen3.8 Max300 / 9001 000 000BASIC
Claude Opus 5650 / 32501 000 000MAX
GPT-5.6 Sol800 / 48001 050 000MAX
Цена и доступ: где Grok 4.6 стоит среди соседей

Отсюда главный проверяемый вывод: на уровне STANDARD Grok 4.6 — единственная модель с подтверждённым индексом 61, а всё, что по индексу выше, лежит на MAX и требует PRO за 4 990 ₽. То есть самый умный вариант, доступный на тарифе за 890 ₽, — это Grok 4.6. С поправкой на терминал и код, о которых выше.

Что брать под конкретную задачу

  • Правки в чужом репозитории и сложные кодовые задачи — GPT-5.6 Sol: 73% на DeepSWE v1.1 против 65,9% у Grok 4.6.
  • Агент, который сам работает в терминале, — сначала свой прогон: у Grok 4.6 на Terminal-Bench v3.0 всего 26%, а сравнимых чисел для GPT-5.6 нет.
  • Разбор документов, юридические формулировки, работа со знаниями — Grok 4.6: 1753 Elo в GDPval-AA v2, позади только Claude Opus 5.
  • В запрос нужно положить больше 500 000 токенов — линейка GPT-5.6 с контекстом 1 050 000; у Grok 4.6 такого объёма нет.
  • Много длинных агентных прогонов с оглядкой на баланс — Grok 4.6: около 53 ходов на задачу и 0,84 доллара замеренной стоимости против примерно 103 ходов у Claude Opus 5.
  • Черновики, переписывание, простые ответы пачками — GPT-5.6 Luna за 14/87 нейронов: индекса для неё не публиковали, но и уровень 61 в таких задачах обычно не нужен.
  • Максимум качества любой ценой — Claude Opus 5 с индексом 63 или Claude Fable 5, но это уровень MAX и тариф PRO за 4 990 ₽.

Проверьте на своей задаче, а не на бенчмарках

Бенчмарки говорят о среднем, а платите вы за свои задачи. Прогоните один и тот же промпт на Grok 4.6 и на модели GPT-5.6, к которой у вас есть доступ, и сравните три вещи: соблюдён ли строгий формат, честно ли модель признала нехватку данных, сколько лишних слов пришлось вычитывать. Заодно посмотрите списанные нейроны — разрыв 270/810 против 800/4800 виден уже на десятке запросов.

Промпт для сравнения двух моделей на своей задаче

Ты — технический аналитик. Ниже задача и ограничения. Ответь тремя разделами, без вступлений и без похвалы задаче.

1. План решения по шагам: что делаем, в каком порядке, зачем нужен каждый шаг.
2. Риски и неопределённости: где данных не хватает и какие именно нужны, чтобы шаг стал выполнимым.
3. Итог строго в JSON по схеме:
{"steps": ["..."], "risks": ["..."], "open_questions": ["..."]}

Правила: не додумывай факты, которых нет в описании. Если чего-то не хватает — напиши это прямо, а не подставляй допущение. Никаких пояснений после JSON.

Задача: <опишите свою задачу в 5-10 предложениях>
Ограничения: <сроки, стек, бюджет, требования согласования>

Прогон занимает минут пятнадцать и снимает большую часть сомнений. Если формат JSON поехал у одной модели и удержался у другой — это важнее любого пункта индекса, потому что чинить придётся вам.

Слабые места, о которых лучше знать заранее

  • По индексу Artificial Analysis Grok 4.6 третья: 61 против 63 у Claude Opus 5 и выше у Claude Fable 5.
  • Terminal-Bench v3.0 — 26%. Почти вдвое лучше, чем 15,7% у 4.5, но в абсолюте мало.
  • DeepSWE v1.1 — 65,9% против 73% у GPT-5.6 Sol Max: в кодовых задачах Sol впереди.
  • В собственной сводной таблице xAI из десяти строк больше всего первых мест берёт Claude Fable 5 Max, а не Grok 4.6.
  • Контекст 500 000 — вдвое меньше, чем у линейки GPT-5.6, и относительно 4.5 он не вырос.
  • Это доработка после обучения, а не новая базовая модель: база та же, что у Grok 4.5.
  • Знания до 1 февраля 2026. Что было позже — только через контекст или поиск в интернете, а он доступен с тарифа «Старт».
  • Выход только текст: изображения и файлы модель принимает, но не создаёт.
  • Открытых весов нет, развернуть у себя нельзя — только через API xAI, Cursor, Grok Build или наш каталог.
  • Про скорость ответа, задержку и число параметров данных нет — xAI их не публиковал. Любые такие цифры в обзорах взяты не из релиза.

Сколько стоит попробовать

Grok 4.6 включается на тарифе «Старт» за 890 ₽: 300 нейронов, 81 модель из 96, 5 агентов, 5 баз знаний, 50 сообщений к платным моделям каждые 4 часа, поиск в интернете и 30 минут проектов в сутки. Если тратить все 300 нейронов только на Grok 4.6, это примерно 370 тысяч выходных токенов по цене 810 за миллион — и заметно больше, когда основной объём приходится на вход по 270.

Дальше ступеньки такие. «Стандартный» — 2 690 ₽, 750 нейронов, те же 81 модель, 40 агентов и 150 сообщений каждые 4 часа. PRO — 4 990 ₽, 1 650 нейронов, все 96 моделей, 60 агентов и без лимита сообщений. Ultra — 9 990 ₽, 3 350 нейронов и 2 места. Нейрон ≈ 3 ₽, если удобнее считать в рублях.

В токенах разница между тарифами выглядит так: 1 650 нейронов на PRO — это около 2 млн выходных токенов у Grok 4.6 или около 340 тысяч у Sol при том же индексе 61. На этом и строится выбор. Ступени целиком разобраны в материалах какой тариф выбрать и тариф «Старт» за 890 ₽.

Практичный порядок такой: сначала соберите промпт и прогоните задачу на бесплатном тарифе — на том, что там открыто. Упёрлись в потолок 52 моделей — берите «Старт» и повторяйте тот же промпт на Grok 4.6, сравнивая результат и списанные нейроны. Карточка модели показывает актуальную цену, контекст и поддерживаемые параметры: сверяйтесь с ней, а не с обзорами, включая этот.