У Grok 4.6 и GPT-5.6 Sol Max одинаковый балл в Artificial Analysis Intelligence Index — 61. Разница в другом: Grok стоит 270 нейронов за миллион входных токенов и 810 за миллион выходных и открывается на тарифе «Старт» за 890 ₽, а Sol в каталоге — это 800/4800 и уровень доступа MAX, то есть тариф PRO за 4 990 ₽. Одинаковый индекс, почти шестикратный разрыв в цене выхода и разница в тарифе в 5,6 раза.
Поэтому вопрос «Grok 4.6 или ChatGPT» на практике распадается на два разных. Первый — сравнение с топовой Sol, где по индексу счёт равный, а по деньгам нет. Второй — сравнение с Luna за 14/87 нейронов, где расклад разворачивается в обратную сторону. Ниже оба, с цифрами и без умалчиваний: у Grok 4.6 есть что признать, и это тоже будет в тексте.
Grok 4.6 и GPT-5.6: цена, контекст и тариф в одной таблице
| Модель | Индекс AA | Нейронов за 1М (вход / выход) | Контекст | Уровень доступа |
|---|---|---|---|---|
| Grok 4.6 | 61 | 270 / 810 | 500 000 | STANDARD — с «Старта», 890 ₽ |
| GPT-5.6 Sol | 61 — замер для варианта Sol Max | 800 / 4800 | 1 050 000 | MAX — с PRO, 4 990 ₽ |
| GPT-5.6 Terra | нет данных | 150 / 900 | 1 050 000 | STANDARD — с «Старта», 890 ₽ |
| GPT-5.6 Luna Pro | нет данных | 14 / 87 | 1 050 000 | STANDARD — с «Старта», 890 ₽ |
| GPT-5.6 Luna | нет данных | 14 / 87 | 1 050 000 | BASIC — самый низкий уровень |
И сразу про место Grok в общем зачёте: 61 — третий результат, а не первый. Выше только Claude Opus 5 с 63 и Claude Fable 5, и обе на уровне MAX, то есть от PRO за 4 990 ₽. При этом Opus 5 (650/3250 нейронов) дороже Grok 4.6 в 2,4 раза по входу и в 4 раза по выходу — за два пункта индекса. Подробный разбор этой пары — в материале Grok 4.6 против Claude Opus 5.
Одно число вообще стоит держать в уме как грубый ориентир. Две модели с равным индексом расходятся на конкретных задачах довольно сильно — следующий раздел как раз про такой случай.
Где GPT-5.6 Sol честно впереди
Код в сложных сценариях. На DeepSWE v1.1 у Grok 4.6 — 65,9% (рост на 11,9 пункта к версии 4.5), у GPT-5.6 Sol Max — 73%. Семь с небольшим пунктов разрыва на тесте, который ближе всего к настоящей работе с репозиторием: если основная нагрузка — правки в чужом коде, это аргумент не в пользу Grok. Общая картина по кодовым моделям — в подборке лучших нейросетей для кода.
Контекст. У линейки GPT-5.6 в каталоге — 1 050 000 токенов, у Grok 4.6 — 500 000, и относительно 4.5 он не вырос ни на токен. Разница в два с лишним раза начинает мешать там, где в один запрос надо положить свод документов или большую часть кодовой базы: у Grok в такой работе раньше кончается место.
Если упор именно в объём, внутри семейства Grok есть grok-4.20-beta: контекст 2 000 000 токенов за 200/400 нейронов на уровне STANDARD. Оговорка существенная — в каталоге она в категории LEGACY, как и сами Grok 4.5 (270/810) и Grok 4.3 (163/325). Строить на LEGACY-модели новый рабочий процесс — плохая идея, но для разового разбора огромного документа вариант рабочий.
Терминал: слабое место, которое видно в цифрах
На Terminal-Bench v3.0 у Grok 4.6 — 26% против 15,7% у 4.5. Рост почти вдвое, а в абсолюте всё равно мало: три четверти задач до конца не доходят. Сравнимой цифры для линейки GPT-5.6 xAI не приводил, поэтому честная формулировка звучит не как «GPT здесь лучше», а как «у Grok здесь тонко, проверяйте на своём сценарии».
И не путайте это с 88,4% на Terminal-Bench v2.1: версия более старая и простая, числа оттуда с v3.0 не сравниваются. Если в чужом обзоре вам показывают «88% в терминале» — почти наверняка это v2.1.
Где Grok 4.6 забирает своё
Работа со знаниями и с документами. На GDPval-AA v2 у Grok 4.6 — 1753 Elo против 1526 у 4.5, впереди только Claude Opus 5. На AA-Briefcase — 1577 против 1313. Плюс 50,7% на τ³-Banking, что входит в число двух лучших результатов.
При этом в собственной сводной таблице xAI из десяти строк больше всего первых мест берёт Claude Fable 5 Max, а Grok 4.6 выигрывает в работе со знаниями и в юридических задачах. Это её профиль, а не «везде лучшая» — такую формулировку стоит держать при себе, когда кто-то показывает вам одну выбранную строку.
| Бенчмарк | Grok 4.6 | Grok 4.5 | GPT-5.6 Sol Max |
|---|---|---|---|
| Artificial Analysis Index | 61 | 56 | 61 |
| GDPval-AA v2, Elo | 1753 | 1526 | нет данных |
| AA-Briefcase, Elo | 1577 | 1313 | нет данных |
| DeepSWE v1.1 | 65,9% (+11,9 пункта к 4.5) | нет данных | 73% |
| Terminal-Bench v3.0 | 26% | 15,7% | нет данных |
| Terminal-Bench v2.1 | 88,4% | нет данных | нет данных |
| CursorBench v3.2 | 69,9% | нет данных | нет данных |
| FrontierCode v1.1 Extended | 61,3% | нет данных | нет данных |
| APEX-Agents | 57,5% | нет данных | нет данных |
| τ³-Banking | 50,7% | нет данных | нет данных |
Второй аргумент — экономность на длинных задачах. Grok 4.6 доходит до результата в среднем за 53 хода и около 0,5 млрд входных токенов, тогда как Claude Opus 5 тратит примерно 103 хода и 2,0 млрд. Замеренная стоимость задачи — 0,84 доллара. Оговорка: сравнение здесь именно с Opus 5, по линейке GPT-5.6 таких замеров ходов и токенов не публиковали.
Для агентного сценария, где модель ходит по кругу десятки раз, это влияет на счёт напрямую: меньше ходов — меньше повторно перечитанного контекста, а вход тоже стоит нейроны. Как одно переводится в другое, разобрано в материале про нейроны и токены.
Что не изменилось: это доработка, а не новая модель
Grok 4.6 вышла 12 августа 2026. Разработчик — xAI; в релизе и в нашем каталоге компания фигурирует ещё и как SpaceXAI, это одна и та же организация. В списке моделей строка подписана «SpaceXAI: Grok 4.6», идентификатор — x-ai/grok-4.6-20260810.
Официально это доработка после обучения, а не новая большая модель: удлинённое дополнительное обучение, заново собранные SFT и обучение с подкреплением в агентных средах. Базовая модель та же, что у 4.5. Формулировка не придирка — от неё зависит, чего ждать: профиль поведения остаётся узнаваемым, ломающихся привычек мало.
Отсюда и совпадения: контекст остался 500 000, цена в каталоге — те же 270/810 нейронов, знания — до 1 февраля 2026, вход текст и изображения (в каталоге ещё и файлы), выход только текст. В официальном прайсе xAI вход и выход тоже не двигались — 2 и 6 долларов за миллион токенов; подорожал только кэш, с 0,3 до 0,5 доллара.
Изменилось другое. Индекс поднялся с 56 до 61, Grok 4.6 стоит в категории FLAGSHIP — одна из 29 флагманских моделей каталога, — а 4.5 и 4.3 переехали в LEGACY. В каталоге у неё включены reasoning, reasoning_effort, вызов инструментов и строгие форматы ответа. Если вы работали с предыдущей версией, полезно перечитать обзор Grok 4.5: большая часть привычек переносится без изменений.
Если решает цена, сравнивать надо не с Sol, а с Luna
В семействе GPT-5.6 есть Luna за 14/87 нейронов с контекстом 1 050 000 — это в 19 раз дешевле по входу и в 9 раз по выходу, чем Grok 4.6, при более низком уровне доступа (BASIC). Рядом Luna Pro с той же ценой на уровне STANDARD и Terra за 150/900. Terra и есть прямой сосед Grok по тарифу: обе открываются на «Старте» за 890 ₽.
Только это не «Luna лучше». Индекса для Luna не публиковали, поэтому ставить её вместо модели с 61 на сложной задаче — размен качества на цену вслепую. Рабочая схема другая: массовые однотипные запросы гоните на Luna, а узкие места, где нужен уровень 61, отдавайте Grok 4.6. По какому признаку делить поток, разобрано в материале какую нейросеть выбрать: Grok, GPT или Gemini.
Ещё несколько ориентиров из того же каталога — просто чтобы понимать, куда 270/810 попадают по деньгам. Индексов Artificial Analysis для этих моделей нет, поэтому сравниваем только цену, контекст и уровень доступа.
| Модель | Нейронов за 1М (вход / выход) | Контекст | Уровень доступа |
|---|---|---|---|
| Gemini 3.7 Flash | 56 / 281 | 1 048 576 | BASIC |
| GPT-5.6 Terra | 150 / 900 | 1 050 000 | STANDARD |
| Gemini 3.1 Pro | 250 / 1500 | 1 048 576 | STANDARD |
| Grok 4.6 | 270 / 810 | 500 000 | STANDARD |
| Claude Sonnet 5 | 290 / 1450 | 1 000 000 | STANDARD |
| Qwen3.8 Max | 300 / 900 | 1 000 000 | BASIC |
| Claude Opus 5 | 650 / 3250 | 1 000 000 | MAX |
| GPT-5.6 Sol | 800 / 4800 | 1 050 000 | MAX |
Отсюда главный проверяемый вывод: на уровне STANDARD Grok 4.6 — единственная модель с подтверждённым индексом 61, а всё, что по индексу выше, лежит на MAX и требует PRO за 4 990 ₽. То есть самый умный вариант, доступный на тарифе за 890 ₽, — это Grok 4.6. С поправкой на терминал и код, о которых выше.
Что брать под конкретную задачу
- Правки в чужом репозитории и сложные кодовые задачи — GPT-5.6 Sol: 73% на DeepSWE v1.1 против 65,9% у Grok 4.6.
- Агент, который сам работает в терминале, — сначала свой прогон: у Grok 4.6 на Terminal-Bench v3.0 всего 26%, а сравнимых чисел для GPT-5.6 нет.
- Разбор документов, юридические формулировки, работа со знаниями — Grok 4.6: 1753 Elo в GDPval-AA v2, позади только Claude Opus 5.
- В запрос нужно положить больше 500 000 токенов — линейка GPT-5.6 с контекстом 1 050 000; у Grok 4.6 такого объёма нет.
- Много длинных агентных прогонов с оглядкой на баланс — Grok 4.6: около 53 ходов на задачу и 0,84 доллара замеренной стоимости против примерно 103 ходов у Claude Opus 5.
- Черновики, переписывание, простые ответы пачками — GPT-5.6 Luna за 14/87 нейронов: индекса для неё не публиковали, но и уровень 61 в таких задачах обычно не нужен.
- Максимум качества любой ценой — Claude Opus 5 с индексом 63 или Claude Fable 5, но это уровень MAX и тариф PRO за 4 990 ₽.
Проверьте на своей задаче, а не на бенчмарках
Бенчмарки говорят о среднем, а платите вы за свои задачи. Прогоните один и тот же промпт на Grok 4.6 и на модели GPT-5.6, к которой у вас есть доступ, и сравните три вещи: соблюдён ли строгий формат, честно ли модель признала нехватку данных, сколько лишних слов пришлось вычитывать. Заодно посмотрите списанные нейроны — разрыв 270/810 против 800/4800 виден уже на десятке запросов.
Промпт для сравнения двух моделей на своей задаче
Ты — технический аналитик. Ниже задача и ограничения. Ответь тремя разделами, без вступлений и без похвалы задаче.
1. План решения по шагам: что делаем, в каком порядке, зачем нужен каждый шаг.
2. Риски и неопределённости: где данных не хватает и какие именно нужны, чтобы шаг стал выполнимым.
3. Итог строго в JSON по схеме:
{"steps": ["..."], "risks": ["..."], "open_questions": ["..."]}
Правила: не додумывай факты, которых нет в описании. Если чего-то не хватает — напиши это прямо, а не подставляй допущение. Никаких пояснений после JSON.
Задача: <опишите свою задачу в 5-10 предложениях>
Ограничения: <сроки, стек, бюджет, требования согласования>Прогон занимает минут пятнадцать и снимает большую часть сомнений. Если формат JSON поехал у одной модели и удержался у другой — это важнее любого пункта индекса, потому что чинить придётся вам.
Слабые места, о которых лучше знать заранее
- По индексу Artificial Analysis Grok 4.6 третья: 61 против 63 у Claude Opus 5 и выше у Claude Fable 5.
- Terminal-Bench v3.0 — 26%. Почти вдвое лучше, чем 15,7% у 4.5, но в абсолюте мало.
- DeepSWE v1.1 — 65,9% против 73% у GPT-5.6 Sol Max: в кодовых задачах Sol впереди.
- В собственной сводной таблице xAI из десяти строк больше всего первых мест берёт Claude Fable 5 Max, а не Grok 4.6.
- Контекст 500 000 — вдвое меньше, чем у линейки GPT-5.6, и относительно 4.5 он не вырос.
- Это доработка после обучения, а не новая базовая модель: база та же, что у Grok 4.5.
- Знания до 1 февраля 2026. Что было позже — только через контекст или поиск в интернете, а он доступен с тарифа «Старт».
- Выход только текст: изображения и файлы модель принимает, но не создаёт.
- Открытых весов нет, развернуть у себя нельзя — только через API xAI, Cursor, Grok Build или наш каталог.
- Про скорость ответа, задержку и число параметров данных нет — xAI их не публиковал. Любые такие цифры в обзорах взяты не из релиза.
Сколько стоит попробовать
Grok 4.6 включается на тарифе «Старт» за 890 ₽: 300 нейронов, 81 модель из 96, 5 агентов, 5 баз знаний, 50 сообщений к платным моделям каждые 4 часа, поиск в интернете и 30 минут проектов в сутки. Если тратить все 300 нейронов только на Grok 4.6, это примерно 370 тысяч выходных токенов по цене 810 за миллион — и заметно больше, когда основной объём приходится на вход по 270.
Дальше ступеньки такие. «Стандартный» — 2 690 ₽, 750 нейронов, те же 81 модель, 40 агентов и 150 сообщений каждые 4 часа. PRO — 4 990 ₽, 1 650 нейронов, все 96 моделей, 60 агентов и без лимита сообщений. Ultra — 9 990 ₽, 3 350 нейронов и 2 места. Нейрон ≈ 3 ₽, если удобнее считать в рублях.
В токенах разница между тарифами выглядит так: 1 650 нейронов на PRO — это около 2 млн выходных токенов у Grok 4.6 или около 340 тысяч у Sol при том же индексе 61. На этом и строится выбор. Ступени целиком разобраны в материалах какой тариф выбрать и тариф «Старт» за 890 ₽.
Практичный порядок такой: сначала соберите промпт и прогоните задачу на бесплатном тарифе — на том, что там открыто. Упёрлись в потолок 52 моделей — берите «Старт» и повторяйте тот же промпт на Grok 4.6, сравнивая результат и списанные нейроны. Карточка модели показывает актуальную цену, контекст и поддерживаемые параметры: сверяйтесь с ней, а не с обзорами, включая этот.



