Grok 4.6 набирает 61 балл по индексу Artificial Analysis и стоит 270 нейронов за миллион входных токенов и 810 за миллион выходных. У Claude Opus 5 индекс 63 — на два балла больше — при цене 650 и 3 250. Это дороже в 2,4 раза по входу и в 4 раза по выходу за два пункта в среднем балле, который вашу конкретную задачу не измеряет. Отсюда главное: вопрос «какая нейросеть лучше» без второй половины — «лучше для чего и за какие деньги» — ответа не имеет.

Любой «топ нейросетей», выстроенный по одному числу, врёт хотя бы наполовину: модель, которая первой разбирает договор, может проваливаться на командах в терминале. Если нужен перечень с описаниями, он у нас есть отдельно — лучшие нейросети 2026; если интересует именно первое место по баллам — самая умная нейросеть. Этот материал про другое: как выбирать под конкретную задачу, с ценой в нейронах и указанием, с какого тарифа модель вообще доступна.

Что именно вышло 12 августа: доработка, а не новое поколение

Grok 4.6 вышла 12 августа 2026 года. Разработчик — xAI; в релизе и в нашем каталоге компания фигурирует как SpaceXAI, так что «SpaceXAI: Grok 4.6» в списке моделей и Grok от xAI — это одно и то же. Идентификатор в каталоге — x-ai/grok-4.6-20260810, категория FLAGSHIP.

Про природу релиза стоит сказать прямо: это доработка после обучения, а не новая большая модель. Официально — удлинённое дополнительное обучение, заново собранное SFT и обучение с подкреплением в агентных средах. Базовая модель та же, что у Grok 4.5, так что скачка уровня «новое поколение» ждать не стоит.

Из остального: контекст 500 000 токенов — ровно как у 4.5, знания до 1 февраля 2026, на входе текст и изображения (в нашем каталоге к ним добавлены файлы), на выходе только текст. Доступ — через API xAI, Cursor, Grok Build и платформы вроде нашей. Открытых весов нет, развернуть у себя не получится.

Почему «топ нейросетей» не отвечает на ваш вопрос

В каталоге платформы 96 активных моделей, из них 29 флагманских. Любой рейтинг сводит эти 96 к одной колонке чисел, а числа получены на разных тестах и усреднены. Пример на той же Grok 4.6: в GDPval-AA v2 у неё 1753 Elo и впереди только Claude Opus 5 — и одновременно 26% на Terminal-Bench v3.0. Это одна и та же модель в одном и том же релизе.

Сравнение нейросетей начинается с цены за результат

По индексу Grok 4.6 третья, а не первая: 61 против 63 у Claude Opus 5 и ещё более высокого результата у Claude Fable 5. Столько же — 61 — у GPT-5.6 Sol Max. Важно другое: обе модели с индексом выше имеют уровень доступа MAX, то есть требуют тарифа PRO за 4 990 ₽, а у Grok 4.6 уровень STANDARD и она открывается с тарифа «Старт» за 890 ₽. Практический вывод: это самый умный вариант, доступный за 890 ₽.

МодельИндекс Artificial AnalysisНейронов за 1М вход / выходУровень доступа
Claude Fable 5выше 63 (точного числа в источнике нет)2000 / 10000MAX — PRO
Claude Opus 563650 / 3250MAX — PRO
Grok 4.661270 / 810STANDARD — «Старт»
Grok 4.556270 / 810STANDARD, категория LEGACY
Grok 4.3на 23 балла ниже, чем у 4.6163 / 325STANDARD, категория LEGACY
Балл против цены: за что вы платите сверху

Второй аргумент в пользу счёта по деньгам, а не по баллам, — расход на дорогу к ответу. Grok 4.6 доходит до результата в среднем за ~53 хода и ~0,5 млрд входных токенов, Claude Opus 5 — за ~103 хода и ~2,0 млрд. Замеренная стоимость одной задачи у Grok 4.6 — 0,84 доллара.

Официальный прайс xAI — 2 доллара за миллион входных токенов и 6 за миллион выходных, кэшированный вход подорожал с 0,3 до 0,5. В нейронах это те же деньги с нашей наценкой: 270 и 810. Дальше арифметика простая — нейрон ≈ 3 ₽, выход почти всегда дороже входа, и именно выход съедает бюджет на длинных ответах. Если механика ещё не в голове, есть разбор про нейроны и токены.

Договоры и базы знаний: тут Grok 4.6 уступает только Opus 5

Это её самая сильная сторона. GDPval-AA v2 — 1753 Elo против 1526 у Grok 4.5, и впереди только Claude Opus 5. AA-Briefcase — 1577 Elo против 1313 у 4.5. В собственной таблице xAI первые места Grok 4.6 берёт как раз в работе со знаниями и в юридических задачах.

На входе она принимает текст, изображения и файлы, контекст — 500 000 токенов. Если нужен максимум качества и тариф PRO уже есть, берите Claude Opus 5 за 650/3250. Если нет — карточка Grok 4.6 и тариф «Старт» закрывают ту же работу вчетверо дешевле по выходу.

Код и разработка: здесь Grok 4.6 не первая

DeepSWE v1.1 — 65,9%, рост на 11,9 пункта относительно 4.5. Но у GPT-5.6 Sol Max на том же тесте 73%, и спорить тут не о чем: по этому бенчмарку Grok уступает.

Остальные цифры по коду: CursorBench v3.2 — 69,9%, FrontierCode v1.1 Extended — 61,3%. А Terminal-Bench v3.0 — 26%. Да, это почти вдвое лучше, чем 15,7% у 4.5, но в абсолюте цифра слабая. На более старой и простой версии того же теста, v2.1, у неё 88,4% — и именно поэтому смотреть надо на версию бенчмарка, а не только на процент.

Что это значит на практике. На «Старте» из проверенных чисел по коду есть только Grok 4.6: 65,9% на DeepSWE и 69,9% на CursorBench. Claude Sonnet 5 за 290/1450 с контекстом 1 000 000 — второй кандидат того же уровня доступа, но её результатов по этим тестам в наших данных нет, так что сравнивать придётся на своей задаче. Известный максимум по DeepSWE — 73% у GPT-5.6 Sol Max; в каталоге GPT-5.6 Sol стоит 800/4800 и требует уровня MAX, то есть тарифа PRO. Разбор с примерами — лучшие нейросети для кода.

Длинный контекст: что брать, когда 500 000 токенов мало

Контекст Grok 4.6 не изменился относительно 4.5 — те же 500 000 токенов. Это середина каталога: GPT-5.6 Terra держит 1 050 000 при цене 150/900 и уровне STANDARD, Gemini 3.1 Pro — 1 048 576 при 250/1500, а самый большой контекст в каталоге у Grok 4.20 Beta — 2 000 000 при 200/400.

Массовые задачи: считайте цену выхода, а не баллы

Когда задач тысячи — классификация обращений, разметка, короткие саммари, — флагман не нужен. Qwen3.7 Flash стоит 4/18 и это самая дешёвая модель каталога: выход у неё дешевле, чем у Grok 4.6, в 45 раз, вход — в 67 раз. GPT-5.6 Luna — 14/87 при контексте 1 050 000, Gemini 3.7 Flash — 56/281, и обе числятся флагманскими при уровне доступа BASIC.

Правило простое: если результат проверяется автоматически или задача повторяется десятки тысяч раз, начинайте с дешёвой модели и поднимайтесь вверх только там, где качества объективно не хватило. Флагман на потоке однотипных запросов — это счёт в нейронах, который ничем не оправдан. Как это считать — в разборе про то, как тратить меньше нейронов.

Скриншоты, схемы и сканы: что Grok 4.6 с ними сделает

Официально Grok 4.6 принимает текст и изображения, в нашем каталоге к этому добавлены файлы. На выходе — только текст. То есть скриншот интерфейса, схему или сканированную страницу она разберёт и опишет, но нарисовать картинку не может: для генерации нужны другие модели.

Агентные сценарии: где доработка заметна лучше всего

Обучение с подкреплением в агентных средах — ровно то, что xAI переделали в этом релизе, и результаты это подтверждают. APEX-Agents — 57,5%, τ³-Banking — 50,7% и место в числе двух лучших. Плюс те самые ~53 хода на задачу: в многошаговом сценарии каждый лишний ход — это лишние токены и лишние нейроны, так что экономия здесь накапливается быстрее всего.

Что успеть на бесплатном тарифе: 52 модели из 96 и 100 нейронов

На бесплатном тарифе доступны 52 модели из 96, 3 агента, 2 базы знаний и 15 сообщений к платным моделям каждые 4 часа. Нейронов дают 100 и только один раз, при регистрации; поиска в интернете нет. Grok 4.6 сюда не входит — у неё уровень доступа STANDARD.

Зато полностью бесплатных моделей в каталоге две — openrouter/free и gpt-oss-20b: они не тратят нейроны и не расходуют лимит сообщений, так что на них можно спокойно тренироваться в постановке задач и не смотреть на счётчик.

Сколько нейронов и моделей даёт каждый тариф

ТарифЦенаНейроновМоделей из 96Сообщений к платным моделям
Бесплатный0 ₽100 один раз при регистрации5215 каждые 4 часа
Старт890 ₽3008150 каждые 4 часа
Стандартный2 690 ₽75081150
PRO4 990 ₽1 650все 96без лимита
Ultra9 990 ₽3 350все 96
Тарифы: цена, нейроны, доступ

Нейрон ≈ 3 ₽. Агентов: 3 на бесплатном, 5 на «Старте» — там же 5 баз знаний, поиск в интернете и 30 минут проектов в сутки, — 40 на «Стандартном», 60 на PRO. Ultra за 9 990 ₽ добавляет 3 350 нейронов и 2 места. Если выбираете между тарифами, посмотрите разбор какой тариф выбрать.

Задача, модель, цена и нужный тариф в одной таблице

ЗадачаМодельНейронов за 1М вход / выходС какого тарифа
Договоры, документы, база знанийSpaceXAI: Grok 4.6270 / 810«Старт», 890 ₽
То же, но нужен максимум качестваClaude Opus 5650 / 3250PRO, 4 990 ₽
Код и рефакторинг каждый деньGrok 4.6 или Claude Sonnet 5270 / 810 или 290 / 1450«Старт», 890 ₽
Самые тяжёлые задачи по кодуGPT-5.6 Sol800 / 4800PRO, 4 990 ₽
Контекст больше 500 000 токеновGPT-5.6 Terra (1 050 000)150 / 900«Старт», 890 ₽
Максимальный контекст 2 000 000Grok 4.20 Beta (LEGACY)200 / 400«Старт», 890 ₽
Массовая обработка, десятки тысяч запросовQwen3.7 Flash4 / 18Бесплатный (уровень BASIC)
Недорогой флагман с контекстом 1 050 000GPT-5.6 Luna14 / 87Бесплатный (уровень BASIC)
Изображения и файлы на входе, текст на выходеSpaceXAI: Grok 4.6270 / 810«Старт», 890 ₽
Агентные многошаговые сценарииSpaceXAI: Grok 4.6270 / 810«Старт», 890 ₽
Попробовать без оплатыopenrouter/free, gpt-oss-20b0 / 0Бесплатный
Что брать под конкретную задачу

Промпт, который сузит выбор до двух моделей

Подбор модели под задачу

Помоги выбрать модель под мою задачу.

Задача: [опишите в 2–3 предложениях, что должно получиться на выходе].
Объём входных данных: [примерно столько-то страниц / символов / файлов].
На входе есть картинки или файлы: [да / нет].
Нужен доступ к свежим данным из интернета: [да / нет].
Частота: [одноразово / столько-то раз в месяц].
Мой тариф: [бесплатный / Старт / Стандартный / PRO / Ultra].

Дай три варианта: самый дешёвый, разумный компромисс и максимум качества. Для каждого напиши, почему он подходит именно этой задаче и на чём может провалиться. Если разница между дорогим и дешёвым вариантом не влияет на результат в моём случае — скажи об этом прямо и не советуй дорогой.

Дальше проверяйте руками, и это единственная проверка, которая что-то доказывает. Возьмите одну настоящую задачу из своей работы — не тестовую, — прогоните её на двух моделях из ответа, сравните результаты и посмотрите, сколько нейронов ушло на каждую. Если качество различить трудно, вопрос закрыт в пользу дешёвой; если разница очевидна, вы теперь знаете, за что платите.

Слабые места Grok 4.6 — прямым текстом

  • Третье место по индексу, а не первое: 61 против 63 у Claude Opus 5 и ещё более высокого результата у Claude Fable 5. Столько же — 61 — у GPT-5.6 Sol Max.
  • Terminal-Bench v3.0 — 26%. Рост почти вдвое относительно 15,7% у 4.5, но длинные цепочки команд в терминале — объективно не её сценарий.
  • DeepSWE v1.1 — 65,9% против 73% у GPT-5.6 Sol Max: по этому тесту на код Grok уступает.
  • В собственной сравнительной таблице xAI из десяти строк больше всего первых мест у Claude Fable 5 Max. Grok 4.6 выигрывает только в работе со знаниями и в юридических задачах.
  • Это доработка после обучения, а не новая базовая модель: удлинённое дополнительное обучение, заново собранное SFT и обучение с подкреплением в агентных средах поверх той же базы, что у 4.5.
  • Контекст не вырос: те же 500 000 токенов, тогда как у части каталога — миллион и больше. Цена в нейронах тоже осталась прежней — 270/810, как у 4.5.
  • Знания до 1 февраля 2026. Про события после этой даты нужен поиск в интернете, а на бесплатном тарифе поиска нет — он появляется со «Старта».
  • Открытых весов нет, развернуть у себя невозможно. Доступ только через API xAI, Cursor, Grok Build и платформы вроде нашей.

Если из всего выбора вам нужен один разумный старт — это Grok 4.6 за 270/810 на тарифе «Старт» за 890 ₽: 300 нейронов, 81 модель, поиск в интернете и 50 сообщений каждые 4 часа. На бесплатном тарифе её нет, уровень доступа STANDARD, но там открыты 52 модели из 96 и 100 нейронов при регистрации — этого хватит, чтобы прогнать свою задачу и понять, куда двигаться дальше.