Grok 4.6 набирает 61 балл по индексу Artificial Analysis и стоит 270 нейронов за миллион входных токенов и 810 за миллион выходных. У Claude Opus 5 индекс 63 — на два балла больше — при цене 650 и 3 250. Это дороже в 2,4 раза по входу и в 4 раза по выходу за два пункта в среднем балле, который вашу конкретную задачу не измеряет. Отсюда главное: вопрос «какая нейросеть лучше» без второй половины — «лучше для чего и за какие деньги» — ответа не имеет.
Любой «топ нейросетей», выстроенный по одному числу, врёт хотя бы наполовину: модель, которая первой разбирает договор, может проваливаться на командах в терминале. Если нужен перечень с описаниями, он у нас есть отдельно — лучшие нейросети 2026; если интересует именно первое место по баллам — самая умная нейросеть. Этот материал про другое: как выбирать под конкретную задачу, с ценой в нейронах и указанием, с какого тарифа модель вообще доступна.
Что именно вышло 12 августа: доработка, а не новое поколение
Grok 4.6 вышла 12 августа 2026 года. Разработчик — xAI; в релизе и в нашем каталоге компания фигурирует как SpaceXAI, так что «SpaceXAI: Grok 4.6» в списке моделей и Grok от xAI — это одно и то же. Идентификатор в каталоге — x-ai/grok-4.6-20260810, категория FLAGSHIP.
Про природу релиза стоит сказать прямо: это доработка после обучения, а не новая большая модель. Официально — удлинённое дополнительное обучение, заново собранное SFT и обучение с подкреплением в агентных средах. Базовая модель та же, что у Grok 4.5, так что скачка уровня «новое поколение» ждать не стоит.
Из остального: контекст 500 000 токенов — ровно как у 4.5, знания до 1 февраля 2026, на входе текст и изображения (в нашем каталоге к ним добавлены файлы), на выходе только текст. Доступ — через API xAI, Cursor, Grok Build и платформы вроде нашей. Открытых весов нет, развернуть у себя не получится.
Почему «топ нейросетей» не отвечает на ваш вопрос
В каталоге платформы 96 активных моделей, из них 29 флагманских. Любой рейтинг сводит эти 96 к одной колонке чисел, а числа получены на разных тестах и усреднены. Пример на той же Grok 4.6: в GDPval-AA v2 у неё 1753 Elo и впереди только Claude Opus 5 — и одновременно 26% на Terminal-Bench v3.0. Это одна и та же модель в одном и том же релизе.
Сравнение нейросетей начинается с цены за результат
По индексу Grok 4.6 третья, а не первая: 61 против 63 у Claude Opus 5 и ещё более высокого результата у Claude Fable 5. Столько же — 61 — у GPT-5.6 Sol Max. Важно другое: обе модели с индексом выше имеют уровень доступа MAX, то есть требуют тарифа PRO за 4 990 ₽, а у Grok 4.6 уровень STANDARD и она открывается с тарифа «Старт» за 890 ₽. Практический вывод: это самый умный вариант, доступный за 890 ₽.
| Модель | Индекс Artificial Analysis | Нейронов за 1М вход / выход | Уровень доступа |
|---|---|---|---|
| Claude Fable 5 | выше 63 (точного числа в источнике нет) | 2000 / 10000 | MAX — PRO |
| Claude Opus 5 | 63 | 650 / 3250 | MAX — PRO |
| Grok 4.6 | 61 | 270 / 810 | STANDARD — «Старт» |
| Grok 4.5 | 56 | 270 / 810 | STANDARD, категория LEGACY |
| Grok 4.3 | на 23 балла ниже, чем у 4.6 | 163 / 325 | STANDARD, категория LEGACY |
Второй аргумент в пользу счёта по деньгам, а не по баллам, — расход на дорогу к ответу. Grok 4.6 доходит до результата в среднем за ~53 хода и ~0,5 млрд входных токенов, Claude Opus 5 — за ~103 хода и ~2,0 млрд. Замеренная стоимость одной задачи у Grok 4.6 — 0,84 доллара.
Официальный прайс xAI — 2 доллара за миллион входных токенов и 6 за миллион выходных, кэшированный вход подорожал с 0,3 до 0,5. В нейронах это те же деньги с нашей наценкой: 270 и 810. Дальше арифметика простая — нейрон ≈ 3 ₽, выход почти всегда дороже входа, и именно выход съедает бюджет на длинных ответах. Если механика ещё не в голове, есть разбор про нейроны и токены.
Договоры и базы знаний: тут Grok 4.6 уступает только Opus 5
Это её самая сильная сторона. GDPval-AA v2 — 1753 Elo против 1526 у Grok 4.5, и впереди только Claude Opus 5. AA-Briefcase — 1577 Elo против 1313 у 4.5. В собственной таблице xAI первые места Grok 4.6 берёт как раз в работе со знаниями и в юридических задачах.
На входе она принимает текст, изображения и файлы, контекст — 500 000 токенов. Если нужен максимум качества и тариф PRO уже есть, берите Claude Opus 5 за 650/3250. Если нет — карточка Grok 4.6 и тариф «Старт» закрывают ту же работу вчетверо дешевле по выходу.
Код и разработка: здесь Grok 4.6 не первая
DeepSWE v1.1 — 65,9%, рост на 11,9 пункта относительно 4.5. Но у GPT-5.6 Sol Max на том же тесте 73%, и спорить тут не о чем: по этому бенчмарку Grok уступает.
Остальные цифры по коду: CursorBench v3.2 — 69,9%, FrontierCode v1.1 Extended — 61,3%. А Terminal-Bench v3.0 — 26%. Да, это почти вдвое лучше, чем 15,7% у 4.5, но в абсолюте цифра слабая. На более старой и простой версии того же теста, v2.1, у неё 88,4% — и именно поэтому смотреть надо на версию бенчмарка, а не только на процент.
Что это значит на практике. На «Старте» из проверенных чисел по коду есть только Grok 4.6: 65,9% на DeepSWE и 69,9% на CursorBench. Claude Sonnet 5 за 290/1450 с контекстом 1 000 000 — второй кандидат того же уровня доступа, но её результатов по этим тестам в наших данных нет, так что сравнивать придётся на своей задаче. Известный максимум по DeepSWE — 73% у GPT-5.6 Sol Max; в каталоге GPT-5.6 Sol стоит 800/4800 и требует уровня MAX, то есть тарифа PRO. Разбор с примерами — лучшие нейросети для кода.
Длинный контекст: что брать, когда 500 000 токенов мало
Контекст Grok 4.6 не изменился относительно 4.5 — те же 500 000 токенов. Это середина каталога: GPT-5.6 Terra держит 1 050 000 при цене 150/900 и уровне STANDARD, Gemini 3.1 Pro — 1 048 576 при 250/1500, а самый большой контекст в каталоге у Grok 4.20 Beta — 2 000 000 при 200/400.
Массовые задачи: считайте цену выхода, а не баллы
Когда задач тысячи — классификация обращений, разметка, короткие саммари, — флагман не нужен. Qwen3.7 Flash стоит 4/18 и это самая дешёвая модель каталога: выход у неё дешевле, чем у Grok 4.6, в 45 раз, вход — в 67 раз. GPT-5.6 Luna — 14/87 при контексте 1 050 000, Gemini 3.7 Flash — 56/281, и обе числятся флагманскими при уровне доступа BASIC.
Правило простое: если результат проверяется автоматически или задача повторяется десятки тысяч раз, начинайте с дешёвой модели и поднимайтесь вверх только там, где качества объективно не хватило. Флагман на потоке однотипных запросов — это счёт в нейронах, который ничем не оправдан. Как это считать — в разборе про то, как тратить меньше нейронов.
Скриншоты, схемы и сканы: что Grok 4.6 с ними сделает
Официально Grok 4.6 принимает текст и изображения, в нашем каталоге к этому добавлены файлы. На выходе — только текст. То есть скриншот интерфейса, схему или сканированную страницу она разберёт и опишет, но нарисовать картинку не может: для генерации нужны другие модели.
Агентные сценарии: где доработка заметна лучше всего
Обучение с подкреплением в агентных средах — ровно то, что xAI переделали в этом релизе, и результаты это подтверждают. APEX-Agents — 57,5%, τ³-Banking — 50,7% и место в числе двух лучших. Плюс те самые ~53 хода на задачу: в многошаговом сценарии каждый лишний ход — это лишние токены и лишние нейроны, так что экономия здесь накапливается быстрее всего.
Что успеть на бесплатном тарифе: 52 модели из 96 и 100 нейронов
На бесплатном тарифе доступны 52 модели из 96, 3 агента, 2 базы знаний и 15 сообщений к платным моделям каждые 4 часа. Нейронов дают 100 и только один раз, при регистрации; поиска в интернете нет. Grok 4.6 сюда не входит — у неё уровень доступа STANDARD.
Зато полностью бесплатных моделей в каталоге две — openrouter/free и gpt-oss-20b: они не тратят нейроны и не расходуют лимит сообщений, так что на них можно спокойно тренироваться в постановке задач и не смотреть на счётчик.
Сколько нейронов и моделей даёт каждый тариф
| Тариф | Цена | Нейронов | Моделей из 96 | Сообщений к платным моделям |
|---|---|---|---|---|
| Бесплатный | 0 ₽ | 100 один раз при регистрации | 52 | 15 каждые 4 часа |
| Старт | 890 ₽ | 300 | 81 | 50 каждые 4 часа |
| Стандартный | 2 690 ₽ | 750 | 81 | 150 |
| PRO | 4 990 ₽ | 1 650 | все 96 | без лимита |
| Ultra | 9 990 ₽ | 3 350 | все 96 | — |
Нейрон ≈ 3 ₽. Агентов: 3 на бесплатном, 5 на «Старте» — там же 5 баз знаний, поиск в интернете и 30 минут проектов в сутки, — 40 на «Стандартном», 60 на PRO. Ultra за 9 990 ₽ добавляет 3 350 нейронов и 2 места. Если выбираете между тарифами, посмотрите разбор какой тариф выбрать.
Задача, модель, цена и нужный тариф в одной таблице
| Задача | Модель | Нейронов за 1М вход / выход | С какого тарифа |
|---|---|---|---|
| Договоры, документы, база знаний | SpaceXAI: Grok 4.6 | 270 / 810 | «Старт», 890 ₽ |
| То же, но нужен максимум качества | Claude Opus 5 | 650 / 3250 | PRO, 4 990 ₽ |
| Код и рефакторинг каждый день | Grok 4.6 или Claude Sonnet 5 | 270 / 810 или 290 / 1450 | «Старт», 890 ₽ |
| Самые тяжёлые задачи по коду | GPT-5.6 Sol | 800 / 4800 | PRO, 4 990 ₽ |
| Контекст больше 500 000 токенов | GPT-5.6 Terra (1 050 000) | 150 / 900 | «Старт», 890 ₽ |
| Максимальный контекст 2 000 000 | Grok 4.20 Beta (LEGACY) | 200 / 400 | «Старт», 890 ₽ |
| Массовая обработка, десятки тысяч запросов | Qwen3.7 Flash | 4 / 18 | Бесплатный (уровень BASIC) |
| Недорогой флагман с контекстом 1 050 000 | GPT-5.6 Luna | 14 / 87 | Бесплатный (уровень BASIC) |
| Изображения и файлы на входе, текст на выходе | SpaceXAI: Grok 4.6 | 270 / 810 | «Старт», 890 ₽ |
| Агентные многошаговые сценарии | SpaceXAI: Grok 4.6 | 270 / 810 | «Старт», 890 ₽ |
| Попробовать без оплаты | openrouter/free, gpt-oss-20b | 0 / 0 | Бесплатный |
Промпт, который сузит выбор до двух моделей
Подбор модели под задачу
Помоги выбрать модель под мою задачу.
Задача: [опишите в 2–3 предложениях, что должно получиться на выходе].
Объём входных данных: [примерно столько-то страниц / символов / файлов].
На входе есть картинки или файлы: [да / нет].
Нужен доступ к свежим данным из интернета: [да / нет].
Частота: [одноразово / столько-то раз в месяц].
Мой тариф: [бесплатный / Старт / Стандартный / PRO / Ultra].
Дай три варианта: самый дешёвый, разумный компромисс и максимум качества. Для каждого напиши, почему он подходит именно этой задаче и на чём может провалиться. Если разница между дорогим и дешёвым вариантом не влияет на результат в моём случае — скажи об этом прямо и не советуй дорогой.Дальше проверяйте руками, и это единственная проверка, которая что-то доказывает. Возьмите одну настоящую задачу из своей работы — не тестовую, — прогоните её на двух моделях из ответа, сравните результаты и посмотрите, сколько нейронов ушло на каждую. Если качество различить трудно, вопрос закрыт в пользу дешёвой; если разница очевидна, вы теперь знаете, за что платите.
Слабые места Grok 4.6 — прямым текстом
- Третье место по индексу, а не первое: 61 против 63 у Claude Opus 5 и ещё более высокого результата у Claude Fable 5. Столько же — 61 — у GPT-5.6 Sol Max.
- Terminal-Bench v3.0 — 26%. Рост почти вдвое относительно 15,7% у 4.5, но длинные цепочки команд в терминале — объективно не её сценарий.
- DeepSWE v1.1 — 65,9% против 73% у GPT-5.6 Sol Max: по этому тесту на код Grok уступает.
- В собственной сравнительной таблице xAI из десяти строк больше всего первых мест у Claude Fable 5 Max. Grok 4.6 выигрывает только в работе со знаниями и в юридических задачах.
- Это доработка после обучения, а не новая базовая модель: удлинённое дополнительное обучение, заново собранное SFT и обучение с подкреплением в агентных средах поверх той же базы, что у 4.5.
- Контекст не вырос: те же 500 000 токенов, тогда как у части каталога — миллион и больше. Цена в нейронах тоже осталась прежней — 270/810, как у 4.5.
- Знания до 1 февраля 2026. Про события после этой даты нужен поиск в интернете, а на бесплатном тарифе поиска нет — он появляется со «Старта».
- Открытых весов нет, развернуть у себя невозможно. Доступ только через API xAI, Cursor, Grok Build и платформы вроде нашей.
Если из всего выбора вам нужен один разумный старт — это Grok 4.6 за 270/810 на тарифе «Старт» за 890 ₽: 300 нейронов, 81 модель, поиск в интернете и 50 сообщений каждые 4 часа. На бесплатном тарифе её нет, уровень доступа STANDARD, но там открыты 52 модели из 96 и 100 нейронов при регистрации — этого хватит, чтобы прогнать свою задачу и понять, куда двигаться дальше.



