Grok 4.6 набирает 61 балл по индексу Artificial Analysis и стоит 270 нейронов за миллион входных токенов. Выше неё в индексе всего две модели: Claude Opus 5 с 63 баллами (650 за вход, 3250 за выход) и Claude Fable 5. Получается, два пункта индекса обходятся дороже в 2,4 раза по входу и в 4 раза по выходу. Рейтинг нейросетей с единственной колонкой «умнее» такую разницу не показывает вообще.
Ниже — рейтинг ИИ-моделей в двух измерениях сразу: независимый индекс Artificial Analysis и реальная цена в нейронах из каталога платформы, где сейчас 96 активных моделей, 29 из них флагманские. По отдельности оба измерения почти бесполезны. Балл без цены не говорит, во что обойдётся день работы; цена без балла не говорит, потратите вы нейроны с толком или впустую.
Три колонки, по которым выбирают модель, а не одна
Индекс Artificial Analysis — сводная оценка по набору тестов, которую считает сторонняя команда, а не разработчик модели. Цены — из боевого каталога: нейроны за миллион входных и миллион выходных токенов. Третий столбец, которого в обычных топах не бывает, — уровень доступа: BASIC, STANDARD или MAX. Он решает, увидите вы модель на тарифе за 890 ₽ или только на PRO за 4 990 ₽.
Кто умнее: рейтинг ИИ-моделей по индексу Artificial Analysis
Данные проверены 17 августа 2026. Grok 4.6 вышла 12 августа, в каталоге подписана «SpaceXAI: Grok 4.6» (идентификатор x-ai/grok-4.6-20260810, категория FLAGSHIP) — xAI и SpaceXAI здесь одна компания, в релизе и в каталоге в ходу обе формы. Её 61 пункт против 56 у Grok 4.5 набран за месяц.
| Модель | Индекс | Вход / выход, нейронов за 1 млн | Уровень доступа |
|---|---|---|---|
| Claude Fable 5 | выше, чем у Opus 5 (значения нет) | 2000 / 10 000 | MAX |
| Claude Opus 5 (замер у версии Opus 5 Max) | 63 | 650 / 3250 | MAX |
| Grok 4.6 | 61 | 270 / 810 | STANDARD |
| GPT-5.6 Sol (замер у версии Sol Max) | 61 | 800 / 4800 | MAX |
| Grok 4.5 | 56 | 270 / 810 | STANDARD, категория LEGACY |
| Grok 4.3 | на 23 пункта ниже 4.6 | 163 / 325 | STANDARD, категория LEGACY |
Таблица короткая не потому, что каталог маленький. Независимый индекс есть далеко не по всем позициям: из 96 активных моделей и 29 флагманов проверенные замеры у нас только по этим строкам, а про Claude Fable 5 известно лишь то, что она выше Opus 5. Дальше таблицы будут разной длины — это ограничение данных, а не подгонка под удобный вывод. Полный перечень моделей с описаниями — в лучших нейросетях 2026.
Сравнение нейросетей по цене: от 4 до 2000 нейронов за миллион
Здесь цифры известны для всего каталога, поэтому таблица длиннее. Это цена входа и выхода в нейронах — то, что реально списывается со счёта.
| Модель | Вход | Выход | Уровень доступа |
|---|---|---|---|
| qwen3.7-flash | 4 | 18 | BASIC |
| gpt-5.6-luna | 14 | 87 | BASIC |
| gpt-5.6-luna-pro | 14 | 87 | STANDARD |
| gemini-3.7-flash | 56 | 281 | BASIC |
| gpt-5.6-terra | 150 | 900 | STANDARD |
| gemini-3.1-pro | 250 | 1500 | STANDARD |
| Grok 4.6 | 270 | 810 | STANDARD |
| claude-sonnet-5 | 290 | 1450 | STANDARD |
| qwen3.8-max | 300 | 900 | BASIC |
| kimi-k3 | 600 | 3000 | STANDARD |
| claude-opus-5 | 650 | 3250 | MAX |
| gpt-5.6-sol | 800 | 4800 | MAX |
| claude-5-fable | 2000 | 10 000 | MAX |
Разброс внутри одного каталога — в 500 раз по входу: от 4 нейронов у qwen3.7-flash, самой дешёвой модели, до 2000 у claude-5-fable. Отдельно посмотрите на соотношение вход/выход: у Grok 4.6 выход дороже входа втрое (810 против 270), у claude-sonnet-5 — впятеро (1450 против 290). Цена входа у них почти одинаковая, но на длинных ответах разница набегает быстро.
И ещё одна вещь, которую топы обычно скрывают: уровень доступа не следует за ценой. qwen3.8-max стоит 300/900 и открыт на уровне BASIC, а gpt-5.6-luna-pro за 14/87 — уже STANDARD, то есть требует минимум тарифа «Старт». Дешёвая модель не значит доступная, и наоборот.
Рейтинг нейросетей 2026 по контексту: где Grok 4.6 проигрывает
| Модель | Контекст, токенов | Уровень доступа |
|---|---|---|
| grok-4.20-beta | 2 000 000 | STANDARD, категория LEGACY |
| gpt-5.6-luna, luna-pro, terra, sol | 1 050 000 | BASIC / STANDARD / MAX |
| gemini-3.7-flash, gemini-3.1-pro, kimi-k3 | 1 048 576 | BASIC / STANDARD |
| claude-opus-5, claude-sonnet-5, claude-5-fable | 1 000 000 | STANDARD / MAX |
| qwen3.8-max | 1 000 000 | BASIC |
| grok-4.3 | 1 000 000 | STANDARD, категория LEGACY |
| Grok 4.6 | 500 000 | STANDARD |
| grok-4.5 | 500 000 | STANDARD, категория LEGACY |
Grok 4.6 в этой таблице внизу, и это честная слабость. Для большинства задач 500 000 токенов хватает, но относительно 4.5 окно не выросло ни на токен, а почти все модели в верхней части списка дают вдвое больше. Самый большой контекст в каталоге — 2 000 000 у grok-4.20-beta, только это предыдущее поколение, категория LEGACY, и в рейтинг по интеллекту такие модели не попадают.
Сколько стоит один пункт индекса — и почему это главная колонка
Теперь сводим два измерения. Слева — балл, справа не только цена за миллион токенов, но и тариф, без которого модель просто не появится у вас в списке.
| Модель | Индекс | Вход / выход, нейронов | С какого тарифа доступна |
|---|---|---|---|
| Grok 4.6 | 61 | 270 / 810 | «Старт», 890 ₽ |
| GPT-5.6 Sol | 61 (замер у версии Sol Max) | 800 / 4800 | PRO, 4 990 ₽ |
| Claude Opus 5 | 63 (замер у версии Opus 5 Max) | 650 / 3250 | PRO, 4 990 ₽ |
| Claude Fable 5 | выше, чем у Opus 5 | 2000 / 10 000 | PRO, 4 990 ₽ |
Вот в этом весь смысл двух измерений. Grok 4.6 не самая умная модель каталога — она третья по индексу, но при этом самый умный вариант, доступный на тарифе «Старт» за 890 ₽: уровень STANDARD, 61 пункт. Всё, что выше по индексу, имеет уровень MAX и требует PRO за 4 990 ₽ — в 5,6 раза дороже. А GPT-5.6 Sol при том же индексе 61 просит 800 нейронов за вход против 270 и тоже живёт только на PRO.
Что стоит за 61 пунктом Grok 4.6
| Тест | Grok 4.6 | Grok 4.5 |
|---|---|---|
| Artificial Analysis Intelligence Index | 61 | 56 |
| GDPval-AA v2 | 1753 Elo | 1526 Elo |
| AA-Briefcase | 1577 Elo | 1313 Elo |
| DeepSWE v1.1 | 65,9% | на 11,9 пункта меньше |
| Terminal-Bench v3.0 | 26% | 15,7% |
| Terminal-Bench v2.1 (более старая и простая версия) | 88,4% | нет данных |
| CursorBench v3.2 | 69,9% | нет данных |
| FrontierCode v1.1 Extended | 61,3% | нет данных |
| APEX-Agents | 57,5% | нет данных |
| τ³-Banking | 50,7% (в числе двух лучших) | нет данных |
По GDPval-AA v2 с её 1753 Elo впереди только Claude Opus 5. Зато DeepSWE v1.1 — 65,9% против 73% у GPT-5.6 Sol Max: в инженерных задачах с кодом Grok 4.6 остаётся вторым номером. В собственной сравнительной таблице xAI из десяти строк больше всего первых мест берёт Claude Fable 5 Max, а Grok 4.6 забирает работу со знаниями и юридические задачи.
И главное про природу прироста: базовая модель здесь та же, что у Grok 4.5. Официально это доработка после обучения, а не новая большая модель — удлинённое дополнительное обучение, заново собранное SFT и обучение с подкреплением в агентных средах. Пять пунктов индекса выжали из тренировки поверх прежней базы, и читать прирост стоит именно так.
Есть измерение, где Grok 4.6 уверенно впереди Opus 5, — расход. На задачу у неё уходит в среднем около 53 ходов и порядка 0,5 млрд входных токенов, у Claude Opus 5 — около 103 ходов и 2,0 млрд. Замеренная стоимость задачи — 0,84 доллара. Официальный прайс xAI — 2 доллара за миллион входных токенов, 0,50 за кэшированные (было 0,3) и 6 за выходные; 270 и 810 нейронов в каталоге — это ровно те же 2 и 6 долларов с наценкой платформы, цифры сходятся.
В каталоге у 4.6 доступны reasoning и reasoning_effort — управление глубиной размышления, инструменты и строгие форматы ответа. У Grok 4.5 параметра reasoning_effort нет, и это заметное отличие в интерфейсе: глубину теперь задаёте вы, а не модель за вас.
Где рейтинг обманывает и что у Grok 4.6 слабо
- Третья по индексу, а не первая: 61 против 63 у Claude Opus 5 Max и ещё выше у Claude Fable 5.
- Terminal-Bench v3.0 — 26%. Почти вдвое лучше, чем 15,7% у 4.5, но в абсолюте это провал: три задачи из четырёх в терминале модель не доводит до конца.
- DeepSWE v1.1 — 65,9% против 73% у GPT-5.6 Sol Max. Если ваша работа — код, это ощутимая разница.
- Контекст 500 000 токенов не изменился с 4.5 и меньше, чем у остальных моделей в таблице контекста.
- Это доработка после обучения, а не новая базовая модель. Формулировка официальная, и её стоит держать в голове, читая прирост индекса.
- Знания — до 1 февраля 2026. Всё, что случилось позже, доходит до модели только через поиск в интернете, а он включён с тарифа «Старт».
- Открытых весов нет: развернуть у себя нельзя, доступ — через API xAI, Cursor и Grok Build, а на платформе через каталог. Вход — текст, изображения и файлы, выход только текст: картинку она не нарисует.
Как проверить рейтинг на своей задаче за один вечер
Возьмите три модели разных уровней — например gemini-3.7-flash за 56/281, Grok 4.6 за 270/810 и claude-opus-5 за 650/3250 — и прогоните один и тот же промпт, не меняя ни слова. Смотрите не на гладкость текста, а на третий пункт ответа: слабая модель обычно не умеет назвать места, где сама может ошибаться.
Промпт для сравнения моделей на своей задаче
Ниже моя рабочая задача. Выполни её полностью, без уточняющих вопросов и без вступлений.
Задача: [опишите в 3–5 предложениях: что на входе, что должно быть на выходе, для кого предназначен результат]
Формат ответа:
1. Готовый результат.
2. Списком: каких данных тебе не хватило и что ты домыслил сам.
3. Три места, где твой ответ может оказаться неверным, и как это проверить.
Не сокращай результат ради краткости.С какого тарифа открывается Grok 4.6
| Тариф | Цена | Нейронов | Моделей из 96 | Агентов | Сообщений к платным моделям / 4 ч |
|---|---|---|---|---|---|
| Бесплатный | 0 ₽ | 100 один раз при регистрации | 52 | 3 | 15 |
| Старт | 890 ₽ | 300 | 81 | 5 | 50 |
| Стандартный | 2 690 ₽ | 750 | 81 | 40 | 150 |
| PRO | 4 990 ₽ | 1 650 | 96 | 60 | без лимита |
| Ultra | 9 990 ₽ | 3 350 | 96 | нет данных | нет данных |
Grok 4.6 открывается с «Старта» за 890 ₽: 300 нейронов, 81 модель из 96, 5 агентов, 5 баз знаний, поиск в интернете, 30 минут проектов в сутки и 50 сообщений к платным моделям каждые четыре часа. На «Стандартном» за 2 690 ₽ тот же список моделей, но 750 нейронов, 40 агентов и 150 сообщений. PRO за 4 990 ₽ добавляет остальные 15 моделей и снимает лимит сообщений, Ultra за 9 990 ₽ — 3 350 нейронов и 2 места в команде.
На бесплатном тарифе Grok 4.6 нет: уровень STANDARD туда не попадает. Зато там 100 нейронов один раз при регистрации, 52 модели из 96, 3 агента и 2 базы знаний — этого хватит, чтобы прогнать промпт выше на моделях подешевле и понять, нужен ли вам 61 пункт вообще. И держите в уме две бесплатные модели каталога, openrouter/free и gpt-oss-20b: они не тратят нейроны и не расходуют лимит сообщений, только поиска в интернете на бесплатном тарифе нет. Параметры и лимиты самой модели — на карточке Grok 4.6, а выбрать тариф под свой поток задач помогает разбор какой тариф выбрать.

