Grok 4.6 набирает 61 балл по индексу Artificial Analysis и стоит 270 нейронов за миллион входных токенов. Выше неё в индексе всего две модели: Claude Opus 5 с 63 баллами (650 за вход, 3250 за выход) и Claude Fable 5. Получается, два пункта индекса обходятся дороже в 2,4 раза по входу и в 4 раза по выходу. Рейтинг нейросетей с единственной колонкой «умнее» такую разницу не показывает вообще.

Ниже — рейтинг ИИ-моделей в двух измерениях сразу: независимый индекс Artificial Analysis и реальная цена в нейронах из каталога платформы, где сейчас 96 активных моделей, 29 из них флагманские. По отдельности оба измерения почти бесполезны. Балл без цены не говорит, во что обойдётся день работы; цена без балла не говорит, потратите вы нейроны с толком или впустую.

Три колонки, по которым выбирают модель, а не одна

Индекс Artificial Analysis — сводная оценка по набору тестов, которую считает сторонняя команда, а не разработчик модели. Цены — из боевого каталога: нейроны за миллион входных и миллион выходных токенов. Третий столбец, которого в обычных топах не бывает, — уровень доступа: BASIC, STANDARD или MAX. Он решает, увидите вы модель на тарифе за 890 ₽ или только на PRO за 4 990 ₽.

Кто умнее: рейтинг ИИ-моделей по индексу Artificial Analysis

Данные проверены 17 августа 2026. Grok 4.6 вышла 12 августа, в каталоге подписана «SpaceXAI: Grok 4.6» (идентификатор x-ai/grok-4.6-20260810, категория FLAGSHIP) — xAI и SpaceXAI здесь одна компания, в релизе и в каталоге в ходу обе формы. Её 61 пункт против 56 у Grok 4.5 набран за месяц.

МодельИндексВход / выход, нейронов за 1 млнУровень доступа
Claude Fable 5выше, чем у Opus 5 (значения нет)2000 / 10 000MAX
Claude Opus 5 (замер у версии Opus 5 Max)63650 / 3250MAX
Grok 4.661270 / 810STANDARD
GPT-5.6 Sol (замер у версии Sol Max)61800 / 4800MAX
Grok 4.556270 / 810STANDARD, категория LEGACY
Grok 4.3на 23 пункта ниже 4.6163 / 325STANDARD, категория LEGACY
Индекс Artificial Analysis и цена в нейронах

Таблица короткая не потому, что каталог маленький. Независимый индекс есть далеко не по всем позициям: из 96 активных моделей и 29 флагманов проверенные замеры у нас только по этим строкам, а про Claude Fable 5 известно лишь то, что она выше Opus 5. Дальше таблицы будут разной длины — это ограничение данных, а не подгонка под удобный вывод. Полный перечень моделей с описаниями — в лучших нейросетях 2026.

Сравнение нейросетей по цене: от 4 до 2000 нейронов за миллион

Здесь цифры известны для всего каталога, поэтому таблица длиннее. Это цена входа и выхода в нейронах — то, что реально списывается со счёта.

МодельВходВыходУровень доступа
qwen3.7-flash418BASIC
gpt-5.6-luna1487BASIC
gpt-5.6-luna-pro1487STANDARD
gemini-3.7-flash56281BASIC
gpt-5.6-terra150900STANDARD
gemini-3.1-pro2501500STANDARD
Grok 4.6270810STANDARD
claude-sonnet-52901450STANDARD
qwen3.8-max300900BASIC
kimi-k36003000STANDARD
claude-opus-56503250MAX
gpt-5.6-sol8004800MAX
claude-5-fable200010 000MAX
Цена за 1 млн токенов, нейронов

Разброс внутри одного каталога — в 500 раз по входу: от 4 нейронов у qwen3.7-flash, самой дешёвой модели, до 2000 у claude-5-fable. Отдельно посмотрите на соотношение вход/выход: у Grok 4.6 выход дороже входа втрое (810 против 270), у claude-sonnet-5 — впятеро (1450 против 290). Цена входа у них почти одинаковая, но на длинных ответах разница набегает быстро.

И ещё одна вещь, которую топы обычно скрывают: уровень доступа не следует за ценой. qwen3.8-max стоит 300/900 и открыт на уровне BASIC, а gpt-5.6-luna-pro за 14/87 — уже STANDARD, то есть требует минимум тарифа «Старт». Дешёвая модель не значит доступная, и наоборот.

Рейтинг нейросетей 2026 по контексту: где Grok 4.6 проигрывает

МодельКонтекст, токеновУровень доступа
grok-4.20-beta2 000 000STANDARD, категория LEGACY
gpt-5.6-luna, luna-pro, terra, sol1 050 000BASIC / STANDARD / MAX
gemini-3.7-flash, gemini-3.1-pro, kimi-k31 048 576BASIC / STANDARD
claude-opus-5, claude-sonnet-5, claude-5-fable1 000 000STANDARD / MAX
qwen3.8-max1 000 000BASIC
grok-4.31 000 000STANDARD, категория LEGACY
Grok 4.6500 000STANDARD
grok-4.5500 000STANDARD, категория LEGACY
Размер контекстного окна

Grok 4.6 в этой таблице внизу, и это честная слабость. Для большинства задач 500 000 токенов хватает, но относительно 4.5 окно не выросло ни на токен, а почти все модели в верхней части списка дают вдвое больше. Самый большой контекст в каталоге — 2 000 000 у grok-4.20-beta, только это предыдущее поколение, категория LEGACY, и в рейтинг по интеллекту такие модели не попадают.

Сколько стоит один пункт индекса — и почему это главная колонка

Теперь сводим два измерения. Слева — балл, справа не только цена за миллион токенов, но и тариф, без которого модель просто не появится у вас в списке.

МодельИндексВход / выход, нейроновС какого тарифа доступна
Grok 4.661270 / 810«Старт», 890 ₽
GPT-5.6 Sol61 (замер у версии Sol Max)800 / 4800PRO, 4 990 ₽
Claude Opus 563 (замер у версии Opus 5 Max)650 / 3250PRO, 4 990 ₽
Claude Fable 5выше, чем у Opus 52000 / 10 000PRO, 4 990 ₽
Балл, цена и тариф входа

Вот в этом весь смысл двух измерений. Grok 4.6 не самая умная модель каталога — она третья по индексу, но при этом самый умный вариант, доступный на тарифе «Старт» за 890 ₽: уровень STANDARD, 61 пункт. Всё, что выше по индексу, имеет уровень MAX и требует PRO за 4 990 ₽ — в 5,6 раза дороже. А GPT-5.6 Sol при том же индексе 61 просит 800 нейронов за вход против 270 и тоже живёт только на PRO.

Что стоит за 61 пунктом Grok 4.6

ТестGrok 4.6Grok 4.5
Artificial Analysis Intelligence Index6156
GDPval-AA v21753 Elo1526 Elo
AA-Briefcase1577 Elo1313 Elo
DeepSWE v1.165,9%на 11,9 пункта меньше
Terminal-Bench v3.026%15,7%
Terminal-Bench v2.1 (более старая и простая версия)88,4%нет данных
CursorBench v3.269,9%нет данных
FrontierCode v1.1 Extended61,3%нет данных
APEX-Agents57,5%нет данных
τ³-Banking50,7% (в числе двух лучших)нет данных
Бенчмарки Grok 4.6 против 4.5

По GDPval-AA v2 с её 1753 Elo впереди только Claude Opus 5. Зато DeepSWE v1.1 — 65,9% против 73% у GPT-5.6 Sol Max: в инженерных задачах с кодом Grok 4.6 остаётся вторым номером. В собственной сравнительной таблице xAI из десяти строк больше всего первых мест берёт Claude Fable 5 Max, а Grok 4.6 забирает работу со знаниями и юридические задачи.

И главное про природу прироста: базовая модель здесь та же, что у Grok 4.5. Официально это доработка после обучения, а не новая большая модель — удлинённое дополнительное обучение, заново собранное SFT и обучение с подкреплением в агентных средах. Пять пунктов индекса выжали из тренировки поверх прежней базы, и читать прирост стоит именно так.

Есть измерение, где Grok 4.6 уверенно впереди Opus 5, — расход. На задачу у неё уходит в среднем около 53 ходов и порядка 0,5 млрд входных токенов, у Claude Opus 5 — около 103 ходов и 2,0 млрд. Замеренная стоимость задачи — 0,84 доллара. Официальный прайс xAI — 2 доллара за миллион входных токенов, 0,50 за кэшированные (было 0,3) и 6 за выходные; 270 и 810 нейронов в каталоге — это ровно те же 2 и 6 долларов с наценкой платформы, цифры сходятся.

В каталоге у 4.6 доступны reasoning и reasoning_effort — управление глубиной размышления, инструменты и строгие форматы ответа. У Grok 4.5 параметра reasoning_effort нет, и это заметное отличие в интерфейсе: глубину теперь задаёте вы, а не модель за вас.

Где рейтинг обманывает и что у Grok 4.6 слабо

  • Третья по индексу, а не первая: 61 против 63 у Claude Opus 5 Max и ещё выше у Claude Fable 5.
  • Terminal-Bench v3.0 — 26%. Почти вдвое лучше, чем 15,7% у 4.5, но в абсолюте это провал: три задачи из четырёх в терминале модель не доводит до конца.
  • DeepSWE v1.1 — 65,9% против 73% у GPT-5.6 Sol Max. Если ваша работа — код, это ощутимая разница.
  • Контекст 500 000 токенов не изменился с 4.5 и меньше, чем у остальных моделей в таблице контекста.
  • Это доработка после обучения, а не новая базовая модель. Формулировка официальная, и её стоит держать в голове, читая прирост индекса.
  • Знания — до 1 февраля 2026. Всё, что случилось позже, доходит до модели только через поиск в интернете, а он включён с тарифа «Старт».
  • Открытых весов нет: развернуть у себя нельзя, доступ — через API xAI, Cursor и Grok Build, а на платформе через каталог. Вход — текст, изображения и файлы, выход только текст: картинку она не нарисует.

Как проверить рейтинг на своей задаче за один вечер

Возьмите три модели разных уровней — например gemini-3.7-flash за 56/281, Grok 4.6 за 270/810 и claude-opus-5 за 650/3250 — и прогоните один и тот же промпт, не меняя ни слова. Смотрите не на гладкость текста, а на третий пункт ответа: слабая модель обычно не умеет назвать места, где сама может ошибаться.

Промпт для сравнения моделей на своей задаче

Ниже моя рабочая задача. Выполни её полностью, без уточняющих вопросов и без вступлений.

Задача: [опишите в 3–5 предложениях: что на входе, что должно быть на выходе, для кого предназначен результат]

Формат ответа:
1. Готовый результат.
2. Списком: каких данных тебе не хватило и что ты домыслил сам.
3. Три места, где твой ответ может оказаться неверным, и как это проверить.

Не сокращай результат ради краткости.

С какого тарифа открывается Grok 4.6

ТарифЦенаНейроновМоделей из 96АгентовСообщений к платным моделям / 4 ч
Бесплатный0 ₽100 один раз при регистрации52315
Старт890 ₽30081550
Стандартный2 690 ₽7508140150
PRO4 990 ₽1 6509660без лимита
Ultra9 990 ₽3 35096нет данныхнет данных
Тарифы платформы

Grok 4.6 открывается с «Старта» за 890 ₽: 300 нейронов, 81 модель из 96, 5 агентов, 5 баз знаний, поиск в интернете, 30 минут проектов в сутки и 50 сообщений к платным моделям каждые четыре часа. На «Стандартном» за 2 690 ₽ тот же список моделей, но 750 нейронов, 40 агентов и 150 сообщений. PRO за 4 990 ₽ добавляет остальные 15 моделей и снимает лимит сообщений, Ultra за 9 990 ₽ — 3 350 нейронов и 2 места в команде.

На бесплатном тарифе Grok 4.6 нет: уровень STANDARD туда не попадает. Зато там 100 нейронов один раз при регистрации, 52 модели из 96, 3 агента и 2 базы знаний — этого хватит, чтобы прогнать промпт выше на моделях подешевле и понять, нужен ли вам 61 пункт вообще. И держите в уме две бесплатные модели каталога, openrouter/free и gpt-oss-20b: они не тратят нейроны и не расходуют лимит сообщений, только поиска в интернете на бесплатном тарифе нет. Параметры и лимиты самой модели — на карточке Grok 4.6, а выбрать тариф под свой поток задач помогает разбор какой тариф выбрать.