Вы открываете каталог, а там 95+ моделей. У доброй половины названия отличаются одной цифрой, и по описанию не понять, чем Gemini 3.7 Flash отличается от Gemini 3.5 Flash и стоит ли Claude Sonnet 5 отдельного тарифа. Ниже — сравнение нейросетей в таблицах: замеры, цены, доступ и расход, без «все хороши, выбирайте сердцем».

Четыре таблицы отвечают на четыре разных вопроса. Первая — кто сильнее на задачах. Вторая — сколько модель стоит у вендора. Третья — что вам вообще открыто на вашем тарифе. Четвёртая — во что задача обходится в нейронах на практике. Смотреть их надо вместе: по отдельности каждая врёт.

Таблица 1. Официальные замеры Google по семи бенчмаркам

Это не наши тесты. Цифры опубликованы Google 13.08.2026 вместе с релизом Gemini 3.7 Flash, мы их не воспроизводили. Относитесь к ним как к заявке производителя: конфигурацию запуска выбирал он сам.

БенчмаркGemini 3.7 FlashGemini 3.6 FlashClaude Sonnet 5GPT-5.6 Terra
FrontierCode 1.1 (качество кода)43,6%34,4%42,7%41,3%
DeepSWE v1.1 (длинные задачи)65,348,653,869,6
Code Arena, Elo1588153815411523
Terminal-bench 2.185,878,080,487,4
AutomationBench30,417,010,723,6
GDPVal-AA1525142215981578
GDP.pdf (документы)34,022,028,024,7
Замеры Google, опубликованы 13.08.2026 вместе с релизом Gemini 3.7 Flash

Колонки читаются так: FrontierCode и DeepSWE — про код, только первый про качество короткого решения, а второй про длинную задачу с многими шагами. Code Arena — рейтинг Elo по слепым сравнениям, Terminal-bench — работа в терминале, AutomationBench — автоматизация цепочек действий, GDPVal-AA и GDP.pdf — офисная работа и разбор документов.

Вывод из таблицы честный, но не победный. Gemini 3.7 Flash впереди на четырёх строках из семи: FrontierCode, Code Arena, AutomationBench (30,4 против 23,6 у GPT-5.6 Terra и 10,7 у Claude Sonnet 5) и документы. В остальных трёх она проигрывает: на длинных задачах DeepSWE и в терминале впереди GPT-5.6 Terra, а на GDPVal-AA обе модели обходит Claude Sonnet 5 с 1598, и ещё выше — Muse Spark с 1628. Подробный разбор пары — в материале Gemini 3.7 против GPT-5.6.

Таблица 2. Цена: сколько стоит миллион токенов у вендоров

Вход — это то, что вы отправляете модели: вопрос, файл, история переписки. Выход — то, что она пишет в ответ. Выход почти везде дороже входа в разы, поэтому длинные развёрнутые ответы стоят больше, чем длинные вопросы.

МодельВходВыход
Gemini 3.7 Flash0,753,75
Claude Sonnet 52,0010,00
GPT-5.6 Terra2,0012,00
Muse Spark1,254,25
Цена у вендора, $ за 1 млн токенов

Разрыв здесь больше, чем в бенчмарках: выход Gemini дешевле выхода GPT-5.6 Terra более чем втрое при сопоставимом результате на FrontierCode (43,6% против 41,3%). Одна оговорка: цена Gemini промо и действует до 31.12.2026, дальше становится $1,50 за вход и $7,50 за выход — всё ещё дешевле конкурентов, но преимущество сокращается вдвое.

На платформе вы платите не долларами, а нейронами, и наценка уже внутри. У Gemini 3.7 Flash это 56 нейронов за миллион входных токенов и 281 за миллион выходных; нейрон стоит примерно 3 ₽. Считать в токенах вручную не нужно — рядом с моделью и в режиме «Лайт» цена показана строкой «≈ N нейронов за ответ».

Таблица 3. Какие модели открыты на каком тарифе

Самая практичная из четырёх таблиц — не про баллы, а про доступ. В каталоге 95 активных моделей: 34 в категории LEGACY, 30 DAILY, 29 FLAGSHIP и 2 автоматических. Бесплатный тариф видит 52 из 95, «Старт» и «Стандартный» — 81, PRO и выше — все 95.

УровеньС какого тарифаПримеры моделейВидно моделей
BASICБесплатный, 0 ₽Gemini 3.7 Flash, Qwen3.8 Max, DeepSeek V4 Pro, DeepSeek V4 Flash, DeepSeek R1, DeepSeek V3.2, GPT-5.6 Luna, Llama 4 Maverick52 из 95
STANDARD«Старт», 890 ₽Claude Sonnet 5, GPT-5.6 Terra, GPT-5.6 Luna Pro, Gemini 3.1 Pro, Gemini 3.5 Flash, Llama 4 Scout81 из 95
MAXPRO, 4 990 ₽GPT-5.6 Sol Pro и остальные топовые95 из 95
Уровни доступа и конкретные модели на каждом

Отсюда следует прямой ответ на вопрос «какой тариф». Gemini 3.7 Flash — модель платформы по умолчанию и при этом доступна бесплатно, поэтому первую строку первой таблицы вы можете проверить, ничего не заплатив. А вот Claude Sonnet 5 и GPT-5.6 Terra — две из четырёх колонок сравнения — открываются только с тарифа «Старт» за 890 ₽. «Стандартный» за 2 690 ₽ каталог не расширяет: те же 81 модель, разница в лимитах и агентах.

Таблица 4. Сколько нейронов уходит на типовые задачи

Цифры ниже — замеры боевого биллинга платформы, а не расчёт по прайсу. Главное, что из них видно: обычная переписка почти ничего не стоит, а бюджет съедают картинки и длинные документы.

ЗадачаНейронов
Ответ бесплатной модели0
Переписка на лёгкой моделидоли нейрона за ответ
Ревью куска кода≈ 3
Разбор договора на 15 страниц≈ 4
Ответ сильной модели на сложный вопрос≈ 12
Выжимка большого отчёта≈ 20
Картинка в MediaLab≈ 30
Минута работы проекта в песочнице1
Расход нейронов на типовых задачах

Переведите это в тарифы. 300 нейронов «Старта» — это примерно 75 разборов договоров, или 15 больших выжимок, или 10 картинок в MediaLab. 750 нейронов «Стандартного» и 1 650 у PRO масштабируются линейно. Отдельно считаются проекты: минута работы в песочнице — 1 нейрон, но на «Старте» они ограничены 30 минутами в сутки. Если упираетесь в баланс, дело почти всегда в MediaLab и длинных документах — что с этим делать, разобрано в материале как тратить меньше нейронов.

Контекст и лимиты: цифры, которых нет в бенчмарках

У Gemini 3.7 Flash контекстное окно 1 048 576 токенов, максимальный ответ — 65 536, на вход принимаются текст, картинки, видео, аудио и файлы. Практический смысл: договор, отчёт и переписку за полгода можно положить в один запрос целиком, не нарезая. Ни один бенчмарк из первой таблицы этого не измеряет, а на реальной работе это решает больше, чем два балла разницы.

Второе, чего нет в бенчмарках, — лимиты тарифа. На бесплатном это 15 сообщений к платным моделям каждые 4 часа, 2 генерации MediaLab, 3 агента и 2 базы знаний; на «Старте» — 50 сообщений, 10 генераций, 5 агентов и 5 баз; на «Стандартном» — 150 и 20 при 40 агентах; на PRO лимита сообщений нет вовсе, агентов 60, баз знаний 20.

Поиск в интернете и проекты начинаются со «Старта» — на бесплатном тарифе ни того, ни другого нет. Артефакты, то есть рабочие страницы прямо в чате, работают на всех тарифах, включая бесплатный.

Почему сравнить нейросети по одной цифре не получится

Бенчмарк — это узкая задача с однозначной проверкой. Он хорошо ловит код и терминал и плохо ловит то, за что вы платите: понял ли ассистент, что именно вы имели в виду, не выдумал ли пункт договора, удобно ли читать ответ. Модель может выигрывать Code Arena и раздражать вас в первый же день.

Есть и внешние рейтинги — на них тоже стоит смотреть как на чужие данные. Artificial Analysis Intelligence Index в августе 2026 ставит Claude Opus 5 на 63,1 и Claude Fable 5 на 62,1. LMSys Arena держит фронтир в коридоре примерно 1450–1561 Elo, где рядом стоят GPT-5, Claude Opus 4.6, Gemini 3.1 Pro, Grok 4 и DeepSeek V3.2. Публичные лидерборды гоняют 300–390 моделей по MMLU Pro, HumanEval, MATH, GPQA Diamond и SWE-Bench Verified, а также по скорости и цене — подробнее в рейтинге нейросетей 2026.

На что смотреть в первую очередь, если хочется правило вместо таблицы:

  1. Тип вашей задачи, а не средний балл. Код и терминал — одна колонка, документы и офисная работа — совсем другая, и лидеры в них разные.
  2. Цена ответа, а не цена модели. Дешёвый вход при дорогом выходе — это дорого, если модель любит писать длинно.
  3. Доступ на вашем тарифе. Лучшая модель, которой у вас нет, проигрывает восьмой по рейтингу, которая открыта прямо сейчас.

Промпт для собственного сравнения — прогоните на двух-трёх моделях подряд

Вот моя типовая рабочая задача: [вставьте реальный фрагмент — кусок договора, участок кода, черновик письма или таблицу].

Сделай её целиком, без уточняющих вопросов и без вступлений.

В конце добавь отдельным блоком:
1) три места в твоём ответе, где ты меньше всего уверен, и почему;
2) какой информации тебе не хватило во вводных;
3) что бы ты сделал иначе, будь у тебя вдвое больше времени.

Один и тот же промпт на трёх моделях даёт вам собственную таблицу за десять минут. Разница обычно видна не в основном ответе, а в третьем блоке: слабая модель отвечает общими словами, сильная называет конкретные риски.

Честные ограничения этих таблиц

  • Первая таблица — замеры вендора. Google публиковал их 13.08.2026 вместе с релизом собственной модели; конфигурацию запуска выбирал он.
  • Модели без единого лидера здесь нет. Gemini 3.7 Flash проигрывает GPT-5.6 Terra на DeepSWE (65,3 против 69,6) и terminal-bench (85,8 против 87,4), а на GDPVal-AA впереди Claude Sonnet 5 и Muse Spark.
  • Цены во второй таблице — вендорские и в долларах. Вы платите нейронами, курс и наценка уже внутри цены нейрона.
  • 100 нейронов на бесплатном тарифе начисляются один раз при регистрации, а не ежемесячно. Это стартовый запас, а не подписка.
  • Промо-цена Gemini заканчивается 31.12.2026 — после этого вход дорожает до $1,50, выход до $7,50.
  • Нейрон на «Стандартном» стоит 3,59 ₽ против 2,97 ₽ на «Старте», 3,02 ₽ на PRO и 2,98 ₽ на Ultra. За «Стандартный» платят не за дешёвые нейроны, а за 40 агентов и лимит в 150 сообщений.
  • Треть каталога — категория LEGACY (34 модели из 95). Это прошлые поколения, они держатся ради совместимости, и для новых задач брать их обычно незачем.

Что брать: короткий вывод

Ваша ситуацияЧто братьЧто получаете
Проверяете, нужно ли это вамБесплатный, 0 ₽52 модели, 100 нейронов разово, артефакты, 15 сообщений / 4 часа, 3 агента; поиска в интернете и проектов нет
Нужны Claude Sonnet 5, GPT-5.6 Terra и поиск в интернете«Старт», 890 ₽81 модель, 300 нейронов, 50 сообщений / 4 часа, 5 агентов, 30 минут проектов в сутки
Работаете каждый день, много агентов«Стандартный», 2 690 ₽750 нейронов, 40 агентов, 150 сообщений / 4 часа; каталог тот же — 81 модель
Хотите топовые модели и не считать сообщенияPRO, 4 990 ₽все модели каталога, 1 650 нейронов, 60 агентов, 20 баз знаний, лимита сообщений нет
Большой объём, нужен второй пользовательUltra, 9 990 ₽3 350 нейронов, 2 места, 100 агентов
Прямая рекомендация по ситуации

Для команд шкала продолжается: Team5 — 12 250 ₽ и 3 500 нейронов, Team10 — 19 500 ₽ и 7 000, Team20 — 39 000 ₽ и 14 000, Team50 — 97 500 ₽ и 35 000. Полная сетка с условиями лежит на странице тарифов, а разбор пограничных случаев — в материале какой тариф выбрать.

Самая полезная проверка — своя. Зарегистрируйтесь на бесплатном тарифе, карта не нужна: вам открыты 52 модели из 95 и 100 стартовых нейронов, включая Gemini 3.7 Flash из первой таблицы — на ней бесплатные ответы вообще не расходуют баланс. Прогоните свой промпт, сравните с тем, что обещают бенчмарки, и уже потом решайте, нужен ли «Старт» за 890 ₽ ради Claude Sonnet 5 и поиска в интернете. Если задачи в основном про код, начните с подборки лучших нейросетей для кода, а весь каталог целиком лежит в разделе нейросети.