Вы открываете каталог, а там 95+ моделей. У доброй половины названия отличаются одной цифрой, и по описанию не понять, чем Gemini 3.7 Flash отличается от Gemini 3.5 Flash и стоит ли Claude Sonnet 5 отдельного тарифа. Ниже — сравнение нейросетей в таблицах: замеры, цены, доступ и расход, без «все хороши, выбирайте сердцем».
Четыре таблицы отвечают на четыре разных вопроса. Первая — кто сильнее на задачах. Вторая — сколько модель стоит у вендора. Третья — что вам вообще открыто на вашем тарифе. Четвёртая — во что задача обходится в нейронах на практике. Смотреть их надо вместе: по отдельности каждая врёт.
Таблица 1. Официальные замеры Google по семи бенчмаркам
Это не наши тесты. Цифры опубликованы Google 13.08.2026 вместе с релизом Gemini 3.7 Flash, мы их не воспроизводили. Относитесь к ним как к заявке производителя: конфигурацию запуска выбирал он сам.
| Бенчмарк | Gemini 3.7 Flash | Gemini 3.6 Flash | Claude Sonnet 5 | GPT-5.6 Terra |
|---|---|---|---|---|
| FrontierCode 1.1 (качество кода) | 43,6% | 34,4% | 42,7% | 41,3% |
| DeepSWE v1.1 (длинные задачи) | 65,3 | 48,6 | 53,8 | 69,6 |
| Code Arena, Elo | 1588 | 1538 | 1541 | 1523 |
| Terminal-bench 2.1 | 85,8 | 78,0 | 80,4 | 87,4 |
| AutomationBench | 30,4 | 17,0 | 10,7 | 23,6 |
| GDPVal-AA | 1525 | 1422 | 1598 | 1578 |
| GDP.pdf (документы) | 34,0 | 22,0 | 28,0 | 24,7 |
Колонки читаются так: FrontierCode и DeepSWE — про код, только первый про качество короткого решения, а второй про длинную задачу с многими шагами. Code Arena — рейтинг Elo по слепым сравнениям, Terminal-bench — работа в терминале, AutomationBench — автоматизация цепочек действий, GDPVal-AA и GDP.pdf — офисная работа и разбор документов.
Вывод из таблицы честный, но не победный. Gemini 3.7 Flash впереди на четырёх строках из семи: FrontierCode, Code Arena, AutomationBench (30,4 против 23,6 у GPT-5.6 Terra и 10,7 у Claude Sonnet 5) и документы. В остальных трёх она проигрывает: на длинных задачах DeepSWE и в терминале впереди GPT-5.6 Terra, а на GDPVal-AA обе модели обходит Claude Sonnet 5 с 1598, и ещё выше — Muse Spark с 1628. Подробный разбор пары — в материале Gemini 3.7 против GPT-5.6.
Таблица 2. Цена: сколько стоит миллион токенов у вендоров
Вход — это то, что вы отправляете модели: вопрос, файл, история переписки. Выход — то, что она пишет в ответ. Выход почти везде дороже входа в разы, поэтому длинные развёрнутые ответы стоят больше, чем длинные вопросы.
| Модель | Вход | Выход |
|---|---|---|
| Gemini 3.7 Flash | 0,75 | 3,75 |
| Claude Sonnet 5 | 2,00 | 10,00 |
| GPT-5.6 Terra | 2,00 | 12,00 |
| Muse Spark | 1,25 | 4,25 |
Разрыв здесь больше, чем в бенчмарках: выход Gemini дешевле выхода GPT-5.6 Terra более чем втрое при сопоставимом результате на FrontierCode (43,6% против 41,3%). Одна оговорка: цена Gemini промо и действует до 31.12.2026, дальше становится $1,50 за вход и $7,50 за выход — всё ещё дешевле конкурентов, но преимущество сокращается вдвое.
На платформе вы платите не долларами, а нейронами, и наценка уже внутри. У Gemini 3.7 Flash это 56 нейронов за миллион входных токенов и 281 за миллион выходных; нейрон стоит примерно 3 ₽. Считать в токенах вручную не нужно — рядом с моделью и в режиме «Лайт» цена показана строкой «≈ N нейронов за ответ».
Таблица 3. Какие модели открыты на каком тарифе
Самая практичная из четырёх таблиц — не про баллы, а про доступ. В каталоге 95 активных моделей: 34 в категории LEGACY, 30 DAILY, 29 FLAGSHIP и 2 автоматических. Бесплатный тариф видит 52 из 95, «Старт» и «Стандартный» — 81, PRO и выше — все 95.
| Уровень | С какого тарифа | Примеры моделей | Видно моделей |
|---|---|---|---|
| BASIC | Бесплатный, 0 ₽ | Gemini 3.7 Flash, Qwen3.8 Max, DeepSeek V4 Pro, DeepSeek V4 Flash, DeepSeek R1, DeepSeek V3.2, GPT-5.6 Luna, Llama 4 Maverick | 52 из 95 |
| STANDARD | «Старт», 890 ₽ | Claude Sonnet 5, GPT-5.6 Terra, GPT-5.6 Luna Pro, Gemini 3.1 Pro, Gemini 3.5 Flash, Llama 4 Scout | 81 из 95 |
| MAX | PRO, 4 990 ₽ | GPT-5.6 Sol Pro и остальные топовые | 95 из 95 |
Отсюда следует прямой ответ на вопрос «какой тариф». Gemini 3.7 Flash — модель платформы по умолчанию и при этом доступна бесплатно, поэтому первую строку первой таблицы вы можете проверить, ничего не заплатив. А вот Claude Sonnet 5 и GPT-5.6 Terra — две из четырёх колонок сравнения — открываются только с тарифа «Старт» за 890 ₽. «Стандартный» за 2 690 ₽ каталог не расширяет: те же 81 модель, разница в лимитах и агентах.
Таблица 4. Сколько нейронов уходит на типовые задачи
Цифры ниже — замеры боевого биллинга платформы, а не расчёт по прайсу. Главное, что из них видно: обычная переписка почти ничего не стоит, а бюджет съедают картинки и длинные документы.
| Задача | Нейронов |
|---|---|
| Ответ бесплатной модели | 0 |
| Переписка на лёгкой модели | доли нейрона за ответ |
| Ревью куска кода | ≈ 3 |
| Разбор договора на 15 страниц | ≈ 4 |
| Ответ сильной модели на сложный вопрос | ≈ 12 |
| Выжимка большого отчёта | ≈ 20 |
| Картинка в MediaLab | ≈ 30 |
| Минута работы проекта в песочнице | 1 |
Переведите это в тарифы. 300 нейронов «Старта» — это примерно 75 разборов договоров, или 15 больших выжимок, или 10 картинок в MediaLab. 750 нейронов «Стандартного» и 1 650 у PRO масштабируются линейно. Отдельно считаются проекты: минута работы в песочнице — 1 нейрон, но на «Старте» они ограничены 30 минутами в сутки. Если упираетесь в баланс, дело почти всегда в MediaLab и длинных документах — что с этим делать, разобрано в материале как тратить меньше нейронов.
Контекст и лимиты: цифры, которых нет в бенчмарках
У Gemini 3.7 Flash контекстное окно 1 048 576 токенов, максимальный ответ — 65 536, на вход принимаются текст, картинки, видео, аудио и файлы. Практический смысл: договор, отчёт и переписку за полгода можно положить в один запрос целиком, не нарезая. Ни один бенчмарк из первой таблицы этого не измеряет, а на реальной работе это решает больше, чем два балла разницы.
Второе, чего нет в бенчмарках, — лимиты тарифа. На бесплатном это 15 сообщений к платным моделям каждые 4 часа, 2 генерации MediaLab, 3 агента и 2 базы знаний; на «Старте» — 50 сообщений, 10 генераций, 5 агентов и 5 баз; на «Стандартном» — 150 и 20 при 40 агентах; на PRO лимита сообщений нет вовсе, агентов 60, баз знаний 20.
Поиск в интернете и проекты начинаются со «Старта» — на бесплатном тарифе ни того, ни другого нет. Артефакты, то есть рабочие страницы прямо в чате, работают на всех тарифах, включая бесплатный.
Почему сравнить нейросети по одной цифре не получится
Бенчмарк — это узкая задача с однозначной проверкой. Он хорошо ловит код и терминал и плохо ловит то, за что вы платите: понял ли ассистент, что именно вы имели в виду, не выдумал ли пункт договора, удобно ли читать ответ. Модель может выигрывать Code Arena и раздражать вас в первый же день.
Есть и внешние рейтинги — на них тоже стоит смотреть как на чужие данные. Artificial Analysis Intelligence Index в августе 2026 ставит Claude Opus 5 на 63,1 и Claude Fable 5 на 62,1. LMSys Arena держит фронтир в коридоре примерно 1450–1561 Elo, где рядом стоят GPT-5, Claude Opus 4.6, Gemini 3.1 Pro, Grok 4 и DeepSeek V3.2. Публичные лидерборды гоняют 300–390 моделей по MMLU Pro, HumanEval, MATH, GPQA Diamond и SWE-Bench Verified, а также по скорости и цене — подробнее в рейтинге нейросетей 2026.
На что смотреть в первую очередь, если хочется правило вместо таблицы:
- Тип вашей задачи, а не средний балл. Код и терминал — одна колонка, документы и офисная работа — совсем другая, и лидеры в них разные.
- Цена ответа, а не цена модели. Дешёвый вход при дорогом выходе — это дорого, если модель любит писать длинно.
- Доступ на вашем тарифе. Лучшая модель, которой у вас нет, проигрывает восьмой по рейтингу, которая открыта прямо сейчас.
Промпт для собственного сравнения — прогоните на двух-трёх моделях подряд
Вот моя типовая рабочая задача: [вставьте реальный фрагмент — кусок договора, участок кода, черновик письма или таблицу].
Сделай её целиком, без уточняющих вопросов и без вступлений.
В конце добавь отдельным блоком:
1) три места в твоём ответе, где ты меньше всего уверен, и почему;
2) какой информации тебе не хватило во вводных;
3) что бы ты сделал иначе, будь у тебя вдвое больше времени.Один и тот же промпт на трёх моделях даёт вам собственную таблицу за десять минут. Разница обычно видна не в основном ответе, а в третьем блоке: слабая модель отвечает общими словами, сильная называет конкретные риски.
Честные ограничения этих таблиц
- Первая таблица — замеры вендора. Google публиковал их 13.08.2026 вместе с релизом собственной модели; конфигурацию запуска выбирал он.
- Модели без единого лидера здесь нет. Gemini 3.7 Flash проигрывает GPT-5.6 Terra на DeepSWE (65,3 против 69,6) и terminal-bench (85,8 против 87,4), а на GDPVal-AA впереди Claude Sonnet 5 и Muse Spark.
- Цены во второй таблице — вендорские и в долларах. Вы платите нейронами, курс и наценка уже внутри цены нейрона.
- 100 нейронов на бесплатном тарифе начисляются один раз при регистрации, а не ежемесячно. Это стартовый запас, а не подписка.
- Промо-цена Gemini заканчивается 31.12.2026 — после этого вход дорожает до $1,50, выход до $7,50.
- Нейрон на «Стандартном» стоит 3,59 ₽ против 2,97 ₽ на «Старте», 3,02 ₽ на PRO и 2,98 ₽ на Ultra. За «Стандартный» платят не за дешёвые нейроны, а за 40 агентов и лимит в 150 сообщений.
- Треть каталога — категория LEGACY (34 модели из 95). Это прошлые поколения, они держатся ради совместимости, и для новых задач брать их обычно незачем.
Что брать: короткий вывод
| Ваша ситуация | Что брать | Что получаете |
|---|---|---|
| Проверяете, нужно ли это вам | Бесплатный, 0 ₽ | 52 модели, 100 нейронов разово, артефакты, 15 сообщений / 4 часа, 3 агента; поиска в интернете и проектов нет |
| Нужны Claude Sonnet 5, GPT-5.6 Terra и поиск в интернете | «Старт», 890 ₽ | 81 модель, 300 нейронов, 50 сообщений / 4 часа, 5 агентов, 30 минут проектов в сутки |
| Работаете каждый день, много агентов | «Стандартный», 2 690 ₽ | 750 нейронов, 40 агентов, 150 сообщений / 4 часа; каталог тот же — 81 модель |
| Хотите топовые модели и не считать сообщения | PRO, 4 990 ₽ | все модели каталога, 1 650 нейронов, 60 агентов, 20 баз знаний, лимита сообщений нет |
| Большой объём, нужен второй пользователь | Ultra, 9 990 ₽ | 3 350 нейронов, 2 места, 100 агентов |
Для команд шкала продолжается: Team5 — 12 250 ₽ и 3 500 нейронов, Team10 — 19 500 ₽ и 7 000, Team20 — 39 000 ₽ и 14 000, Team50 — 97 500 ₽ и 35 000. Полная сетка с условиями лежит на странице тарифов, а разбор пограничных случаев — в материале какой тариф выбрать.
Самая полезная проверка — своя. Зарегистрируйтесь на бесплатном тарифе, карта не нужна: вам открыты 52 модели из 95 и 100 стартовых нейронов, включая Gemini 3.7 Flash из первой таблицы — на ней бесплатные ответы вообще не расходуют баланс. Прогоните свой промпт, сравните с тем, что обещают бенчмарки, и уже потом решайте, нужен ли «Старт» за 890 ₽ ради Claude Sonnet 5 и поиска в интернете. Если задачи в основном про код, начните с подборки лучших нейросетей для кода, а весь каталог целиком лежит в разделе нейросети.


