У вас на столе договор на 15 страниц, ветка кода на ревью и черновик статьи. Три задачи — и три противоположных совета: одни говорят, что Claude аккуратнее с текстом, другие — что GPT надёжнее на длинных задачах, третьи — что Gemini делает то же самое заметно дешевле. Каждый прав про свою задачу, и это единственный честный ответ на вопрос «какую взять».
Ниже — разбор по официальной таблице Google, опубликованной 13 августа 2026 года вместе с релизом Gemini 3.7 Flash. Это замеры вендора одной из моделей, а не наши: мы их не повторяли и приводим как чужие данные. Строки, где Gemini проигрывает, в них ценнее остальных — по ним видно, где разрыв реальный, а где он в пределах одного-двух пунктов.
Короткий ответ, если читать некогда
- Длинные многошаговые задачи, терминал, автономные прогоны — GPT-5.6 Terra. В таблице Google он впереди на DeepSWE v1.1 (69,6 против 65,3 у Gemini и 53,8 у Claude) и на terminal-bench 2.1 (87,4 против 85,8).
- Длинный связный текст, редактура, договоры — Claude Sonnet 5. GDPVal-AA 1598 — выше, чем у Gemini (1525) и GPT (1578), хотя в той же строке выше всех Muse Spark с 1628.
- Ежедневный поток, файлы, картинки, видео и аудио в одном окне — Gemini 3.7 Flash. Контекст 1 048 576 токенов, вход 56 нейронов за 1 млн токенов и 281 на выходе; у вендора вход $0,75 против $2,00 у Claude и GPT.
- Когда тратить нейроны не хочется — бесплатные модели каталога: они не списывают нейроны и не расходуют лимит сообщений. На бесплатном тарифе открыты 52 модели из 95, среди них DeepSeek V4 Pro, Qwen3.8 Max, GPT-5.6 Luna и сама Gemini 3.7 Flash.
Что показывают официальные замеры Google
Google опубликовала таблицу 13.08.2026 вместе с релизом Gemini 3.7 Flash и сравнила новинку с предыдущей версией, Claude Sonnet 5 и GPT-5.6 Terra. Набор тестов и условия прогона выбирал вендор одной из участвующих моделей — это стоит держать в голове, читая строки, где Gemini выигрывает.
| Тест | Gemini 3.7 Flash | Gemini 3.6 Flash | Claude Sonnet 5 | GPT-5.6 Terra |
|---|---|---|---|---|
| FrontierCode 1.1 (качество кода) | 43,6% | 34,4% | 42,7% | 41,3% |
| DeepSWE v1.1 (длинные задачи) | 65,3 | 48,6 | 53,8 | 69,6 |
| Code Arena, Elo | 1588 | 1538 | 1541 | 1523 |
| Terminal-bench 2.1 | 85,8 | 78,0 | 80,4 | 87,4 |
| AutomationBench | 30,4 | 17,0 | 10,7 | 23,6 |
| GDPVal-AA | 1525 | 1422 | 1598 | 1578 |
| GDP.pdf (документы) | 34,0 | 22,0 | 28,0 | 24,7 |
На качестве кода тройка идёт вплотную: 43,6% у Gemini, 42,7% у Claude, 41,3% у GPT. Разница меньше трёх пунктов — на реальной задаче вы её, скорее всего, не заметите, а вот разницу в цене заметите сразу.
Там, где задача длинная и требует много шагов подряд, картина переворачивается. DeepSWE: 69,6 у GPT-5.6 Terra против 65,3 у Gemini и 53,8 у Claude. Terminal-bench 2.1: 87,4 против 85,8. Если модель должна сама держать план на десятки действий, ставьте на GPT.
И ещё одна строка против универсальных выводов: на GDPVal-AA впереди Claude Sonnet 5 с 1598, за ним GPT с 1578, а Gemini — 1525. При этом выше всех там вообще Muse Spark с 1628. Лучшей во всём модели в этой таблице нет, и подробный разбор пары есть в материале Gemini 3.7 против GPT-5.6.
Отдельно стоит смотреть на цены вендоров за 1 млн токенов: вход $0,75 у Gemini, $2,00 у Claude, $2,00 у GPT и $1,25 у Muse; выход — $3,75, $10,00, $12,00 и $4,25 соответственно. Промо-цена Gemini действует до 31.12.2026, дальше $1,50 на входе и $7,50 на выходе.
GPT-5.6: длинные задачи и автономия
Семейство GPT сильнее всего там, где нужно много последовательных шагов без вашего участия: прогнать тесты, поправить, снова прогнать, собрать отчёт. Две строки, где Gemini проигрывает в собственной таблице Google, — как раз про это: DeepSWE и terminal-bench.
Доступ ступенчатый. GPT-5.6 Luna есть уже на бесплатном тарифе, GPT-5.6 Terra и GPT-5.6 Luna Pro открываются с тарифа «Старт» за 890 ₽, а топовый GPT-5.6 Sol Pro — с PRO за 4 990 ₽. Познакомиться с линейкой можно, не платя ничего, но именно Terra из таблицы на бесплатном не будет.
Слабое место — цена у вендора: $2,00 за 1 млн токенов на входе и $12,00 на выходе, самый дорогой выход в таблице. На задачах, где модель много пишет, это чувствуется сильнее всего.
Claude Sonnet 5: что лучше для текста — GPT или Claude
Claude берёт связностью и длинным текстом: GDPVal-AA 1598 — лучший результат в тройке. Но на документах картина не односторонняя: строка GDP.pdf уходит к Gemini — 34,0 против 28,0 у Claude и 24,7 у GPT. Практический вывод: редактура, договоры и длинные инструкции — Claude; быстрый разбор пачки разнородных файлов — Gemini.
Где Claude проседает: AutomationBench 10,7 — заметно ниже и Gemini (30,4), и GPT (23,6), а на DeepSWE 53,8 против 69,6 у GPT. Отдавать ему длинную автономную цепочку действий смысла мало, его сила в одном хорошо сделанном ответе. Цена у вендора — $2,00 вход и $10,00 выход.
Важная деталь про доступ: Claude Sonnet 5 на бесплатном тарифе нет, он открывается с тарифа «Старт». Если вы пришли именно за Claude — это минимальная ступень. Сравнение с соседями по фронтиру разобрано в материале Gemini 3.7 против Claude и Grok.
Gemini 3.7 Flash: что лучше, ChatGPT или Gemini, если считать деньги
Gemini 3.7 Flash вышла 13.08.2026 и стоит на платформе моделью по умолчанию. Контекст — 1 048 576 токенов, максимальный ответ — 65 536. Принимает текст, картинки, видео, аудио и файлы, то есть закрывает почти весь повседневный поток без переключений, и доступна уже на бесплатном тарифе.
В нейронах это 56 за 1 млн токенов на входе и 281 на выходе. У вендора вход $0,75 против $2,00 у Claude и GPT — почти втрое дешевле. Промо-цена действует до 31.12.2026, дальше $1,50 на входе и $7,50 на выходе, но и тогда она остаётся ниже, чем у Claude и GPT.
Слабые места видны в той же таблице: на длинных автономных задачах и в терминале Gemini уступает GPT-5.6 Terra, а на GDPVal-AA (1525) — и Claude, и GPT, и Muse Spark. Зато AutomationBench 30,4 — лучший результат в таблице. Что модель умеет на практике, разобрано отдельно — что умеет Gemini 3.7 Flash.
ChatGPT или DeepSeek — и куда девать Qwen
Этот вопрос добавляют к тройке чаще всего. На бесплатном тарифе открыты 52 модели из 95, и среди них DeepSeek V4 Pro, DeepSeek V4 Flash, DeepSeek R1, DeepSeek V3.2 и Qwen3.8 Max — вместе с Gemini 3.7 Flash, GPT-5.6 Luna и Llama 4 Maverick. Попробовать открытые модели рядом с закрытыми можно, ничего не платя.
Важная деталь про счёт: доступ на бесплатном тарифе и нулевая цена — не одно и то же. Бесплатные модели каталога не тратят нейроны вообще и не расходуют лимит 15 сообщений к платным моделям каждые 4 часа, а вот та же Gemini 3.7 Flash тарифицируется — 56 нейронов за миллион токенов на входе. В режиме «Лайт» бесплатные модели собраны в отдельный сценарий «Бесплатная».
Практический сценарий такой: черновая работа, переформулировки и первые подходы к задаче — на бесплатных моделях, а нейроны остаются на те ответы, ради которых вы и платите. Оговорка: в официальной таблице Google этих моделей нет, сравнить их с тройкой по одним и тем же цифрам не получится — про устройство таких моделей есть материал открытые модели против закрытых.
Сколько это стоит в нейронах
Нейрон стоит примерно 3 ₽, точная цена зависит от ступени: «Старт» — 2,97 ₽, «Стандартный» — 3,59 ₽, PRO — 3,02 ₽, Ultra — 2,98 ₽. Заметьте, что у «Стандартного» нейрон самый дорогой из платных тарифов: он берёт не ценой нейрона, а лимитами и числом агентов. Ниже — замеры боевого биллинга, а не расчёт по прайсу.
| Задача | Расход |
|---|---|
| Обычная переписка на лёгкой модели | доли нейрона за ответ |
| Ревью кода | ≈ 3 нейрона |
| Разбор договора на 15 страниц | ≈ 4 нейрона |
| Ответ сильной модели на сложный вопрос | ≈ 12 нейронов |
| Выжимка большого отчёта | ≈ 20 нейронов |
| Картинка в MediaLab | ≈ 30 нейронов |
| Минута работы проекта в песочнице | 1 нейрон |
| Любая бесплатная модель | 0 нейронов |
Главный вывод из этой таблицы: счёт растёт не от переписки, а от тяжёлых сценариев — генерации картинок и длинных разборов на сильных моделях. Обычный диалог на лёгкой модели стоит доли нейрона за ответ. Приёмы, которые реально снижают расход, собраны в материале как тратить меньше нейронов.
Доступ по тарифам
В каталоге 95 активных моделей: 34 в категории LEGACY, 30 в DAILY, 29 во FLAGSHIP и 2 автоматических режима AUTO. Тариф определяет, какую часть этого каталога вы видите и какие лимиты на вас действуют.
| Тариф | Цена | Нейронов | Моделей | Что важно |
|---|---|---|---|---|
| Бесплатный | 0 ₽ | 100 разово при регистрации | 52 | 15 сообщений к платным моделям каждые 4 часа, 2 генерации MediaLab, 3 агента, 2 базы знаний; поиска в интернете и проектов нет |
| Старт | 890 ₽ | 300 | 81 | Claude Sonnet 5 и GPT-5.6 Terra, поиск в интернете, 30 минут проектов в сутки, 5 агентов, 5 баз знаний, 50 сообщений и 10 генераций каждые 4 часа |
| Стандартный | 2 690 ₽ | 750 | 81 | 40 агентов, 5 баз знаний, 150 сообщений и 20 генераций каждые 4 часа |
| PRO | 4 990 ₽ | 1 650 | 95 | GPT-5.6 Sol Pro и остальные топовые, без лимита сообщений, 60 агентов, 20 баз знаний |
| Ultra | 9 990 ₽ | 3 350 | 95 | 2 места, 100 агентов |
Если моделями пользуется команда, ступени считаются от мест и объёма нейронов: Team5 — 12 250 ₽ и 3 500 нейронов, Team10 — 19 500 ₽ и 7 000, Team20 — 39 000 ₽ и 14 000, Team50 — 97 500 ₽ и 35 000. Для одного человека потолок — Ultra за 9 990 ₽ с 3 350 нейронами и 2 местами.
Честные ограничения
Замеры сделаны заинтересованной стороной
Таблицу публиковала Google вместе с релизом собственной модели. Строки, где Gemini проигрывает, там есть — это хороший знак, но набор тестов и условия прогона выбирал вендор. Внешние рейтинги считают иначе, и это тоже не наши замеры: Artificial Analysis Intelligence Index в августе 2026 ставит Claude Opus 5 на 63,1 и Claude Fable 5 на 62,1, а на LMSys Arena фронтир — GPT-5, Claude Opus 4.6, Gemini 3.1 Pro, Grok 4, DeepSeek V3.2 — держится примерно в диапазоне 1450–1561 Elo.
Разница в один-два пункта ничего не решает
43,6% против 42,7% на FrontierCode — это не «лучше», это «на уровне». Реальную разницу вы почувствуете на цене, скорости и на том, как модель ведёт себя именно с вашими формулировками. Публичные лидерборды сравнивают 300–390 моделей по MMLU Pro, HumanEval, MATH, GPQA Diamond, SWE-Bench Verified, скорости и цене — и порядок мест меняется от теста к тесту.
На бесплатном тарифе часть сценариев закрыта
Нет поиска в интернете, нет проектов, действует лимит 15 сообщений к платным моделям каждые 4 часа, 2 генерации в MediaLab, 3 агента и 2 базы знаний. Артефакты — рабочие страницы прямо в чате — работают на всех тарифах, включая бесплатный, а проекты с сервером начинаются со «Старта»: там 30 минут работы проектов в сутки, минута в песочнице стоит 1 нейрон. Если задаче нужен свежий веб, бесплатный тариф её не закроет.
Проверьте на своей задаче за десять минут
Универсального победителя нет, зато есть дешёвый способ найти своего. Возьмите реальный кусок работы, а не тестовый вопрос, и прогоните один и тот же промпт через несколько моделей подряд в одном диалоге.
Промпт для сравнения моделей на своей задаче
Вот фрагмент моей реальной работы: [вставьте текст, код или файл].
Сделай три вещи:
1. Выполни задачу: [сформулируйте, что нужно — разобрать, отредактировать, переписать, найти ошибки].
2. Перечисли, какие места в исходнике показались тебе неоднозначными и какие допущения ты сделал.
3. Скажи, какой информации не хватило, чтобы сделать лучше.
Отвечай без вступлений и без пересказа задания.Второй и третий пункты важнее первого: они показывают, насколько модель поняла контекст, а не просто складно написала. Учтите ступени доступа: Gemini 3.7 Flash и GPT-5.6 Luna прогоняются на бесплатном тарифе, а Claude Sonnet 5 и GPT-5.6 Terra открываются со «Старта» — полное сравнение тройки без оплаты не соберётся. Если каталог из 95+ моделей пугает, включите режим «Лайт»: вместо названий там сценарии — «Сложные задачи», «Тексты и статьи», «Поиск в интернете», «Бесплатная», — и цена показана как «≈ N нейронов за ответ».
Итог: что брать под какую задачу
- Код и разработка. Короткие правки и ревью — Gemini 3.7 Flash: у неё лучший Code Arena (1588) и FrontierCode (43,6%), а ревью кода по замерам биллинга обходится примерно в 3 нейрона. Длинные автономные прогоны и терминал — GPT-5.6 Terra (DeepSWE 69,6, terminal-bench 87,4).
- Документы и договоры. Длинный связный текст и редактура — Claude Sonnet 5 (GDPVal-AA 1598, разбор договора на 15 страниц ≈ 4 нейрона), доступен со «Старта». Быстрый разбор пачки файлов — Gemini 3.7 Flash: на GDP.pdf у неё 34,0 против 28,0 у Claude.
- Ежедневный поток и файлы. Gemini 3.7 Flash: контекст 1 048 576 токенов, принимает видео и аудио, вход 56 нейронов за 1 млн токенов против 281 на выходе.
- Черновики и объём. Сначала бесплатные модели — они не списывают нейроны и не расходуют лимит сообщений, ищите их по сценарию «Бесплатная». Из открытого на бесплатном тарифе для черновиков удобны DeepSeek V4 Pro и Qwen3.8 Max.
- Автоматизация и агенты. AutomationBench: 30,4 у Gemini против 23,6 у GPT и 10,7 у Claude — начинайте с Gemini, но длинную автономную цепочку переносите на GPT-5.6 Terra.
Определиться со ступенью помогает разбор какой тариф выбрать, а свести характеристики моделей в одном месте — сводная таблица нейросетей.
Проверить всё это можно без оплаты: на бесплатном тарифе открыты 52 модели из 95 — включая Gemini 3.7 Flash, GPT-5.6 Luna, DeepSeek V4 Pro и Qwen3.8 Max — и 100 нейронов, которые начисляют один раз при регистрации. Прогоните свой рабочий фрагмент через несколько моделей и посмотрите, чей ответ вы правите меньше. Если упрётесь в лимит сообщений или понадобятся Claude Sonnet 5, поиск в интернете и проекты — следующая ступень «Старт» стоит 890 ₽ и даёт 300 нейронов, 81 модель и 30 минут проектов в сутки.



