Gemini 3.8 Flash — это та же 3.7 Flash, только она стала думать дольше, и в этом вся разница. Цена за токен не изменилась ни на нейрон: 113 нейрона за миллион входных и 563 за миллион выходных — ровно как у 3.7 Flash. Уровень доступа тоже прежний, BASIC: модель работает на всех тарифах, включая бесплатный. Но одна и та же задача на 3.8 обходится примерно на 40% дороже, потому что модель делает больше шагов рассуждения и чаще обращается к инструментам.

Что произошло за три недели

По данным Google, 3.8 Flash вышла 2 сентября 2026 года — примерно через три недели после 3.7 Flash. Это первая причина не паниковать: 3.7 Flash никуда не делась, она остаётся в каталоге СуперИнтеллекта на тех же условиях доступа и по той же цене. Обе версии стоят в списке моделей рядом, переключение занимает один клик.

Вместе с обычной версией Google представил Gemini 3.8 Flash Cyber — отдельный вариант для проверенных специалистов по кибербезопасности, доступный, по данным Google, только участникам программы Fairwind. В нашем каталоге Cyber-варианта нет: это инструмент для команд, которые ищут и чинят уязвимости в коде, а не для повседневной работы. Для контекста: по данным Google, команда безопасности Chrome получила от Cyber-варианта в 2,6 раза больше верных исправлений уязвимостей, чем от лучших коммерческих моделей заметно большего размера.

Что осталось прежним, а что изменилось?

Верхняя половина таблицы ниже — это то, за что вы платите и на каких тарифах: здесь не изменилось ничего. Нижняя половина — поведение модели, и оно поменялось целиком. Обновление не про новый ценник, а про новый характер работы.

ПараметрОсталось прежним / изменилосьЗначение
Цена за входной миллионБез изменений113 нейрона у обеих
Цена за выходной миллионБез изменений563 нейрона у обеих
Уровень доступаБез измененийBASIC — все тарифы, включая бесплатный
КонтекстБез изменений1 048 576 токенов
Модальности на входеБез измененийтекст, изображения, файлы, аудио, видео
Формат ответаБез измененийтолько текст
Глубина рассужденияИзменилосьбольше шагов и вызовов инструментов
Расход токенов на задачуИзменилосьвыше, отсюда рост счёта примерно на 40%
Сложные многошаговые задачиИзменилосьзаметно лучше, по данным Google
Время до готового ответаИзменилосьдольше: модель проходит больше шагов
Gemini 3.7 Flash и Gemini 3.8 Flash: построчно

Парадокс цены: за токен столько же, за задачу дороже

Это главное, что стоит понять перед переключением, и в чужих обзорах этого почти не разбирают. Тариф за токен у 3.8 Flash не вырос — те же 113 и 563 нейрона. Но токенов на одну и ту же задачу уходит больше: модель работает усерднее, то есть строит более длинную цепочку рассуждений и чаще обращается к инструментам, прежде чем выдать ответ. В итоге счёт растёт не из-за прайса, а из-за объёма работы — примерно на 40% на одной и той же задаче. Если вы привыкли планировать расход по цене за миллион токенов, здесь эта привычка подводит: считать надо по завершённым задачам.

МодельВход, нейронов за 1 млнВыход, нейронов за 1 млнДоступ
Gemini 3.8 Flash113563BASIC — все тарифы
Gemini 3.7 Flash113563BASIC — все тарифы
Gemini 3.5 Flash-Lite48400BASIC — все тарифы
Gemini 3.1 Pro Preview2501500STANDARD — с тарифа Старт
Цена в нейронах: Gemini в каталоге СуперИнтеллекта

Из таблицы видно главное: 3.8 Flash более чем вдвое дешевле по входу, чем Gemini 3.1 Pro Preview, и при этом открыта на бесплатном тарифе, тогда как Pro Preview начинается с тарифа Старт. А Flash-Lite остаётся самой экономной из Gemini в этой таблице — она слабее, но для простых массовых операций этого часто достаточно.

Отдельно про доллары, чтобы не путаться. У самой Google цена сейчас $0,75 за миллион входных и $3,75 за миллион выходных токенов, и это вводная ставка: она действует до 31 декабря, после чего удваивается. К нейронам это отношения не имеет — в СуперИнтеллекте вы платите нейронами по ценам из таблицы выше, и они от календаря Google не зависят.

Насколько реально вырастет счёт?

По публичным подсчётам средняя задача на 3.8 Flash стоит около $0,58 — это самая низкая цена среди моделей сопоставимого уровня интеллекта; у Claude Fable 5.1 та же средняя задача выходит примерно в $3,76, то есть примерно в шесть раз дороже. Эта оценка уже учитывает возросший расход токенов, так что даже с более длинными рассуждениями 3.8 Flash остаётся одним из самых доступных способов получить сильное рассуждение. В нейронах то же самое проверяется за пару минут — двумя запусками одной и той же задачи.

Промпт для честного сравнения двух версий

Ниже — задача из моей работы. Выполни её полностью, шаг за шагом, до готового результата, без уточняющих вопросов. В конце коротко перечисли, какие шаги ты сделал.

Задача: [вставьте свою реальную задачу — разбор документа, план, код, анализ данных]

Что говорят бенчмарки

Google называет 3.8 Flash своей лучшей моделью для рассуждений и кода. Независимые замеры это в целом подтверждают, но с оговоркой: прирост не универсальный, он собран в сложных многошаговых сценариях.

ПоказательРезультатИсточник
Intelligence Index (высокое рассуждение)59 — на три пункта выше 3.7 Flashнезависимый сводный индекс
Столько же набираютGPT-5.6 Sol и Grok 4.6тот же индекс
Выше толькоClaude Fable 5.1 (66), Claude Opus 5 (63), Grok 4.6 high (61), GPT-5.6 Sol max (61)тот же индекс
HLE-Verified, многошаговые рассуждения в науке и профессиональных областях54,9%по данным Google
DeepSWE v1.1, инженерные задачи от начала до концаобходит большинство более крупных флагманов при доле их стоимостипо данным Google
Vals Finance Agent V2выше, чем у 3.7 Flash и других флагмановпо данным Google
Harvey's Legal Agent Benchmarkвыше, чем у 3.7 Flash и других флагмановпо данным Google
Ключевые результаты 3.8 Flash

Три пункта в сводном индексе — это не революция, а аккуратный шаг вперёд. Гораздо интереснее другое: модель уровня Flash встала вровень с моделями, которые принято считать флагманскими, и делает это на уровне доступа, где нет доплаты за тариф.

Кому переход оправдан

Логика простая: чем длиннее и запутаннее задача, тем сильнее окупается привычка модели думать дольше.

  • Агентные сценарии, где нужно пройти цепочку шагов и несколько раз обратиться к инструментам — здесь прирост качества самый заметный.
  • Разбор кода и инженерные задачи «от постановки до готового результата», а не «допиши функцию».
  • Финансовая и юридическая аналитика, отчёты со сложными выводами и самопроверкой.
  • Работа с большими документами и длинными переписками: контекст в 1 048 576 токенов позволяет держать весь массив целиком.
  • Разбор аудио и видео вместе с текстом — полный набор модальностей на входе редкость даже среди флагманов.

А кому лучше остаться на 3.7 Flash?

  • Короткая рутина: переписать абзац, вытащить данные из таблицы, ответить на типовой вопрос. Качество то же, а платите вы больше.
  • Большой поток однотипных запросов, где важна суммарная стоимость за день, а не потолок интеллекта.
  • Сценарии, где человек ждёт ответ на экране: 3.8 Flash проходит больше шагов, поэтому готовый ответ приходит позже.
  • Уже отлаженные промпты, которые дают предсказуемый результат — менять работающее без причины смысла нет.

И самый практичный вывод: не надо выбирать одну модель навсегда. Обе версии открыты на всех тарифах, поэтому держите 3.7 Flash как рабочую лошадку для потока, а 3.8 Flash включайте, когда задача действительно сложная. Переключение модели в чате — это один клик, и оно ничего не стоит.

Что модель умеет на входе

Набор модальностей у 3.8 Flash остался полным: текст, изображения, файлы, аудио и видео. Отвечает она текстом. На практике это значит, что в одном диалоге можно совместить договор в PDF, скриншот интерфейса и запись созвона и попросить свести всё в один вывод, а контекста в 1 048 576 токенов хватает, чтобы не резать материал на куски. Про актуальность знаний: по части областей модель знает мир до марта 2026 года, по остальным — до января 2025-го, поэтому всё важное и свежее лучше приносить в чат файлом или ссылкой.

Как переключиться в СуперИнтеллекте?

  1. Откройте чат и нажмите на название текущей модели над полем ввода.
  2. Найдите в списке «Google: Gemini 3.8 Flash» — она доступна на любом тарифе, включая бесплатный.
  3. Прогоните одну свою типовую задачу и сравните результат и списание нейронов с 3.7 Flash.
  4. Оставьте 3.8 Flash там, где выигрыш в качестве заметен, а для потока вернитесь на 3.7 Flash.

Частые вопросы

Gemini 3.8 Flash подорожала по сравнению с 3.7 Flash?

Нет. Цена за токен одинаковая: 113 нейрона за миллион входных и 563 за миллион выходных у обеих версий. Дороже становится законченная задача — примерно на 40%, потому что модель тратит больше токенов на рассуждение и вызовы инструментов.

Нужен ли платный тариф, чтобы попробовать 3.8 Flash?

Нет. Уровень доступа BASIC означает, что модель открыта на всех тарифах, включая бесплатный. Ограничивает вас только запас нейронов, а не право доступа. Для сравнения, Gemini 3.1 Pro Preview начинается с тарифа Старт и стоит 250 и 1500 нейронов.

Стоит ли переносить на 3.8 Flash уже работающие промпты?

Не автоматически. Если промпт отлажен и даёт стабильный результат на короткой задаче, перенос только увеличит расход. Переносите то, где вы регулярно недовольны глубиной ответа: многошаговый разбор, код целиком, аналитику с выводами.

Есть ли в чате настройка глубины рассуждения?

Нет. В чате СуперИнтеллекта нет ползунков уровня рассуждения и прочих параметров API — вы выбираете модель, и всё. Поэтому единственный способ управлять расходом здесь — осознанный выбор между 3.8 Flash, 3.7 Flash и более экономной Flash-Lite.

Что такое Gemini 3.8 Flash Cyber и доступна ли она у вас?

Это отдельный вариант модели для проверенных специалистов по кибербезопасности. По данным Google, доступ к нему дают только участникам программы Fairwind. В нашем каталоге Cyber-варианта нет — есть обычная Gemini 3.8 Flash.

3.7 Flash перестанет работать?

Нет, обе версии остаются в каталоге рядом и на одинаковых условиях доступа: BASIC, те же 113 и 563 нейрона. Так что это выбор инструмента под задачу, а не вынужденная миграция.