Gemini 3.8 Flash даёт результат уровня флагмана в коде и агентских сценариях, а стоит как обычная рабочая модель Flash. Она вышла 2 сентября 2026 года, в каталоге СуперИнтеллекта появилась 3 сентября и открыта на уровне доступа BASIC — то есть на всех тарифах, включая бесплатный. Цена: 113 нейронов за миллион входных токенов и 563 за миллион выходных — ровно столько же, сколько у Gemini 3.7 Flash. Контекст — 1 048 576 токенов, на вход принимает текст, изображения, файлы, аудио и видео, отвечает текстом.

Что изменилось по сравнению с Gemini 3.7 Flash

Между релизами прошло примерно три недели, а прирост, по публичным обзорам, заметен именно там, где болит у разработчиков: многошаговые инженерные задачи, вызов инструментов, длинные цепочки рассуждений. По данным Google, вместе с 3.8 Flash вышел ещё вариант 3.8 Flash Cyber — про него отдельно ниже. При этом формула цены осталась прежней: за токен вы платите столько же, сколько платили за 3.7 Flash, и модель так же доступна на бесплатном тарифе.

Почему цена за токен та же, а счёт за задачу выше?

Это главный практический нюанс, который легко пропустить в чужих обзорах. Модель делает больше шагов рассуждения и чаще вызывает инструменты — значит, генерирует больше токенов на ту же задачу. По публичным подсчётам средняя задача выходит примерно на 40% дороже, чем у 3.7 Flash, при одинаковом прайсе за миллион токенов. Обратная сторона приятная: по тем же подсчётам средняя задача стоит около $0,58 — самая низкая цифра среди моделей такого уровня интеллекта, тогда как у Claude Fable 5.1 — около $3,76, примерно в шесть раз больше. Доллары здесь — из внешних источников: это цены Google и подсчёты обзорщиков, они не приравниваются к нейронам СуперИнтеллекта и не конвертируются в них. Отдельно отметим: $0,75 за миллион входных и $3,75 за миллион выходных токенов у Google — вводная цена, она действует до 31 декабря, после чего удваивается.

МодельВход, нейронов за 1 млнВыход, нейронов за 1 млнДоступКогда брать
Gemini 3.8 Flash113563BASIC — все тарифыКод, агенты, многошаговые задачи
Gemini 3.7 Flash113563BASIC — все тарифыТот же ценник за токен, меньше лишних шагов
Gemini 3.5 Flash-Lite48400BASIC — все тарифыМассовая рутина, где важна дешевизна
Gemini 3.1 Pro Preview2501500STANDARD — с тарифа СтартКогда нужен именно Pro-профиль; по входу более чем вдвое дороже 3.8 Flash
Модели Gemini в каталоге СуперИнтеллекта (цены в нейронах)

DeepSWE v1.1: бенчмарк, ради которого стоит присмотреться

Если вы строите агентов, из всего списка оценок вам важна одна. DeepSWE v1.1 проверяет не знание синтаксиса, а способность довести инженерную задачу от начала до конца самостоятельно. Что за этим стоит на практике — ниже.

Что нужно, чтобы довести задачу до конца?

  • Разобраться в чужой кодовой базе: найти нужные файлы, понять связи, не сломать соседние модули.
  • Спланировать работу: разбить задачу на шаги и держать план на длинной дистанции, а не чинить первый попавшийся кусок.
  • Пользоваться инструментами: читать файлы, запускать команды, смотреть на результат и корректировать себя.
  • Дойти до результата: итоговая правка должна действительно решать задачу, а не выглядеть правдоподобно.

По публичным обзорам, на DeepSWE v1.1 Gemini 3.8 Flash обходит большинство более крупных флагманских моделей — при доле их стоимости. Отсюда и внимание к модели: такой профиль поведения раньше встречался в основном у самых дорогих моделей, а здесь он открыт на бесплатном тарифе.

Какие ещё независимые оценки есть?

По Intelligence Index — сводному независимому индексу — у 3.8 Flash 59 баллов в режиме высокого рассуждения. Столько же у GPT-5.6 Sol и Grok 4.6; выше стоят Claude Fable 5.1 (66), Claude Opus 5 (63), Grok 4.6 high (61) и GPT-5.6 Sol max (61). То есть модель идёт вплотную к верхней группе, оставаясь в цене рабочей лошадки.

ОценкаРезультат Gemini 3.8 FlashЧто это значит на практике
Intelligence Index59 в режиме высокого рассужденияНа три пункта выше 3.7 Flash, вровень с GPT-5.6 Sol и Grok 4.6
HLE-Verified54,9%Многошаговые рассуждения в науке и профессиональных областях
DeepSWE v1.1Обходит большинство более крупных флагмановАвтономное решение инженерных задач от начала до конца
Vals Finance Agent V2Выше, чем у 3.7 Flash и других флагмановФинансовые агентские сценарии
Harvey's Legal Agent BenchmarkВыше, чем у 3.7 Flash и других флагмановЮридические агентские сценарии
Средняя стоимость задачиоколо $0,58 по публичным подсчётамСамая низкая цифра среди моделей такого уровня; у Claude Fable 5.1 около $3,76
Внешние оценки и подсчёты (данные Google и публичных обзоров, не наши)

«Работает усерднее»: плюс для агентов, минус для мелкой рутины

Усердие здесь — не маркетинговый эпитет, а описание поведения: там, где другая модель ответит с первого захода, эта сделает лишний круг рассуждения, перепроверит себя и ещё раз вызовет инструмент. Достоинство это или недостаток — зависит исключительно от того, какую работу вы ей даёте.

  • Плюс: агент реже бросает задачу на середине и реже возвращает «сделал вид, что сделал».
  • Плюс: на длинных цепочках лишние шаги окупаются — одна доведённая до конца задача дешевле трёх переделок.
  • Плюс: чаще вызывает инструменты, а значит опирается на факты из кода и файлов, а не на память.
  • Минус: на мелкой рутине — теги, короткие ответы, однострочные правки — вы платите за рассуждения, которые задаче не нужны.
  • Минус: на большом потоке однотипных запросов разница примерно в 40% по стоимости задачи превращается в заметную сумму.
  • Минус: больше шагов — дольше ответ, и в интерактивных сценариях это чувствуется.

Практическое правило простое: чем крупнее и многошаговее задача, тем выгоднее 3.8 Flash. Чем мельче и массовее — тем разумнее взять Gemini 3.5 Flash-Lite (48 и 400 нейронов) или остаться на Gemini 3.7 Flash, у которой ровно тот же ценник за токен, но меньше склонности накручивать шаги. Как выбирать между Flash-моделями — подробно в гайде какая Gemini Flash подойдёт.

Брать ли 3.8 Flash под вашу задачу

ЗадачаБрать ли 3.8 FlashПочему
Агент, который сам доводит задачу до концаДаБольше шагов рассуждения и вызовов инструментов работают на результат
Разобраться в незнакомом репозитории, найти причину багаДаКонтекст 1 048 576 токенов и сильный профиль в коде
Рефакторинг, миграция на новую версию библиотекиДаМногошаговость здесь важнее экономии токенов
Разбор PDF, спецификаций и таблиц пачкамиДаФайлы на вход плюс миллионный контекст
Разбор записи созвона или голосовой заметки с задачамиДаПринимает аудио и видео — редкость даже среди флагманов
Массовая классификация тикетов, теги, короткие ответыСкорее нетЛишние шаги рассуждения раздувают счёт: берите Flash-Lite
Однострочные правки и быстрые подсказки по ходуНетЗадача мелкая, усердие не окупается
Самые тяжёлые исследовательские рассужденияНе всегдаПо Intelligence Index выше стоят Claude Fable 5.1, Opus 5 и максимальные режимы Grok и GPT
Задача → решение → почему

Пять промптов, с которых стоит начать

Карта незнакомого репозитория

Ты senior-разработчик. Я приложил архив с исходниками проекта.

1. Составь карту репозитория: точки входа, слои, где живёт бизнес-логика, где интеграции.
2. Назови 5 файлов, которые нужно прочитать первыми, чтобы понять систему, и объясни почему.
3. Отметь места, где архитектура вызывает вопросы, и сформулируй, что именно там рискованно.

Не пересказывай код построчно. Пиши так, будто вводишь в проект нового человека за 20 минут.

Поиск причины бага по логу и коду

Симптом: <опиши, что видит пользователь и когда>.
Ниже — фрагмент лога и файлы, которые я подозреваю.

Сделай так:
1. Выпиши цепочку событий по логу от запроса до ошибки.
2. Сформулируй 3 гипотезы о причине, отсортируй по вероятности.
3. Для каждой гипотезы скажи, каким одним экспериментом её подтвердить или отбросить.
4. Только после этого предложи правку — минимальную, без переписывания соседнего кода.

Если данных не хватает, прямо скажи каких.

Ревью пул-реквеста

Вот diff пул-реквеста. Проведи ревью как техлид.

Разложи замечания по трём корзинам:
A. Блокирующее — сломает прод или данные.
B. Стоит поправить до мержа — читаемость, обработка ошибок, граничные случаи.
C. На потом — вкусовщина и долги.

По каждому пункту: файл, строка, в чём риск, как исправить.
Ничего не выдумывай: если контекста не хватает — так и напиши.

Проектирование агента под задачу

Опиши агента для задачи: <опиши задачу и что считается успехом>.

Выдай:
1. Разбиение на шаги — что агент делает в каком порядке.
2. Какие инструменты нужны на каждом шаге и что они возвращают.
3. Точки, где агент должен остановиться и спросить человека.
4. Критерии готовности — как понять, что задача решена, а не брошена на середине.
5. Три сценария отказа и поведение агента в каждом.

Без общих слов: формулируй так, чтобы это можно было сразу переложить в конфигурацию.

План миграции без сюрпризов

Нужно перевести проект с <что> на <что>. Приложил зависимости и ключевые файлы.

Составь план миграции:
— что ломается наверняка и где именно в нашем коде;
— что можно мигрировать независимо, а что тянет за собой соседей;
— порядок шагов с точками отката;
— что проверить руками после каждого шага.

Отдельно: список мест, где ты не уверен и нужна проверка в документации.

Cyber-вариант: что это и почему его у нас нет

Вместе с обычной 3.8 Flash Google выпустил вариант 3.8 Flash Cyber — модель для проверенных специалистов по кибербезопасности. Цифры там показательные: по данным Google, команда безопасности Chrome получила в 2,6 раза больше верных исправлений уязвимостей, чем от лучших коммерческих моделей заметно большего размера, а на бенчмарке Wiz полнота оказалась выше на 7,5–9,7% при цене в 2,3–5,2 раза ниже. Важная оговорка: это результаты именно Cyber-варианта, к обычной 3.8 Flash они не относятся. Для нас они интересны как контекст — задачи такого рода требуют родственных навыков: внимательно читать чужой код и удерживать длинную цепочку рассуждений.

Честно про доступ: Cyber-варианта в СуперИнтеллекте нет — он раздаётся только участникам программы Fairwind, то есть проверенным специалистам по кибербезопасности. В каталоге доступна обычная «Google: Gemini 3.8 Flash», и её возможностей хватает для подавляющего большинства инженерных задач.

Как начать

  1. Откройте чат в личном кабинете — регистрации на бесплатном тарифе достаточно.
  2. В выборе модели найдите «Google: Gemini 3.8 Flash» — она в каталоге с 3 сентября 2026 года.
  3. Прикрепите то, с чем работаете: код, PDF, таблицы, изображения, аудио или видео — модель принимает всё это на вход.
  4. Начните с промпта на разбор, а не на генерацию: пусть модель сначала объяснит систему, потом предлагает правки.
  5. Если строите постоянного помощника под команду — соберите его в разделе ИИ-агенты, а не переписывайте промпт каждый раз.

Частые вопросы

Правда ли, что Gemini 3.8 Flash доступна на бесплатном тарифе?

Да. У модели уровень доступа BASIC — это значит, что она работает на всех тарифах СуперИнтеллекта, включая бесплатный. Ограничивает вас не уровень доступа, а объём нейронов на балансе: 113 нейронов за миллион входных токенов и 563 за миллион выходных. Условия по тарифам — на странице тарифов.

Можно ли включить в чате высокий уровень рассуждения?

Нет, в чате СуперИнтеллекта нет переключателей уровня рассуждения, thinking и прочих параметров API — это настройки для тех, кто работает с моделью напрямую через код. Влиять на глубину проработки вы можете промптом: просите план перед решением, просите проверить себя, просите назвать неопределённости. На практике это работает не хуже тумблера.

Что выбрать для кода — 3.8 Flash или 3.7 Flash?

Цена за токен у них одинаковая — 113 и 563 нейрона, так что вопрос только в характере задач. Крупные многошаговые задачи — репозитории, миграции, агенты, доведение работы до конца — берите 3.8 Flash. Массовый поток коротких запросов, где важна экономия и предсказуемость счёта, — оставайтесь на 3.7 Flash: по публичным подсчётам средняя задача у 3.8 Flash выходит примерно на 40% дороже просто потому, что модель делает больше кругов рассуждения.

Подойдёт ли модель для больших репозиториев и документов?

Да, контекст 1 048 576 токенов — это десятки файлов кода или увесистая пачка документации за один заход. Плюс на вход идут файлы, изображения, аудио и видео, а отвечает модель текстом. Полный набор модальностей — редкость даже среди флагманов, и в инженерной работе он выручает чаще, чем кажется: разбор скринкаста с багом или голосовой планёрки не требует отдельного инструмента. Подробнее про работу с объёмными материалами — в гайде про большие документы, а про медиа — в гайде про видео и аудио.

Насколько свежие у модели знания?

По части областей знания доходят до марта 2026 года, по остальным — до января 2025-го. Для кода это означает простое правило: если работаете со свежими версиями библиотек, прикладывайте документацию или примеры прямо в чат, а не полагайтесь на память модели. Контекста на это хватит с запасом.