Gemini 3.8 Flash даёт результат уровня флагмана в коде и агентских сценариях, а стоит как обычная рабочая модель Flash. Она вышла 2 сентября 2026 года, в каталоге СуперИнтеллекта появилась 3 сентября и открыта на уровне доступа BASIC — то есть на всех тарифах, включая бесплатный. Цена: 113 нейронов за миллион входных токенов и 563 за миллион выходных — ровно столько же, сколько у Gemini 3.7 Flash. Контекст — 1 048 576 токенов, на вход принимает текст, изображения, файлы, аудио и видео, отвечает текстом.
Что изменилось по сравнению с Gemini 3.7 Flash
Между релизами прошло примерно три недели, а прирост, по публичным обзорам, заметен именно там, где болит у разработчиков: многошаговые инженерные задачи, вызов инструментов, длинные цепочки рассуждений. По данным Google, вместе с 3.8 Flash вышел ещё вариант 3.8 Flash Cyber — про него отдельно ниже. При этом формула цены осталась прежней: за токен вы платите столько же, сколько платили за 3.7 Flash, и модель так же доступна на бесплатном тарифе.
Почему цена за токен та же, а счёт за задачу выше?
Это главный практический нюанс, который легко пропустить в чужих обзорах. Модель делает больше шагов рассуждения и чаще вызывает инструменты — значит, генерирует больше токенов на ту же задачу. По публичным подсчётам средняя задача выходит примерно на 40% дороже, чем у 3.7 Flash, при одинаковом прайсе за миллион токенов. Обратная сторона приятная: по тем же подсчётам средняя задача стоит около $0,58 — самая низкая цифра среди моделей такого уровня интеллекта, тогда как у Claude Fable 5.1 — около $3,76, примерно в шесть раз больше. Доллары здесь — из внешних источников: это цены Google и подсчёты обзорщиков, они не приравниваются к нейронам СуперИнтеллекта и не конвертируются в них. Отдельно отметим: $0,75 за миллион входных и $3,75 за миллион выходных токенов у Google — вводная цена, она действует до 31 декабря, после чего удваивается.
| Модель | Вход, нейронов за 1 млн | Выход, нейронов за 1 млн | Доступ | Когда брать |
|---|---|---|---|---|
| Gemini 3.8 Flash | 113 | 563 | BASIC — все тарифы | Код, агенты, многошаговые задачи |
| Gemini 3.7 Flash | 113 | 563 | BASIC — все тарифы | Тот же ценник за токен, меньше лишних шагов |
| Gemini 3.5 Flash-Lite | 48 | 400 | BASIC — все тарифы | Массовая рутина, где важна дешевизна |
| Gemini 3.1 Pro Preview | 250 | 1500 | STANDARD — с тарифа Старт | Когда нужен именно Pro-профиль; по входу более чем вдвое дороже 3.8 Flash |
DeepSWE v1.1: бенчмарк, ради которого стоит присмотреться
Если вы строите агентов, из всего списка оценок вам важна одна. DeepSWE v1.1 проверяет не знание синтаксиса, а способность довести инженерную задачу от начала до конца самостоятельно. Что за этим стоит на практике — ниже.
Что нужно, чтобы довести задачу до конца?
- Разобраться в чужой кодовой базе: найти нужные файлы, понять связи, не сломать соседние модули.
- Спланировать работу: разбить задачу на шаги и держать план на длинной дистанции, а не чинить первый попавшийся кусок.
- Пользоваться инструментами: читать файлы, запускать команды, смотреть на результат и корректировать себя.
- Дойти до результата: итоговая правка должна действительно решать задачу, а не выглядеть правдоподобно.
По публичным обзорам, на DeepSWE v1.1 Gemini 3.8 Flash обходит большинство более крупных флагманских моделей — при доле их стоимости. Отсюда и внимание к модели: такой профиль поведения раньше встречался в основном у самых дорогих моделей, а здесь он открыт на бесплатном тарифе.
Какие ещё независимые оценки есть?
По Intelligence Index — сводному независимому индексу — у 3.8 Flash 59 баллов в режиме высокого рассуждения. Столько же у GPT-5.6 Sol и Grok 4.6; выше стоят Claude Fable 5.1 (66), Claude Opus 5 (63), Grok 4.6 high (61) и GPT-5.6 Sol max (61). То есть модель идёт вплотную к верхней группе, оставаясь в цене рабочей лошадки.
| Оценка | Результат Gemini 3.8 Flash | Что это значит на практике |
|---|---|---|
| Intelligence Index | 59 в режиме высокого рассуждения | На три пункта выше 3.7 Flash, вровень с GPT-5.6 Sol и Grok 4.6 |
| HLE-Verified | 54,9% | Многошаговые рассуждения в науке и профессиональных областях |
| DeepSWE v1.1 | Обходит большинство более крупных флагманов | Автономное решение инженерных задач от начала до конца |
| Vals Finance Agent V2 | Выше, чем у 3.7 Flash и других флагманов | Финансовые агентские сценарии |
| Harvey's Legal Agent Benchmark | Выше, чем у 3.7 Flash и других флагманов | Юридические агентские сценарии |
| Средняя стоимость задачи | около $0,58 по публичным подсчётам | Самая низкая цифра среди моделей такого уровня; у Claude Fable 5.1 около $3,76 |
«Работает усерднее»: плюс для агентов, минус для мелкой рутины
Усердие здесь — не маркетинговый эпитет, а описание поведения: там, где другая модель ответит с первого захода, эта сделает лишний круг рассуждения, перепроверит себя и ещё раз вызовет инструмент. Достоинство это или недостаток — зависит исключительно от того, какую работу вы ей даёте.
- Плюс: агент реже бросает задачу на середине и реже возвращает «сделал вид, что сделал».
- Плюс: на длинных цепочках лишние шаги окупаются — одна доведённая до конца задача дешевле трёх переделок.
- Плюс: чаще вызывает инструменты, а значит опирается на факты из кода и файлов, а не на память.
- Минус: на мелкой рутине — теги, короткие ответы, однострочные правки — вы платите за рассуждения, которые задаче не нужны.
- Минус: на большом потоке однотипных запросов разница примерно в 40% по стоимости задачи превращается в заметную сумму.
- Минус: больше шагов — дольше ответ, и в интерактивных сценариях это чувствуется.
Практическое правило простое: чем крупнее и многошаговее задача, тем выгоднее 3.8 Flash. Чем мельче и массовее — тем разумнее взять Gemini 3.5 Flash-Lite (48 и 400 нейронов) или остаться на Gemini 3.7 Flash, у которой ровно тот же ценник за токен, но меньше склонности накручивать шаги. Как выбирать между Flash-моделями — подробно в гайде какая Gemini Flash подойдёт.
Брать ли 3.8 Flash под вашу задачу
| Задача | Брать ли 3.8 Flash | Почему |
|---|---|---|
| Агент, который сам доводит задачу до конца | Да | Больше шагов рассуждения и вызовов инструментов работают на результат |
| Разобраться в незнакомом репозитории, найти причину бага | Да | Контекст 1 048 576 токенов и сильный профиль в коде |
| Рефакторинг, миграция на новую версию библиотеки | Да | Многошаговость здесь важнее экономии токенов |
| Разбор PDF, спецификаций и таблиц пачками | Да | Файлы на вход плюс миллионный контекст |
| Разбор записи созвона или голосовой заметки с задачами | Да | Принимает аудио и видео — редкость даже среди флагманов |
| Массовая классификация тикетов, теги, короткие ответы | Скорее нет | Лишние шаги рассуждения раздувают счёт: берите Flash-Lite |
| Однострочные правки и быстрые подсказки по ходу | Нет | Задача мелкая, усердие не окупается |
| Самые тяжёлые исследовательские рассуждения | Не всегда | По Intelligence Index выше стоят Claude Fable 5.1, Opus 5 и максимальные режимы Grok и GPT |
Пять промптов, с которых стоит начать
Карта незнакомого репозитория
Ты senior-разработчик. Я приложил архив с исходниками проекта.
1. Составь карту репозитория: точки входа, слои, где живёт бизнес-логика, где интеграции.
2. Назови 5 файлов, которые нужно прочитать первыми, чтобы понять систему, и объясни почему.
3. Отметь места, где архитектура вызывает вопросы, и сформулируй, что именно там рискованно.
Не пересказывай код построчно. Пиши так, будто вводишь в проект нового человека за 20 минут.Поиск причины бага по логу и коду
Симптом: <опиши, что видит пользователь и когда>.
Ниже — фрагмент лога и файлы, которые я подозреваю.
Сделай так:
1. Выпиши цепочку событий по логу от запроса до ошибки.
2. Сформулируй 3 гипотезы о причине, отсортируй по вероятности.
3. Для каждой гипотезы скажи, каким одним экспериментом её подтвердить или отбросить.
4. Только после этого предложи правку — минимальную, без переписывания соседнего кода.
Если данных не хватает, прямо скажи каких.Ревью пул-реквеста
Вот diff пул-реквеста. Проведи ревью как техлид.
Разложи замечания по трём корзинам:
A. Блокирующее — сломает прод или данные.
B. Стоит поправить до мержа — читаемость, обработка ошибок, граничные случаи.
C. На потом — вкусовщина и долги.
По каждому пункту: файл, строка, в чём риск, как исправить.
Ничего не выдумывай: если контекста не хватает — так и напиши.Проектирование агента под задачу
Опиши агента для задачи: <опиши задачу и что считается успехом>.
Выдай:
1. Разбиение на шаги — что агент делает в каком порядке.
2. Какие инструменты нужны на каждом шаге и что они возвращают.
3. Точки, где агент должен остановиться и спросить человека.
4. Критерии готовности — как понять, что задача решена, а не брошена на середине.
5. Три сценария отказа и поведение агента в каждом.
Без общих слов: формулируй так, чтобы это можно было сразу переложить в конфигурацию.План миграции без сюрпризов
Нужно перевести проект с <что> на <что>. Приложил зависимости и ключевые файлы.
Составь план миграции:
— что ломается наверняка и где именно в нашем коде;
— что можно мигрировать независимо, а что тянет за собой соседей;
— порядок шагов с точками отката;
— что проверить руками после каждого шага.
Отдельно: список мест, где ты не уверен и нужна проверка в документации.Cyber-вариант: что это и почему его у нас нет
Вместе с обычной 3.8 Flash Google выпустил вариант 3.8 Flash Cyber — модель для проверенных специалистов по кибербезопасности. Цифры там показательные: по данным Google, команда безопасности Chrome получила в 2,6 раза больше верных исправлений уязвимостей, чем от лучших коммерческих моделей заметно большего размера, а на бенчмарке Wiz полнота оказалась выше на 7,5–9,7% при цене в 2,3–5,2 раза ниже. Важная оговорка: это результаты именно Cyber-варианта, к обычной 3.8 Flash они не относятся. Для нас они интересны как контекст — задачи такого рода требуют родственных навыков: внимательно читать чужой код и удерживать длинную цепочку рассуждений.
Честно про доступ: Cyber-варианта в СуперИнтеллекте нет — он раздаётся только участникам программы Fairwind, то есть проверенным специалистам по кибербезопасности. В каталоге доступна обычная «Google: Gemini 3.8 Flash», и её возможностей хватает для подавляющего большинства инженерных задач.
Как начать
- Откройте чат в личном кабинете — регистрации на бесплатном тарифе достаточно.
- В выборе модели найдите «Google: Gemini 3.8 Flash» — она в каталоге с 3 сентября 2026 года.
- Прикрепите то, с чем работаете: код, PDF, таблицы, изображения, аудио или видео — модель принимает всё это на вход.
- Начните с промпта на разбор, а не на генерацию: пусть модель сначала объяснит систему, потом предлагает правки.
- Если строите постоянного помощника под команду — соберите его в разделе ИИ-агенты, а не переписывайте промпт каждый раз.
Частые вопросы
Правда ли, что Gemini 3.8 Flash доступна на бесплатном тарифе?
Да. У модели уровень доступа BASIC — это значит, что она работает на всех тарифах СуперИнтеллекта, включая бесплатный. Ограничивает вас не уровень доступа, а объём нейронов на балансе: 113 нейронов за миллион входных токенов и 563 за миллион выходных. Условия по тарифам — на странице тарифов.
Можно ли включить в чате высокий уровень рассуждения?
Нет, в чате СуперИнтеллекта нет переключателей уровня рассуждения, thinking и прочих параметров API — это настройки для тех, кто работает с моделью напрямую через код. Влиять на глубину проработки вы можете промптом: просите план перед решением, просите проверить себя, просите назвать неопределённости. На практике это работает не хуже тумблера.
Что выбрать для кода — 3.8 Flash или 3.7 Flash?
Цена за токен у них одинаковая — 113 и 563 нейрона, так что вопрос только в характере задач. Крупные многошаговые задачи — репозитории, миграции, агенты, доведение работы до конца — берите 3.8 Flash. Массовый поток коротких запросов, где важна экономия и предсказуемость счёта, — оставайтесь на 3.7 Flash: по публичным подсчётам средняя задача у 3.8 Flash выходит примерно на 40% дороже просто потому, что модель делает больше кругов рассуждения.
Подойдёт ли модель для больших репозиториев и документов?
Да, контекст 1 048 576 токенов — это десятки файлов кода или увесистая пачка документации за один заход. Плюс на вход идут файлы, изображения, аудио и видео, а отвечает модель текстом. Полный набор модальностей — редкость даже среди флагманов, и в инженерной работе он выручает чаще, чем кажется: разбор скринкаста с багом или голосовой планёрки не требует отдельного инструмента. Подробнее про работу с объёмными материалами — в гайде про большие документы, а про медиа — в гайде про видео и аудио.
Насколько свежие у модели знания?
По части областей знания доходят до марта 2026 года, по остальным — до января 2025-го. Для кода это означает простое правило: если работаете со свежими версиями библиотек, прикладывайте документацию или примеры прямо в чат, а не полагайтесь на память модели. Контекста на это хватит с запасом.


