Gemini 3.8 Flash — новая быстрая модель Google, и в СуперИнтеллекте она открыта на всех тарифах, включая бесплатный. Google представила её 2 сентября 2026 года, в каталоге платформы она появилась 3 сентября под именем «Google: Gemini 3.8 Flash». Стоит 113 нейронов за миллион входных токенов и 563 за миллион выходных — ровно столько же, сколько предыдущая 3.7 Flash. Контекст — 1 048 576 токенов, на вход принимает текст, изображения, файлы, аудио и видео, отвечает текстом.
Что нового по сравнению с 3.7 Flash
Разница между версиями не в цене и не в размере контекста — они не изменились. Изменилось поведение модели: она стала настойчивее в сложных задачах. По данным Google, 3.8 Flash — их лучшая модель для рассуждений и кода, и главный прирост виден там, где нужно довести длинную работу до конца, а не ответить одной репликой.
- Вышла 2 сентября 2026 года, примерно через три недели после Gemini 3.7 Flash.
- По данным Google, это их лучшая модель для рассуждений и написания кода.
- По публичным обзорам, на бенчмарке DeepSWE v1.1 обходит большинство более крупных флагманских моделей в автономном решении инженерных задач от начала до конца — при доле их стоимости.
- По публичным обзорам, на отраслевых наборах Vals Finance Agent V2 и Harvey's Legal Agent Benchmark результат выше, чем у 3.7 Flash и у других флагманов.
- Вместе с ней Google показала Gemini 3.8 Flash Cyber — вариант для проверенных специалистов по кибербезопасности, доступный только участникам программы Fairwind. В каталоге СуперИнтеллекта Cyber-варианта нет.
Насколько она умнее предыдущей версии?
По независимому сводному индексу Intelligence Index у Gemini 3.8 Flash 59 баллов в режиме высокого рассуждения — на три пункта выше, чем у 3.7 Flash. Столько же набирают GPT-5.6 Sol и Grok 4.6. На HLE-Verified, наборе многошаговых задач в науке и профессиональных областях, — 54,9%. Выше по индексу только четыре модели: Claude Fable 5.1, Claude Opus 5, Grok 4.6 в режиме high и GPT-5.6 Sol max.
| Модель | Балл |
|---|---|
| Claude Fable 5.1 | 66 |
| Claude Opus 5 | 63 |
| Grok 4.6 high | 61 |
| GPT-5.6 Sol max | 61 |
| Gemini 3.8 Flash (высокое рассуждение) | 59 |
| GPT-5.6 Sol | 59 |
| Grok 4.6 | 59 |
| Gemini 3.7 Flash | 56 |
Характеристики и цена в СуперИнтеллекте
| Параметр | Значение |
|---|---|
| Идентификатор | google/gemini-3.8-flash |
| Название в каталоге | Google: Gemini 3.8 Flash |
| Добавлена на платформу | 3 сентября 2026 |
| Уровень доступа | BASIC — все тарифы, включая бесплатный |
| Контекст | 1 048 576 токенов |
| Вход | Текст, изображения, файлы, аудио, видео |
| Выход | Текст |
| Цена входа | 113 нейронов за 1 млн токенов |
| Цена выхода | 563 нейронов за 1 млн токенов |
| Знания модели | Март 2026 по части областей, январь 2025 по остальным |
Списание идёт в нейронах — единой единице расчёта на платформе. Отдельной подписки на Google, зарубежной карты и VPN не нужно: модель уже подключена, выбираете её в списке и пишете.
Почему она доступна на бесплатном тарифе?
Потому что уровень доступа у неё BASIC — самый открытый в системе тарифов. BASIC-модели работают на всех планах, начиная с бесплатного: тариф решает, какие модели вам открыты, а размер списания зависит от цены модели в нейронах и объёма запроса. Дальше всё упирается только в остаток нейронов на балансе — то есть модель, вышедшая 2 сентября, доступна сразу после регистрации.
- BASIC — доступно на всех тарифах, включая бесплатный. Сюда попадает Gemini 3.8 Flash, а также 3.7 Flash и 3.5 Flash-Lite.
- STANDARD — начиная с тарифа Старт. Здесь, например, Gemini 3.1 Pro Preview.
Какую Gemini выбрать в каталоге
| Модель | Доступ | Вход, нейронов за 1 млн | Выход, нейронов за 1 млн |
|---|---|---|---|
| Gemini 3.8 Flash | BASIC — все тарифы | 113 | 563 |
| Gemini 3.7 Flash | BASIC — все тарифы | 113 | 563 |
| Gemini 3.5 Flash-Lite | BASIC — все тарифы | 48 | 400 |
| Gemini 3.1 Pro Preview | STANDARD — с тарифа Старт | 250 | 1500 |
Из таблицы видно главное: по входу 3.8 Flash более чем вдвое дешевле Gemini 3.1 Pro Preview — 113 нейронов против 250, — и при этом открыта на тарифах, где Pro Preview ещё недоступна. Для большинства сценариев это разумная точка старта.
Когда лучше взять 3.5 Flash-Lite?
Когда задача простая и массовая: короткие ответы, разбор однотипных сообщений, черновые формулировки, быстрые переводы. Flash-Lite стоит 48 и 400 нейронов — по входу это примерно в 2,3 раза дешевле, чем у 3.8 Flash, по выходу — примерно в 1,4 раза. На объёме экономия накапливается. Как только появляется многошаговая логика, код или длинный документ, возвращайтесь к 3.8 Flash.
А 3.7 Flash ещё нужна?
Да, и это не формальность. Если у вас уже настроен сценарий, который стабильно даёт нужный результат на 3.7 Flash, менять его ради версии повыше смысла мало: цена за токен одинаковая, но 3.8 обычно тратит больше токенов на ту же задачу. Разбор предыдущей версии — в материале Gemini 3.7 Flash: обзор, а выбор между всеми Flash — в какую Gemini Flash выбрать.
Аудио, видео и файлы: полный набор модальностей
Gemini 3.8 Flash понимает не только текст и картинки. На вход можно отправить документ, таблицу, аудиозапись и видео — и получить текстовый ответ. Такой набор модальностей встречается редко даже среди флагманских моделей. Подробные сценарии для предыдущей версии — в гайдах про видео и аудио и большие документы; для 3.8 Flash они работают так же.
- Аудио: расшифровка планёрки, интервью, голосового сообщения — сразу с выводами и списком задач.
- Видео: разбор записи демо, вебинара или рекламного ролика без ручного просмотра.
- Файлы: договоры, отчёты, выгрузки, презентации — контекст на 1 048 576 токенов позволяет закинуть материал целиком, а не резать на куски.
- Изображения: скриншоты интерфейса, схемы, фотографии документов.
Контекст в миллион токенов и мультимодальность работают в паре: можно приложить длинный документ вместе с записью обсуждения и попросить свести одно с другим.
Промпт для разбора записи встречи
Ты — ассистент, который превращает записи встреч в рабочие документы.
Прослушай приложенную запись и верни:
1) Краткое резюме на 5-7 предложений.
2) Принятые решения — списком, с формулировкой «что решили».
3) Задачи: что сделать, кто отвечает, к какому сроку. Если срок не назван — напиши «срок не обозначен».
4) Открытые вопросы, по которым решение отложили.
Ничего не додумывай: если чего-то в записи нет, так и напиши.Честно про деньги: токен тот же, задача дороже
Это главный нюанс версии, и его почти не разбирают в обзорах. Цена за токен у 3.8 Flash не выросла ни на копейку — те же 113 и 563 нейронов, что у 3.7 Flash. Но конечная задача обходится примерно на 40% дороже. Причина простая: модель «работает усерднее» — делает больше шагов рассуждения и чаще вызывает инструменты, а значит, тратит больше токенов на тот же вопрос.
По публичным подсчётам средняя задача на Gemini 3.8 Flash стоит около $0,58 — это самая низкая цена среди моделей такого уровня интеллекта; у Claude Fable 5.1 та же средняя задача обходится примерно в $3,76, около шести раз дороже. Долларовые цифры здесь приведены как есть, из внешних оценок: это не наша цена и в нейроны они не пересчитываются.
Отдельно про доллары у самой Google: по данным компании, цена API — $0,75 за миллион входных и $3,75 за миллион выходных токенов, и это вводная цена, которая действует до 31 декабря, после чего удваивается. На расчёты в нейронах внутри платформы это не влияет, но объясняет, почему момент сейчас удачный.
Кому какая модель подойдёт
| Задача | Что взять | Почему |
|---|---|---|
| Первое знакомство с ИИ на бесплатном тарифе | Gemini 3.8 Flash | Доступна сразу, понимает файлы, аудио и видео |
| Массовые короткие ответы, разбор потока сообщений | Gemini 3.5 Flash-Lite | 48 и 400 нейронов — заметная экономия на объёме |
| Код, рефакторинг, длинные инженерные задачи | Gemini 3.8 Flash | По данным Google, главный прирост версии именно здесь |
| Уже отлаженный рабочий сценарий | Gemini 3.7 Flash | Та же цена за токен, но меньше расход токенов |
| Разбор часовой записи или большого договора | Gemini 3.8 Flash | Контекст 1 048 576 токенов и полный набор модальностей |
Как попробовать
- Зайдите в чат — регистрации на бесплатном тарифе достаточно.
- В списке моделей выберите «Google: Gemini 3.8 Flash».
- Приложите файл, запись или видео, если задача этого требует, и опишите, что нужно на выходе.
- Для повторяющейся работы соберите ИИ-агента с этой моделью — промпт задаётся один раз.
Полный список подключённых моделей — в разделе нейросети, условия по тарифам и нейронам — на странице тарифов. Начать работу можно на my.suin.ai.
Частые вопросы
Gemini 3.8 Flash действительно доступна на бесплатном тарифе?
Да: её уровень доступа — BASIC, а BASIC-модели открыты на всех тарифах, включая бесплатный. Отдельно за подключение платить не нужно, расходуются только нейроны с вашего баланса: 113 за миллион входных токенов и 563 за миллион выходных. Как устроен бесплатный доступ к Gemini, подробно разобрано в материале Gemini 3.7 бесплатно.
Чем 3.8 Flash отличается от 3.7 Flash в цене?
Ценой за токен — ничем: обе стоят 113 и 563 нейронов и обе на уровне BASIC. Отличается расход: 3.8 Flash делает больше шагов рассуждения, поэтому средняя задача, по публичным подсчётам, выходит примерно на 40% дороже. Разбор цен предыдущей версии — в гайде про цену Gemini 3.7 Flash.
Можно ли настроить уровень рассуждения в чате?
Нет. В чате СуперИнтеллекта нет переключателя уровня рассуждения и других параметров API — вы просто выбираете модель и пишете задачу. Управлять глубиной ответа проще всего формулировкой промпта: просите разложить решение по шагам, если нужен подробный разбор, и просите короткий ответ, когда объём не нужен.
Насколько свежие у модели знания?
По части областей знания доходят до марта 2026 года, по остальным — до января 2025-го. Для событий последних месяцев на память модели лучше не полагаться: прикладывайте документы и источники прямо в запрос — с контекстом на миллион токенов это не проблема.
Подойдёт ли она для программирования?
Это как раз её сильная сторона: по данным Google, 3.8 Flash — их лучшая модель для рассуждений и кода, а по публичным обзорам на DeepSWE v1.1 она обходит большинство более крупных флагманов в автономном решении инженерных задач при доле их стоимости. Приёмы работы с кодом на Gemini собраны в гайде про программирование, а сравнение моделей для разработки — в лучших нейросетях для кода.


