Gemini 3.8 Flash — новая быстрая модель Google, и в СуперИнтеллекте она открыта на всех тарифах, включая бесплатный. Google представила её 2 сентября 2026 года, в каталоге платформы она появилась 3 сентября под именем «Google: Gemini 3.8 Flash». Стоит 113 нейронов за миллион входных токенов и 563 за миллион выходных — ровно столько же, сколько предыдущая 3.7 Flash. Контекст — 1 048 576 токенов, на вход принимает текст, изображения, файлы, аудио и видео, отвечает текстом.

Что нового по сравнению с 3.7 Flash

Разница между версиями не в цене и не в размере контекста — они не изменились. Изменилось поведение модели: она стала настойчивее в сложных задачах. По данным Google, 3.8 Flash — их лучшая модель для рассуждений и кода, и главный прирост виден там, где нужно довести длинную работу до конца, а не ответить одной репликой.

  • Вышла 2 сентября 2026 года, примерно через три недели после Gemini 3.7 Flash.
  • По данным Google, это их лучшая модель для рассуждений и написания кода.
  • По публичным обзорам, на бенчмарке DeepSWE v1.1 обходит большинство более крупных флагманских моделей в автономном решении инженерных задач от начала до конца — при доле их стоимости.
  • По публичным обзорам, на отраслевых наборах Vals Finance Agent V2 и Harvey's Legal Agent Benchmark результат выше, чем у 3.7 Flash и у других флагманов.
  • Вместе с ней Google показала Gemini 3.8 Flash Cyber — вариант для проверенных специалистов по кибербезопасности, доступный только участникам программы Fairwind. В каталоге СуперИнтеллекта Cyber-варианта нет.

Насколько она умнее предыдущей версии?

По независимому сводному индексу Intelligence Index у Gemini 3.8 Flash 59 баллов в режиме высокого рассуждения — на три пункта выше, чем у 3.7 Flash. Столько же набирают GPT-5.6 Sol и Grok 4.6. На HLE-Verified, наборе многошаговых задач в науке и профессиональных областях, — 54,9%. Выше по индексу только четыре модели: Claude Fable 5.1, Claude Opus 5, Grok 4.6 в режиме high и GPT-5.6 Sol max.

МодельБалл
Claude Fable 5.166
Claude Opus 563
Grok 4.6 high61
GPT-5.6 Sol max61
Gemini 3.8 Flash (высокое рассуждение)59
GPT-5.6 Sol59
Grok 4.659
Gemini 3.7 Flash56
Intelligence Index: место Gemini 3.8 Flash (по публичным данным)

Характеристики и цена в СуперИнтеллекте

ПараметрЗначение
Идентификаторgoogle/gemini-3.8-flash
Название в каталогеGoogle: Gemini 3.8 Flash
Добавлена на платформу3 сентября 2026
Уровень доступаBASIC — все тарифы, включая бесплатный
Контекст1 048 576 токенов
ВходТекст, изображения, файлы, аудио, видео
ВыходТекст
Цена входа113 нейронов за 1 млн токенов
Цена выхода563 нейронов за 1 млн токенов
Знания моделиМарт 2026 по части областей, январь 2025 по остальным
Google: Gemini 3.8 Flash — карточка модели

Списание идёт в нейронах — единой единице расчёта на платформе. Отдельной подписки на Google, зарубежной карты и VPN не нужно: модель уже подключена, выбираете её в списке и пишете.

Почему она доступна на бесплатном тарифе?

Потому что уровень доступа у неё BASIC — самый открытый в системе тарифов. BASIC-модели работают на всех планах, начиная с бесплатного: тариф решает, какие модели вам открыты, а размер списания зависит от цены модели в нейронах и объёма запроса. Дальше всё упирается только в остаток нейронов на балансе — то есть модель, вышедшая 2 сентября, доступна сразу после регистрации.

  • BASIC — доступно на всех тарифах, включая бесплатный. Сюда попадает Gemini 3.8 Flash, а также 3.7 Flash и 3.5 Flash-Lite.
  • STANDARD — начиная с тарифа Старт. Здесь, например, Gemini 3.1 Pro Preview.

Какую Gemini выбрать в каталоге

МодельДоступВход, нейронов за 1 млнВыход, нейронов за 1 млн
Gemini 3.8 FlashBASIC — все тарифы113563
Gemini 3.7 FlashBASIC — все тарифы113563
Gemini 3.5 Flash-LiteBASIC — все тарифы48400
Gemini 3.1 Pro PreviewSTANDARD — с тарифа Старт2501500
Линейка Gemini в СуперИнтеллекте: доступ и цена в нейронах

Из таблицы видно главное: по входу 3.8 Flash более чем вдвое дешевле Gemini 3.1 Pro Preview — 113 нейронов против 250, — и при этом открыта на тарифах, где Pro Preview ещё недоступна. Для большинства сценариев это разумная точка старта.

Когда лучше взять 3.5 Flash-Lite?

Когда задача простая и массовая: короткие ответы, разбор однотипных сообщений, черновые формулировки, быстрые переводы. Flash-Lite стоит 48 и 400 нейронов — по входу это примерно в 2,3 раза дешевле, чем у 3.8 Flash, по выходу — примерно в 1,4 раза. На объёме экономия накапливается. Как только появляется многошаговая логика, код или длинный документ, возвращайтесь к 3.8 Flash.

А 3.7 Flash ещё нужна?

Да, и это не формальность. Если у вас уже настроен сценарий, который стабильно даёт нужный результат на 3.7 Flash, менять его ради версии повыше смысла мало: цена за токен одинаковая, но 3.8 обычно тратит больше токенов на ту же задачу. Разбор предыдущей версии — в материале Gemini 3.7 Flash: обзор, а выбор между всеми Flash — в какую Gemini Flash выбрать.

Аудио, видео и файлы: полный набор модальностей

Gemini 3.8 Flash понимает не только текст и картинки. На вход можно отправить документ, таблицу, аудиозапись и видео — и получить текстовый ответ. Такой набор модальностей встречается редко даже среди флагманских моделей. Подробные сценарии для предыдущей версии — в гайдах про видео и аудио и большие документы; для 3.8 Flash они работают так же.

  • Аудио: расшифровка планёрки, интервью, голосового сообщения — сразу с выводами и списком задач.
  • Видео: разбор записи демо, вебинара или рекламного ролика без ручного просмотра.
  • Файлы: договоры, отчёты, выгрузки, презентации — контекст на 1 048 576 токенов позволяет закинуть материал целиком, а не резать на куски.
  • Изображения: скриншоты интерфейса, схемы, фотографии документов.

Контекст в миллион токенов и мультимодальность работают в паре: можно приложить длинный документ вместе с записью обсуждения и попросить свести одно с другим.

Промпт для разбора записи встречи

Ты — ассистент, который превращает записи встреч в рабочие документы.
Прослушай приложенную запись и верни:
1) Краткое резюме на 5-7 предложений.
2) Принятые решения — списком, с формулировкой «что решили».
3) Задачи: что сделать, кто отвечает, к какому сроку. Если срок не назван — напиши «срок не обозначен».
4) Открытые вопросы, по которым решение отложили.
Ничего не додумывай: если чего-то в записи нет, так и напиши.

Честно про деньги: токен тот же, задача дороже

Это главный нюанс версии, и его почти не разбирают в обзорах. Цена за токен у 3.8 Flash не выросла ни на копейку — те же 113 и 563 нейронов, что у 3.7 Flash. Но конечная задача обходится примерно на 40% дороже. Причина простая: модель «работает усерднее» — делает больше шагов рассуждения и чаще вызывает инструменты, а значит, тратит больше токенов на тот же вопрос.

По публичным подсчётам средняя задача на Gemini 3.8 Flash стоит около $0,58 — это самая низкая цена среди моделей такого уровня интеллекта; у Claude Fable 5.1 та же средняя задача обходится примерно в $3,76, около шести раз дороже. Долларовые цифры здесь приведены как есть, из внешних оценок: это не наша цена и в нейроны они не пересчитываются.

Отдельно про доллары у самой Google: по данным компании, цена API — $0,75 за миллион входных и $3,75 за миллион выходных токенов, и это вводная цена, которая действует до 31 декабря, после чего удваивается. На расчёты в нейронах внутри платформы это не влияет, но объясняет, почему момент сейчас удачный.

Кому какая модель подойдёт

ЗадачаЧто взятьПочему
Первое знакомство с ИИ на бесплатном тарифеGemini 3.8 FlashДоступна сразу, понимает файлы, аудио и видео
Массовые короткие ответы, разбор потока сообщенийGemini 3.5 Flash-Lite48 и 400 нейронов — заметная экономия на объёме
Код, рефакторинг, длинные инженерные задачиGemini 3.8 FlashПо данным Google, главный прирост версии именно здесь
Уже отлаженный рабочий сценарийGemini 3.7 FlashТа же цена за токен, но меньше расход токенов
Разбор часовой записи или большого договораGemini 3.8 FlashКонтекст 1 048 576 токенов и полный набор модальностей
Выбор под задачу

Как попробовать

  1. Зайдите в чат — регистрации на бесплатном тарифе достаточно.
  2. В списке моделей выберите «Google: Gemini 3.8 Flash».
  3. Приложите файл, запись или видео, если задача этого требует, и опишите, что нужно на выходе.
  4. Для повторяющейся работы соберите ИИ-агента с этой моделью — промпт задаётся один раз.

Полный список подключённых моделей — в разделе нейросети, условия по тарифам и нейронам — на странице тарифов. Начать работу можно на my.suin.ai.


Частые вопросы

Gemini 3.8 Flash действительно доступна на бесплатном тарифе?

Да: её уровень доступа — BASIC, а BASIC-модели открыты на всех тарифах, включая бесплатный. Отдельно за подключение платить не нужно, расходуются только нейроны с вашего баланса: 113 за миллион входных токенов и 563 за миллион выходных. Как устроен бесплатный доступ к Gemini, подробно разобрано в материале Gemini 3.7 бесплатно.

Чем 3.8 Flash отличается от 3.7 Flash в цене?

Ценой за токен — ничем: обе стоят 113 и 563 нейронов и обе на уровне BASIC. Отличается расход: 3.8 Flash делает больше шагов рассуждения, поэтому средняя задача, по публичным подсчётам, выходит примерно на 40% дороже. Разбор цен предыдущей версии — в гайде про цену Gemini 3.7 Flash.

Можно ли настроить уровень рассуждения в чате?

Нет. В чате СуперИнтеллекта нет переключателя уровня рассуждения и других параметров API — вы просто выбираете модель и пишете задачу. Управлять глубиной ответа проще всего формулировкой промпта: просите разложить решение по шагам, если нужен подробный разбор, и просите короткий ответ, когда объём не нужен.

Насколько свежие у модели знания?

По части областей знания доходят до марта 2026 года, по остальным — до января 2025-го. Для событий последних месяцев на память модели лучше не полагаться: прикладывайте документы и источники прямо в запрос — с контекстом на миллион токенов это не проблема.

Подойдёт ли она для программирования?

Это как раз её сильная сторона: по данным Google, 3.8 Flash — их лучшая модель для рассуждений и кода, а по публичным обзорам на DeepSWE v1.1 она обходит большинство более крупных флагманов в автономном решении инженерных задач при доле их стоимости. Приёмы работы с кодом на Gemini собраны в гайде про программирование, а сравнение моделей для разработки — в лучших нейросетях для кода.