Gemini 3.8 Flash закрывает в компании тот слой работы, где нужно прочитать много и ответить по делу: входящие обращения, договоры, записи совещаний, отчётность и сводки. В СуперИнтеллекте модель доступна на всех тарифах, включая бесплатный, стоит 113 нейронов за миллион входных токенов и 563 за миллион выходных и держит контекст в 1 048 576 токенов. На вход принимает текст, файлы, изображения, аудио и видео — то есть большую часть того, чем компания реально обменивается внутри. Порядок расходов на типичных объёмах — сотни нейронов в месяц на процесс, а не тысячи.

Какие процессы модель закрывает в компании

Полезнее смотреть не на список умений модели, а на список мест, где у вас регулярно тратится человеческое время. Gemini 3.8 Flash хорошо ложится туда, где вход большой и разнородный, а на выходе нужен короткий понятный результат: решение, сводка, черновик, разметка. Ниже — раскладка по границе ответственности: что модель берёт на себя и что остаётся за человеком.

ПроцессЧто делает модельЧто остаётся человеку
Входящие обращения и письмаЧитает переписку целиком, определяет суть запроса, готовит черновик ответа и помечает, что срочноПроверить факты по клиенту, отправить или переписать под тон компании
Договоры и коммерческие документыРазбирает документ, вытаскивает сроки, суммы, ответственность, сравнивает с вашим типовым шаблономЮридическое решение и подпись. Модель показывает места для проверки, а не заменяет юриста
Совещания и созвоныПринимает аудио и видео на вход, делает расшифровку, протокол и список задач с owner'амиПодтвердить договорённости и поставить задачи в рабочем трекере
Регулярная отчётностьСобирает разрозненные выгрузки и таблицы в единую сводку с выводами и отклонениямиПроверить источники цифр и принять решение по отклонениям
Коммерческие предложенияГотовит структуру и текст под конкретного клиента на основе брифа и прошлых сделокЦена, условия, финальная редактура
Аналитика отзывов и переписокРазмечает массив сообщений по темам и причинам недовольства, выделяет повторяющиеся сюжетыРешение, что менять в продукте и процессе
Внутренняя база знаний и онбордингОтвечает новичкам по регламентам, которые вы загрузили в контекст, и переписывает устаревшие инструкцииАктуальность самих регламентов — модель отвечает по тому, что ей дали
Процесс → что делает модель → что остаётся человеку

Общий признак у всех строк: результат модели проверяем за минуты, а собрать его руками — от получаса. Там, где проверка занимает столько же, сколько работа, автоматизация не окупается — это отдельный критерий отбора процессов, независимый от выбора модели.

Промпт для разбора договора

Ты помогаешь юристу компании подготовить договор к рассмотрению.

1. Составь карточку сделки: предмет, стороны, сумма, срок действия, порядок оплаты.
2. Выпиши таблицей все обязанности с нашей стороны и сроки по ним.
3. Отдельно перечисли пункты, которые могут стоить нам денег: штрафы, пени, односторонний отказ, автопролонгация, ответственность без ограничения суммы.
4. Сравни с нашим типовым шаблоном (приложен) и покажи расхождения построчно.
5. В конце — пять вопросов, которые стоит задать контрагенту до подписания.

Не давай юридических заключений: твоя задача — показать места, требующие решения человека.

Договор: [приложите файл]

Чем это отличается от привычного чат-бота?

Тремя вещами, и все три видны в первый же рабочий день.

  • Объём входа. Контекст 1 048 576 токенов означает, что не нужно резать документы на куски и склеивать ответы — вся папка идёт в один разговор, и модель видит связи между документами.
  • Форматы. Файлы, изображения, аудио и видео на вход — это скан акта, фото полки в магазине, запись планёрки и ролик с площадки в одном окне. Отвечает модель текстом.
  • Глубина разбора. По данным Google, это её лучшая модель для рассуждений и кода; по публичным обзорам, на HLE-Verified — 54,9% на многошаговых рассуждениях в науке и профессиональных областях. На практике это про то, что модель не сдаётся на втором шаге сложного запроса.

Почему бесплатный тариф снимает барьер входа для команды

Главная проблема внедрения ИИ в компании — не цена и не техника, а то, что сотрудники не пробуют. Пока доступ надо согласовать, оплатить и раздать, любая инициатива умирает на этапе заявки. Уровень доступа BASIC означает, что Gemini 3.8 Flash видна на всех тарифах, включая бесплатный: вы заводите людей в чат, и они начинают работать в тот же день.

  • Не нужно заранее угадывать, кому именно ИИ пригодится, — пусть попробуют все, а бюджет вы направите туда, где сам собой пойдёт объём.
  • Отпадает спор «а вдруг не подойдёт»: гипотезу проверяют на своих документах, а не на демо-примерах из презентации.
  • Обучение получается практическим. Человек приносит на встречу не мнение о нейросетях, а конкретный сэкономленный час.
  • Переход на платный тариф становится осознанным: вы уже знаете, какие процессы дают отдачу и какой объём они съедают.

Как запустить пилот без бюджета?

  1. Выберите три процесса из таблицы выше, где регулярность выше, а цена ошибки ниже — обычно это сводки, разбор обращений и протоколы встреч.
  2. Дайте по одному владельцу на процесс и две недели срока. Один владелец — один измеримый результат.
  3. Заведите людей на бесплатном тарифе в my.suin.ai и выберите в чате «Google: Gemini 3.8 Flash».
  4. Замерьте до и после: сколько времени уходило на процесс раньше и сколько уходит теперь вместе с проверкой.
  5. Через две недели посмотрите расход нейронов по каждому процессу и решите, что масштабировать на платном тарифе.

Промпт для разбора входящих обращений

Ты помогаешь отделу клиентского сервиса. Ниже — переписка с клиентом.

1. Сформулируй суть запроса одним предложением.
2. Определи срочность: критично / обычно / можно отложить, и объясни почему.
3. Вытащи все обещания и сроки, которые мы уже дали клиенту.
4. Подготовь черновик ответа: спокойный деловой тон, без извинений-заклинаний, с конкретным следующим шагом и датой.
5. Отдельным списком укажи, что нужно проверить человеку перед отправкой.

Переписка:
[вставьте текст или приложите файл]

Экономика: считаем в нейронах

Расход складывается из двух частей: сколько текста вы отправили модели и сколько она написала в ответ. Выход почти в пять раз дороже входа, поэтому дешевле всего процессы, где вход большой, а ответ короткий, — сводки, классификация, извлечение полей. И наоборот: длинные генерации текста стоят заметно дороже при том же исходном материале.

МодельВход / выход, нейронов за млн токеновДоступПод какие задачи
Gemini 3.8 Flash113 / 563BASIC — все тарифы, включая бесплатныйСложный разбор, многошаговые задачи, длинные документы, аудио и видео
Gemini 3.7 Flash113 / 563BASIC — все тарифыМассовая рутина, где важна скорость первого ответа
Gemini 3.5 Flash-Lite48 / 400BASIC — все тарифыКороткие однотипные операции в большом объёме
Gemini 3.1 Pro Preview250 / 1500STANDARD — с тарифа СтартКогда нужен другой профиль ответов на тех же данных
Цены семейства Gemini в каталоге СуперИнтеллекта

Отдельно про главный практический нюанс. Цена за токен у 3.8 Flash та же, что у 3.7 Flash, но сама задача обходится дороже: по публичным подсчётам примерно на 40% — модель «работает усерднее», делает больше шагов рассуждения и чаще обращается к инструментам. Практический вывод простой: на многошаговых задачах закладывайте расход примерно в полтора раза выше расчётного по таблице ниже.

Процесс за месяцОбъём токеновПорядок расходов
200 входящих обращений: разбор + черновик ответа0,4 млн входа, 0,1 млн выходаоколо 100 нейронов
50 договоров по ~30 000 токенов: разбор и карточка рисков1,5 млн входа, 0,1 млн выходаоколо 230 нейронов
1000 коротких классификаций сообщений0,8 млн входа, 0,1 млн выходаоколо 150 нейронов
Многошаговая задача с несколькими проходамитот же объём плюс дополнительные шаги рассужденияумножайте расчёт примерно на 1,4
Порядок расходов на типичных месячных объёмах

Цифры в таблице — арифметика по тарифу 113 и 563 нейрона за миллион токенов, а не замер. Ваши объёмы будут другими, но порядок величины сохранится: типичный процесс среднего отдела — это сотни нейронов в месяц. Расшифровку аудио и видео так точно не посчитать заранее: вход считается по длительности записи, поэтому прогоните одну реальную встречу и умножайте на их количество.

Где 3.8 Flash невыгодна?

Честный ответ: на короткой массовой рутине. Если задача — размечать тысячи однотипных сообщений или вытаскивать три поля из шаблонного бланка, глубина рассуждения не нужна, а платите вы именно за неё.

  • Однотипная классификация в объёме — берите Gemini 3.5 Flash-Lite: 48 и 400 нейронов против 113 и 563. На входном объёме это более чем вдвое дешевле, на выходном — примерно в полтора раза.
  • Короткие ответы, где важна скорость реакции, — Gemini 3.7 Flash стоит столько же за токен, но тратит на задачу меньше шагов.
  • Простое переписывание и форматирование текста — разницы в качестве вы не увидите, а разницу в расходе увидите.
  • Сложный разбор, длинные документы, многошаговые сценарии, аудио и видео — вот здесь 3.8 Flash окупает каждый нейрон.

Что показывают публичные замеры

Модель вышла 2 сентября 2026 года, через три недели после 3.7 Flash. Вместе с ней Google выпустила отдельный вариант 3.8 Flash Cyber для проверенных специалистов по кибербезопасности в рамках программы Fairwind — в каталоге СуперИнтеллекта этого варианта нет. По публичным обзорам картина такая:

  • Intelligence Index — 59 в режиме высокого рассуждения: на три пункта выше 3.7 Flash, столько же у GPT-5.6 Sol и Grok 4.6. Выше только Claude Fable 5.1 (66), Claude Opus 5 (63), Grok 4.6 high (61) и GPT-5.6 Sol max (61).
  • HLE-Verified — 54,9% на многошаговых рассуждениях в науке и профессиональных областях.
  • DeepSWE v1.1 — обходит большинство более крупных флагманов в автономном решении инженерных задач при доле их стоимости.
  • Vals Finance Agent V2 и Harvey's Legal Agent Benchmark — результат выше, чем у 3.7 Flash. Это ровно те области, где бизнес чаще всего и просит помощи: финансовые и юридические документы.
  • Стоимость средней задачи — около $0,58 по публичным подсчётам, самая низкая среди моделей такого уровня; у Claude Fable 5.1 около $3,76. Это внешние оценки в долларах, к расчёту в нейронах на нашей платформе они отношения не имеют.

Ещё две вещи, о которых стоит знать заранее. Знания модели ограничены мартом 2026 года по части областей и январём 2025 по остальным — свежие изменения в законах, ценах и вашей внутренней политике нужно давать в контексте, а не рассчитывать, что модель их знает. И цена у самой Google, $0,75 за миллион входных и $3,75 за миллион выходных токенов, объявлена как вводная до 31 декабря, после чего удваивается (по данным Google).

Как выбрать модель под процесс

В чате СуперИнтеллекта нет переключателей уровня рассуждения и прочих параметров API — вы выбираете модель, и всё. Это упрощает решение: вместо настройки крутилок вы просто ставите под процесс подходящую модель из каталога.

Когда процесс перестаёт быть разовым и превращается в конвейер — разбор почты каждое утро, сводка по продажам каждый понедельник, — его стоит переносить из чата в ИИ-агентов: там сценарий выполняется сам, а вы получаете результат. Логика выбора модели при этом не меняется.

Частые вопросы

Правда ли модель доступна на бесплатном тарифе?

Да. Уровень доступа BASIC означает все тарифы, включая бесплатный. Ограничение — не в доступе к модели, а в количестве нейронов на балансе: они расходуются по цене 113 за миллион входных и 563 за миллион выходных токенов. Для пилота на трёх процессах этого обычно хватает, чтобы понять отдачу до первой оплаты.

Почему при той же цене за токен счёт получается больше?

Потому что платите вы не за задачу, а за токены, а 3.8 Flash тратит их больше: делает дополнительные шаги рассуждения и чаще обращается к инструментам. По публичным подсчётам средняя задача выходит примерно на 40% дороже, чем у 3.7 Flash. Если вам нужен именно этот более глубокий разбор — вы за него и платите; если нет — выбирайте модель попроще.

Можно ли загружать в модель договоры и записи совещаний?

Технически да: на вход принимаются файлы, изображения, аудио и видео, а контекст в 1 048 576 токенов позволяет не резать документы на куски. Организационно решение за вами: прежде чем заводить в ИИ персональные данные клиентов и коммерческую тайну, зафиксируйте внутреннее правило, какие категории документов можно загружать, а какие нет.

С чего начать, если в компании ИИ ещё никто не использует?

С одного процесса, который повторяется каждую неделю и не связан с деньгами напрямую: сводка по обращениям, протокол планёрки, черновики ответов. Дайте его одному человеку на две недели с задачей замерить сэкономленное время. Дальше решение принимается по цифрам, а не по впечатлению от демонстрации.

Что если через месяц выйдет модель лучше?

Ничего страшного — процесс переживает модель. Если у вас описан сценарий, промпт и критерий приёмки результата, смена модели в чате занимает секунды, а сравнить две модели на своей задаче можно за один прогон. Именно поэтому вкладываться стоит в описание процессов, а не в привязку к конкретному названию.


Ещё про Gemini 3.8 Flash