Gemini 3.8 Flash понимает аудио и видео напрямую: вы прикладываете запись созвона или ролик прямо в чат и сразу получаете конспект, задачи или цитаты — промежуточная расшифровка не нужна. Модель добавлена в каталог СуперИнтеллекта 3 сентября 2026 года, у неё уровень доступа BASIC — то есть она работает на всех тарифах, включая бесплатный. Контекст 1 048 576 токенов, цена 113 нейронов за миллион входных токенов и 563 за миллион выходных. На вход идут текст, изображения, файлы, аудио и видео; отвечает модель текстом.

Один шаг вместо двух

Привычный маршрут работы с записями состоит из двух половин: сначала запись прогоняют через сервис расшифровки и получают простыню текста, потом эту простыню отдают языковой модели и просят конспект, задачи, цитаты. Между половинами теряется то, чего в тексте просто нет: кто именно говорил, каким тоном, что было на экране, где человек замялся, а где показал слайд с цифрой. Gemini 3.8 Flash убирает этот шов — модель слушает звук и смотрит кадр сама, поэтому просить можно сразу результат, а не сырьё: не нужно чистить расшифровку от «эээ», расставлять спикеров и переклеивать куски перед тем, как задать вопрос по существу.

Что сравниваемРасшифровка отдельно, потом обработка текстаЗапись сразу в Gemini 3.8 Flash
Число шаговДва инструмента, два экспорта, склейка вручнуюОдин запрос: файл плюс задача
Кто говорилЗависит от разделения спикеров в сервисе расшифровкиПометку спикеров нужно запросить явно; имена надёжнее дать списком в том же сообщении
Что было на экранеТеряется полностьюДоступны слайды, подписи, графика, демонстрация экрана
Интонация и заминкиСтирается при переводе в текстМожно попросить отметить, где собеседник сомневался
ДословностьВысокая: это прямая задача сервисаНиже, если не попросить дословно — модель склонна пересказывать
Когда лучшеНужен точный протокол слово в слово, субтитры, тайм-коды под монтажНужен смысл: решения, задачи, цитаты, конспект, разбор ролика
Два маршрута до готового текста

Что модель улавливает в записи, чего нет в расшифровке?

Разница особенно заметна на видео. Модель получает не только звуковую дорожку, но и кадр, поэтому из ролика можно вытянуть то, чего в текстовой расшифровке нет в принципе.

  • Подписи на экране: имя и должность спикера из плашки, название компании, заголовок слайда — попросите выписать их отдельным списком.
  • Цифры и схемы с презентации — их можно попросить перенести в таблицу.
  • Демонстрация экрана: какой раздел интерфейса показывали, куда нажимали.
  • Кто из участников говорит в конкретный момент, если человек в кадре.
  • Смена темы по визуальному признаку — новый слайд, новая сцена, новый герой.

Отсюда простое правило: если в записи есть картинка, отдавайте видео целиком, а не вытащенную из него дорожку. Звук вы не потеряете, а контекста станет заметно больше.

Что приложить, что попросить, что получите

Самая частая ошибка — приложить часовую запись и написать «сделай саммари». Модель сделает, но общими словами. Работает связка «файл + формат результата»: чем точнее описан нужный документ на выходе, тем меньше правок потом.

Что прикладываетеО чём проситеЧто получаете на выходе
Запись планёркиРешения, задачи, ответственные, срокиТаблица задач, готовая к переносу в трекер
Интервью с экспертомДословные цитаты по темам с тайм-кодамиЗаготовка статьи: блоки цитат, к каждому — тема
Запись вебинараКонспект по разделам плюс список тезисов для постаСтруктурированный конспект и черновик анонса
Звонок с клиентомВозражения, договорённости, следующий шагКарточка сделки: боли, обещания, дедлайн
Рекламный роликРаскадровка по сценам, посыл, что в кадре и в звукеРазбор сцена за сценой с выводами по коммуникации
Скринкаст или демо продуктаПошаговая инструкция по тому, что показалиЧерновик документации со списком шагов
Лекция или подкастТезисы, термины, вопросы для проверки пониманияУчебная выжимка с глоссарием
Связка «файл → запрос → результат»

Сколько стоит разбор записи?

Цена в СуперИнтеллекте считается в нейронах и зависит от объёма входа и выхода. Для записей вход почти всегда тяжелее выхода: длинный файл против одностраничного конспекта. Точную цифру за час записи заранее назвать нельзя — она зависит от длины, формата и того, насколько подробный ответ вы просите. Ориентироваться проще по ставкам линейки: ниже — актуальные цены в каталоге, чтобы было с чем сравнивать.

МодельВход, нейронов за 1 млн токеновВыход, нейронов за 1 млн токеновДоступ
Gemini 3.8 Flash113563BASIC — все тарифы, включая бесплатный
Gemini 3.7 Flash113563BASIC — все тарифы, включая бесплатный
Gemini 3.5 Flash-Lite48400BASIC — все тарифы, включая бесплатный
Gemini 3.1 Pro Preview2501500STANDARD — с тарифа Старт
Цены на Gemini в каталоге СуперИнтеллекта, в нейронах

Отдельно — внешние, долларовые данные. Они приведены только для сравнения моделей между собой, в нейроны не пересчитываются и на списание в СуперИнтеллекте не влияют. У Google вводная цена 3.8 Flash — $0,75 за миллион входных и $3,75 за миллион выходных токенов; она действует до 31 декабря, после чего удваивается. По публичным подсчётам, ставка за токен у 3.8 Flash та же, что у 3.7, но сама задача выходит примерно на 40% дороже: модель работает усерднее, делает больше шагов рассуждения и чаще обращается к инструментам. При этом средняя задача обходится около $0,58 — самая низкая цена среди моделей такого уровня; у Claude Fable 5.1, по тем же подсчётам, около $3,76.

Вывод для работы с записями простой. Если задача рутинная — распустить планёрку на задачи, собрать конспект вебинара — берите модель полегче и экономьте. Если запись сложная, спикеров много, а на кону смысл разговора с клиентом, разница в нейронах окупается качеством разбора. Подробнее про выбор внутри линейки — в материале какую Gemini Flash выбрать.

Шесть промптов под реальные записи

Прикладывайте файл в том же сообщении, где текст запроса. Тайм-коды модель ставит, когда об этом сказано прямо, поэтому в промптах ниже они запрошены явно — полезно сразу указать, к чему привязывать метку: к началу реплики, к смене темы или к моменту на экране. Формулировки можно копировать целиком и менять только названия ролей и продуктов.

Планёрка → список задач

Это запись рабочей планёрки. Разбери её и верни три блока.

1. Решения: что команда решила окончательно. Каждое решение — одной строкой.
2. Задачи: таблица со столбцами «Задача», «Ответственный», «Срок», «Откуда взял (тайм-код)». Если ответственный или срок не назывались — так и напиши «не назван», не додумывай.
3. Открытые вопросы: что обсудили, но ни к чему не пришли.

Имена участников бери из того, как они представляются и как их называют коллеги. Пустых пунктов не добавляй.

Интервью → цитаты для статьи

Это запись интервью. Мне нужны дословные цитаты, а не пересказ.

Сгруппируй разговор по темам. Внутри каждой темы дай 2–4 цитаты собеседника ДОСЛОВНО, с тайм-кодом начала фразы. Убери слова-паразиты и повторы, но не меняй смысл и лексику.

После цитат добавь блок «Что осталось за кадром»: на какие вопросы собеседник ответил уклончиво или ушёл от темы.

В конце — 5 вариантов заголовка для статьи, каждый основан на конкретной цитате.

Вебинар → конспект и анонс

Это запись вебинара. Сделай два документа.

Первый — конспект: раздели на смысловые разделы, у каждого заголовок и 3–5 тезисов. Если на слайдах были цифры, схемы или названия инструментов — вынеси их отдельным списком «Со слайдов».

Второй — черновик поста-анонса на 1200 знаков: чем полезно, три главных вывода, для кого запись.

Отдельно укажи тайм-коды моментов, которые стоит вырезать в короткие клипы, и объясни, чем каждый цепляет.

Рекламный ролик → разбор сцена за сценой

Это рекламный ролик. Разбери его как маркетолог.

1. Раскадровка: таблица со столбцами «Тайм-код», «Что в кадре», «Что в звуке», «Какую мысль продаёт сцена».
2. Структура: где крючок, где обещание, где доказательство, где призыв. Отметь, если какого-то элемента нет.
3. Кому адресован ролик: по визуальным и речевым признакам, с обоснованием.
4. Три слабых места и что конкретно изменить в каждом.

Оценки без опоры на кадр не давай — на каждый вывод указывай тайм-код.

Звонок с клиентом → карточка сделки

Это запись звонка с клиентом. Собери карточку сделки.

— Задача клиента своими словами (как он сам её формулирует).
— Боли и ограничения: бюджет, сроки, люди, прошлый негативный опыт.
— Возражения: цитата возражения и как менеджер на него ответил.
— Что мы пообещали: список обязательств с тайм-кодами.
— Следующий шаг: что, кто и когда.
— Риски: где по интонации и формулировкам клиент звучал неуверенно.

Если чего-то в разговоре не прозвучало, пиши «не обсуждалось».

Демо продукта → черновик инструкции

Это запись демонстрации экрана. Преврати её в инструкцию.

Выпиши последовательность шагов: что открывали, куда нажимали, что вводили, что появилось в результате. Названия кнопок и разделов бери с экрана дословно.

Формат: нумерованный список, у каждого шага — тайм-код. Отдельно вынеси блок «Подводные камни»: моменты, где ведущий оговорился «здесь обычно ошибаются» или что-то пошло не так.

Почему модель перевирает имена и термины?

Это общая беда любой автоматической расшифровки: имена собственные и редкие термины страдают сильнее всего, когда опора только на звук — акцент, шум, быстрая речь, и фамилия превращается в похожее по звучанию слово. Лечится дёшево: в том же сообщении дайте список участников, названия продуктов и профессиональные термины, которые встретятся. Модель будет сверяться со списком вместо того, чтобы угадывать. На видео помогает и картинка: подписи на экране и титры дают правильное написание сами.

Что делать с записью на три часа?

Контекст в 1 048 576 токенов позволяет отдать очень длинную запись целиком, но у длины есть цена — внимание модели размывается, и середина разговора проработана слабее краёв. Рабочая тактика: сначала попросить общую карту записи с тайм-кодами разделов, потом отдельными запросами разбирать интересные куски. Так вы получите и общую картину, и глубину там, где она нужна, не переплачивая за детальный разбор трёх часов болтовни.

Когда стоит взять специализированную расшифровку

Честная граница проходит по слову «дословно». Универсальная модель сильна в смысле: она понимает, о чём был разговор, и приводит выводы. Специализированные сервисы расшифровки сильны в букве: они бьют запись на реплики, проставляют тайм-код к каждой, разделяют спикеров как отдельную техническую задачу и отдают файл субтитров. Развёрнуто варианты мы сравнили в материале сравнение моделей расшифровки аудио в текст.

  • Нужен протокол слово в слово для юридической или кадровой процедуры — берите специализированную расшифровку.
  • Нужны субтитры под монтаж, с тайм-кодом на каждую реплику, — тоже.
  • Нужен смысл: решения, задачи, цитаты, конспект, разбор ролика — быстрее и дешевле сделать одним запросом в чате.
  • Нужно и то и другое — расшифруйте специализированным сервисом, а разбор текста доверьте модели.

Чем 3.8 Flash отличается от предшественницы на записях

По данным Google, модель вышла 2 сентября 2026 года, через три недели после 3.7 Flash, и компания называет её своей лучшей моделью для рассуждений и кода. Вместе с ней вышел вариант 3.8 Flash Cyber для проверенных специалистов по кибербезопасности в рамках программы Fairwind — в нашем каталоге его нет. По публичным обзорам, Intelligence Index у 3.8 Flash — 59 в режиме высокого рассуждения, на три пункта выше 3.7 Flash и столько же у GPT-5.6 Sol и Grok 4.6; выше только Claude Fable 5.1 (66), Claude Opus 5 (63), Grok 4.6 high (61) и GPT-5.6 Sol max (61). На HLE-Verified — 54,9% на многошаговых рассуждениях в науке и профессиональных областях.

  • На простой расшифровке разницы почти не видно — там всё решает качество звука.
  • Разница проявляется, когда от записи нужны выводы: связать реплики из разных мест, поймать противоречие, вытащить смысл из недосказанного.
  • На агентских сценариях, по публичным данным, модель обходит большинство более крупных флагманов: по DeepSWE v1.1 она решает инженерные задачи автономно при доле их стоимости, а по Vals Finance Agent V2 и Harvey's Legal Agent Benchmark результат выше, чем у 3.7 Flash.
  • Знания модели — март 2026 по части областей и январь 2025 по остальным. На разбор ваших записей это не влияет, но свежие факты о рынке лучше давать прямо в запросе.

Частые вопросы

Модель доступна на бесплатном тарифе?

Да. У Gemini 3.8 Flash уровень доступа BASIC — она работает на всех тарифах СуперИнтеллекта, включая бесплатный. Списываются только нейроны за объём: 113 за миллион входных токенов и 563 за миллион выходных. Тарифы и объёмы нейронов — на странице тарифов.

Нужен ли отдельный сервис транскрибации?

Для большинства рабочих задач — нет. Gemini 3.8 Flash принимает аудио и видео как обычные вложения, поэтому запись отправляется прямо в чат и разбирается за один запрос. Отдельный сервис оправдан, когда нужен дословный протокол или файл субтитров с тайм-кодом на каждую реплику.

Что выбрать, если записей очень много?

На потоке однотипных задач — коротких планёрок, звонков по скрипту — разумно взять более дешёвую модель линейки: Gemini 3.5 Flash-Lite стоит 48 нейронов за миллион входных токенов и 400 за миллион выходных, тоже с доступом BASIC. Сложные разговоры и видео с разбором смысла оставьте 3.8 Flash. Если поток регулярный, поставьте разбор на ИИ-агента, чтобы записи обрабатывались по одному сценарию без ручных запросов.

Чем 3.8 Flash отличается от 3.7 Flash по цене?

По прайсу — ничем: обе стоят 113 нейронов за миллион входных токенов и 563 за миллион выходных, обе с доступом BASIC. Разница в поведении: по публичным подсчётам, 3.8 Flash тратит на задачу примерно на 40% больше, потому что делает больше шагов рассуждения. Развёрнутое сравнение — в материале 3.8 Flash против 3.7 Flash.

Ещё про Gemini 3.8 Flash