Gemini 3.8 Flash понимает аудио и видео напрямую: вы прикладываете запись созвона или ролик прямо в чат и сразу получаете конспект, задачи или цитаты — промежуточная расшифровка не нужна. Модель добавлена в каталог СуперИнтеллекта 3 сентября 2026 года, у неё уровень доступа BASIC — то есть она работает на всех тарифах, включая бесплатный. Контекст 1 048 576 токенов, цена 113 нейронов за миллион входных токенов и 563 за миллион выходных. На вход идут текст, изображения, файлы, аудио и видео; отвечает модель текстом.
Один шаг вместо двух
Привычный маршрут работы с записями состоит из двух половин: сначала запись прогоняют через сервис расшифровки и получают простыню текста, потом эту простыню отдают языковой модели и просят конспект, задачи, цитаты. Между половинами теряется то, чего в тексте просто нет: кто именно говорил, каким тоном, что было на экране, где человек замялся, а где показал слайд с цифрой. Gemini 3.8 Flash убирает этот шов — модель слушает звук и смотрит кадр сама, поэтому просить можно сразу результат, а не сырьё: не нужно чистить расшифровку от «эээ», расставлять спикеров и переклеивать куски перед тем, как задать вопрос по существу.
| Что сравниваем | Расшифровка отдельно, потом обработка текста | Запись сразу в Gemini 3.8 Flash |
|---|---|---|
| Число шагов | Два инструмента, два экспорта, склейка вручную | Один запрос: файл плюс задача |
| Кто говорил | Зависит от разделения спикеров в сервисе расшифровки | Пометку спикеров нужно запросить явно; имена надёжнее дать списком в том же сообщении |
| Что было на экране | Теряется полностью | Доступны слайды, подписи, графика, демонстрация экрана |
| Интонация и заминки | Стирается при переводе в текст | Можно попросить отметить, где собеседник сомневался |
| Дословность | Высокая: это прямая задача сервиса | Ниже, если не попросить дословно — модель склонна пересказывать |
| Когда лучше | Нужен точный протокол слово в слово, субтитры, тайм-коды под монтаж | Нужен смысл: решения, задачи, цитаты, конспект, разбор ролика |
Что модель улавливает в записи, чего нет в расшифровке?
Разница особенно заметна на видео. Модель получает не только звуковую дорожку, но и кадр, поэтому из ролика можно вытянуть то, чего в текстовой расшифровке нет в принципе.
- Подписи на экране: имя и должность спикера из плашки, название компании, заголовок слайда — попросите выписать их отдельным списком.
- Цифры и схемы с презентации — их можно попросить перенести в таблицу.
- Демонстрация экрана: какой раздел интерфейса показывали, куда нажимали.
- Кто из участников говорит в конкретный момент, если человек в кадре.
- Смена темы по визуальному признаку — новый слайд, новая сцена, новый герой.
Отсюда простое правило: если в записи есть картинка, отдавайте видео целиком, а не вытащенную из него дорожку. Звук вы не потеряете, а контекста станет заметно больше.
Что приложить, что попросить, что получите
Самая частая ошибка — приложить часовую запись и написать «сделай саммари». Модель сделает, но общими словами. Работает связка «файл + формат результата»: чем точнее описан нужный документ на выходе, тем меньше правок потом.
| Что прикладываете | О чём просите | Что получаете на выходе |
|---|---|---|
| Запись планёрки | Решения, задачи, ответственные, сроки | Таблица задач, готовая к переносу в трекер |
| Интервью с экспертом | Дословные цитаты по темам с тайм-кодами | Заготовка статьи: блоки цитат, к каждому — тема |
| Запись вебинара | Конспект по разделам плюс список тезисов для поста | Структурированный конспект и черновик анонса |
| Звонок с клиентом | Возражения, договорённости, следующий шаг | Карточка сделки: боли, обещания, дедлайн |
| Рекламный ролик | Раскадровка по сценам, посыл, что в кадре и в звуке | Разбор сцена за сценой с выводами по коммуникации |
| Скринкаст или демо продукта | Пошаговая инструкция по тому, что показали | Черновик документации со списком шагов |
| Лекция или подкаст | Тезисы, термины, вопросы для проверки понимания | Учебная выжимка с глоссарием |
Сколько стоит разбор записи?
Цена в СуперИнтеллекте считается в нейронах и зависит от объёма входа и выхода. Для записей вход почти всегда тяжелее выхода: длинный файл против одностраничного конспекта. Точную цифру за час записи заранее назвать нельзя — она зависит от длины, формата и того, насколько подробный ответ вы просите. Ориентироваться проще по ставкам линейки: ниже — актуальные цены в каталоге, чтобы было с чем сравнивать.
| Модель | Вход, нейронов за 1 млн токенов | Выход, нейронов за 1 млн токенов | Доступ |
|---|---|---|---|
| Gemini 3.8 Flash | 113 | 563 | BASIC — все тарифы, включая бесплатный |
| Gemini 3.7 Flash | 113 | 563 | BASIC — все тарифы, включая бесплатный |
| Gemini 3.5 Flash-Lite | 48 | 400 | BASIC — все тарифы, включая бесплатный |
| Gemini 3.1 Pro Preview | 250 | 1500 | STANDARD — с тарифа Старт |
Отдельно — внешние, долларовые данные. Они приведены только для сравнения моделей между собой, в нейроны не пересчитываются и на списание в СуперИнтеллекте не влияют. У Google вводная цена 3.8 Flash — $0,75 за миллион входных и $3,75 за миллион выходных токенов; она действует до 31 декабря, после чего удваивается. По публичным подсчётам, ставка за токен у 3.8 Flash та же, что у 3.7, но сама задача выходит примерно на 40% дороже: модель работает усерднее, делает больше шагов рассуждения и чаще обращается к инструментам. При этом средняя задача обходится около $0,58 — самая низкая цена среди моделей такого уровня; у Claude Fable 5.1, по тем же подсчётам, около $3,76.
Вывод для работы с записями простой. Если задача рутинная — распустить планёрку на задачи, собрать конспект вебинара — берите модель полегче и экономьте. Если запись сложная, спикеров много, а на кону смысл разговора с клиентом, разница в нейронах окупается качеством разбора. Подробнее про выбор внутри линейки — в материале какую Gemini Flash выбрать.
Шесть промптов под реальные записи
Прикладывайте файл в том же сообщении, где текст запроса. Тайм-коды модель ставит, когда об этом сказано прямо, поэтому в промптах ниже они запрошены явно — полезно сразу указать, к чему привязывать метку: к началу реплики, к смене темы или к моменту на экране. Формулировки можно копировать целиком и менять только названия ролей и продуктов.
Планёрка → список задач
Это запись рабочей планёрки. Разбери её и верни три блока.
1. Решения: что команда решила окончательно. Каждое решение — одной строкой.
2. Задачи: таблица со столбцами «Задача», «Ответственный», «Срок», «Откуда взял (тайм-код)». Если ответственный или срок не назывались — так и напиши «не назван», не додумывай.
3. Открытые вопросы: что обсудили, но ни к чему не пришли.
Имена участников бери из того, как они представляются и как их называют коллеги. Пустых пунктов не добавляй.Интервью → цитаты для статьи
Это запись интервью. Мне нужны дословные цитаты, а не пересказ.
Сгруппируй разговор по темам. Внутри каждой темы дай 2–4 цитаты собеседника ДОСЛОВНО, с тайм-кодом начала фразы. Убери слова-паразиты и повторы, но не меняй смысл и лексику.
После цитат добавь блок «Что осталось за кадром»: на какие вопросы собеседник ответил уклончиво или ушёл от темы.
В конце — 5 вариантов заголовка для статьи, каждый основан на конкретной цитате.Вебинар → конспект и анонс
Это запись вебинара. Сделай два документа.
Первый — конспект: раздели на смысловые разделы, у каждого заголовок и 3–5 тезисов. Если на слайдах были цифры, схемы или названия инструментов — вынеси их отдельным списком «Со слайдов».
Второй — черновик поста-анонса на 1200 знаков: чем полезно, три главных вывода, для кого запись.
Отдельно укажи тайм-коды моментов, которые стоит вырезать в короткие клипы, и объясни, чем каждый цепляет.Рекламный ролик → разбор сцена за сценой
Это рекламный ролик. Разбери его как маркетолог.
1. Раскадровка: таблица со столбцами «Тайм-код», «Что в кадре», «Что в звуке», «Какую мысль продаёт сцена».
2. Структура: где крючок, где обещание, где доказательство, где призыв. Отметь, если какого-то элемента нет.
3. Кому адресован ролик: по визуальным и речевым признакам, с обоснованием.
4. Три слабых места и что конкретно изменить в каждом.
Оценки без опоры на кадр не давай — на каждый вывод указывай тайм-код.Звонок с клиентом → карточка сделки
Это запись звонка с клиентом. Собери карточку сделки.
— Задача клиента своими словами (как он сам её формулирует).
— Боли и ограничения: бюджет, сроки, люди, прошлый негативный опыт.
— Возражения: цитата возражения и как менеджер на него ответил.
— Что мы пообещали: список обязательств с тайм-кодами.
— Следующий шаг: что, кто и когда.
— Риски: где по интонации и формулировкам клиент звучал неуверенно.
Если чего-то в разговоре не прозвучало, пиши «не обсуждалось».Демо продукта → черновик инструкции
Это запись демонстрации экрана. Преврати её в инструкцию.
Выпиши последовательность шагов: что открывали, куда нажимали, что вводили, что появилось в результате. Названия кнопок и разделов бери с экрана дословно.
Формат: нумерованный список, у каждого шага — тайм-код. Отдельно вынеси блок «Подводные камни»: моменты, где ведущий оговорился «здесь обычно ошибаются» или что-то пошло не так.Почему модель перевирает имена и термины?
Это общая беда любой автоматической расшифровки: имена собственные и редкие термины страдают сильнее всего, когда опора только на звук — акцент, шум, быстрая речь, и фамилия превращается в похожее по звучанию слово. Лечится дёшево: в том же сообщении дайте список участников, названия продуктов и профессиональные термины, которые встретятся. Модель будет сверяться со списком вместо того, чтобы угадывать. На видео помогает и картинка: подписи на экране и титры дают правильное написание сами.
Что делать с записью на три часа?
Контекст в 1 048 576 токенов позволяет отдать очень длинную запись целиком, но у длины есть цена — внимание модели размывается, и середина разговора проработана слабее краёв. Рабочая тактика: сначала попросить общую карту записи с тайм-кодами разделов, потом отдельными запросами разбирать интересные куски. Так вы получите и общую картину, и глубину там, где она нужна, не переплачивая за детальный разбор трёх часов болтовни.
Когда стоит взять специализированную расшифровку
Честная граница проходит по слову «дословно». Универсальная модель сильна в смысле: она понимает, о чём был разговор, и приводит выводы. Специализированные сервисы расшифровки сильны в букве: они бьют запись на реплики, проставляют тайм-код к каждой, разделяют спикеров как отдельную техническую задачу и отдают файл субтитров. Развёрнуто варианты мы сравнили в материале сравнение моделей расшифровки аудио в текст.
- Нужен протокол слово в слово для юридической или кадровой процедуры — берите специализированную расшифровку.
- Нужны субтитры под монтаж, с тайм-кодом на каждую реплику, — тоже.
- Нужен смысл: решения, задачи, цитаты, конспект, разбор ролика — быстрее и дешевле сделать одним запросом в чате.
- Нужно и то и другое — расшифруйте специализированным сервисом, а разбор текста доверьте модели.
Чем 3.8 Flash отличается от предшественницы на записях
По данным Google, модель вышла 2 сентября 2026 года, через три недели после 3.7 Flash, и компания называет её своей лучшей моделью для рассуждений и кода. Вместе с ней вышел вариант 3.8 Flash Cyber для проверенных специалистов по кибербезопасности в рамках программы Fairwind — в нашем каталоге его нет. По публичным обзорам, Intelligence Index у 3.8 Flash — 59 в режиме высокого рассуждения, на три пункта выше 3.7 Flash и столько же у GPT-5.6 Sol и Grok 4.6; выше только Claude Fable 5.1 (66), Claude Opus 5 (63), Grok 4.6 high (61) и GPT-5.6 Sol max (61). На HLE-Verified — 54,9% на многошаговых рассуждениях в науке и профессиональных областях.
- На простой расшифровке разницы почти не видно — там всё решает качество звука.
- Разница проявляется, когда от записи нужны выводы: связать реплики из разных мест, поймать противоречие, вытащить смысл из недосказанного.
- На агентских сценариях, по публичным данным, модель обходит большинство более крупных флагманов: по DeepSWE v1.1 она решает инженерные задачи автономно при доле их стоимости, а по Vals Finance Agent V2 и Harvey's Legal Agent Benchmark результат выше, чем у 3.7 Flash.
- Знания модели — март 2026 по части областей и январь 2025 по остальным. На разбор ваших записей это не влияет, но свежие факты о рынке лучше давать прямо в запросе.
Частые вопросы
Модель доступна на бесплатном тарифе?
Да. У Gemini 3.8 Flash уровень доступа BASIC — она работает на всех тарифах СуперИнтеллекта, включая бесплатный. Списываются только нейроны за объём: 113 за миллион входных токенов и 563 за миллион выходных. Тарифы и объёмы нейронов — на странице тарифов.
Нужен ли отдельный сервис транскрибации?
Для большинства рабочих задач — нет. Gemini 3.8 Flash принимает аудио и видео как обычные вложения, поэтому запись отправляется прямо в чат и разбирается за один запрос. Отдельный сервис оправдан, когда нужен дословный протокол или файл субтитров с тайм-кодом на каждую реплику.
Что выбрать, если записей очень много?
На потоке однотипных задач — коротких планёрок, звонков по скрипту — разумно взять более дешёвую модель линейки: Gemini 3.5 Flash-Lite стоит 48 нейронов за миллион входных токенов и 400 за миллион выходных, тоже с доступом BASIC. Сложные разговоры и видео с разбором смысла оставьте 3.8 Flash. Если поток регулярный, поставьте разбор на ИИ-агента, чтобы записи обрабатывались по одному сценарию без ручных запросов.
Чем 3.8 Flash отличается от 3.7 Flash по цене?
По прайсу — ничем: обе стоят 113 нейронов за миллион входных токенов и 563 за миллион выходных, обе с доступом BASIC. Разница в поведении: по публичным подсчётам, 3.8 Flash тратит на задачу примерно на 40% больше, потому что делает больше шагов рассуждения. Развёрнутое сравнение — в материале 3.8 Flash против 3.7 Flash.





