Чаще всего Gemini 3.8 Flash разочаровывает не потому, что слабая, а потому что её просят не о том и не так. В каталоге СуперИнтеллекта это «Google: Gemini 3.8 Flash» с уровнем доступа BASIC — она открыта на всех тарифах, включая бесплатный, стоит 113 нейронов за миллион входных токенов и 563 за миллион выходных, держит контекст в 1 048 576 токенов и принимает на вход текст, изображения, файлы, аудио и видео, а отвечает текстом. Ниже — семь ошибок, из-за которых всё это не превращается в нужный результат, и к каждой готовая формулировка-исправление.

Почему сильная модель даёт слабый ответ

Все семь ошибок ниже — про одно и то же: 3.8 Flash ведёт себя как модель, которая старается. По описанию Google она делает больше шагов рассуждения и чаще обращается к инструментам, чем предыдущая версия. Там, где задача этого стоит, вы получаете результат высокого класса. Там, где не стоит, вы платите за усердие и получаете стену текста вместо короткого ответа. Дальше — как развернуть эту черту в свою пользу.

ОшибкаКак проявляетсяЧто сделать
Брать 3.8 на короткую рутинуОтвет не лучше, а расход вышеОтдать рутину 3.5 Flash-Lite или 3.7 Flash
Не задавать форматСвязный текст вместо таблицы или спискаОписать формат прямо в запросе
Класть документ целикомМодель отвечает «в среднем» по файлуРезать на смысловые разделы и обрабатывать по одному
Не просить цитатПересказ, который не проверитьТребовать дословные цитаты и метку «нет в источнике»
Продолжать старый чатМодель тянет отменённые правкиНачать новый чат с коротким ТЗ
Расшифровывать аудио отдельноЛишний шаг и потеря интонацииПриложить файл напрямую
Ждать свежих фактовУверенный ответ по устаревшим даннымПросить проверить и указать дату
Семь ошибок и короткое лечение

Ошибка 1. Ставить 3.8 на короткую рутину

Самая дорогая ошибка — не в качестве, а в экономике. Цена за токен у 3.8 Flash и 3.7 Flash одинаковая: 113 нейронов за миллион входных токенов и 563 за миллион выходных. Разница в том, сколько токенов уходит на задачу. По публичным подсчётам одна и та же задача на 3.8 требует примерно на 40% больше расхода — модель делает больше шагов рассуждения и чаще обращается к инструментам. На разборе договора это окупается. На «переведи три абзаца» или «разложи сто заявок по категориям» — нет: ответ будет тем же, а нейронов уйдёт больше. Держите под рукой две модели и переключайтесь осознанно.

Формулировка, которая укорачивает рутинный ответ

Задача простая и однозначная — не разбирай варианты и не объясняй ход мысли.
Переведи текст ниже на английский, сохрани абзацы, верни только перевод.

[текст]

Как понять, что задача рутинная?

Три признака: правильный ответ один и вы его узнаете с первого взгляда; на входе меньше пары страниц; вы гоняете такой запрос десятками раз в день. Если совпало хотя бы два — берите модель попроще. Если задача многошаговая, требует свести несколько источников или написать рабочий код — 3.8 Flash окупает разницу в расходе.

МодельВход / выход, нейронов за млнДоступКогда брать
Gemini 3.8 Flash113 / 563BASIC — все тарифыРазбор документов, код, многошаговые задачи
Gemini 3.7 Flash113 / 563BASIC — все тарифыТот же класс задач при потоковом объёме
Gemini 3.5 Flash-Lite48 / 400BASIC — все тарифыКлассификация, извлечение полей, короткие правки
Gemini 3.1 Pro Preview250 / 1500STANDARD — с тарифа СтартКогда нужен ответ более крупной модели
Модели Gemini на платформе: чем платите и что получаете

Ошибка 2. Не задавать формат ответа

Без указания формата ответ приходит связным текстом: там, где вы ждали таблицу на пять колонок, приходит абзац со всеми фактами внутри. Формально модель права — вы про таблицу не говорили. Это самый быстрый в исправлении промах: одна строчка с описанием формата меняет вид ответа полностью. Просите не «красиво оформи», а конкретную конструкцию — колонки, длину, порядок разделов, чего быть не должно.

Задаём формат явно

Ответ верни таблицей с колонками: Пункт договора | Что означает на практике | Риск для нас | Что предложить взамен.
Одна строка — один пункт, не больше 25 слов в ячейке.
Перед таблицей — три предложения вывода. После таблицы ничего не добавляй.

Ошибка 3. Класть документ целиком, раз контекст миллион

Контекст в 1 048 576 токенов соблазняет загрузить всё разом — годовой отчёт, десять договоров, выгрузку переписки. Модель это примет, но ответ станет усреднённым: она смотрит на массив как на одно целое и отдаёт общее впечатление вместо точных находок. Практика проще и надёжнее: режьте на смысловые разделы, обрабатывайте по одному и сводите результаты в конце. Полезный приём для длинных сообщений — повторить инструкцию после текста, чтобы она не потерялась среди страниц. Подробный разбор работы с объёмными файлами — в гайде про большие документы.

Работа частями с фиксированным выходом

Ниже — часть 3 из 7 (раздел «Ответственность сторон») договора поставки.

[текст части]

По этой части и только по ней: выпиши пункты, где ответственность несимметрична, каждый — одной строкой с номером пункта. Если таких нет, напиши «в этой части нет». Общих выводов по договору не делай — они будут после всех частей.

Ошибка 4. Не просить цитат при работе с источниками

Пересказ звучит убедительно и проверяется только чтением оригинала — а именно ради того, чтобы его не читать, вы и обратились к модели. Требуйте дословные цитаты рядом с каждым утверждением и отдельно оговаривайте, что делать, когда ответа в источнике нет: без этого пробел будет заполнен правдоподобной догадкой. Формулировка «если в тексте этого нет, так и напиши» стоит одной строки и снимает большую часть разочарований.

Ответ с опорой на источник

Отвечай строго по приложенному файлу.
Каждое утверждение подкрепляй дословной цитатой в кавычках и указывай страницу или пункт.
Если ответа в документе нет — пиши «в источнике не найдено» и не достраивай из общих знаний.
Вопрос: [ваш вопрос]

Ошибка 5. Продолжать старый чат вместо нового

Длинная переписка кажется удобной: контекст же накоплен. На деле в ней остались ваши отменённые правки, черновые версии и требования к прошлой задаче — и модель честно пытается угодить всему сразу. Ответы плывут, а вы списываете это на модель. Правило простое: новая задача — новый чат, и первым сообщением короткое ТЗ. Старый диалог никуда не денется, а качество ответов заметно выровняется.

Первое сообщение нового чата

Роль: редактор коммерческих предложений.
Задача: сократить текст ниже до одной страницы, сохранив цифры и сроки.
Читатель: технический директор, времени мало.
Формат: три блока — проблема, решение, стоимость.
Ограничение: без превосходных степеней и общих фраз.

[текст]

Ошибка 6. Тратить лишний шаг на расшифровку аудио и видео

Классический маршрут — прогнать запись через расшифровку, скопировать текст, вставить в чат — здесь не нужен. Gemini 3.8 Flash принимает аудио и видео на вход напрямую и отвечает текстом. Промежуточный шаг не только съедает время: в расшифровке теряются паузы, интонация, кто именно говорит и что происходит на экране. Прикладывайте исходник и сразу просите то, что нужно на выходе, — протокол, список задач, тайм-коды. Если расшифровка нужна вам как самостоятельный документ, способы сравниваются в гайде про расшифровку аудио в текст.

Запись — сразу в результат

К сообщению приложена запись созвона на 40 минут.
Сделай: 1) протокол по темам; 2) список решений с ответственными; 3) открытые вопросы.
К каждому решению — тайм-код. Реплики не пересказывай целиком, только суть.

Ошибка 7. Ждать свежих фактов без просьбы проверить

Знания модели ограничены: март 2026 по части областей и январь 2025 по остальным. Про цены, законы, версии продуктов и вчерашние новости она ответит уверенно — и может ответить устаревшим. Лечится это не хитрым промптом, а привычкой: либо приложите актуальный источник сами, либо прямо попросите отметить, что могло измениться. Второе особенно полезно, когда вы не знаете заранее, какая часть ответа успела устареть.

Просьба разделить надёжное и устаревающее

Ответь на вопрос ниже и раздели ответ на две части:
1) что устойчиво и вряд ли изменилось;
2) что могло устареть — с пометкой, на какой момент ты это знаешь, и что стоит перепроверить.
Вопрос: [ваш вопрос]

Порядок починки, если результат не устраивает прямо сейчас

  1. Проверьте, та ли модель: короткая рутина — 3.5 Flash-Lite или 3.7 Flash, разбор и код — 3.8 Flash.
  2. Начните новый чат — вместе со старой историей уйдут отменённые правки и требования к прошлой задаче.
  3. Опишите формат ответа: колонки, длина, порядок разделов.
  4. Разрежьте большой документ на смысловые разделы и обрабатывайте по одному.
  5. Потребуйте цитаты и явное «в источнике не найдено».
  6. Прикладывайте аудио, видео и файлы напрямую, без предварительной расшифровки.
  7. Спросите отдельно, что в ответе могло устареть.
Что вы видитеВероятная причинаПравка
Ответ длиннее задачиМодель разбирает варианты там, где нужен одинДобавить «не разбирай варианты, ответь сразу»
Сплошной текст вместо таблицыФормат не заданОписать колонки и длину ячеек
Общие слова по большому файлуДокумент обработан целикомРазрезать по разделам и подавать по одному
Факт, которого нет в документеНе задано поведение при пробеле«Если в тексте нет — так и напиши»
Модель тянет отменённые правкиДлинная история диалогаНовый чат и короткое ТЗ
Устаревшая цифраГраница знаний моделиПриложить источник или попросить пометить дату
Симптом — причина — что поменять

Стоит ли вообще переходить на 3.8

По данным Google, 3.8 Flash — их лучшая модель для рассуждений и кода: Intelligence Index 59 в режиме высокого рассуждения, на три пункта выше 3.7 Flash и столько же, сколько у GPT-5.6 Sol и Grok 4.6; выше в этом рейтинге — Claude Fable 5.1 (66), Claude Opus 5 (63), Grok 4.6 high и GPT-5.6 Sol max (по 61). HLE-Verified — 54,9% на многошаговых рассуждениях в науке и профессиональных областях, а на DeepSWE v1.1 модель обходит большинство более крупных флагманов в автономном решении инженерных задач. Вывод практический: для сложных многошаговых задач 3.8 Flash оправдана почти всегда, для простых — держите рядом модель поскромнее. Развёрнутое сравнение — в обзоре модели.

Частые вопросы

Gemini 3.8 Flash доступна на бесплатном тарифе?

Да. Уровень доступа модели — BASIC, а это все тарифы, включая бесплатный. Ограничивает вас только остаток нейронов: 113 за миллион входных токенов и 563 за миллион выходных. Открыть модель можно в чате на my.suin.ai, тарифы — на странице тарифов.

Можно ли уменьшить длину рассуждений в настройках?

В чате СуперИнтеллекта нет переключателей уровня рассуждения и прочих параметров вроде температуры — это настройки программного интерфейса, а не рабочего окна. Длина ответа регулируется формулировкой: скажите, что задача однозначная, задайте предел в словах и опишите формат — этого достаточно, чтобы модель перестала разворачивать варианты.

Почему цена за токен та же, а нейронов уходит больше?

Цена за токен у 3.8 и 3.7 Flash действительно одинаковая — 113 и 563 нейрона. Разница в том, сколько токенов уходит на задачу: 3.8 делает больше шагов рассуждения и чаще обращается к инструментам, поэтому по публичным подсчётам одна и та же задача требует примерно на 40% больше расхода. Снижают его короткие точные формулировки и выбор модели попроще для рутины.

Стоит ли остаться на 3.7 Flash?

Стоит, если у вас поток однотипных коротких задач: цена за токен та же — 113 и 563, а расход на задачу ниже. Для разбора документов, кода и многошаговых сценариев логичнее 3.8. Сравнение по пунктам — в материале 3.8 против 3.7, а выбор между всеми Flash-моделями разобран здесь.

Ещё про Gemini 3.8 Flash