Gemini 3.8 Flash держит 1 048 576 токенов контекста — это сотни страниц договоров, регламентов и отчётов за один заход. Модель доступна на уровне BASIC, то есть на всех тарифах СуперИнтеллекта, включая бесплатный, и стоит 113 нейронов за миллион входных токенов и 563 за миллион выходных. На вход принимает текст, изображения, файлы, аудио и видео, отвечает текстом. Но исход решает не размер окна, а то, как вы подадите материал: задача первой, данные размеченными блоками, явный формат ответа и требование цитат.

Что реально помещается в 1 048 576 токенов

Токен — это кусочек текста, чаще всего часть слова. Точную цифру заранее не посчитать: она зависит от языка, форматирования и того, сколько в документе таблиц и сносок. Поэтому удобнее держать в голове не страницы, а порядки величины — вот как это выглядит на рабочих документах.

Что загружаетеПорядок величиныПомещается ли в 1 048 576 токенов
Договор на 15–20 страницдесятки тысяч токеновДа, и таких можно подать сразу несколько десятков
Тендерная документация, 100–150 страницсотни тысяч токеновДа, вместе с парой смежных документов и перепиской
Годовой отчёт со всеми приложениямисотни тысяч токеновДа, останется запас на вопросы и уточнения
Регламент или отраслевой стандарт на 300 страницсотни тысяч токеновДа, но лучше оставить свободным хотя бы четверть окна
Переписка по проекту за годсотни тысяч токеновОбычно да, но вложения расходуют окно быстрее самих писем
Часовая запись совещания с видеозаметно больше, чем кажется по расшифровкеОбычно да, но видео расходует окно быстрее текста
Объём документа → что влезает в контекст

Русский текст расходует токены менее экономно, чем английский: одно слово нередко разбивается на два-три токена. Поэтому англоязычные ориентиры для русских документов смело делите примерно пополам и оставляйте запас — окно нужно не только под ваши файлы, но и под весь дальнейший диалог: каждый следующий вопрос и каждый ответ модели тоже занимают место.

Значит, можно загрузить тысячу страниц и ни о чём не думать?

Нет — и это главное, что стоит знать до того, как вы отдадите модели пакет на пятьсот страниц. Большое окно означает, что документы физически поместятся, а не что каждая строка будет прочитана с одинаковым вниманием. По публичным обзорам и исследованиям длинного контекста, у любой модели информация в начале и в конце запроса используется надёжнее, чем в середине — эффект известен как «lost in the middle». Там же отмечают закономерность: найти один конкретный факт в огромном массиве модели удаётся почти всегда, а вот когда фактов нужно собрать много и они разбросаны по разным местам, результат заметно проседает.

  • Чем больше вопросов вы задаёте одним запросом, тем выше шанс, что часть останется без ответа. Один запрос — одна задача.
  • Середина длинного массива — зона риска. Самое важное ставьте в начало или в конец, а не закапывайте между двумя сотнями страниц.
  • Модель охотно заполняет пробелы правдоподобным текстом. Если в договоре пункта нет, без прямого запрета она может «вспомнить» типовую формулировку.

Как подавать объём, чтобы модель не потерялась

  1. Задача — первой строкой. Одно предложение о том, что нужно получить, до всех данных. Модель должна понимать, что искать, ещё до того, как начнёт читать.
  2. Данные — блоками с подписями. Каждый документ отдельным блоком с явным заголовком: ДОГОВОР_01, ОТЧЁТ_МАРТ, ПРИЛОЖЕНИЕ_Б. Это то, на что модель потом будет ссылаться.
  3. Формат ответа — заранее. Таблица с перечисленными колонками, список, одна страница текста. Без этого получите свободное сочинение вместо рабочего документа.
  4. Запрет на догадки — отдельным пунктом. «Если данных нет, пиши „не указано“. Не додумывай и не подставляй типовые формулировки».
  5. Требование цитат. Каждое утверждение — с указанием блока, пункта и дословной цитатой до 25 слов. Так ответ можно проверить за минуту, а не перечитывать всё заново.
  6. Повторите вопрос в конце. После большого массива данных короткая строка «Итак, задача: …» заметно повышает шанс, что вы получите именно то, что просили.

Почему задача должна идти первой, а вопрос повторяться в конце?

Это самый дешёвый способ поднять качество на длинных запросах. По публичным рекомендациям вопрос советуют ставить после всего остального контекста; практики, которые работают с многодокументными запросами, советуют обратное — сначала обозначить задачу. Противоречия здесь нет: работает связка. Короткая постановка задачи в начале задаёт оптику чтения, развёрнутая формулировка в конце попадает в зону, которую модель точно не пропустит. Между ними — данные.

Как обычно делаютЧто получаетсяКак лучше
Загрузить 12 файлов и написать «проанализируй»Общий пересказ без конкретикиОдин вопрос, один формат ответа, одна таблица на выходе
Задать десять вопросов одним сообщениемОтвет на первые три, остальные потеряныРазбить на серию запросов в одном чате — документы уже в контексте
Не подписывать файлыСсылки вида «в одном из документов»Подписи блоков: ДОГОВОР_01, ОТЧЁТ_МАРТ
Не запрещать догадкиПравдоподобные пункты, которых в тексте нет«Нет данных — пиши „не указано“»
Не просить цитатыПроверка занимает больше времени, чем ручное чтениеЦитата до 25 слов и номер пункта к каждому выводу
Сразу просить выводы и рекомендацииКрасивый текст, оторванный от документовСначала факты с цитатами, выводы — вторым запросом
Типичные ошибки и что делать вместо

Шесть промптов для работы с большими документами

Как сверить пачку договоров?

Сверка условий в пакете договоров

Задача: сравнить условия во всех приложенных договорах и собрать таблицу расхождений.

Что сделать:
1) Для каждого договора вытащи: стороны, предмет, сумму, срок, порядок оплаты, ответственность, порядок расторжения, применимое право.
2) Сведи в таблицу: строки — параметры, столбцы — договоры.
3) Отдельным списком — где условия расходятся с ДОГОВОР_01, он эталон.

Формат: сначала таблица, потом список расхождений.

Правила:
- После каждого значения ставь ссылку [файл, пункт] и дословную цитату до 25 слов.
- Если параметра в договоре нет — пиши «не указано». Не додумывай и не подставляй типовые формулировки.
- Оценок и рекомендаций на этом шаге не давай.

Итак, задача: таблица параметров по всем договорам плюс список расхождений с ДОГОВОР_01.

Как найти противоречия в регламенте?

Поиск внутренних противоречий в документе

Задача: проверить приложенный регламент на внутренние противоречия.

Найди:
- пункты, которые противоречат друг другу;
- места, где один и тот же процесс описан по-разному;
- сроки, суммы и роли, которые не сходятся между разделами;
- ссылки на пункты и приложения, которых в документе нет.

Формат: таблица с колонками «Что противоречит | Пункт А и цитата | Пункт Б и цитата | В чём конфликт | Критичность: высокая / средняя / низкая».

Правила:
- Только то, что подтверждается цитатами из текста. Формулировок вида «вероятно, имелось в виду» быть не должно.
- Если в разделе противоречий нет, так и напиши.
- В конце отдельным списком — места, где формулировка допускает два толкования.

Как собрать сводку по отчётам за год?

Сводка по пакету периодических отчётов

Задача: собрать сводку по приложенным месячным отчётам за год для обсуждения на совете.

Данные идут блоками: ОТЧЁТ_01 … ОТЧЁТ_12.

Сделай:
1) Таблицу по месяцам: выручка, расходы, маржа, число клиентов — ровно те цифры, что есть в отчётах.
2) Три тренда, которые видно по этим цифрам, каждый с перечнем месяцев-подтверждений.
3) Пять вопросов, ответа на которые в отчётах нет.

Правила:
- Не считай ничего, кроме разностей и процентов от приведённых чисел.
- К каждой цифре ставь пометку [ОТЧЁТ_NN].
- Показателя за месяц нет — пиши «нет данных», не интерполируй.
- Объём: не больше страницы текста плюс таблица.

Как вытащить все сроки и обязательства?

Календарь обязательств из пакета документов

Задача: собрать календарь обязательств по приложенному пакету документов.

Формат — таблица с колонками: срок | что нужно сделать | кто отвечает | документ и пункт | точная цитата | последствие просрочки.

Правила:
- Обязательство — всё, где есть срок: «в течение», «не позднее», «ежеквартально», «до __».
- Относительные сроки («в течение 10 рабочих дней с момента подписания») оставляй как есть, в календарные даты не переводи.
- Сортируй так: сначала жёсткие даты, потом относительные сроки, потом бессрочные обязанности.
- Ничего не добавляй по общей практике или по закону — только то, что написано в документах.

Итак, задача: полный календарь обязательств с цитатами и ссылками на пункты.

Как проверить документ по своему чек-листу?

Сверка документа с чек-листом требований

Задача: проверить приложенный документ по чек-листу ниже.

[ЧЕК-ЛИСТ]
1. …
2. …
3. …

По каждому пункту дай: Есть / Есть частично / Нет + цитату из документа или отметку «в тексте не найдено» + одним предложением, что дописать.

Формат: таблица, под ней итог одной строкой — сколько пунктов закрыто из скольких.

Правила:
- «Есть» ставь только при дословном подтверждении в тексте.
- Сомневаешься — ставь «Есть частично» и объясняй сомнение одной фразой.
- Пункты чек-листа не переформулируй и не объединяй.

Как сориентироваться в незнакомом пакете документов?

Первый проход по чужому массиву

Задача: ты видишь этот пакет документов впервые. Сориентируй меня, прежде чем разбираться по существу.

Дай:
1) Перечень: что за документ, о чём, объём, дата — по каждому файлу одной строкой.
2) Карту тем: какие вопросы встречаются сразу в нескольких документах.
3) Пять мест, куда стоит посмотреть в первую очередь, с указанием файла и раздела.
4) Чего в пакете нет, хотя по логике должно быть.

Правила:
- Выводов по существу на этом шаге не делай, только навигация.
- Каждое утверждение — со ссылкой на файл и раздел.
- Если назначение документа непонятно, так и напиши, не угадывай.

Во сколько обходится работа с объёмом

Единица списания — нейрон. У Gemini 3.8 Flash это 113 нейронов за миллион входных токенов и 563 за миллион выходных. Входные — то, что вы загружаете: документы, вопросы, вся предыдущая переписка в чате. Выходные — ответ модели, и он примерно в пять раз дороже. Отсюда практический вывод: гигантский пакет документов сам по себе стоит недорого, а вот просьба «перескажи всё подробно» бьёт по кошельку сильнее. Просите таблицы и списки, а не развёрнутые сочинения.

МодельВход, нейронов за 1 млнВыход, нейронов за 1 млнДоступ
Gemini 3.8 Flash113563BASIC — все тарифы, включая бесплатный
Gemini 3.7 Flash113563BASIC — все тарифы, включая бесплатный
Gemini 3.5 Flash-Lite48400BASIC — все тарифы, включая бесплатный
Gemini 3.1 Pro Preview2501500STANDARD — с тарифа Старт
Модели Gemini в каталоге: цена и доступ

Есть нюанс, который заметен именно на больших задачах. Цена за токен у 3.8 Flash та же, что у 3.7, но, по публичным подсчётам, сама задача обходится примерно на 40% дороже: модель работает усерднее — делает больше шагов рассуждения и чаще обращается к инструментам. В чате СуперИнтеллекта переключателей уровня рассуждения и прочих параметров API нет, число шагов модель выбирает сама, поэтому влиять на это можно только формулировкой задачи. По тем же публичным подсчётам средняя задача выходит около $0,58 — самая низкая цена среди моделей сопоставимого уровня, у Claude Fable 5.1 около $3,76; это внешние долларовые оценки, к списанию нейронов они отношения не имеют. Если задача простая — вытащить реквизиты из десяти счетов — переплачивать смысла нет.

Когда стоит взять другую модель Gemini?

Для механической работы по большому объёму — вытащить поля, разложить по таблице, посчитать вхождения — берите Gemini 3.5 Flash-Lite: 48 и 400 нейронов, тоже на всех тарифах. Для разбора, где нужно понять смысл, найти противоречие или собрать позицию по спорному пункту, — 3.8 Flash. Gemini 3.1 Pro Preview стоит 250 и 1500 нейронов и доступен с тарифа Старт, его имеет смысл держать про запас для отдельных тяжёлых случаев. Подробное сравнение — в гайде какую Gemini Flash выбрать, а разбор различий поколений — в материале 3.8 Flash против 3.7 Flash.

Отдельно про формат входа: модель принимает не только текстовые файлы, но и изображения, аудио и видео. На практике это значит, что скан договора, фотография страницы с рукописной правкой и запись совещания попадают в тот же разбор, что и обычные документы. Знания самой модели, по данным Google, охватывают март 2026 года по части областей и январь 2025 по остальным, поэтому свежие нормы и внутренние правила подавайте файлом, а не рассчитывайте, что модель их помнит.

Частые вопросы

Сколько документов можно загрузить за один раз?

Ограничение одно — 1 048 576 токенов на весь диалог вместе с ответами модели. Пакет из нескольких десятков договоров или годовой отчёт с приложениями помещаются свободно. Практический совет: не забивайте окно под завязку, оставьте примерно четверть свободной — вам ещё задавать уточняющие вопросы в том же чате, и каждый из них тоже занимает место.

Модель точно прочитает весь документ или пробежит по диагонали?

Формально в контекст попадает всё, что вы загрузили. Но внимание распределяется неравномерно: начало и конец запроса отрабатываются надёжнее середины, а если задать сразу много вопросов, часть останется без ответа. Поэтому и работают простые приёмы — один запрос на одну задачу, подписанные блоки данных и требование цитат: они превращают «прочитала ли» в проверяемый факт.

Можно ли доверять цитатам, которые приводит модель?

Цитату всегда стоит сверить с оригиналом — на то она и цитата, что проверка занимает секунды. Именно поэтому требование дословных фрагментов и номеров пунктов входит в каждый промпт выше: вы получаете не «модель считает, что», а адрес в документе, по которому можно перейти. Ответственность за юридический или финансовый вывод остаётся на человеке — модель ускоряет поиск и разбор, а не заменяет специалиста.

Нужен ли платный тариф, чтобы работать с большими документами?

Gemini 3.8 Flash имеет уровень доступа BASIC, то есть открыта на всех тарифах СуперИнтеллекта, включая бесплатный. Разница между тарифами — в запасе нейронов и дополнительных возможностях платформы, а не в доступе к самой модели. Условия смотрите на странице тарифов, начать можно в my.suin.ai.

Что делать, если документы всё-таки не помещаются?

Разбейте работу на два шага. Сначала пройдитесь по каждой части отдельно и попросите структурированную выжимку с цитатами — списком, а не пересказом. Затем во втором чате соберите эти выжимки вместе и работайте уже с ними: объём падает в разы, а привязка к исходным пунктам сохраняется. Такой же подход выручает, когда нужно сравнить документы за несколько лет.

Ещё про Gemini 3.8 Flash