Миллион токенов — это примерно 700 тысяч слов: несколько книг или годовой архив переписки. Модель с таким контекстом видит документ целиком и не теряет начало, дойдя до конца.

МодельКонтекстВход за 1МВыход за 1М
GPT-5.6 Luna1 050 00014 нейронов87 нейронов
Llama 4 Scout1 048 57620 нейронов60 нейронов
Gemini 3.1 Flash Lite1 048 57638 нейронов225 нейронов
Llama 4 Maverick1 048 57640 нейронов139 нейронов
Gemini 3.7 Flash1 048 57656 нейронов281 нейрон
GPT-5.6 Terra1 050 000150 нейронов900 нейронов
Gemini 3.6 Flash1 048 576225 нейронов1 125 нейронов
Модели с миллионным контекстом и их цены

Зачем такой контекст нужен

  • Комплект документов целиком — тендерная документация, договоры с приложениями.
  • Длинная переписка — найти, что обещали клиенту три месяца назад.
  • Кодовая база или большая выгрузка — модель видит связи, а не отдельные куски.
  • Долгий диалог — история не подрезается, а значит работает дешёвое чтение из кэша.

Что выбрать под большие документы

Если на входе только текст — дешевле всего Luna и Scout. Если среди документов есть сканы, фотографии или записи — берите Gemini 3.7 Flash: она читает их напрямую. Практика работы с большими объёмами — работа с большими документами, а по тендерной документации есть отдельный разбор: нейросеть для тендеров.

👉 Загрузить свой документ — 100 нейронов при регистрации.