Контекст Ox Alpha — 1 048 576 токенов, это примерно 700–800 тысяч слов русского текста за один запрос. Для сравнения: «Война и мир» — около 460 тысяч слов. То есть в одно сообщение помещается роман Толстого целиком и ещё половина сверху. И всё это бесплатно, на любом тарифе.

Что помещается: понятные ориентиры

ЧтоСколько влезаетКомментарий
Слов русского текстаоколо 700–800 тысячРусский текст «тяжелее» английского в токенах
Страниц А4примерно 1 500–2 000При обычной плотности вёрстки
Книг среднего объёма5–7Или одна «Война и мир» плюс запас
Строк кодапорядка 100 тысячКодовая база среднего проекта целиком
Договоров на 30 страницоколо 50Можно сверить всю пачку разом
Часов расшифровки разговоров80–100Текстом; аудио модель напрямую не понимает
Миллион токенов в привычных единицах

Оценки приблизительные: количество токенов зависит от языка и структуры текста. Русский текст расходует токены быстрее английского, таблицы и код — быстрее прозы. Ориентируйтесь на нижнюю границу.

Пять задач, которые раньше приходилось резать

Сверить пачку договоров

Пятьдесят договоров в одном запросе — и вопрос «где условия расходятся» получает ответ по всей пачке, а не по той части, что влезла.

Сверка комплекта документов

Ниже — комплект договоров с разными контрагентами.

Сведи в таблицу: контрагент, срок оплаты, штраф за просрочку, порядок расторжения, автопролонгация.
После таблицы отдельным списком — где условия хуже, чем в большинстве остальных.

Цитируй пункты. Ничего не додумывай: если условия в договоре нет, пиши «не указано».

[документы]

Разобрать проект целиком

Сто тысяч строк кода — это средний рабочий репозиторий. Модель видит зависимости между модулями, а не отдельный файл. Разбор кодовых сценариев — в материале Ox Alpha для программирования.

Свести годовой архив переписки

История обсуждения проекта за год — и вопрос «когда и почему мы решили сделать так» получает ответ с датами и цитатами вместо коллективного припоминания.

Проверить большой документ на противоречия

Регламент, который писали пять человек по разделам, почти гарантированно содержит расхождения: разные сроки, разные названия одного и того же, взаимоисключающие правила. Человек читает по разделам и их не видит. Модель с полным текстом — видит.

Проанализировать конкурентов

Выгрузили тексты сайтов, прайсы, публичные материалы — и сравниваете по одним и тем же критериям, а не по впечатлению.

Как подавать большой объём, чтобы модель не потерялась

Миллион токенов — не значит, что можно свалить всё в кучу. Модель прочитает, но потратит время и может расставить акценты не там.

  1. Задача идёт первой, данные — после. Модель читает сверху вниз: пусть сразу знает, что искать.
  2. Разделяйте блоки подписями. «--- Договор 1: ООО Ромашка ---». Так модель сможет ссылаться на источник.
  3. Задавайте формат ответа явно. Иначе на большом объёме получите свободное сочинение.
  4. Запретите догадки. Строка «если данных нет, напиши „не указано“» экономит перепроверку.
  5. Просите ссылки на источник. «Указывай, из какого блока взят факт» превращает ответ в проверяемый.

Каркас запроса на большой объём

ЗАДАЧА
[одно предложение]

ФОРМАТ
[таблица со столбцами ... / список по пунктам]

ПРАВИЛА
- Опирайся только на данные ниже.
- Для каждого факта указывай, из какого блока он взят.
- Чего нет в данных — пиши «не указано». Не додумывай.

ДАННЫЕ
--- Блок 1: [название] ---
[...]

--- Блок 2: [название] ---
[...]

Чего ждать не стоит

  • Мгновенного ответа. Чем больше данных, тем дольше модель рассуждает. Большой разбор — это минуты, а не секунды.
  • Понимания вложений. Ox Alpha читает текст, картинки и видео. Файлы попадают к ней уже текстом.
  • Идеальной памяти на всё сразу. Большой контекст не отменяет проверку: просите цитаты.
  • Гарантий доступности. Это бесплатное превью, в пиковые часы бывают обрывы.

Если нужны именно вложения и звук — в каталоге есть модели с таким же контекстом, которые понимают файлы и аудио напрямую. Сопоставление — в сравнении моделей.


Частые вопросы

Сколько страниц помещается в миллион токенов?

Примерно 1 500–2 000 страниц А4 обычного текста. Точная цифра зависит от языка и вёрстки: русский текст расходует токены быстрее английского, а таблицы и код — быстрее прозы.

Правда ли модель помнит весь миллион токенов одинаково хорошо?

Модели с большим контекстом обычно лучше удерживают начало и конец запроса, чем середину. Поэтому важное стоит класть ближе к началу, а на длинных разборах — просить цитаты и точные ссылки на источник. Это относится ко всем моделям, не только к этой.

Есть ли другие модели с миллионным контекстом бесплатно?

На бесплатном тарифе СуперИнтеллекта доступны и другие модели с контекстом около миллиона токенов, но запрос к ним списывает нейроны. Ox Alpha пока единственная, у которой цена нулевая. Актуальный статус — в карточке модели.