Контекст Ox Alpha — 1 048 576 токенов, это примерно 700–800 тысяч слов русского текста за один запрос. Для сравнения: «Война и мир» — около 460 тысяч слов. То есть в одно сообщение помещается роман Толстого целиком и ещё половина сверху. И всё это бесплатно, на любом тарифе.
Что помещается: понятные ориентиры
| Что | Сколько влезает | Комментарий |
|---|---|---|
| Слов русского текста | около 700–800 тысяч | Русский текст «тяжелее» английского в токенах |
| Страниц А4 | примерно 1 500–2 000 | При обычной плотности вёрстки |
| Книг среднего объёма | 5–7 | Или одна «Война и мир» плюс запас |
| Строк кода | порядка 100 тысяч | Кодовая база среднего проекта целиком |
| Договоров на 30 страниц | около 50 | Можно сверить всю пачку разом |
| Часов расшифровки разговоров | 80–100 | Текстом; аудио модель напрямую не понимает |
Оценки приблизительные: количество токенов зависит от языка и структуры текста. Русский текст расходует токены быстрее английского, таблицы и код — быстрее прозы. Ориентируйтесь на нижнюю границу.
Пять задач, которые раньше приходилось резать
Сверить пачку договоров
Пятьдесят договоров в одном запросе — и вопрос «где условия расходятся» получает ответ по всей пачке, а не по той части, что влезла.
Сверка комплекта документов
Ниже — комплект договоров с разными контрагентами.
Сведи в таблицу: контрагент, срок оплаты, штраф за просрочку, порядок расторжения, автопролонгация.
После таблицы отдельным списком — где условия хуже, чем в большинстве остальных.
Цитируй пункты. Ничего не додумывай: если условия в договоре нет, пиши «не указано».
[документы]Разобрать проект целиком
Сто тысяч строк кода — это средний рабочий репозиторий. Модель видит зависимости между модулями, а не отдельный файл. Разбор кодовых сценариев — в материале Ox Alpha для программирования.
Свести годовой архив переписки
История обсуждения проекта за год — и вопрос «когда и почему мы решили сделать так» получает ответ с датами и цитатами вместо коллективного припоминания.
Проверить большой документ на противоречия
Регламент, который писали пять человек по разделам, почти гарантированно содержит расхождения: разные сроки, разные названия одного и того же, взаимоисключающие правила. Человек читает по разделам и их не видит. Модель с полным текстом — видит.
Проанализировать конкурентов
Выгрузили тексты сайтов, прайсы, публичные материалы — и сравниваете по одним и тем же критериям, а не по впечатлению.
Как подавать большой объём, чтобы модель не потерялась
Миллион токенов — не значит, что можно свалить всё в кучу. Модель прочитает, но потратит время и может расставить акценты не там.
- Задача идёт первой, данные — после. Модель читает сверху вниз: пусть сразу знает, что искать.
- Разделяйте блоки подписями. «--- Договор 1: ООО Ромашка ---». Так модель сможет ссылаться на источник.
- Задавайте формат ответа явно. Иначе на большом объёме получите свободное сочинение.
- Запретите догадки. Строка «если данных нет, напиши „не указано“» экономит перепроверку.
- Просите ссылки на источник. «Указывай, из какого блока взят факт» превращает ответ в проверяемый.
Каркас запроса на большой объём
ЗАДАЧА
[одно предложение]
ФОРМАТ
[таблица со столбцами ... / список по пунктам]
ПРАВИЛА
- Опирайся только на данные ниже.
- Для каждого факта указывай, из какого блока он взят.
- Чего нет в данных — пиши «не указано». Не додумывай.
ДАННЫЕ
--- Блок 1: [название] ---
[...]
--- Блок 2: [название] ---
[...]Чего ждать не стоит
- Мгновенного ответа. Чем больше данных, тем дольше модель рассуждает. Большой разбор — это минуты, а не секунды.
- Понимания вложений. Ox Alpha читает текст, картинки и видео. Файлы попадают к ней уже текстом.
- Идеальной памяти на всё сразу. Большой контекст не отменяет проверку: просите цитаты.
- Гарантий доступности. Это бесплатное превью, в пиковые часы бывают обрывы.
Если нужны именно вложения и звук — в каталоге есть модели с таким же контекстом, которые понимают файлы и аудио напрямую. Сопоставление — в сравнении моделей.
Частые вопросы
Сколько страниц помещается в миллион токенов?
Примерно 1 500–2 000 страниц А4 обычного текста. Точная цифра зависит от языка и вёрстки: русский текст расходует токены быстрее английского, а таблицы и код — быстрее прозы.
Правда ли модель помнит весь миллион токенов одинаково хорошо?
Модели с большим контекстом обычно лучше удерживают начало и конец запроса, чем середину. Поэтому важное стоит класть ближе к началу, а на длинных разборах — просить цитаты и точные ссылки на источник. Это относится ко всем моделям, не только к этой.
Есть ли другие модели с миллионным контекстом бесплатно?
На бесплатном тарифе СуперИнтеллекта доступны и другие модели с контекстом около миллиона токенов, но запрос к ним списывает нейроны. Ox Alpha пока единственная, у которой цена нулевая. Актуальный статус — в карточке модели.
Куда дальше: обзор Ox Alpha · как пользоваться · модели с контекстом миллион токенов



