Вы просите написать письмо клиенту — и получаете «Надеюсь, данное письмо застанет вас в добром здравии». Грамматика в порядке, но звучит как перевод с английского, сделанный очень вежливым роботом. Отсюда и берётся вывод, что с русским модели не справляются — хотя справляются, просто очень по-разному, и лучшая нейросеть на русском у каждой задачи своя. Различий ровно три: токены, слог и знание российских реалий.

Почему одна и та же модель по-русски работает иначе

Токенизация: русский стоит дороже английского

Модель считает не буквы и не слова, а токены — куски текста. Частое английское слово обычно укладывается в один токен, русское распадается на несколько: приставка, корень, окончание. Одна и та же мысль по-русски — это больше токенов, чем по-английски, при полностью совпадающем смысле.

На практике это бьёт по двум местам: контекст заполняется быстрее, а ответ обходится дороже. У Gemini 3.7 Flash контекст 1 048 576 токенов, максимальный ответ — 65 536, вход стоит 56 нейронов за 1 млн токенов, выход — 281. Выход дороже входа примерно в пять раз, поэтому загрузить большой русский документ заметно дешевле, чем попросить большой русский ответ.

Слог: грамотно — ещё не значит по-русски

Грамматических ошибок почти никто уже не делает. Ошибаются в регистре: лишние вводные, отглагольные существительные вроде «осуществляем предоставление», кальки «имеет место быть» и «на регулярной основе». Одни модели скатываются в это с первой фразы, другие держатся, пока вы сами не попросите «сделай официальнее».

Честно про измерения: публичных бенчмарков именно по качеству русского слога не существует, и своих замеров чужих моделей у нас нет. Официальные замеры Google, опубликованные 13.08.2026, меряют код, агентные задачи и работу с документами. Внешние рейтинги за август 2026 — тоже про другое: в Artificial Analysis Intelligence Index у Claude Opus 5 — 63,1, у Claude Fable 5 — 62,1, а Elo фронтирных моделей в LMSys Arena держится примерно в диапазоне 1450–1561; публичные лидерборды сравнивают 300–390 моделей по MMLU Pro, HumanEval, MATH, GPQA Diamond и SWE-Bench Verified. Слог проверяется только на ваших собственных текстах — как это делать системно, разобрано в материале про нейросеть для текста.

Российские реалии: чего модель про Россию не знает

Третье отличие — фактура. Как устроен договор оказания услуг по российскому праву, чем закрывающие документы отличаются от счёта, как называются должности в российской компании, какие сроки считаются рабочими. Здесь модель ошибается уверенно и без предупреждения, поэтому фактуру проверяют всегда, а не только когда ответ «выглядит странно».

Что показывают чужие замеры и где Gemini уступает

Цифры ниже — не наши. Это официальная таблица Google, опубликованная 13.08.2026 вместе с релизом Gemini 3.7 Flash. К русскому языку она отношения не имеет, но показывает, где модель по умолчанию сильна, а где её обходят.

БенчмаркGemini 3.7 FlashGemini 3.6 FlashClaude Sonnet 5GPT-5.6 Terra
FrontierCode 1.1 — качество кода43,6%34,4%42,7%41,3%
DeepSWE v1.1 — длинные задачи65,348,653,869,6
Code Arena, Elo1588153815411523
Terminal-bench 2.185,878,080,487,4
AutomationBench30,417,010,723,6
GDPVal-AA1525142215981578
GDP.pdf — документы34,022,028,024,7
Замеры Google от 13.08.2026 (данные вендора, не наши измерения)

Из этой же таблицы видно, что «лучшей во всём» модели там нет. На DeepSWE v1.1 впереди GPT-5.6 Terra — 69,6 против 65,3, на terminal-bench 2.1 он же — 87,4 против 85,8. На GDPVal-AA Gemini с 1525 уступает и Claude Sonnet 5 (1598), и GPT-5.6 Terra (1578), а выше всех там Muse Spark — 1628. Сильные стороны Gemini 3.7 Flash по этим данным — Code Arena (1588), AutomationBench (30,4) и работа с документами в GDP.pdf (34,0).

Там же Google приводит цены вендоров за 1 млн токенов: у Gemini вход $0,75 и выход $3,75, у Claude — $2,00 и $10,00, у GPT — $2,00 и $12,00, у Muse — $1,25 и $4,25. Цена Gemini промо-тарифная, до 31.12.2026, дальше $1,50 и $7,50. На платформе вы платите нейронами, но именно из этой разницы и берётся то, что модель по умолчанию — самая дешёвая в списке.

Какая нейросеть для русского языка доступна на каком тарифе

В каталоге платформы 95+ моделей. Бесплатный тариф открывает 52, «Старт» и «Стандартный» — 81, PRO и выше — все 95. Для русского бесплатной половины уже достаточно: Gemini 3.7 Flash вышла 13.08.2026, работает моделью по умолчанию и принимает текст, картинки, видео, аудио и файлы — подробности в разборе Gemini 3.7 Flash бесплатно. Артефакты — рабочие страницы прямо в чате — доступны на всех тарифах, включая бесплатный.

МодельДоступна с тарифаЗачем брать для русского
Gemini 3.7 FlashБесплатныйМодель по умолчанию; контекст 1 048 576 токенов — большой русский документ влезает целиком
Qwen3.8 MaxБесплатныйВторая бесплатная опция, если тон первого ответа не подошёл
DeepSeek V4 Pro, DeepSeek R1БесплатныйРазбор и логика: договоры, расчёты, придирчивая проверка. Слог суховатый
GPT-5.6 LunaБесплатныйКороткие переписки, черновики, быстрые правки
Claude Sonnet 5Старт, 890 ₽Письма, статьи, редактура — реже приходится переписывать за ним тон
GPT-5.6 TerraСтарт, 890 ₽Длинные структурные тексты и задачи в несколько шагов
Gemini 3.1 ProСтарт, 890 ₽Когда нужен разбор подробнее, чем даёт Flash
GPT-5.6 Sol ProPRO, 4 990 ₽Верхний уровень каталога; ради русского слога доплата оправдана редко
Модели для работы с русским и уровни доступа

Прямая рекомендация. Если русский у вас бытовой — переписка, черновики, разовые разборы — платить не за что, бесплатного набора хватает. Если текст читают снаружи, разница между бесплатной моделью и Claude Sonnet 5 окупается первой же сэкономленной вычиткой: это тариф «Старт» за 890 ₽, 300 нейронов и 81 модель. Прыгать сразу на PRO ради русского языка смысла нет: 4 990 ₽ оправданы, когда упираетесь в лимит сообщений — на PRO его нет вовсе — или когда нужны все модели каталога и 60 агентов.

Сценарий «Российская»: когда нужна русская нейросеть

В выборе модели есть режим «Лайт» — вместо каталога сценарии: Универсальная, Мгновенные ответы, Сложные задачи, Тексты и статьи, Поиск в интернете, Бесплатная, Российская. «Российская» означает ровно одно: запрос уйдёт к модели российского происхождения, а не в зарубежный сервис. Её берут, когда во внутреннем регламенте написано, что данные не должны покидать страну. Цена ответа в «Лайте» показана сразу — «≈ N нейронов за ответ», уже с наценкой, так что сравнить сценарии между собой можно до отправки.

Набор сценариев зависит от раздела: в «Задачах» он свой — Универсальный агент, Сложные проекты, Код и разработка, Документы и файлы, Исследования, Экономный агент. Для русских текстов обычно хватает «Текстов и статей» в «Чате», для пачки документов — «Документов и файлов» в «Задачах». Учтите: сценарий «Поиск в интернете» работает с тарифа «Старт», на бесплатном поиска нет.

Как формулировать по-русски, чтобы не получить кальку

Главный источник канцелярита — расплывчатая просьба. На «напиши текст о нашем продукте» модель выдаёт усреднённый корпоративный текст: она не знает адресата, канал и цель, поэтому берёт самый безопасный регистр. Уточните эти три вещи — и половина проблемы исчезает.

  • Назовите адресата и ситуацию: «письмо клиенту, который второй раз просит отсрочку», а не «деловое письмо».
  • Запрещайте прямо. Список из пяти конкретных запрещённых оборотов работает лучше, чем просьба «пиши живо».
  • Дайте образец своего текста на три-пять предложений — под него модель подстроится точнее, чем под любое описание тона.
  • Просите вариант короче на треть: при сжатии из русского текста первой уходит вода, а не смысл.
  • Требуйте глаголы вместо отглагольных существительных: «оплатить», а не «произвести оплату».

Промпт для делового письма на русском без канцелярита

Напиши письмо на русском.
Кому: постоянный клиент, третий месяц задерживает оплату, отношения хочу сохранить.
Задача: попросить закрыть долг до пятницы и предложить разбить сумму на два платежа.
Тон: спокойный, без давления и без извинений за то, что мы просим свои деньги.
Ограничения:
— не длиннее 120 слов;
— без канцелярита («на регулярной основе», «в рамках», «осуществляем»);
— без вступлений вроде «надеюсь, у вас всё хорошо»;
— глаголы вместо отглагольных существительных: «оплатить», а не «произвести оплату».
Дай два варианта: помягче и пожёстче.

Работает здесь не вежливость запроса, а четыре заданные рамки: адресат, задача, тон и явные запреты. Такой запрос к лёгкой модели стоит доли нейрона, так что перебрать три формулировки дешевле, чем один раз переписывать письмо руками. Обратная задача — вычистить уже готовый русский текст — решается отдельным промптом.

Промпт для вычитки готового русского текста

Проверь текст ниже как редактор.
1. Найди кальки с английского и канцелярит. Выведи таблицей: было — стало — почему.
2. Отдельно отметь предложения длиннее 25 слов, которые стоит разрезать.
3. Не переписывай текст целиком, не меняй смысл, термины и цифры.
4. В конце — одна строка: что в тексте главная проблема стиля.
Текст: <вставьте свой>

Расход: русский дороже, и это стоит закладывать

Раз русский занимает больше токенов, тот же документ обходится дороже своего английского перевода. Величины при этом небольшие: обычная переписка почти ничего не стоит, лёгкие модели берут доли нейрона за ответ, а для тяжёлых задач есть замеры боевого биллинга платформы.

ЗадачаПримерный расход, нейронов
Ответ бесплатной модели0
Ревью кода≈ 3
Разбор договора на 15 страниц≈ 4
Ответ сильной модели на сложный вопрос≈ 12
Выжимка большого отчёта≈ 20
Картинка в MediaLab≈ 30
Минута работы проекта в песочнице1
Замеры боевого биллинга: сколько стоят типовые задачи

Считать удобно так: 300 нейронов тарифа «Старт» — это 75 разборов договора по 4 нейрона или 15 выжимок большого отчёта. Дорожает не переписка, а объём: если из PDF на 200 страниц нужен один раздел, вставляйте раздел, а не файл целиком. Нейрон стоит примерно 3 ₽; фактическая цена — 2,97 ₽ на «Старте», 3,59 ₽ на «Стандартном», 3,02 ₽ на PRO и 2,98 ₽ на Ultra. Проекты считаются отдельно: они открываются с «Старта», по 30 минут в сутки, и минута работы стоит 1 нейрон.

Честные ограничения

  • Сравнений моделей именно по качеству русского слога в публичном доступе нет — ни у нас, ни у вендоров. Любой выбор здесь делается на ваших текстах, а не по таблице.
  • В собственной таблице Google от 13.08.2026 Gemini 3.7 Flash уступает GPT-5.6 Terra на DeepSWE v1.1 (65,3 против 69,6) и terminal-bench 2.1 (85,8 против 87,4), а на GDPVal-AA идёт ниже Claude Sonnet 5, GPT-5.6 Terra и Muse Spark. Это чужие данные, и они не про русский язык.
  • Российские реалии модель знает неровно и ошибается уверенно: даты, нормы, названия документов проверяйте руками.
  • На бесплатном тарифе 100 нейронов дают один раз при регистрации, а не каждый месяц. Там же нет поиска в интернете и проектов, к платным моделям — 15 сообщений каждые 4 часа, MediaLab — 2 генерации.
  • Самая дорогая часть работы на русском — длинный ответ: у Gemini 3.7 Flash выход стоит 281 нейрон за 1 млн токенов против 56 на входе.
  • Мест на «Стандартном» не прибавляется: второе место появляется только на Ultra за 9 990 ₽ (3 350 нейронов), дальше — командные тарифы, от Team5 за 12 250 ₽ с 3 500 нейронами.
  • Сценарий «Российская» решает вопрос маршрута запроса, а не вопрос вашей ответственности за данные.

Что брать в итоге

Для повседневных задач — Gemini 3.7 Flash на бесплатном тарифе: контекста в 1 048 576 токенов хватает на любой рабочий документ, а бесплатные модели не тратят нейроны вовсе. Для текстов, которые уходят наружу, — Claude Sonnet 5 с «Старта»: 890 ₽, 300 нейронов, 81 модель и 50 сообщений каждые 4 часа. Если русские документы разбираете ежедневно и упираетесь в этот лимит, следующая осмысленная ступень — «Стандартный» за 2 690 ₽ с 750 нейронами и 150 сообщениями; как считать под свою нагрузку, разобрано в материале какой тариф выбрать.

Проверяется это за один вечер и без карты: на бесплатном тарифе открыты 52 модели из 95 и 100 стартовых нейронов. Возьмите свой настоящий текст — договор, письмо, статью — и прогоните через две-три модели подряд с одним и тем же промптом. Разница в русском слоге видна на первом же абзаце, и после этого вопрос про «Старт» за 890 ₽ вы решите сами, без чужих рекомендаций.