Модели китайского происхождения дают до 46% корпоративного объёма токенов на шлюзе OpenRouter — это недельный пик к середине 2026 года. Цифру опубликовало расследование CNBC от 7 июля 2026 года; в среднем за предыдущие двенадцать месяцев доля была 11%, а в первой половине 2025-го — 4,5%.

Важна не только величина, но и устойчивость. По данным того же расследования, каждую неделю начиная с 8 февраля 2026 года доля держалась не ниже 30%. То есть это не всплеск на релизе очередной модели, а уровень, который сохраняется месяц за месяцем.

ПериодДоля токенов на моделях китайского происхождения
Первая половина 2025 года4,5%
В среднем за предыдущие двенадцать месяцев11%
Каждая неделя начиная с 8 февраля 2026 годане ниже 30%
Недельный пик к середине 2026 года46%
Доля моделей китайского происхождения в корпоративном объёме токенов на OpenRouter. Источник: расследование CNBC от 7 июля 2026 года

Похожая картина на другом шлюзе. Через продакшн-шлюз Vercel в июне 2026 года прошло 29% токенов на китайских моделях с открытыми весами — против примерно одной девятой в апреле того же года (CNBC, 7 июля 2026 года).

Почему это вообще важно

Шлюз — это единая точка доступа к разным моделям: компания подключается один раз и дальше решает, какой модели отдать конкретный запрос. Поэтому доля токенов на шлюзе показывает не то, о чём говорят на конференциях, а то, за что реально платят каждый день.

Сама эта смена прошла без громких заявлений — она складывалась из повседневных решений о том, какому запросу какая модель. Именно поэтому её проще увидеть в счётчике токенов, чем в новостях о релизах.

Заодно короткий контекст про сам шлюз, чьи данные считает CNBC. По сообщению Bloomberg от 16 августа 2026 года (подтверждено TechCrunch, Fortune и Dataconomy), Stripe закрыла сделку по покупке OpenRouter, сумма — больше 7 млрд долларов. Это в 5,4 раза выше оценки в 1,3 млрд, которую компания получила на раунде Series B в мае 2026 года; гендиректор Алекс Аталла описывал OpenRouter как «Stripe для ИИ».

Почему их берут: дело в цене

Причина, которую называет CNBC, простая — стоимость. Китайские модели дешевле американских в разы. Конкретных прайсов расследование не приводит, поэтому и мы не будем подставлять цифры, которых в источнике нет.

Разница в цене решает там, где задач много и они однотипны: разбор входящих писем, классификация заявок, извлечение полей из документов, черновые выжимки. На одном запросе разница незаметна. На потоке из десятков тысяч запросов она и превращается в весь бюджет.

Дешевеет при этом и у американских вендоров. При релизе Gemini 3.7 Flash 13 августа 2026 года Google опубликовала сравнение цен за миллион входных токенов: 0,75 доллара у Gemini против 2,00 у Claude и 2,00 у GPT; за миллион выходных — 3,75 против 10,00 и 12,00. Цена Gemini промоакционная, действует до 31 декабря 2026 года, дальше 1,50 и 7,50. Оговорка по-честному: это сравнение опубликовал сам вендор.

Что это за модели

Расследование считает поток на шлюзе целиком и не расписывает долю по конкретным моделям. В нашем каталоге модели китайского происхождения представлены двумя семействами — DeepSeek и Qwen, и они находятся на уровне доступа BASIC:

  • DeepSeek V4 Pro
  • DeepSeek V4 Flash
  • DeepSeek R1
  • DeepSeek V3.2
  • Qwen3.8 Max

Уровень BASIC открыт на бесплатном тарифе — там доступны 52 модели из 95, вместе с Gemini 3.7 Flash, GPT-5.6 Luna и Llama 4 Maverick. Проще говоря: те же семейства моделей, чью долю считает CNBC, вы можете сравнить на собственной задаче сегодня, без подписки.

Что это меняет для вас

Главный вывод не «переходите на китайские модели», а «перестаньте выбирать лагерь один раз и навсегда». Модель выбирается под задачу и бюджет, и переключить её можно прямо внутри одного диалога — сравнение двух ответов на один и тот же текст занимает пару минут.

Экономика выглядит так: ответ сильной модели — примерно 12 нейронов, разбор договора на 15 страниц — около 4, выжимка большого отчёта — около 20 (нейрон ≈ 3 ₽). Если половину рутины забирают бесплатные модели, месячный пакет держится заметно дольше. А если не хочется держать каталог в голове, режим «Лайт» предлагает готовые сценарии вместо списка моделей и заранее показывает цену ответа — «≈ N нейронов за ответ», уже с наценкой.

ТарифЦена в месяцМоделей в каталогеНейроны
Бесплатный0 ₽52 из 95100 один раз при регистрации
Старт890 ₽81300
Стандартный2 690 ₽81750
PRO4 990 ₽все 951 650
Ultra9 990 ₽все 953 350
Доступ к каталогу по тарифам. Данные платформы на 14 августа 2026 года

Промпт для честного сравнения: прогоните его на бесплатной и на сильной модели

Задача: [опишите в двух предложениях, что нужно получить]
Исходные данные: [вставьте текст, письмо, кусок таблицы]
Формат ответа: [список из 5 пунктов / таблица / абзац на 700 знаков]

Сделай работу. В конце отдельным абзацем перечисли:
1) что в задаче ты счёл однозначным;
2) где пришлось додумывать за меня;
3) чего в исходных данных не хватило.

Риски: происхождение модели и чувствительные данные

Открытые веса и страна происхождения — отдельный вопрос, и ценой он не снимается. Для части задач он не стоит вовсе: черновик текста, разбор публичной статьи, код без секретов. Для персональных данных сотрудников и клиентов, медицинских сведений, коммерческой тайны — стоит, и отвечать на него нужно до отправки, а не после.

Практическое правило несложное: не отправляйте в чат персональные данные — ФИО вместе с телефонами, паспортные данные, сканы документов. Обезличивайте: «сотрудник А», «клиент Б», суммы округлённо. Это правило не про происхождение модели, а про то, что любой текст из чата уходит внешнему поставщику.

Честные оговорки

  • 46% — недельный пик, а не средняя величина. Устойчивая планка по данным CNBC — не ниже 30% каждую неделю начиная с 8 февраля 2026 года.
  • Измерение сделано по корпоративному трафику OpenRouter. Это крупный, но всё же один шлюз; доли по рынку США целиком никто не публиковал.
  • Данные Vercel приведены приблизительно: 29% в июне 2026 года против «примерно одной девятой» в апреле.
  • Цены китайских моделей в расследовании не названы — только порядок разницы, «в разы». Точные цифры мы придумывать не будем.
  • Сравнение цен за миллион токенов опубликовала Google при релизе Gemini 3.7 Flash 13 августа 2026 года — это данные вендора о самом себе и о конкурентах.
  • Из доли токенов не следует превосходство в качестве: в индексе Artificial Analysis Intelligence Index на август 2026 года наверху Claude Opus 5 (63,1) и Claude Fable 5 (62,1).

И ещё одно, чтобы не осталось недосказанности. Через какую инфраструктуру работает наша платформа — не публичная информация, и к сделкам вокруг шлюзов мы отношения не имеем. Здесь мы пишем про отрасль, а выводы делаем только про то, что вы видите в интерфейсе.

Что делать сейчас

  1. Заведите бесплатный аккаунт: 52 модели из 95 и 100 нейронов один раз при регистрации, без подписки — регистрация.
  2. Возьмите одну реальную рабочую задачу, не тестовую, и прогоните её на DeepSeek V4 Flash, на Qwen3.8 Max и на Gemini 3.7 Flash. Модель переключается внутри одного диалога, ответы окажутся рядом.
  3. Отметьте задачи, где разницы с сильной моделью нет. Их можно навсегда отдать бесплатным моделям — нейроны они не тратят и лимит сообщений не расходуют.
  4. Отметьте, где разница есть. Именно на такие задачи и имеет смысл тратить платные модели и нейроны.
  5. Если понадобится поиск в интернете, проекты и 81 модель вместо 52 — следующая ступень это тариф «Старт» за 890 ₽: 300 нейронов, 50 сообщений и 10 генераций на 4 часа, 30 минут проектов в сутки.