Модели китайского происхождения дают до 46% корпоративного объёма токенов на шлюзе OpenRouter — это недельный пик к середине 2026 года. Цифру опубликовало расследование CNBC от 7 июля 2026 года; в среднем за предыдущие двенадцать месяцев доля была 11%, а в первой половине 2025-го — 4,5%.
Важна не только величина, но и устойчивость. По данным того же расследования, каждую неделю начиная с 8 февраля 2026 года доля держалась не ниже 30%. То есть это не всплеск на релизе очередной модели, а уровень, который сохраняется месяц за месяцем.
| Период | Доля токенов на моделях китайского происхождения |
|---|---|
| Первая половина 2025 года | 4,5% |
| В среднем за предыдущие двенадцать месяцев | 11% |
| Каждая неделя начиная с 8 февраля 2026 года | не ниже 30% |
| Недельный пик к середине 2026 года | 46% |
Похожая картина на другом шлюзе. Через продакшн-шлюз Vercel в июне 2026 года прошло 29% токенов на китайских моделях с открытыми весами — против примерно одной девятой в апреле того же года (CNBC, 7 июля 2026 года).
Почему это вообще важно
Шлюз — это единая точка доступа к разным моделям: компания подключается один раз и дальше решает, какой модели отдать конкретный запрос. Поэтому доля токенов на шлюзе показывает не то, о чём говорят на конференциях, а то, за что реально платят каждый день.
Сама эта смена прошла без громких заявлений — она складывалась из повседневных решений о том, какому запросу какая модель. Именно поэтому её проще увидеть в счётчике токенов, чем в новостях о релизах.
Заодно короткий контекст про сам шлюз, чьи данные считает CNBC. По сообщению Bloomberg от 16 августа 2026 года (подтверждено TechCrunch, Fortune и Dataconomy), Stripe закрыла сделку по покупке OpenRouter, сумма — больше 7 млрд долларов. Это в 5,4 раза выше оценки в 1,3 млрд, которую компания получила на раунде Series B в мае 2026 года; гендиректор Алекс Аталла описывал OpenRouter как «Stripe для ИИ».
Почему их берут: дело в цене
Причина, которую называет CNBC, простая — стоимость. Китайские модели дешевле американских в разы. Конкретных прайсов расследование не приводит, поэтому и мы не будем подставлять цифры, которых в источнике нет.
Разница в цене решает там, где задач много и они однотипны: разбор входящих писем, классификация заявок, извлечение полей из документов, черновые выжимки. На одном запросе разница незаметна. На потоке из десятков тысяч запросов она и превращается в весь бюджет.
Дешевеет при этом и у американских вендоров. При релизе Gemini 3.7 Flash 13 августа 2026 года Google опубликовала сравнение цен за миллион входных токенов: 0,75 доллара у Gemini против 2,00 у Claude и 2,00 у GPT; за миллион выходных — 3,75 против 10,00 и 12,00. Цена Gemini промоакционная, действует до 31 декабря 2026 года, дальше 1,50 и 7,50. Оговорка по-честному: это сравнение опубликовал сам вендор.
Что это за модели
Расследование считает поток на шлюзе целиком и не расписывает долю по конкретным моделям. В нашем каталоге модели китайского происхождения представлены двумя семействами — DeepSeek и Qwen, и они находятся на уровне доступа BASIC:
- DeepSeek V4 Pro
- DeepSeek V4 Flash
- DeepSeek R1
- DeepSeek V3.2
- Qwen3.8 Max
Уровень BASIC открыт на бесплатном тарифе — там доступны 52 модели из 95, вместе с Gemini 3.7 Flash, GPT-5.6 Luna и Llama 4 Maverick. Проще говоря: те же семейства моделей, чью долю считает CNBC, вы можете сравнить на собственной задаче сегодня, без подписки.
Что это меняет для вас
Главный вывод не «переходите на китайские модели», а «перестаньте выбирать лагерь один раз и навсегда». Модель выбирается под задачу и бюджет, и переключить её можно прямо внутри одного диалога — сравнение двух ответов на один и тот же текст занимает пару минут.
Экономика выглядит так: ответ сильной модели — примерно 12 нейронов, разбор договора на 15 страниц — около 4, выжимка большого отчёта — около 20 (нейрон ≈ 3 ₽). Если половину рутины забирают бесплатные модели, месячный пакет держится заметно дольше. А если не хочется держать каталог в голове, режим «Лайт» предлагает готовые сценарии вместо списка моделей и заранее показывает цену ответа — «≈ N нейронов за ответ», уже с наценкой.
| Тариф | Цена в месяц | Моделей в каталоге | Нейроны |
|---|---|---|---|
| Бесплатный | 0 ₽ | 52 из 95 | 100 один раз при регистрации |
| Старт | 890 ₽ | 81 | 300 |
| Стандартный | 2 690 ₽ | 81 | 750 |
| PRO | 4 990 ₽ | все 95 | 1 650 |
| Ultra | 9 990 ₽ | все 95 | 3 350 |
Промпт для честного сравнения: прогоните его на бесплатной и на сильной модели
Задача: [опишите в двух предложениях, что нужно получить]
Исходные данные: [вставьте текст, письмо, кусок таблицы]
Формат ответа: [список из 5 пунктов / таблица / абзац на 700 знаков]
Сделай работу. В конце отдельным абзацем перечисли:
1) что в задаче ты счёл однозначным;
2) где пришлось додумывать за меня;
3) чего в исходных данных не хватило.Риски: происхождение модели и чувствительные данные
Открытые веса и страна происхождения — отдельный вопрос, и ценой он не снимается. Для части задач он не стоит вовсе: черновик текста, разбор публичной статьи, код без секретов. Для персональных данных сотрудников и клиентов, медицинских сведений, коммерческой тайны — стоит, и отвечать на него нужно до отправки, а не после.
Практическое правило несложное: не отправляйте в чат персональные данные — ФИО вместе с телефонами, паспортные данные, сканы документов. Обезличивайте: «сотрудник А», «клиент Б», суммы округлённо. Это правило не про происхождение модели, а про то, что любой текст из чата уходит внешнему поставщику.
Честные оговорки
- 46% — недельный пик, а не средняя величина. Устойчивая планка по данным CNBC — не ниже 30% каждую неделю начиная с 8 февраля 2026 года.
- Измерение сделано по корпоративному трафику OpenRouter. Это крупный, но всё же один шлюз; доли по рынку США целиком никто не публиковал.
- Данные Vercel приведены приблизительно: 29% в июне 2026 года против «примерно одной девятой» в апреле.
- Цены китайских моделей в расследовании не названы — только порядок разницы, «в разы». Точные цифры мы придумывать не будем.
- Сравнение цен за миллион токенов опубликовала Google при релизе Gemini 3.7 Flash 13 августа 2026 года — это данные вендора о самом себе и о конкурентах.
- Из доли токенов не следует превосходство в качестве: в индексе Artificial Analysis Intelligence Index на август 2026 года наверху Claude Opus 5 (63,1) и Claude Fable 5 (62,1).
И ещё одно, чтобы не осталось недосказанности. Через какую инфраструктуру работает наша платформа — не публичная информация, и к сделкам вокруг шлюзов мы отношения не имеем. Здесь мы пишем про отрасль, а выводы делаем только про то, что вы видите в интерфейсе.
Что делать сейчас
- Заведите бесплатный аккаунт: 52 модели из 95 и 100 нейронов один раз при регистрации, без подписки — регистрация.
- Возьмите одну реальную рабочую задачу, не тестовую, и прогоните её на DeepSeek V4 Flash, на Qwen3.8 Max и на Gemini 3.7 Flash. Модель переключается внутри одного диалога, ответы окажутся рядом.
- Отметьте задачи, где разницы с сильной моделью нет. Их можно навсегда отдать бесплатным моделям — нейроны они не тратят и лимит сообщений не расходуют.
- Отметьте, где разница есть. Именно на такие задачи и имеет смысл тратить платные модели и нейроны.
- Если понадобится поиск в интернете, проекты и 81 модель вместо 52 — следующая ступень это тариф «Старт» за 890 ₽: 300 нейронов, 50 сообщений и 10 генераций на 4 часа, 30 минут проектов в сутки.



