13 августа 2026 года Google выпустила Gemini 3.7 Flash и вместе с релизом опубликовала сравнение цен вендоров за миллион входных токенов: Gemini — 0,75 доллара, Claude — 2,00, GPT — 2,00, Muse — 1,25. За миллион выходных токенов — 3,75, 10,00, 12,00 и 4,25 соответственно.
Цифры выглядят как хорошая новость для всех, кто платит за работу моделей. Таблицу, правда, составила сама Google, сравнивая себя с конкурентами, — это стоит держать в уме. И там же есть строка, которую в пересказах новости обычно теряют: цена Gemini промоакционная и действует до 31 декабря 2026 года.
| Семейство | Вход, за 1 млн токенов | Выход, за 1 млн токенов |
|---|---|---|
| Gemini, промо до 31.12.2026 | 0,75 | 3,75 |
| Gemini, после промо | 1,50 | 7,50 |
| Muse | 1,25 | 4,25 |
| Claude | 2,00 | 10,00 |
| GPT | 2,00 | 12,00 |
Что такое «миллион токенов» и почему это не цена вашего вопроса
Токен — это кусок слова: поставщики считают не страницы и не символы, а такие куски. Точного курса пересчёта токенов в слова не существует — он зависит от языка и от самого текста, поэтому прайс и публикуют в токенах, а не в страницах. Для масштаба: у Gemini 3.7 Flash контекст 1 048 576 токенов, то есть примерно такой объём модель способна держать в одном разговоре целиком.
Почему цены падают
Идёт борьба за массового пользователя
11 августа 2026 года приложение Gemini перешагнуло миллиард активных пользователей в месяц; Google называет его самым быстрорастущим продуктом в своей истории. По данным самой Google динамика такая: 400 млн в мае 2025 года, 900 млн в мае 2026, а путь с 950 млн до миллиарда занял меньше месяца. При таком масштабе цена входа — прежде всего аргумент в борьбе за пользователя; что стоит за прайсом на самом деле, себестоимость или маркетинг, Google не раскрывает.
Китайские модели давят ценой
По расследованию CNBC от 7 июля 2026 года, каждую неделю начиная с 8 февраля 2026 модели китайского происхождения давали не меньше 30% корпоративного объёма токенов на шлюзе OpenRouter, а недельный пик к середине года — 46%. Для сравнения: в среднем за предыдущие двенадцать месяцев было 11%, а в первой половине 2025 года — 4,5%. Отдельно CNBC приводит Vercel: в июне 2026 через него прошло 29% токенов на китайских моделях с открытыми весами против примерно одной девятой в апреле. Причину называют простую — цена: эти модели дешевле американских в разы. Подробнее о том, чем они отличаются на практике, — в разборе китайских нейросетей.
Сам OpenRouter, по данным которого считал CNBC, — это «шлюз» к моделям: единая точка доступа к разным нейросетям, помогающая выбрать модель под задачу и бюджет и не привязываться к одному поставщику. По сообщению Bloomberg от 16 августа 2026 года его покупает Stripe более чем за 7 млрд долларов; сделку подтвердили TechCrunch и Fortune. Это в 5,4 раза выше оценки в 1,3 млрд долларов, полученной на раунде Series B тремя месяцами ранее, в мае 2026 (раунд на 113 млн долларов, участники — Sequoia, Andreessen Horowitz, Menlo Ventures, CapitalG). Гендиректор OpenRouter Алекс Аталла описывал компанию как «Stripe для ИИ» — покупателем в итоге оказался сам Stripe. Вывод для отрасли простой: дорого стоит не только модель, но и возможность не зависеть от одного поставщика.
У поставщиков очень разная экономика
По сообщениям СМИ, Anthropic во втором квартале 2026 года впервые за всю историю вышла в операционную прибыль: выручка около 10,9 млрд долларов — больше чем вдвое к 4,8 млрд первого квартала, операционная прибыль около 559 млн. По тем же сообщениям, обсуждается возможное IPO осенью 2026 года.
OpenAI, наоборот, готовит подачу S-1: по сообщениям, документы ждут в ближайшие недели, а размещение возможно уже в сентябре 2026 года. В 2026 году компания, по тем же сообщениям, потратит около 22 млрд долларов при выручке около 13 млрд — операционный убыток порядка 14 млрд; выход в прибыль планируется к 2030 году. Что из этой разницы в экономике следует для цен — вопрос открытый: своих будущих прайсов ни OpenAI, ни Anthropic не объявляли, и гадать за них мы не будем.
Главное: сегодняшняя цена — это не цена на год
Промоцена Gemini живёт до 31 декабря 2026 года. С 1 января вход становится 1,50 доллара за миллион токенов вместо 0,75, а выход — 7,50 вместо 3,75. Это ровно вдвое, и это не рыночный прогноз, а объявленный самим поставщиком прайс.
Считайте не в токенах, а в задачах
Токен — единица поставщика, а не ваша. Никто не планирует работу отдела в токенах, зато все знают, сколько договоров, писем, отчётов и картинок делают за месяц. У нас расход считается в нейронах — это своя единица, она не пересчитывается напрямую в чужой прайс за миллион токенов, зато её видно в задачах. Как это устроено, подробно разобрано в материале о том, как тратить меньше нейронов.
| Задача | Расход, нейроны | Примерно в рублях |
|---|---|---|
| Разбор договора на 15 страниц | 4 | 12 ₽ |
| Ответ сильной модели | 12 | 36 ₽ |
| Выжимка большого отчёта | 20 | 60 ₽ |
| Картинка | 30 | 90 ₽ |
| Минута работы проекта | 1 | 3 ₽ |
Отсюда легко собрать свой месяц. Двадцать разобранных договоров — 80 нейронов, десять ответов сильной модели — 120, пять выжимок из больших отчётов — 100. Итого 300 нейронов, то есть ровно тариф «Старт» за 890 ₽. Если ваша арифметика даёт вдвое больше, смотрите какой тариф выбрать: платить за запас, который не расходуете, смысла столько же, сколько упираться в лимит в середине месяца.
Отдельная строка экономии: бесплатные модели не тратят нейроны и не расходуют лимит сообщений. Gemini 3.7 Flash — модель платформы по умолчанию, доступна бесплатно на всех тарифах, включая бесплатный, и заметную часть рутины можно закрыть ею, оставив сильные модели для задач, где разница в качестве видна. Что до долларовых прайсов поставщиков — ваш счёт у нас считается в нейронах, а не в них; про саму модель есть отдельный разбор — сколько стоит Gemini 3.7 Flash.
Чего из этой новости не следует
- Google не сообщила, что будет с ценами конкурентов. Из того, что Gemini подорожает вдвое в январе, не следует ни что Claude и GPT подешевеют, ни что они останутся на месте.
- Данные CNBC — про корпоративный трафик на шлюзе OpenRouter и про Vercel. Это большой и показательный срез, но не весь рынок и не ваша конкретная нагрузка.
- Миллиард пользователей Gemini — это активные пользователи приложения в месяц. Сколько из них платят, Google не раскрыла.
- Дешёвый вход не означает дешёвую работу. Выход дороже входа у всех четырёх семейств в таблице, а в диалоге вы платите ещё и за то, что модель каждый раз перечитывает контекст.
- Внешние рейтинги измеряют не цену, а способности: в августе 2026 года индекс Artificial Analysis Intelligence Index ставит наверх Claude Opus 5 (63,1) и Claude Fable 5 (62,1), а публичные лидерборды сравнивают от 300 до 390 моделей. Самая дешёвая и самая сильная — почти никогда не одна и та же модель.
- Наши замеры расхода — это наши задачи и наши формулировки, а не универсальный норматив. Ваш расход зависит от длины документов и от того, сколько раз вы переспрашиваете; поэтому считать стоит на своих задачах, а не на чужой таблице.
Что делать сейчас
- Посчитайте свой типичный месяц в задачах: сколько документов, ответов и картинок вы реально делаете. Это единственная цифра, из которой можно строить бюджет.
- Пересчитайте годовой план по постпромо-цене — 1,50 и 7,50 у Gemini. Если сходится, всё в порядке; если нет, вы планировали по скидке.
- Не привязывайтесь к одной модели. Возможность переключить модель прямо внутри диалога — это и есть страховка от чужого прайс-листа.
- Переведите рутину на бесплатные модели, а сильные держите для задач, где разница в качестве видна невооружённым глазом.
- Через месяц сверьте план с фактом. Расход в задачах — цифра, которая уточняется только на практике.
Промпт: перевести свою работу из ощущений в месячный объём
Помоги посчитать мой месячный объём работы с ИИ.
Вот что я делаю за обычную неделю:
- [перечислите: разбор документов, ответы клиентам, выжимки из отчётов, картинки, прочее]
Сделай так:
1. Переведи недельные объёмы в месячные по каждой категории.
2. Сгруппируй задачи в четыре типа: разбор документа, длинный ответ модели, выжимка большого отчёта, картинка.
3. Верни таблицу: тип задачи, количество в месяц.
4. Отдельно отметь, какие из этих задач простые и их можно отдать быстрой модели, а какие требуют сильной.Проверить арифметику проще, чем спорить о прогнозах. На бесплатном тарифе доступны 52 модели из 95 и 100 нейронов — они начисляются один раз при регистрации, а не ежемесячно. Этого хватит, чтобы прогнать свои настоящие задачи и увидеть реальный расход. Про пределы честно: поиска в интернете и проектов на бесплатном нет, к платным моделям — 15 сообщений каждые 4 часа, бесплатные модели этот лимит не расходуют. Следующая ступень — «Старт» за 890 ₽: 300 нейронов, 81 модель, поиск в интернете и 30 минут проектов в сутки; остальное — на странице тарифов.



