Обзоры моделей обычно перечисляют победы. Полезнее знать границу: где модель надёжна, где ошибается предсказуемо и где не поможет вовсе. Ниже — три списка и цифры, на которые они опираются.

Что она делает уверенно

  • Работает с большим объёмом текста. Миллион токенов контекста — комплект документов целиком, без нарезки и склейки ответов.
  • Понимает разные входы. Текст, картинки, видео, аудио, файлы — редкое сочетание для одной модели, и единственное на бесплатном тарифе.
  • Держит многошаговые задачи. Поддерживает инструменты и строгие форматы ответа, годится для сценариев с несколькими шагами.
  • Быстро отвечает при умеренной цене. Линейка Flash — про отклик, а 113 нейронов за миллион входа делают её пригодной для потока.

Где нужен присмотр

  • Арифметика по данным. Числа, посчитанные «в уме», проверяйте. Просите код расчёта — тогда результат воспроизводим.
  • Точные цитаты и ссылки. Модель может уверенно назвать несуществующий пункт. Требуйте цитату из приложенного файла, а не пересказ.
  • Свежие события. Знания модели ограничены датой обучения; про вчерашнее она либо не знает, либо додумывает.
  • Юридические и медицинские выводы. Годится как черновик и как поиск по документу, но не как заключение.

Чего она не делает

  • Не создаёт картинки и видео. Только читает их. Для генерации на платформе есть МедиаЛаб.
  • Не выходит в интернет сама по себе. Поиск — отдельная возможность платформы, а не свойство модели.
  • Не помнит вас между диалогами. Постоянный контекст живёт в базах знаний и в настройках помощника, а не в самой модели.
  • Не даёт настраивать глубину рассуждения из окна чата. Такие параметры доступны только через API.

Где она среди других моделей

По независимому сводному индексу Intelligence Index у Gemini 3.8 Flash 59 баллов в режиме высокого рассуждения. Это на три пункта выше предыдущей версии и вровень с частью старших моделей — при цене лёгкой.

МодельБаллС какого тарифа
Claude Fable 5.166Про
Claude Opus 563Про
Grok 4.6 high61Старт
GPT-5.6 Sol max61Про
Gemini 3.8 Flash59бесплатный
GPT-5.6 Sol59Про
Gemini 3.7 Flash56бесплатный

Читать эту таблицу стоит так: разрыв с верхом есть, но он меньше разрыва в цене. Fable 5.1 стоит 1 800 и 9 000 нейронов против 113 и 563 — в шестнадцать раз дороже за семь баллов индекса.

Когда разница в баллах важна, а когда нет

  • Не важна — если задача типовая и результат вы всё равно проверяете: письма, конспекты, поиск по документу, черновики.
  • Важна — если цена ошибки высокая и проверить некому: юридический анализ, финансовая модель, длинный автономный прогон агента.
  • Проверяется за десять минут — прогоните свою настоящую задачу на 3.8 Flash и на старшей модели и сравните. Это надёжнее любого рейтинга.

Что ещё почитать

👉 Проверить границы самому — 100 нейронов при регистрации, без карты.