Прямой таблицы «Haiku против Gemini» в анонсе Anthropic нет. Сравнение ниже — из заметки Artificial Analysis от 7 октября 2026 и из описания входа в документации Haiku.

Оценки

Замер Artificial AnalysisHaiku 5.5Gemini 3.8 Flash
Индекс интеллекта, max4341
Terminal-Bench 4.033%20%
AA-Omniscience, точность36%55%
Доля галлюцинаций40%55%
Artificial Analysis, 7 октября 2026. Индекс Haiku снят на максимальном усилии

33% на Terminal-Bench — это прогон Artificial Analysis, не 39,2% из анонса Anthropic. Порядок «Haiku выше Gemini Flash на этом тесте» относится к их замеру. На AutomationBench-AA у Haiku 35%, а у Gemini 3.8 Flash, Luna и GLM-5.3 Flash — в диапазоне 53–60%. Artificial Analysis пишет, что результат Haiku, скорее всего, занижен: на предварительных проверках модель слишком часто отказывала, и Anthropic это исправляет. Пока повторного прогона нет.

Что модель вообще принимает

  • Haiku 5.5 — текст и изображения на входе, текст на выходе. Так написано у Anthropic и у Artificial Analysis. Видео и звук сами по себе она не смотрит.
  • Gemini 3.8 Flash в чате SUIN.AI принимает ещё звук и видео. Если задача — ролик, запись созвона или голосовое, выбирать Haiku бессмысленно: файла она не увидит.
  • Окно контекста у Haiku — 1 миллион токенов. Ответ — до 128 тысяч.

Как выбрать

  1. Текст, картинка, график, короткая агентная задача — Haiku уместна: на индексе и на их Terminal-Bench она чуть выше.
  2. Нужен факт «из головы», без приложенного источника — у Gemini в замере AA точность выше. Всё равно прикладывайте источник, если ошибка недопустима.
  3. Видео или аудио — Gemini 3.8 Flash, не Haiku.

Обе модели есть в списке чата. Сравнение с Luna — в гайде Haiku 5.5 и GPT-6 Luna.


Открыть чат в SUIN.AI — Haiku 5.5, GPT-6 Luna, Gemini 3.8 Flash, GLM и Kimi выбираются в одном списке.