Прямой таблицы «Haiku против Gemini» в анонсе Anthropic нет. Сравнение ниже — из заметки Artificial Analysis от 7 октября 2026 и из описания входа в документации Haiku.
Оценки
| Замер Artificial Analysis | Haiku 5.5 | Gemini 3.8 Flash |
|---|---|---|
| Индекс интеллекта, max | 43 | 41 |
| Terminal-Bench 4.0 | 33% | 20% |
| AA-Omniscience, точность | 36% | 55% |
| Доля галлюцинаций | 40% | 55% |
33% на Terminal-Bench — это прогон Artificial Analysis, не 39,2% из анонса Anthropic. Порядок «Haiku выше Gemini Flash на этом тесте» относится к их замеру. На AutomationBench-AA у Haiku 35%, а у Gemini 3.8 Flash, Luna и GLM-5.3 Flash — в диапазоне 53–60%. Artificial Analysis пишет, что результат Haiku, скорее всего, занижен: на предварительных проверках модель слишком часто отказывала, и Anthropic это исправляет. Пока повторного прогона нет.
Что модель вообще принимает
- Haiku 5.5 — текст и изображения на входе, текст на выходе. Так написано у Anthropic и у Artificial Analysis. Видео и звук сами по себе она не смотрит.
- Gemini 3.8 Flash в чате SUIN.AI принимает ещё звук и видео. Если задача — ролик, запись созвона или голосовое, выбирать Haiku бессмысленно: файла она не увидит.
- Окно контекста у Haiku — 1 миллион токенов. Ответ — до 128 тысяч.
Как выбрать
- Текст, картинка, график, короткая агентная задача — Haiku уместна: на индексе и на их Terminal-Bench она чуть выше.
- Нужен факт «из головы», без приложенного источника — у Gemini в замере AA точность выше. Всё равно прикладывайте источник, если ошибка недопустима.
- Видео или аудио — Gemini 3.8 Flash, не Haiku.
Обе модели есть в списке чата. Сравнение с Luna — в гайде Haiku 5.5 и GPT-6 Luna.
Открыть чат в SUIN.AI — Haiku 5.5, GPT-6 Luna, Gemini 3.8 Flash, GLM и Kimi выбираются в одном списке.




