Анонс Anthropic сравнивает Haiku 5.5 с Sonnet на отдельных тестах. Artificial Analysis добавляет одну шкалу на все модели и показывает, как балл Haiku едет вместе со ступенью усилия. Оба источника от 7 октября 2026.
Одна шкала
| Модель и ступень | Индекс |
|---|---|
| Sonnet 5.5, max | 56 |
| Kimi K3 | 44 |
| Haiku 5.5, max | 43 |
| GLM-5.3 Flash | 42 |
| Gemini 3.8 Flash | 41 |
| Haiku 5.5, high, и GPT-6 Luna, max | 38 |
Год назад, пишет Artificial Analysis, предыдущая Haiku была на 26 пунктов ниже. Рост большой относительно себя. До Sonnet на максимальной ступени всё равно 13 пунктов — это уже не «почти то же самое в более быстром корпусе».
Усилие меняет балл
- По умолчанию в Claude API у Haiku стоит medium, а таблица анонса и индекс 43 сняты на максимальном усилии. Это разные режимы.
- На high индекс Haiku — 38. Столько же Artificial Analysis ставит GPT-6 Luna на max.
- С xhigh до max Haiku прибавляет около 2 пунктов. На max она пишет около 162 тысяч выходных токенов на задачу индекса — больше, чем Opus 5.5 на max, и примерно втрое больше, чем Luna на max (около 50 тысяч).
- На high объём ближе к Luna: около 55 тысяч токенов на задачу при тех же 38 пунктах.
Не смешивать два Terminal-Bench
В анонсе у Haiku на Terminal-Bench 4.0 — 39,2%, у Sonnet — 70,6%. У Artificial Analysis свой прогон того же имени бенчмарка: у Haiku 33%. Оба числа настоящие и оба подписаны своим источником. Для выбора важно не среднее, а вывод, который совпадает: на сложном коде в терминале Sonnet далеко впереди, Haiku — модель узкого шага.
Таблицу Anthropic по трём своим моделям см. в гайде Haiku, Sonnet и Opus. Новость о выходе — в материале новости о выходе.
Открыть чат в SUIN.AI — Haiku 5.5, GPT-6 Luna, Gemini 3.8 Flash, GLM и Kimi выбираются в одном списке.






