Анонс Anthropic сравнивает Haiku 5.5 с Sonnet на отдельных тестах. Artificial Analysis добавляет одну шкалу на все модели и показывает, как балл Haiku едет вместе со ступенью усилия. Оба источника от 7 октября 2026.

Одна шкала

Модель и ступеньИндекс
Sonnet 5.5, max56
Kimi K344
Haiku 5.5, max43
GLM-5.3 Flash42
Gemini 3.8 Flash41
Haiku 5.5, high, и GPT-6 Luna, max38
Artificial Analysis, 7 октября 2026

Год назад, пишет Artificial Analysis, предыдущая Haiku была на 26 пунктов ниже. Рост большой относительно себя. До Sonnet на максимальной ступени всё равно 13 пунктов — это уже не «почти то же самое в более быстром корпусе».

Усилие меняет балл

  • По умолчанию в Claude API у Haiku стоит medium, а таблица анонса и индекс 43 сняты на максимальном усилии. Это разные режимы.
  • На high индекс Haiku — 38. Столько же Artificial Analysis ставит GPT-6 Luna на max.
  • С xhigh до max Haiku прибавляет около 2 пунктов. На max она пишет около 162 тысяч выходных токенов на задачу индекса — больше, чем Opus 5.5 на max, и примерно втрое больше, чем Luna на max (около 50 тысяч).
  • На high объём ближе к Luna: около 55 тысяч токенов на задачу при тех же 38 пунктах.

Не смешивать два Terminal-Bench

В анонсе у Haiku на Terminal-Bench 4.0 — 39,2%, у Sonnet — 70,6%. У Artificial Analysis свой прогон того же имени бенчмарка: у Haiku 33%. Оба числа настоящие и оба подписаны своим источником. Для выбора важно не среднее, а вывод, который совпадает: на сложном коде в терминале Sonnet далеко впереди, Haiku — модель узкого шага.

Таблицу Anthropic по трём своим моделям см. в гайде Haiku, Sonnet и Opus. Новость о выходе — в материале новости о выходе.


Открыть чат в SUIN.AI — Haiku 5.5, GPT-6 Luna, Gemini 3.8 Flash, GLM и Kimi выбираются в одном списке.