Haiku 4.5 Anthropic не сняла: в обзоре моделей она в списке прежних, но документация прямо советует смотреть в сторону Haiku 5.5. Ниже — только то, что расходится по фактам, без оценки «на глаз».

Цифры рядом

Haiku 4.5Haiku 5.5
Релиз линейкиоктябрь 20257 октября 2026
Контекст200 0001 000 000
Ответ64 000128 000
GDPval-AA v2.17351620
OSWorld 2.1, офлайн15,7%72,4%
Terminal-Bench 4.00,0%39,2%
Усилиенетпять ступеней, по умолчанию medium
Источники: анонс Haiku 5.5 и карточки моделей Claude

Сравнение с другими небольшими моделями — в гайдах Haiku 5.5 и GPT-6 Luna и Haiku 5.5 и Gemini 3.8 Flash.

Где разрыв большой

  • Работа за компьютером. OSWorld 2.1 на офлайн-подмножестве: 72,4% против 15,7%. Это тест длинных многошаговых действий в настоящей среде, не «напиши функцию».
  • Знания и офисные задачи. GDPval-AA вырос с 735 до 1620, AA-Briefcase — с 614 до 1578. Оба теста приводит Anthropic.
  • Картинки и графики. Chartography без инструментов: 46,4% против 6,4%.
  • Длинный контекст. 200 тысяч против миллиона. Для пачки договоров или длинной переписки это другой класс, не «чуть больше».

Где Haiku 5.5 всё ещё не замена большой модели

Terminal-Bench 4.0: 39,2% у Haiku 5.5 и 70,6% у Sonnet 5.5. У Haiku 4.5 в той же таблице ноль. Рост относительно себя огромный, до Sonnet на сложном агентном коде — нет. Anthropic так и пишет: большую разработку оставляйте Sonnet и Opus, Haiku ставьте на узкие шаги.

Практическое правило

  1. Короткие однотипные вызовы, которые сейчас идут на Haiku 4.5, переводите на 5.5 и сверяйте свою выборку, а не только таблицу Anthropic.
  2. Код, где модель сама ведёт длинную сессию в терминале, на Haiku не переносите. Ей там место субагента: найти фрагмент, сжать diff, классифицировать ошибку. См. Haiku 5.5 как субагент для кода.

Открыть чат в SUIN.AI — Claude Haiku 5.5, Claude Sonnet 5.5 и Claude Opus 5.5 уже в списке моделей. Отдельный аккаунт Anthropic не нужен.