Haiku 4.5 Anthropic не сняла: в обзоре моделей она в списке прежних, но документация прямо советует смотреть в сторону Haiku 5.5. Ниже — только то, что расходится по фактам, без оценки «на глаз».
Цифры рядом
| Haiku 4.5 | Haiku 5.5 | |
|---|---|---|
| Релиз линейки | октябрь 2025 | 7 октября 2026 |
| Контекст | 200 000 | 1 000 000 |
| Ответ | 64 000 | 128 000 |
| GDPval-AA v2.1 | 735 | 1620 |
| OSWorld 2.1, офлайн | 15,7% | 72,4% |
| Terminal-Bench 4.0 | 0,0% | 39,2% |
| Усилие | нет | пять ступеней, по умолчанию medium |
Сравнение с другими небольшими моделями — в гайдах Haiku 5.5 и GPT-6 Luna и Haiku 5.5 и Gemini 3.8 Flash.
Где разрыв большой
- Работа за компьютером. OSWorld 2.1 на офлайн-подмножестве: 72,4% против 15,7%. Это тест длинных многошаговых действий в настоящей среде, не «напиши функцию».
- Знания и офисные задачи. GDPval-AA вырос с 735 до 1620, AA-Briefcase — с 614 до 1578. Оба теста приводит Anthropic.
- Картинки и графики. Chartography без инструментов: 46,4% против 6,4%.
- Длинный контекст. 200 тысяч против миллиона. Для пачки договоров или длинной переписки это другой класс, не «чуть больше».
Где Haiku 5.5 всё ещё не замена большой модели
Terminal-Bench 4.0: 39,2% у Haiku 5.5 и 70,6% у Sonnet 5.5. У Haiku 4.5 в той же таблице ноль. Рост относительно себя огромный, до Sonnet на сложном агентном коде — нет. Anthropic так и пишет: большую разработку оставляйте Sonnet и Opus, Haiku ставьте на узкие шаги.
Практическое правило
- Короткие однотипные вызовы, которые сейчас идут на Haiku 4.5, переводите на 5.5 и сверяйте свою выборку, а не только таблицу Anthropic.
- Код, где модель сама ведёт длинную сессию в терминале, на Haiku не переносите. Ей там место субагента: найти фрагмент, сжать diff, классифицировать ошибку. См. Haiku 5.5 как субагент для кода.
Открыть чат в SUIN.AI — Claude Haiku 5.5, Claude Sonnet 5.5 и Claude Opus 5.5 уже в списке моделей. Отдельный аккаунт Anthropic не нужен.

