Haiku 4.5 думала по ручному бюджету токенов. У Haiku 5.5 этот параметр возвращает ошибку 400. Вместо него — адаптивное мышление, которое включено само, и рычаг effort. Рекомендации ниже — из страницы промптинга Haiku 5.5.

Какую ступень ставить

СтупеньКогда
lowМетка, извлечение поля, короткий ответ в поддержке. На длинном агентном промпте чаще пропускает поиск и проверку
mediumСтарт почти для всего, включая агентный код. Это значение по умолчанию
highНужно точнее держать инструкцию, задача длиннее
xhigh и maxТолько после замера. Anthropic просит сравнить их с Sonnet 5.5
По документации параметра effort для Claude Haiku 5.5

Выключить мышление можно отдельно: thinking: {"type":"disabled"}, и только если усилие не выше high. На xhigh и max такой запрос — ошибка 400. Токены размышления входят в лимит ответа, поэтому маленький max_tokens обрезает ответ ещё на размышлении.

Что писать в запросе

  • Одна задача на сообщение. «Разметь и заодно напиши стратегию» смешивает короткий шаг с длинным.
  • Формат ответа задайте явно: «только метка», «пять пунктов», «цитата или фраза, что в тексте этого нет».
  • Не просите «отвечай без размышлений». В тестах Anthropic такая фраза мышление не останавливала. Меняйте ступень усилия.
  • Если нужен и вызов инструмента, и строгий JSON, оставляйте адаптивное мышление. С выключенным мышлением модель может пропустить нужный вызов. Запасной путь — принудительный tool_choice.

Смена верхнего effort между запросами сбрасывает кеш промпта. Отдельный бета-заголовок позволяет менять усилие на одном ходу, не сбрасывая кеш. В обычном чате это остаётся на стороне платформы: вы двигаете ступень, а не заголовок.

Готовые формулировки для поддержки — в гайде Поддержка, классификация, маршрутизация. Что ещё ломается в API — в гайде Переход с Haiku 4.5.


Открыть чат в SUIN.AI — Claude Haiku 5.5, Claude Sonnet 5.5 и Claude Opus 5.5 уже в списке моделей. Отдельный аккаунт Anthropic не нужен.