Перейти к содержимому

Обучения

Sonnet 5.5 или Opus 5.5: что выбрать — тесты, цена токена и сценарии

Claude Sonnet 5.5 почти догнала Opus 5.5 в тестах Anthropic и даже обошла её в Terminal-Bench, а её токен вдвое дешевле. Разбираем, где Opus 5.5 всё же сильнее, как совмещать обе модели и как сравнить их на своей задаче в одном чате СуперИнтеллекта.

Команда СуперИнтеллекта · · ~8 мин

Sonnet 5.5 или Opus 5.5 — на 29 сентября 2026 года ответ такой: Claude Sonnet 5.5 берите для повседневной работы, кода по понятной задаче, документов и всего, где важны скорость и объём, а Claude Opus 5.5 — для сложной открытой работы, где модели нужно долго держать суждение. По таблице Anthropic модели почти вровень: в Terminal-Bench 4.0 Sonnet 5.5 даже впереди, а в остальных тестах с процентами отстаёт на 1,7–3,2 пункта (во FrontierCode — на ступени Xhigh, на Max разрыв больше). При этом токен у Sonnet 5.5 вдвое дешевле. В СуперИнтеллекте обе модели работают в России без VPN: Sonnet 5.5 — с тарифа СТАРТ, Opus 5.5 — с тарифа Про.

Чем Sonnet 5.5 отличается от Opus 5.5?

Sonnet 5.5 — быстрая и более дешёвая модель для повседневной работы: понятных задач, исправления ошибок, документов, слайдов и таблиц. Opus 5.5 — старшая модель для задач, где нужно взвешенное суждение. Так их разводит сама Anthropic: в анонсе Sonnet 5.5 новинка названа более быстрым и дешёвым дополнением к Opus 5.5, а не её заменой.

  • Семейство и даты. Обе — модели Claude 5.5: Opus 5.5 вышла 22 сентября 2026 года, Sonnet 5.5 — 28 сентября. Младшая Haiku 5.5 для больших объёмов обещана в ближайшие недели.
  • Окно контекста. У обеих — до 1 млн токенов на входе и до 128 тыс. токенов в ответе (по каталогу OpenRouter). Токены — кусочки текста, по которым считаются объём и оплата.

Как Sonnet 5.5 и Opus 5.5 выступают в тестах?

По таблице Anthropic Opus 5.5 выше в семи тестах из восьми, но разрыв везде небольшой, а в Terminal-Bench 4.0, если сравнивать лучшие результаты обеих моделей, впереди Sonnet 5.5.

Тест (что проверяет)Sonnet 5.5Opus 5.5Разница
Terminal-Bench 4.0 (агентное программирование в терминале)70,6% (Max)66,4% (Xhigh)+4,2 у Sonnet
FrontierCode 1.1 Main (код, готовый к слиянию)52,1% (Xhigh); 46,2% (Max)54,4%+2,3 у Opus (к Xhigh)
CursorBench 4.0 (задачи из реальных сессий Cursor)55,5%57,8%+2,3 у Opus
GDPval-AA v2.1* (работа 44 профессий, Эло)18441846+2 у Opus
AA-Briefcase v1.1* (долгая работа с документами, Эло)18111822+11 у Opus
Humanity's Last Exam (с инструментами)64,5%67,7%+3,2 у Opus
OSWorld 2.1 (работа с компьютером, частичная оценка)80,1%81,8%+1,7 у Opus
Chartography (распознавание графиков, без инструментов)61,6%64,4%+2,8 у Opus
Sonnet 5.5 против Opus 5.5: тесты из анонса Anthropic

Эло — рейтинговая шкала, как в шахматах. Два очка в GDPval-AA при результатах около 1 850 — практически ничья (для масштаба: Sonnet 5 набрала здесь 1449).

Три оговорки. Во FrontierCode Sonnet 5.5 на Max набрала меньше, чем на Xhigh: тест штрафует за правки за рамками задачи, а на Max модель чаще запускала ревью кода множеством субагентов — вспомогательных агентов, — и в разобранных случаях это кончалось таймаутом или лишними правками. Тесты со звёздочкой Artificial Analysis прогоняла на предрелизной версии с багом в структурированных ответах; по оценке Anthropic, он мог лишь немного занизить результат. И это данные разработчика: сама Anthropic признаёт, что тесты показывают лишь одну грань модели. Полная таблица с Sonnet 5 и GPT-6 Sol — в обзоре Claude Sonnet 5.5.

Где Opus 5.5 сильнее Sonnet 5.5?

Opus 5.5 сильнее в сложной открытой работе, где постановка размыта и модели нужно долго держать суждение. Anthropic пишет об этом прямо: на нескольких тестах Sonnet 5.5 на Max сравнима с Opus 5.5, но и во внутренних проверках, и у внешних тестировщиков Opus 5.5 в такой работе явно сильнее.

На практике это задачи без готового ответа: спроектировать архитектуру с нуля, разобраться в запутанной проблеме, написать стратегию, где важны выводы, а не оформление, провести длинное исследование со множеством развилок. Здесь разумно начинать с Opus 5.5 — что она умеет, мы разбирали в обзоре Claude Opus 5.5.

Небольшое преимущество у Opus 5.5 есть и в безопасности: в полном аудите поведения она, по данным Anthropic, в целом чуть лучше, хотя в тестах на попытки выбраться из песочницы Sonnet 5.5 к ней близка.

Где Sonnet 5.5 выигрывает у Opus 5.5?

Sonnet 5.5 выигрывает там, где задач много и они понятны, а важны скорость и цена: исправление ошибок, код по готовому плану, документы, таблицы и презентации.

  • Цена на потоке. Токен вдвое дешевле, чем у Opus 5.5, и на сотнях однотипных задач это заметно сразу.
  • Скорость. Это самая быстрая Sonnet на сегодня — на 30% с лишним быстрее Sonnet 5. В Every отметили, что её легко направлять в быстрых итерациях.
  • Низкие ступени рассуждений. В Terminal-Bench 4.0 на Low и Medium Sonnet 5.5 обходится дешевле самой экономной ступени Opus 5.5, хотя и решает меньше задач, — это видно на графике ниже.
  • Документы и слайды. Тестировщики отмечают чутьё на дизайн и умение следовать шаблону слайдов; во внутреннем тесте Anthropic два эксперта сочли первый черновик обзора на 10 слайдов готовым к отправке как есть.

Компании, получившие модель до релиза, говорят то же. В Epic Games Sonnet 5.5 прошла планку качества, которую ждут от модели старшего уровня, в SpaceXAI её 55,5% в CursorBench назвали вторым результатом после Opus 5.5, а в Base44 на 118 реальных сборках приложений она вышла на уровень прошлой старшей модели Opus 5 — в среднем за 3,6 итерации против 7,7.

Насколько Opus 5.5 дороже Sonnet 5.5?

Токен Opus 5.5 вдвое дороже, чем у Sonnet 5.5, — и на входе, и на выходе. Запись в кэш у Opus тоже вдвое дороже, а чтение из кэша у обеих стоит одинаково. Кэш — сохранённое начало запроса, которое при следующем обращении модели не приходится обрабатывать заново.

Цена задачи — другое дело. По словам Anthropic, Sonnet 5.5 лучше всего дополняет Opus 5.5 на низких ступенях рассуждений, где задача обходится заметно дешевле; на высоких ступенях она может выдавать сравнимый результат примерно за те же деньги. Проще говоря, если держать Sonnet 5.5 на «Максимуме», выгода почти исчезает. Цену и скорость отметили и в прессе — TechCrunch вынес их в заголовок.

Terminal-Bench 4.0: доля решённых задач против стоимости попытки по данным Anthropic на каждой ступени у Sonnet 5.5, Opus 5.5 и Sonnet 5; для сравнения — GPT-5.6 Sol. Источник: anthropic.com
Terminal-Bench 4.0: доля решённых задач против стоимости попытки по данным Anthropic на каждой ступени у Sonnet 5.5, Opus 5.5 и Sonnet 5; для сравнения — GPT-5.6 Sol. Источник: anthropic.com

Самые дешёвые точки на графике — у Sonnet 5.5 на Low и Medium: так дёшево Opus 5.5 в этом тесте не работает ни на одной ступени. В середине кривая Opus 5.5 выше — за ту же стоимость попытки она решает больше задач. А рекордные 70,6% Sonnet 5.5 взяла на Max, и эта точка правее лучшей точки Opus 5.5, то есть попытка там дороже.

Нейроны в СуперИнтеллекте списываются по фактическому расходу токенов, так что эта экономия доходит до вас напрямую.

Можно ли совмещать Opus 5.5 и Sonnet 5.5?

Да, и для больших проектов это самый разумный вариант: Opus 5.5 задаёт архитектуру и план, Sonnet 5.5 реализует. Такую связку предложил Кевин Нго из компании Creator, который тестировал модель до релиза:

«Когда Opus 5.5 задаёт архитектуру… я спокойно доверил бы Sonnet 5.5 реализацию.»

КЕ

Кевин Нго

креативный разработчик, Creator

Он же отметил, что Sonnet 5.5 хорошо справляется с долгими сложными задачами. В СуперИнтеллекте такая связка собирается в одном чате:

  1. Выберите Claude Opus 5.5 и попросите план: архитектуру, разбиение на шаги, критерии готовности.
  2. Переключите модель на Claude Sonnet 5.5 в том же чате — история и план останутся у неё перед глазами.
  3. Давайте Sonnet 5.5 шаги по одному и проверяйте результат; на спорных развилках снова зовите Opus 5.5 — на ревью.

Учтите кэш: у каждой модели он свой, поэтому первый ответ после переключения дороже следующих. В нашем замере с Sonnet 5.5 следующие ходы того же чата выходили примерно в 10 раз дешевле первого: почти весь запрос читался из кэша. Поэтому модели выгоднее менять на границах этапов, а не на каждом сообщении.

Что выбрать: Sonnet 5.5 или Opus 5.5?

Начинайте с Sonnet 5.5 и переходите на Opus 5.5, когда задача упирается в суждение, а не в объём. Короткое дерево решений:

  • Задача понятна и сформулирована — исправить ошибку, написать функцию по описанию, собрать таблицу или презентацию по шаблону → Sonnet 5.5 на «Обычно» или «Глубже».
  • Задач много, они однотипные, важны скорость и расход → Sonnet 5.5 на «Быстрее» или «Обычно».
  • Нужно продумать архитектуру, стратегию или разобрать запутанную проблему без готовой постановки → Opus 5.5.
  • Большой проект → Opus 5.5 для плана и ревью, Sonnet 5.5 для реализации.
  • Sonnet 5.5 не справляется даже на «Максимуме» → Opus 5.5: на высоких ступенях цена задачи у них сопоставима.
  • У вас тариф СТАРТ → Sonnet 5.5: Opus 5.5 открывается с тарифа Про.

Ступень выбирается в чипе «Модель · Ступень» рядом с кнопкой выбора модели — по нажатию открывается шкала «Быстрее ↔ Умнее». У Sonnet 5.5 их пять — от «Быстрее» до «Максимума», режима без раздумий нет. Как устроена шкала, мы разбирали в материале о слайдере глубины размышлений. Если в чате или у ИИ-агента закреплена Claude Sonnet Latest, она уже ведёт на Sonnet 5.5 — перенастраивать ничего не нужно.

Как сравнить Sonnet 5.5 и Opus 5.5 самому?

Проще всего дать обеим моделям одну задачу в одном чате СуперИнтеллекта: модель переключается одним кликом, историю и промпты переписывать не нужно. Понадобится тариф Про — на нём доступны обе модели, а регистрация бесплатная.

  1. Откройте новый чат, выберите Claude Sonnet 5.5 и ступень «Глубже».
  2. Отправьте задачу из своей работы — лучше такую, где вы знаете хороший ответ, — и приложите файлы, если нужны.
  3. Переключитесь на Claude Opus 5.5 и отправьте промпт ниже, чтобы модель решала с нуля.
  4. Сравните точность, оформление, время ответа и сколько нейронов ушло на каждый ответ.

Промпт для второй модели: решить ту же задачу с нуля

Реши ту же задачу заново, с нуля, не опираясь на предыдущий ответ в этом чате.

Сначала коротко перечисли свои допущения, затем дай решение, а в конце — список того, что человеку стоит проверить.

Первый ход каждой модели в чате — «холодный», поэтому расход сравнивайте на нескольких ходах. Больше о ступенях и файлах — в гайде как пользоваться Claude Sonnet 5.5.

Частые вопросы

Sonnet 5.5 лучше Opus 5.5?

В целом нет: Opus 5.5 выше в семи тестах из восьми и, по словам Anthropic, явно сильнее в сложной открытой работе. Но разрыв небольшой, а в Terminal-Bench 4.0 впереди Sonnet 5.5.

Во сколько раз Opus 5.5 дороже Sonnet 5.5?

Токен Opus 5.5 вдвое дороже на входе и выходе. Цена задачи зависит от ступени: на низких Sonnet 5.5 заметно дешевле, на высоких разница почти исчезает.

Какая модель быстрее?

Sonnet 5.5. Anthropic называет её более быстрым дополнением к Opus 5.5, и это самая быстрая Sonnet на сегодня.

Какую модель брать для программирования?

Для исправления ошибок, кода по готовому плану и работы в терминале — Sonnet 5.5, для проектирования архитектуры и сложного ревью — Opus 5.5. Подробнее — в гайде Claude Sonnet 5.5 для программирования.

На каком тарифе доступны Sonnet 5.5 и Opus 5.5?

В СуперИнтеллекте Sonnet 5.5 доступна с тарифа СТАРТ, Opus 5.5 — с тарифа Про; на бесплатном тарифе работают GPT-6 Luna и Gemini 3.8 Flash. В России обе модели доступны без VPN и зарубежной карты, оплата в рублях.


Бесплатная экскурсия · онлайн · до часа

Посмотрите, как это работает на ваших задачах

Эксперт по внедрению покажет платформу вживую: ИИ-агенты, базы знаний, генерация контента и интеграции — на примерах именно ваших процессов. Без обязательств.

  • Разберём 2–3 ваших процесса и покажем, что автоматизируется уже сейчас
  • После встречи — запись, мини-план внедрения и подборка агентов
  • Экскурсию проводит эксперт по внедрению, а не менеджер по продажам

Не готовы к встрече? Пройдите квиз «Готов ли бизнес к ИИ» — получите персональный отчёт и бонусные нейроны за 2 минуты.

Запишитесь на экскурсию

Свяжемся в течение рабочего дня и подберём удобное время.

Защищено reCAPTCHA: Конфиденциальность · Условия