Обучения
Sonnet 5.5 или Opus 5.5: что выбрать — тесты, цена токена и сценарии
Claude Sonnet 5.5 почти догнала Opus 5.5 в тестах Anthropic и даже обошла её в Terminal-Bench, а её токен вдвое дешевле. Разбираем, где Opus 5.5 всё же сильнее, как совмещать обе модели и как сравнить их на своей задаче в одном чате СуперИнтеллекта.
Команда СуперИнтеллекта · · ~8 мин

Sonnet 5.5 или Opus 5.5 — на 29 сентября 2026 года ответ такой: Claude Sonnet 5.5 берите для повседневной работы, кода по понятной задаче, документов и всего, где важны скорость и объём, а Claude Opus 5.5 — для сложной открытой работы, где модели нужно долго держать суждение. По таблице Anthropic модели почти вровень: в Terminal-Bench 4.0 Sonnet 5.5 даже впереди, а в остальных тестах с процентами отстаёт на 1,7–3,2 пункта (во FrontierCode — на ступени Xhigh, на Max разрыв больше). При этом токен у Sonnet 5.5 вдвое дешевле. В СуперИнтеллекте обе модели работают в России без VPN: Sonnet 5.5 — с тарифа СТАРТ, Opus 5.5 — с тарифа Про.
Чем Sonnet 5.5 отличается от Opus 5.5?
Sonnet 5.5 — быстрая и более дешёвая модель для повседневной работы: понятных задач, исправления ошибок, документов, слайдов и таблиц. Opus 5.5 — старшая модель для задач, где нужно взвешенное суждение. Так их разводит сама Anthropic: в анонсе Sonnet 5.5 новинка названа более быстрым и дешёвым дополнением к Opus 5.5, а не её заменой.
- Семейство и даты. Обе — модели Claude 5.5: Opus 5.5 вышла 22 сентября 2026 года, Sonnet 5.5 — 28 сентября. Младшая Haiku 5.5 для больших объёмов обещана в ближайшие недели.
- Окно контекста. У обеих — до 1 млн токенов на входе и до 128 тыс. токенов в ответе (по каталогу OpenRouter). Токены — кусочки текста, по которым считаются объём и оплата.
Как Sonnet 5.5 и Opus 5.5 выступают в тестах?
По таблице Anthropic Opus 5.5 выше в семи тестах из восьми, но разрыв везде небольшой, а в Terminal-Bench 4.0, если сравнивать лучшие результаты обеих моделей, впереди Sonnet 5.5.
| Тест (что проверяет) | Sonnet 5.5 | Opus 5.5 | Разница |
|---|---|---|---|
| Terminal-Bench 4.0 (агентное программирование в терминале) | 70,6% (Max) | 66,4% (Xhigh) | +4,2 у Sonnet |
| FrontierCode 1.1 Main (код, готовый к слиянию) | 52,1% (Xhigh); 46,2% (Max) | 54,4% | +2,3 у Opus (к Xhigh) |
| CursorBench 4.0 (задачи из реальных сессий Cursor) | 55,5% | 57,8% | +2,3 у Opus |
| GDPval-AA v2.1* (работа 44 профессий, Эло) | 1844 | 1846 | +2 у Opus |
| AA-Briefcase v1.1* (долгая работа с документами, Эло) | 1811 | 1822 | +11 у Opus |
| Humanity's Last Exam (с инструментами) | 64,5% | 67,7% | +3,2 у Opus |
| OSWorld 2.1 (работа с компьютером, частичная оценка) | 80,1% | 81,8% | +1,7 у Opus |
| Chartography (распознавание графиков, без инструментов) | 61,6% | 64,4% | +2,8 у Opus |
Эло — рейтинговая шкала, как в шахматах. Два очка в GDPval-AA при результатах около 1 850 — практически ничья (для масштаба: Sonnet 5 набрала здесь 1449).
Три оговорки. Во FrontierCode Sonnet 5.5 на Max набрала меньше, чем на Xhigh: тест штрафует за правки за рамками задачи, а на Max модель чаще запускала ревью кода множеством субагентов — вспомогательных агентов, — и в разобранных случаях это кончалось таймаутом или лишними правками. Тесты со звёздочкой Artificial Analysis прогоняла на предрелизной версии с багом в структурированных ответах; по оценке Anthropic, он мог лишь немного занизить результат. И это данные разработчика: сама Anthropic признаёт, что тесты показывают лишь одну грань модели. Полная таблица с Sonnet 5 и GPT-6 Sol — в обзоре Claude Sonnet 5.5.
Где Opus 5.5 сильнее Sonnet 5.5?
Opus 5.5 сильнее в сложной открытой работе, где постановка размыта и модели нужно долго держать суждение. Anthropic пишет об этом прямо: на нескольких тестах Sonnet 5.5 на Max сравнима с Opus 5.5, но и во внутренних проверках, и у внешних тестировщиков Opus 5.5 в такой работе явно сильнее.
На практике это задачи без готового ответа: спроектировать архитектуру с нуля, разобраться в запутанной проблеме, написать стратегию, где важны выводы, а не оформление, провести длинное исследование со множеством развилок. Здесь разумно начинать с Opus 5.5 — что она умеет, мы разбирали в обзоре Claude Opus 5.5.
Небольшое преимущество у Opus 5.5 есть и в безопасности: в полном аудите поведения она, по данным Anthropic, в целом чуть лучше, хотя в тестах на попытки выбраться из песочницы Sonnet 5.5 к ней близка.
Где Sonnet 5.5 выигрывает у Opus 5.5?
Sonnet 5.5 выигрывает там, где задач много и они понятны, а важны скорость и цена: исправление ошибок, код по готовому плану, документы, таблицы и презентации.
- Цена на потоке. Токен вдвое дешевле, чем у Opus 5.5, и на сотнях однотипных задач это заметно сразу.
- Скорость. Это самая быстрая Sonnet на сегодня — на 30% с лишним быстрее Sonnet 5. В Every отметили, что её легко направлять в быстрых итерациях.
- Низкие ступени рассуждений. В Terminal-Bench 4.0 на Low и Medium Sonnet 5.5 обходится дешевле самой экономной ступени Opus 5.5, хотя и решает меньше задач, — это видно на графике ниже.
- Документы и слайды. Тестировщики отмечают чутьё на дизайн и умение следовать шаблону слайдов; во внутреннем тесте Anthropic два эксперта сочли первый черновик обзора на 10 слайдов готовым к отправке как есть.
Компании, получившие модель до релиза, говорят то же. В Epic Games Sonnet 5.5 прошла планку качества, которую ждут от модели старшего уровня, в SpaceXAI её 55,5% в CursorBench назвали вторым результатом после Opus 5.5, а в Base44 на 118 реальных сборках приложений она вышла на уровень прошлой старшей модели Opus 5 — в среднем за 3,6 итерации против 7,7.
Насколько Opus 5.5 дороже Sonnet 5.5?
Токен Opus 5.5 вдвое дороже, чем у Sonnet 5.5, — и на входе, и на выходе. Запись в кэш у Opus тоже вдвое дороже, а чтение из кэша у обеих стоит одинаково. Кэш — сохранённое начало запроса, которое при следующем обращении модели не приходится обрабатывать заново.
Цена задачи — другое дело. По словам Anthropic, Sonnet 5.5 лучше всего дополняет Opus 5.5 на низких ступенях рассуждений, где задача обходится заметно дешевле; на высоких ступенях она может выдавать сравнимый результат примерно за те же деньги. Проще говоря, если держать Sonnet 5.5 на «Максимуме», выгода почти исчезает. Цену и скорость отметили и в прессе — TechCrunch вынес их в заголовок.

Самые дешёвые точки на графике — у Sonnet 5.5 на Low и Medium: так дёшево Opus 5.5 в этом тесте не работает ни на одной ступени. В середине кривая Opus 5.5 выше — за ту же стоимость попытки она решает больше задач. А рекордные 70,6% Sonnet 5.5 взяла на Max, и эта точка правее лучшей точки Opus 5.5, то есть попытка там дороже.
Нейроны в СуперИнтеллекте списываются по фактическому расходу токенов, так что эта экономия доходит до вас напрямую.
Можно ли совмещать Opus 5.5 и Sonnet 5.5?
Да, и для больших проектов это самый разумный вариант: Opus 5.5 задаёт архитектуру и план, Sonnet 5.5 реализует. Такую связку предложил Кевин Нго из компании Creator, который тестировал модель до релиза:
«Когда Opus 5.5 задаёт архитектуру… я спокойно доверил бы Sonnet 5.5 реализацию.»
Он же отметил, что Sonnet 5.5 хорошо справляется с долгими сложными задачами. В СуперИнтеллекте такая связка собирается в одном чате:
- Выберите Claude Opus 5.5 и попросите план: архитектуру, разбиение на шаги, критерии готовности.
- Переключите модель на Claude Sonnet 5.5 в том же чате — история и план останутся у неё перед глазами.
- Давайте Sonnet 5.5 шаги по одному и проверяйте результат; на спорных развилках снова зовите Opus 5.5 — на ревью.
Учтите кэш: у каждой модели он свой, поэтому первый ответ после переключения дороже следующих. В нашем замере с Sonnet 5.5 следующие ходы того же чата выходили примерно в 10 раз дешевле первого: почти весь запрос читался из кэша. Поэтому модели выгоднее менять на границах этапов, а не на каждом сообщении.
Что выбрать: Sonnet 5.5 или Opus 5.5?
Начинайте с Sonnet 5.5 и переходите на Opus 5.5, когда задача упирается в суждение, а не в объём. Короткое дерево решений:
- Задача понятна и сформулирована — исправить ошибку, написать функцию по описанию, собрать таблицу или презентацию по шаблону → Sonnet 5.5 на «Обычно» или «Глубже».
- Задач много, они однотипные, важны скорость и расход → Sonnet 5.5 на «Быстрее» или «Обычно».
- Нужно продумать архитектуру, стратегию или разобрать запутанную проблему без готовой постановки → Opus 5.5.
- Большой проект → Opus 5.5 для плана и ревью, Sonnet 5.5 для реализации.
- Sonnet 5.5 не справляется даже на «Максимуме» → Opus 5.5: на высоких ступенях цена задачи у них сопоставима.
- У вас тариф СТАРТ → Sonnet 5.5: Opus 5.5 открывается с тарифа Про.
Ступень выбирается в чипе «Модель · Ступень» рядом с кнопкой выбора модели — по нажатию открывается шкала «Быстрее ↔ Умнее». У Sonnet 5.5 их пять — от «Быстрее» до «Максимума», режима без раздумий нет. Как устроена шкала, мы разбирали в материале о слайдере глубины размышлений. Если в чате или у ИИ-агента закреплена Claude Sonnet Latest, она уже ведёт на Sonnet 5.5 — перенастраивать ничего не нужно.
Как сравнить Sonnet 5.5 и Opus 5.5 самому?
Проще всего дать обеим моделям одну задачу в одном чате СуперИнтеллекта: модель переключается одним кликом, историю и промпты переписывать не нужно. Понадобится тариф Про — на нём доступны обе модели, а регистрация бесплатная.
- Откройте новый чат, выберите Claude Sonnet 5.5 и ступень «Глубже».
- Отправьте задачу из своей работы — лучше такую, где вы знаете хороший ответ, — и приложите файлы, если нужны.
- Переключитесь на Claude Opus 5.5 и отправьте промпт ниже, чтобы модель решала с нуля.
- Сравните точность, оформление, время ответа и сколько нейронов ушло на каждый ответ.
Промпт для второй модели: решить ту же задачу с нуля
Реши ту же задачу заново, с нуля, не опираясь на предыдущий ответ в этом чате.
Сначала коротко перечисли свои допущения, затем дай решение, а в конце — список того, что человеку стоит проверить.Первый ход каждой модели в чате — «холодный», поэтому расход сравнивайте на нескольких ходах. Больше о ступенях и файлах — в гайде как пользоваться Claude Sonnet 5.5.
Частые вопросы
Sonnet 5.5 лучше Opus 5.5?
В целом нет: Opus 5.5 выше в семи тестах из восьми и, по словам Anthropic, явно сильнее в сложной открытой работе. Но разрыв небольшой, а в Terminal-Bench 4.0 впереди Sonnet 5.5.
Во сколько раз Opus 5.5 дороже Sonnet 5.5?
Токен Opus 5.5 вдвое дороже на входе и выходе. Цена задачи зависит от ступени: на низких Sonnet 5.5 заметно дешевле, на высоких разница почти исчезает.
Какая модель быстрее?
Sonnet 5.5. Anthropic называет её более быстрым дополнением к Opus 5.5, и это самая быстрая Sonnet на сегодня.
Какую модель брать для программирования?
Для исправления ошибок, кода по готовому плану и работы в терминале — Sonnet 5.5, для проектирования архитектуры и сложного ревью — Opus 5.5. Подробнее — в гайде Claude Sonnet 5.5 для программирования.
На каком тарифе доступны Sonnet 5.5 и Opus 5.5?
В СуперИнтеллекте Sonnet 5.5 доступна с тарифа СТАРТ, Opus 5.5 — с тарифа Про; на бесплатном тарифе работают GPT-6 Luna и Gemini 3.8 Flash. В России обе модели доступны без VPN и зарубежной карты, оплата в рублях.