Обучения
Чем Claude Opus 5 отличается от Opus 4.8
Разбираем конкретные отличия Claude Opus 5 от Opus 4.8: «мышление» включено по умолчанию, новые уровни усилий xhigh и max, скачок качества (сводный рейтинг 77,44→85,88, SWE-bench Pro 69,2%→79,2%) и изменения в поведении. Стоит ли переходить и где попробовать обе модели.
· ~11 мин

Claude Opus 5 (вышел 23 июля 2026, также пишут «клод опус 5» и «Anthropic Opus 5») — прямой преемник флагмана Claude Opus 4.8 (28 мая 2026). Главные отличия: в Opus 5 «мышление» (режим рассуждений) включено по умолчанию, добавлены новые уровни усилий xhigh и max, заметно вырос уровень качества (по данным независимого агрегатора сводный рейтинг поднялся с 77,44 до 85,88, а SWE-bench Pro — с 69,2% до 79,2%), и изменилось само поведение модели: ответы стали длиннее, она чаще сама себя проверяет и охотнее делегирует подзадачи субагентам. Обе модели доступны на СуперИнтеллекте, работают в России без VPN и зарубежной карты.
Ниже — по пунктам, что именно поменялось, таблица «4.8 vs 5» с числами и атрибуцией, а также ответ на главный вопрос: стоит ли переходить на новый флагман или остаться на Opus 4.8. Если нужен общий разбор новинки, есть отдельный обзор Claude Opus 5.
Что такое Opus 4.8 и Opus 5 в линейке Claude?
В семействе Claude модели делятся по назначению. Haiku — самая быстрая и лёгкая, для массовых задач вроде классификации и маршрутизации. Sonnet — «рабочая лошадка», баланс скорости и качества на каждый день. Opus — максимальная мощность, флагман линейки. Отдельно стоит экспериментальный Claude Fable 5, который был вершиной до выхода Opus 5. Если хотите разобраться в различиях всей линейки, есть материал чем отличаются модели Claude.
Claude Opus 4.8 вышел 28 мая 2026 и был прежним флагманом — самой мощной моделью Anthropic для глубоких рассуждений, программирования и длинных задач. Claude Opus 5 вышел 23 июля 2026 как прямой преемник: та же роль «максимальной мощности», но с обновлёнными дефолтами, новыми уровнями усилий и более высокими результатами на бенчмарках. Проще говоря, Opus 5 — это следующее поколение того же класса моделей, а не другая ветка.
Почему «мышление» теперь включено по умолчанию?
Ключевое изменение в дефолтах: в Claude Opus 5 режим «мышления» (глубокие рассуждения перед ответом) включён по умолчанию. Раньше рассуждения приходилось учитывать и настраивать отдельно — теперь модель по умолчанию сначала обдумывает задачу, а затем отвечает. Это напрямую влияет на качество на сложных запросах: чем труднее задача (математика, длинная агентная цепочка, поиск бага в коде), тем заметнее выигрыш от того, что модель «думает» перед выводом.
Практический эффект для пользователя: на нетривиальных задачах Opus 5 из коробки ведёт себя ближе к «аналитику», который сначала раскладывает проблему, а потом даёт решение. Это одна из причин, почему ответы стали длиннее и обстоятельнее, чем у Opus 4.8 — модель показывает и обосновывает ход мысли, а не только финальный результат.
Что дают новые уровни усилий xhigh и max?
В Opus 5 расширилась шкала «усилий» (effort) — сколько ресурсов модель тратит на обдумывание. Теперь доступны пять уровней: low, medium, high, xhigh и max, при этом по умолчанию используется high. Уровни xhigh и max — новые по сравнению с Opus 4.8 и позволяют выделить ещё больше test-time compute на самые тяжёлые задачи.
- low — минимум обдумывания: быстро и экономно по нейронам, для простых и рутинных запросов.
- medium — умеренные рассуждения для типовых рабочих задач.
- high (по умолчанию) — глубокое обдумывание, оптимальный баланс для большинства сложных запросов.
- xhigh — новый уровень: ещё больше «мышления» для трудных цепочек рассуждений и агентных задач.
- max — новый максимум: предельные усилия для самых требовательных сценариев, где важна каждая доля точности.
Насколько вырос уровень качества по сравнению с Opus 4.8?
Скачок качества — не маркетинговая формулировка, а видимое движение по метрикам. По данным независимого агрегатора, оценивавшего 215 моделей, сводный рейтинг Opus 4.8 составлял 77,44 (6-е место), а Opus 5 возглавил список с результатом 85,88 (1-е место). На агентном программировании разрыв тоже заметный: SWE-bench Pro у Opus 4.8 — 69,2%, у Opus 5 — 79,2%.
Чтобы показать общий уровень нового флагмана, приведём ключевые публичные результаты Opus 5 (по данным Anthropic и независимых замеров). По самому Opus 4.8 из проверенных чисел есть SWE-bench Pro (69,2%) и позиция в сводном рейтинге (77,44) — их и используем для честного сравнения, не додумывая остальное.
| Бенчмарк | Claude Opus 5 |
|---|---|
| SWE-bench Verified (кодинг) | 96,0% |
| SWE-bench Pro (агентное кодирование) | 79,2% |
| GPQA Diamond (наука) | 93,2% |
| Multilingual (многоязычность) | 89,5% |
| BrowseComp (веб-навигация) | 90,8% |
| Toolathlon (работа с инструментами) | 80,6% |
| ARC-AGI-2 | 90,4% |
| MMMU-Pro (мультимодальность) | 84,7% |
| OfficeQA Pro (офисные задачи) | 66,9% |
Важная оговорка: числа выше относятся к Opus 5. По Opus 4.8 подтверждены только два показателя (SWE-bench Pro 69,2% и сводный рейтинг 77,44), поэтому прямое сравнение мы делаем именно по ним — этого достаточно, чтобы увидеть направление и масштаб прогресса.
Как изменилось поведение модели?
Помимо цифр, поменялся «характер» модели. Если вы привыкли к Opus 4.8, при переходе на Opus 5 вы заметите несколько поведенческих отличий — они логично вытекают из включённого по умолчанию мышления и более высоких уровней усилий.
- Ответы стали длиннее и обстоятельнее — Opus 5 охотнее разворачивает рассуждения, приводит промежуточные шаги и обоснования, а не только итог.
- Модель чаще сама себя проверяет — встроенная перепроверка (self-verification) снижает число ошибок на сложных задачах, что особенно ценно в коде и расчётах.
- Охотнее делегирует субагентам — в мультиагентных сценариях Opus 5 сильнее в роли оркестратора: разбивает задачу и передаёт подзадачи субагентам (паттерн writer-verifier).
- Эффективнее на низких усилиях — при этом на простых запросах модель не «переусердствует», если выбран уровень low/medium.
Таблица: Opus 4.8 против Opus 5
| Параметр | Claude Opus 4.8 | Claude Opus 5 |
|---|---|---|
| Дата выхода | 28 мая 2026 | 23 июля 2026 |
| Позиция в линейке | Прежний флагман | Новый флагман, прямой преемник |
| Режим «мышления» | Не был включён по умолчанию | Включён по умолчанию |
| Уровни усилий | low / medium / high | low / medium / high / xhigh / max (деф. high) |
| SWE-bench Pro | 69,2% | 79,2% |
| Сводный рейтинг агрегатора | 77,44 (#6) | 85,88 (#1) |
| Модальность | Вход: текст, изображения, файлы; выход: текст | Вход: текст, изображения, файлы; выход: текст |
| Поведение | База линейки | Длиннее ответы, самопроверка, делегирование субагентам |
| На СуперИнтеллекте | Доступна | Доступна (обычная + версия Fast) |
Обратите внимание на модальность: и Opus 4.8, и Opus 5 принимают на вход текст, изображения и файлы, но на выходе дают только текст. «Зрение» здесь означает понимание графиков, документов, диаграмм и интерфейсов — обе модели не генерируют картинки, видео или аудио. Для генерации изображений и видео на платформе есть отдельный раздел МедиаЛаб.
Стоит ли переходить с Opus 4.8 на Opus 5?
Короткий ответ: да, если ваши задачи сложные. Opus 5 выигрывает именно там, где важны глубокие рассуждения — агентное программирование и длинные многошаговые задачи, ревью кода и поиск багов, работа с длинным контекстом (до 1 000 000 токенов), офисные сценарии (таблицы, презентации) и мультиагентные связки. На таких задачах прирост качества и самопроверка окупают чуть более длинные ответы. Если основная задача — программирование, пригодится практический гайд Claude Opus 5 для кода.
- Переходить стоит, если вы пишете или ревьюите код, ведёте аналитику, работаете с большими документами, строите агентов или вам важна максимальная точность рассуждений.
- Можно не спешить, если у вас простые, повторяющиеся запросы, где Opus 4.8 уже устраивает по скорости и результату — либо присмотреться к более лёгким и быстрым моделям линейки.
- Хорошая новость: выбор не окончательный. Opus 4.8 остаётся доступным, а смена модели на СуперИнтеллекте — это один клик, без переписывания промптов. Можно сравнить обе на своей реальной задаче.
Где попробовать Opus 5 и Opus 4.8?
Обе модели уже доступны на СуперИнтеллекте в чате: Claude Opus 5 (в обычной и ускоренной версии «Claude Opus 5 (Fast)»), а также Claude Opus 4.8, Claude Fable 5, Claude Sonnet 5 и другие модели (GPT, Gemini, GigaChat) — всё в одном окне. Работает в России без VPN и без зарубежной карты, оплата — нейронами, есть бесплатный старт. Если вы только начинаете, пошаговый разбор — в гайде как пользоваться Claude Opus 5.
Самый честный тест — сравнить Opus 5 и Opus 4.8 на своей реальной задаче: один клик переключает модель, промпт переписывать не нужно. Зарегистрироваться и попробовать Claude Opus 5.
Частые вопросы (FAQ)
Opus 5 полностью заменяет Opus 4.8?
Нет. Opus 5 — прямой преемник и новый флагман, но Opus 4.8 остаётся доступным на СуперИнтеллекте. Вы можете использовать любую из них и переключаться в один клик. Для новых сложных задач по умолчанию имеет смысл выбирать Opus 5.
Правда ли, что Opus 5 «думает» дольше и отвечает медленнее?
На высоких уровнях усилий (high, xhigh, max) Opus 5 тратит больше времени на обдумывание — это и даёт прирост качества на сложных задачах. Но модель эффективна и на низких уровнях: для простых запросов выберите low или medium, и ответ будет быстрым. Также есть ускоренная версия «Claude Opus 5 (Fast)».
Чем xhigh и max отличаются от обычного high?
Это более высокие уровни усилий, которых не было в Opus 4.8. Они выделяют модели ещё больше вычислений на обдумывание (test-time compute) для самых трудных задач. По умолчанию используется high — он оптимален для большинства сложных запросов; xhigh и max включают точечно, когда нужна предельная глубина рассуждений.
Opus 5 умеет генерировать изображения или видео?
Нет. Как и Opus 4.8, Opus 5 принимает на вход текст, изображения и файлы, но на выходе даёт только текст. Она понимает графики, документы, диаграммы и интерфейсы («зрение»), но не рисует и не создаёт видео. Для генерации картинок и видео используйте раздел МедиаЛаб на платформе.
Насколько именно вырос уровень качества?
По подтверждённым числам: сводный рейтинг независимого агрегатора (215 моделей) — с 77,44 (#6) у Opus 4.8 до 85,88 (#1) у Opus 5; SWE-bench Pro — с 69,2% до 79,2%. Остальные бенчмарки Opus 5 (например, SWE-bench Verified 96,0%, GPQA Diamond 93,2%) показывают общий уровень нового флагмана.
Итог: Opus 5 отличается от Opus 4.8 не одной деталью, а связкой изменений — мышление по умолчанию, новые уровни усилий xhigh и max, ощутимый рост качества и более «вдумчивое» поведение с самопроверкой и делегированием субагентам. Для сложных задач это заметный шаг вперёд, при этом привычный Opus 4.8 остаётся под рукой. Проверьте разницу сами: начать бесплатно на СуперИнтеллекте. Полезно рядом: обзор Claude Opus 5, что умеет Claude Opus 5 и практический гайд как пользоваться Claude Opus 5.