Перейти к содержимому

Обучения

Чем Claude Opus 5 отличается от Opus 4.8

Разбираем конкретные отличия Claude Opus 5 от Opus 4.8: «мышление» включено по умолчанию, новые уровни усилий xhigh и max, скачок качества (сводный рейтинг 77,44→85,88, SWE-bench Pro 69,2%→79,2%) и изменения в поведении. Стоит ли переходить и где попробовать обе модели.

· ~11 мин

Claude Opus 5 (вышел 23 июля 2026, также пишут «клод опус 5» и «Anthropic Opus 5») — прямой преемник флагмана Claude Opus 4.8 (28 мая 2026). Главные отличия: в Opus 5 «мышление» (режим рассуждений) включено по умолчанию, добавлены новые уровни усилий xhigh и max, заметно вырос уровень качества (по данным независимого агрегатора сводный рейтинг поднялся с 77,44 до 85,88, а SWE-bench Pro — с 69,2% до 79,2%), и изменилось само поведение модели: ответы стали длиннее, она чаще сама себя проверяет и охотнее делегирует подзадачи субагентам. Обе модели доступны на СуперИнтеллекте, работают в России без VPN и зарубежной карты.

Ниже — по пунктам, что именно поменялось, таблица «4.8 vs 5» с числами и атрибуцией, а также ответ на главный вопрос: стоит ли переходить на новый флагман или остаться на Opus 4.8. Если нужен общий разбор новинки, есть отдельный обзор Claude Opus 5.

Что такое Opus 4.8 и Opus 5 в линейке Claude?

В семействе Claude модели делятся по назначению. Haiku — самая быстрая и лёгкая, для массовых задач вроде классификации и маршрутизации. Sonnet — «рабочая лошадка», баланс скорости и качества на каждый день. Opus — максимальная мощность, флагман линейки. Отдельно стоит экспериментальный Claude Fable 5, который был вершиной до выхода Opus 5. Если хотите разобраться в различиях всей линейки, есть материал чем отличаются модели Claude.

Claude Opus 4.8 вышел 28 мая 2026 и был прежним флагманом — самой мощной моделью Anthropic для глубоких рассуждений, программирования и длинных задач. Claude Opus 5 вышел 23 июля 2026 как прямой преемник: та же роль «максимальной мощности», но с обновлёнными дефолтами, новыми уровнями усилий и более высокими результатами на бенчмарках. Проще говоря, Opus 5 — это следующее поколение того же класса моделей, а не другая ветка.

Почему «мышление» теперь включено по умолчанию?

Ключевое изменение в дефолтах: в Claude Opus 5 режим «мышления» (глубокие рассуждения перед ответом) включён по умолчанию. Раньше рассуждения приходилось учитывать и настраивать отдельно — теперь модель по умолчанию сначала обдумывает задачу, а затем отвечает. Это напрямую влияет на качество на сложных запросах: чем труднее задача (математика, длинная агентная цепочка, поиск бага в коде), тем заметнее выигрыш от того, что модель «думает» перед выводом.

Практический эффект для пользователя: на нетривиальных задачах Opus 5 из коробки ведёт себя ближе к «аналитику», который сначала раскладывает проблему, а потом даёт решение. Это одна из причин, почему ответы стали длиннее и обстоятельнее, чем у Opus 4.8 — модель показывает и обосновывает ход мысли, а не только финальный результат.

Что дают новые уровни усилий xhigh и max?

В Opus 5 расширилась шкала «усилий» (effort) — сколько ресурсов модель тратит на обдумывание. Теперь доступны пять уровней: low, medium, high, xhigh и max, при этом по умолчанию используется high. Уровни xhigh и max — новые по сравнению с Opus 4.8 и позволяют выделить ещё больше test-time compute на самые тяжёлые задачи.

  • low — минимум обдумывания: быстро и экономно по нейронам, для простых и рутинных запросов.
  • medium — умеренные рассуждения для типовых рабочих задач.
  • high (по умолчанию) — глубокое обдумывание, оптимальный баланс для большинства сложных запросов.
  • xhigh — новый уровень: ещё больше «мышления» для трудных цепочек рассуждений и агентных задач.
  • max — новый максимум: предельные усилия для самых требовательных сценариев, где важна каждая доля точности.

Насколько вырос уровень качества по сравнению с Opus 4.8?

Скачок качества — не маркетинговая формулировка, а видимое движение по метрикам. По данным независимого агрегатора, оценивавшего 215 моделей, сводный рейтинг Opus 4.8 составлял 77,44 (6-е место), а Opus 5 возглавил список с результатом 85,88 (1-е место). На агентном программировании разрыв тоже заметный: SWE-bench Pro у Opus 4.8 — 69,2%, у Opus 5 — 79,2%.

Чтобы показать общий уровень нового флагмана, приведём ключевые публичные результаты Opus 5 (по данным Anthropic и независимых замеров). По самому Opus 4.8 из проверенных чисел есть SWE-bench Pro (69,2%) и позиция в сводном рейтинге (77,44) — их и используем для честного сравнения, не додумывая остальное.

БенчмаркClaude Opus 5
SWE-bench Verified (кодинг)96,0%
SWE-bench Pro (агентное кодирование)79,2%
GPQA Diamond (наука)93,2%
Multilingual (многоязычность)89,5%
BrowseComp (веб-навигация)90,8%
Toolathlon (работа с инструментами)80,6%
ARC-AGI-290,4%
MMMU-Pro (мультимодальность)84,7%
OfficeQA Pro (офисные задачи)66,9%
Публичные бенчмарки Claude Opus 5. Источник: Anthropic и независимые замеры.

Важная оговорка: числа выше относятся к Opus 5. По Opus 4.8 подтверждены только два показателя (SWE-bench Pro 69,2% и сводный рейтинг 77,44), поэтому прямое сравнение мы делаем именно по ним — этого достаточно, чтобы увидеть направление и масштаб прогресса.

Как изменилось поведение модели?

Помимо цифр, поменялся «характер» модели. Если вы привыкли к Opus 4.8, при переходе на Opus 5 вы заметите несколько поведенческих отличий — они логично вытекают из включённого по умолчанию мышления и более высоких уровней усилий.

  • Ответы стали длиннее и обстоятельнее — Opus 5 охотнее разворачивает рассуждения, приводит промежуточные шаги и обоснования, а не только итог.
  • Модель чаще сама себя проверяет — встроенная перепроверка (self-verification) снижает число ошибок на сложных задачах, что особенно ценно в коде и расчётах.
  • Охотнее делегирует субагентам — в мультиагентных сценариях Opus 5 сильнее в роли оркестратора: разбивает задачу и передаёт подзадачи субагентам (паттерн writer-verifier).
  • Эффективнее на низких усилиях — при этом на простых запросах модель не «переусердствует», если выбран уровень low/medium.

Таблица: Opus 4.8 против Opus 5

ПараметрClaude Opus 4.8Claude Opus 5
Дата выхода28 мая 202623 июля 2026
Позиция в линейкеПрежний флагманНовый флагман, прямой преемник
Режим «мышления»Не был включён по умолчаниюВключён по умолчанию
Уровни усилийlow / medium / highlow / medium / high / xhigh / max (деф. high)
SWE-bench Pro69,2%79,2%
Сводный рейтинг агрегатора77,44 (#6)85,88 (#1)
МодальностьВход: текст, изображения, файлы; выход: текстВход: текст, изображения, файлы; выход: текст
ПоведениеБаза линейкиДлиннее ответы, самопроверка, делегирование субагентам
На СуперИнтеллектеДоступнаДоступна (обычная + версия Fast)
Сравнение Claude Opus 4.8 и Claude Opus 5. Числа — по данным Anthropic и независимого агрегатора (215 моделей).

Обратите внимание на модальность: и Opus 4.8, и Opus 5 принимают на вход текст, изображения и файлы, но на выходе дают только текст. «Зрение» здесь означает понимание графиков, документов, диаграмм и интерфейсов — обе модели не генерируют картинки, видео или аудио. Для генерации изображений и видео на платформе есть отдельный раздел МедиаЛаб.

Стоит ли переходить с Opus 4.8 на Opus 5?

Короткий ответ: да, если ваши задачи сложные. Opus 5 выигрывает именно там, где важны глубокие рассуждения — агентное программирование и длинные многошаговые задачи, ревью кода и поиск багов, работа с длинным контекстом (до 1 000 000 токенов), офисные сценарии (таблицы, презентации) и мультиагентные связки. На таких задачах прирост качества и самопроверка окупают чуть более длинные ответы. Если основная задача — программирование, пригодится практический гайд Claude Opus 5 для кода.

  • Переходить стоит, если вы пишете или ревьюите код, ведёте аналитику, работаете с большими документами, строите агентов или вам важна максимальная точность рассуждений.
  • Можно не спешить, если у вас простые, повторяющиеся запросы, где Opus 4.8 уже устраивает по скорости и результату — либо присмотреться к более лёгким и быстрым моделям линейки.
  • Хорошая новость: выбор не окончательный. Opus 4.8 остаётся доступным, а смена модели на СуперИнтеллекте — это один клик, без переписывания промптов. Можно сравнить обе на своей реальной задаче.

Где попробовать Opus 5 и Opus 4.8?

Обе модели уже доступны на СуперИнтеллекте в чате: Claude Opus 5 (в обычной и ускоренной версии «Claude Opus 5 (Fast)»), а также Claude Opus 4.8, Claude Fable 5, Claude Sonnet 5 и другие модели (GPT, Gemini, GigaChat) — всё в одном окне. Работает в России без VPN и без зарубежной карты, оплата — нейронами, есть бесплатный старт. Если вы только начинаете, пошаговый разбор — в гайде как пользоваться Claude Opus 5.

Самый честный тест — сравнить Opus 5 и Opus 4.8 на своей реальной задаче: один клик переключает модель, промпт переписывать не нужно. Зарегистрироваться и попробовать Claude Opus 5.

Частые вопросы (FAQ)

Opus 5 полностью заменяет Opus 4.8?

Нет. Opus 5 — прямой преемник и новый флагман, но Opus 4.8 остаётся доступным на СуперИнтеллекте. Вы можете использовать любую из них и переключаться в один клик. Для новых сложных задач по умолчанию имеет смысл выбирать Opus 5.

Правда ли, что Opus 5 «думает» дольше и отвечает медленнее?

На высоких уровнях усилий (high, xhigh, max) Opus 5 тратит больше времени на обдумывание — это и даёт прирост качества на сложных задачах. Но модель эффективна и на низких уровнях: для простых запросов выберите low или medium, и ответ будет быстрым. Также есть ускоренная версия «Claude Opus 5 (Fast)».

Чем xhigh и max отличаются от обычного high?

Это более высокие уровни усилий, которых не было в Opus 4.8. Они выделяют модели ещё больше вычислений на обдумывание (test-time compute) для самых трудных задач. По умолчанию используется high — он оптимален для большинства сложных запросов; xhigh и max включают точечно, когда нужна предельная глубина рассуждений.

Opus 5 умеет генерировать изображения или видео?

Нет. Как и Opus 4.8, Opus 5 принимает на вход текст, изображения и файлы, но на выходе даёт только текст. Она понимает графики, документы, диаграммы и интерфейсы («зрение»), но не рисует и не создаёт видео. Для генерации картинок и видео используйте раздел МедиаЛаб на платформе.

Насколько именно вырос уровень качества?

По подтверждённым числам: сводный рейтинг независимого агрегатора (215 моделей) — с 77,44 (#6) у Opus 4.8 до 85,88 (#1) у Opus 5; SWE-bench Pro — с 69,2% до 79,2%. Остальные бенчмарки Opus 5 (например, SWE-bench Verified 96,0%, GPQA Diamond 93,2%) показывают общий уровень нового флагмана.


Итог: Opus 5 отличается от Opus 4.8 не одной деталью, а связкой изменений — мышление по умолчанию, новые уровни усилий xhigh и max, ощутимый рост качества и более «вдумчивое» поведение с самопроверкой и делегированием субагентам. Для сложных задач это заметный шаг вперёд, при этом привычный Opus 4.8 остаётся под рукой. Проверьте разницу сами: начать бесплатно на СуперИнтеллекте. Полезно рядом: обзор Claude Opus 5, что умеет Claude Opus 5 и практический гайд как пользоваться Claude Opus 5.

Бесплатная экскурсия · онлайн · до часа

Посмотрите, как это работает на ваших задачах

Эксперт по внедрению покажет платформу вживую: ИИ-агенты, базы знаний, генерация контента и интеграции — на примерах именно ваших процессов. Без обязательств.

  • Разберём 2–3 ваших процесса и покажем, что автоматизируется уже сейчас
  • После встречи — запись, мини-план внедрения и подборка агентов
  • Экскурсию проводит эксперт по внедрению, а не менеджер по продажам

Не готовы к встрече? Пройдите квиз «Готов ли бизнес к ИИ» — получите персональный отчёт и бонусные нейроны за 2 минуты.

Запишитесь на экскурсию

Свяжемся в течение рабочего дня и подберём удобное время.

Защищено reCAPTCHA: Конфиденциальность · Условия

Claude Opus 5 vs Opus 4.8: что изменилось — СуперИнтеллект