Перейти к содержимому

Обучения

Что умеет Claude Opus 5: возможности и примеры

Claude Opus 5 — новый флагман Anthropic. Разбираем, что он умеет: глубокие рассуждения, агентное программирование, ревью кода, анализ графиков и документов, контекст 1 млн токенов, офисные задачи и мультиагентные команды — с практическими примерами промптов.

· ~13 мин

Claude Opus 5 — это новый флагман компании Anthropic и заметный шаг вперёд относительно Opus 4.8, а не просто очередной инкремент. Модель умеет глубоко рассуждать над сложными задачами, вести длинные многошаговые агентные проекты (в первую очередь в программировании), находить баги при ревью кода, «читать» графики, документы и диаграммы, работать с контекстом до 1 000 000 токенов, решать офисные задачи (сложные таблицы и презентации) и координировать команды субагентов. Важно сразу зафиксировать модальность: на вход Opus 5 принимает текст, изображения и файлы, а на выход выдаёт только текст — картинки, аудио и видео он не генерирует. Ниже разбираем каждую способность на практических примерах, а попробовать модель можно сразу в чате СуперИнтеллекта.

Что такое Claude Opus 5 и чем он отличается от Opus 4.8?

Claude Opus 5 — это старшая, «думающая» модель линейки Claude, и её ключевое отличие от предшественника не в мелких улучшениях, а в качестве рассуждений и уровне агентности. Модель даёт более длинные и продуманные ответы, чаще сама перепроверяет свою работу и охотнее делегирует часть задач субагентам. Отдельная особенность — масштабирование качества с ростом «усилий» (test-time compute): чем больше времени вы разрешаете модели подумать, тем выше точность на трудных задачах. При этом на низких уровнях усилий Opus 5 остаётся эффективной и отвечает быстро, так что включать максимальную глубину каждый раз не обязательно — под простые запросы хватает и лёгкого режима. По данным независимого агрегатора бенчмарков (сводный рейтинг из 215 моделей) Claude Opus 5 занимает первое место; это полезный ориентир, но стоит помнить, что рейтинг усредняет очень разные задачи, и под конкретную работу модель всегда полезно проверить на своих данных. Сравнить Opus 5 с другими флагманами удобно в отдельных материалах: Opus 5 против GPT-5.6, Opus 5 против Gemini и Opus 5 против Fable 5.

МестоМодельБалл
#1Claude Opus 585,88
#3Claude Fable 582,76
#4GPT-5.6 Sol81,46
#6Claude Opus 4.877,44
Сводный рейтинг независимого агрегатора бенчмарков (из 215 моделей). По данным агрегатора.

Глубокие рассуждения: как Opus 5 думает над сложными задачами?

«Мышление» в Opus 5 включено по умолчанию: перед ответом модель проводит внутреннюю проработку задачи, а не выдаёт первый пришедший вариант. Это особенно заметно там, где нужно связать много условий, — в математике, логике, научных вопросах, разборе запутанных требований и планировании. По данным Anthropic, Opus 5 показывает 93,2% на GPQA Diamond (научные вопросы уровня PhD), 90,4% на ARC-AGI-2 (тест абстрактного рассуждения) и решает 42 из 42 задач на олимпиаде IMO 2026. Это не значит, что модель непогрешима, но уровень проработки высокий. На практике это удобно, когда техническое задание противоречиво и нужно не просто «сделать», а сначала найти в нём дыры и развилки: Opus 5 хорошо играет роль «критика требований» — раскладывает задачу на предпосылки, подсвечивает неоднозначности и предлагает варианты, вместо того чтобы молча выбрать один из них.

Агентное программирование и длинные многошаговые задачи

Одна из сильнейших сторон Opus 5 — агентное программирование: не разовая генерация сниппета, а длинные задачи, где нужно держать план, выполнять шаги по очереди, проверять промежуточный результат и корректировать курс. По данным Anthropic, на SWE-bench Verified (решение реальных задач из GitHub-репозиториев) модель набирает 96,0% в среднем по пяти прогонам, а на более сложном SWE-bench Pro — 79,2%. Для сравнения: по данным Anthropic, Claude Fable 5 набирает около 95% на SWE-bench Verified, так что оба флагмана здесь очень сильны. На практике Opus 5 хорошо ведёт задачи такого вида:

  • Реализовать фичу «от тикета до PR»: разобраться в незнакомом репозитории, внести изменения в нескольких файлах, обновить тесты.
  • Мигрировать код между версиями фреймворка или библиотеками, аккуратно проходя по всем затронутым местам.
  • Написать скрипт автоматизации и итеративно его отладить, читая ошибки и правя код.
  • Поднять прототип по описанию: структура проекта, основные модули, заготовки тестов.

Подробнее про кодинг-сценарии — в материале Claude Opus 5 для кода, а общий разбор возможностей — в обзоре Claude Opus 5.

Ревью кода и поиск багов: что находит Opus 5?

Ревью — отдельная сильная сторона модели. Opus 5 не ограничивается вердиктом «выглядит нормально», а вычитывает логику: ищет ошибки в граничных условиях, гонки, утечки ресурсов, неверную обработку ошибок, проблемы безопасности и расхождения между кодом и его же тестами. Благодаря длинному контексту ему можно за один раз отдать большой diff или несколько связанных файлов, чтобы он видел картину целиком, а не отдельный фрагмент. Такой ревью удобно встроить в рабочий процесс как «второго проверяющего»: человек смотрит на архитектуру и продуктовую логику, а модель методично проходит по деталям и подсвечивает подозрительные места с объяснением, почему именно это может сломаться и при каком сценарии. Важно, что модель не просто отмечает строку, а формулирует гипотезу отказа и предлагает конкретную правку, — такой ответ проще проверять и превращать в задачу для исправления.

Зрение: анализ графиков, документов и диаграмм, копирование UI

«Зрение» у Opus 5 — это понимание визуального содержимого на входе, а не рисование на выходе. Вы можете загрузить скриншот, фотографию документа, диаграмму, дашборд или график — и модель разберёт, что на них изображено, и переведёт это в текст, таблицу или код. Это удобно, когда данные существуют только как картинка: снимок доски после совещания, PDF-отчёт без исходных таблиц, фото бумажного документа. По данным Anthropic, на мультимодальном тесте MMMU-Pro модель показывает 84,7%, а на SWE-bench Multimodal (задачи, где нужно учитывать визуальный контекст) — 59,4%. Вот типичные визуальные сценарии:

  • «Прочитать» график или дашборд: описать тренды, найти аномалии, выписать ключевые цифры в текст или таблицу.
  • Разобрать скан договора или счёта: вытащить структуру, суммы, даты, ответственных.
  • Понять архитектурную диаграмму или блок-схему и объяснить её словами.
  • Скопировать вёрстку/UI: по скриншоту интерфейса собрать разметку и стили, воспроизводящие макет.

Длинный контекст 1 000 000 токенов: зачем он нужен?

Контекст в 1 000 000 токенов — это возможность держать в одном разговоре очень большой объём материала: обширную кодовую базу, десятки документов, длинную переписку или целую базу знаний. Модель не «забывает» начало, когда работает над концом, и связывает факты, разбросанные по разным частям входных данных, — это меняет сам класс задач, которые можно решать за один заход, без ручной нарезки на кусочки. Особенно это полезно для аудита большого репозитория целиком, сверки нескольких версий договора, ответов по объёмной документации, анализа длинных логов и обобщения серии интервью или тикетов. Выход при этом остаётся до 128 000 токенов — этого хватает и на развёрнутый отчёт, и на большой рефакторинг за один проход.

Офисные задачи: сложные таблицы и презентации

Opus 5 уверенно работает с офисными задачами — многолистовыми таблицами со сложными формулами и подготовкой презентаций. По данным Anthropic, на профильном тесте OfficeQA Pro модель показывает 66,9%. На практике это значит, что ей можно поручить не только «посчитать сумму», но и разобраться в логике связанных листов, восстановить формулу, объяснить, откуда взялось число, и предложить структуру расчёта. Всё это остаётся в текстовом виде — модель опишет таблицу, формулы и логику словами, а перенести результат в редактор вы сможете сами. Вот что удобно делегировать модели (а больше прикладных бизнес-сценариев — в материале Claude Opus 5 для бизнеса):

  • Разбор чужой таблицы: объяснить, что делает формула, где потенциальная ошибка, как её упростить.
  • Спроектировать модель расчёта (например, юнит-экономику или бюджет) и описать формулы по ячейкам.
  • Собрать структуру презентации по теме: план слайдов, тезисы, черновой текст для каждого блока.
  • Превратить сырые данные или заметки в аккуратную текстовую таблицу и выводы по ней.

Мультиагентные команды: как Opus 5 координирует субагентов?

Opus 5 охотнее и качественнее работает по схеме мультиагентной координации — когда одна модель выступает «исполнителем», другая «проверяющим», и вместе они доводят задачу до результата. Модель хорошо держит роль оркестратора: раскладывает крупную цель на подзадачи, распределяет их между субагентами и сводит результаты воедино. Косвенно это подтверждают агентные бенчмарки: по данным Anthropic, BrowseComp — 90,8%, Toolathlon Verified — 80,6%. Практический сценарий такой команды: один агент пишет код фичи, второй проводит ревью и ищет баги, третий сверяет результат с чек-листом требований — и всё это координируется в рамках одной задачи. Такой подход снижает число ошибок за счёт встроенной перепроверки, а не одного прохода, а инициирует эту перепроверку модель всё чаще сама, что особенно заметно на длинных задачах.

Уровни усилий low / medium / high / xhigh / max: как управлять глубиной?

Глубина «мышления» регулируется параметром усилий. По умолчанию стоит high — разумный баланс между качеством и скоростью. Для рутинных запросов усилия можно снизить и получить быстрый ответ, а для действительно трудных задач — поднять до max, чтобы модель проработала решение максимально глубоко. Именно здесь проявляется масштабирование качества: больше усилий — выше точность на сложном, но и дольше ответ. Ниже — ориентир, какой уровень выбирать под какую задачу; а как именно переключать глубину и настраивать модель, разбираем в практическом гайде как пользоваться Claude Opus 5.

УровеньКогда выбирать
lowПростые и рутинные запросы, где важна скорость
mediumОбычные задачи средней сложности
high (по умолчанию)Универсальный баланс качества и скорости
xhighТрудные многошаговые задачи, важные решения
maxСамая глубокая проработка: сложная логика, критичные задачи
Ориентир по выбору уровня усилий в Claude Opus 5.

Как попробовать Claude Opus 5 на СуперИнтеллекте?

Claude Opus 5 уже доступен в чате СуперИнтеллекта — есть обычная версия и ускоренная Claude Opus 5 (Fast). Работает из России без VPN и без зарубежной карты, в одном окне с другими моделями (Claude Opus 4.8, Fable 5, Sonnet 5, GPT, Gemini, GigaChat и другими). Переключиться между ними — один клик в том же чате, без переписывания промптов: можно начать задачу на одной модели и продолжить на другой, сохранив весь контекст переписки. Оплата — «нейронами», есть бесплатный старт, так что познакомиться с моделью можно без вложений и сразу на реальной задаче: зарегистрироваться на СуперИнтеллекте.

  • Начните с задачи, где важны рассуждения, — разбор требований или ревью кода.
  • Для трудных задач поднимите уровень усилий до xhigh или max.
  • Прикрепляйте картинки и файлы — модель разберёт графики, сканы и диаграммы.
  • Нужна другая модель для сравнения — переключитесь в один клик в том же чате.

Частые вопросы о возможностях Claude Opus 5

Claude Opus 5 умеет генерировать изображения или видео?

Нет. Opus 5 принимает на вход текст, изображения и файлы, но на выходе выдаёт только текст (включая код, разметку и таблицы в текстовом виде). Он понимает картинки — графики, документы, диаграммы, скриншоты интерфейсов, — но не рисует их. Для генерации изображений и видео на СуперИнтеллекте есть отдельный раздел MediaLab.

Какой контекст у Claude Opus 5 и сколько он может выдать в ответе?

Контекст — 1 000 000 токенов, это и значение по умолчанию, и максимум. Такой объём позволяет держать в одном разговоре большую кодовую базу, десятки документов или длинную переписку. Максимальная длина ответа — до 128 000 токенов, чего хватает и на объёмный отчёт, и на крупный рефакторинг.

Для чего Claude Opus 5 подходит лучше всего?

Для задач, где важны глубокие рассуждения и аккуратность: агентное программирование и длинные многошаговые задачи, ревью кода и поиск багов, анализ графиков и документов, работа с большим объёмом материала за счёт длинного контекста, сложные таблицы и презентации, а также мультиагентная координация по схеме «исполнитель — проверяющий». Для простых и рутинных запросов модель тоже подходит — достаточно снизить уровень усилий, чтобы получать быстрый ответ без лишней траты времени.

Нужен ли VPN или зарубежная карта, чтобы пользоваться Claude Opus 5?

Нет. На СуперИнтеллекте Claude Opus 5 работает из России без VPN и без зарубежной карты. Модель доступна в одном окне с другими нейросетями, переключение — в один клик, оплата — нейронами, есть бесплатный старт. Начать можно по ссылке: my.suin.ai/auth/register.