Claude Opus 5 — это новая флагманская модель Anthropic, которая для задач программирования выступает как «старший инженер»: она пишет код, сама его проверяет, ищет баги, доводит длинные многошаговые задачи до конца и удерживает в контексте до 1 000 000 токенов — этого хватает на большую кодовую базу целиком. По данным Anthropic, на ключевом отраслевом бенчмарке SWE-bench Verified модель достигает 96,0% (среднее по 5 прогонам) — это уровень, на котором модель решает подавляющее большинство реальных задач из открытых репозиториев без вмешательства человека.

В отличие от инкрементальных обновлений, Opus 5 — это заявленный «шаг вперёд» относительно Claude Opus 4.8. «Мышление» (reasoning) включено по умолчанию, а его глубину можно регулировать уровнем усилий — от быстрого low до самой тщательной проработки max. Для разработчика это значит одно: одна и та же модель может и мгновенно поправить опечатку в типах, и несколько часов вести рефакторинг с проверкой каждого шага.

Почему Claude Opus 5 силён именно в коде?

Сила модели в разработке складывается не из одного числа на бенчмарке, а из нескольких взаимоусиливающих свойств. Opus 5 одновременно хорошо рассуждает, умеет действовать шагами (агентно), работает с очень длинным контекстом и понимает изображения — графики, документы, скриншоты интерфейсов. Для программиста это переводится в конкретные преимущества.

  • Глубокие рассуждения. Модель разбирает сложную логику, выстраивает план решения и обосновывает архитектурные решения, а не просто «дописывает следующую строку».
  • Агентное программирование. Opus 5 ведёт длинные многошаговые задачи: читает файлы, вносит правки, запускает проверки, исправляет обнаруженные проблемы и продолжает до результата.
  • Меньше заглушек. Поведенчески модель чаще доводит работу до конца и сама её перепроверяет, вместо того чтобы оставить // TODO или пустую функцию-заглушку.
  • Ревью и поиск багов. Одна из заявленных сильных сторон — чтение чужого кода, разбор диффов и обнаружение дефектов, включая неочевидные краевые случаи.
  • Зрение для вёрстки. По скриншоту или макету модель воспроизводит UI и вёрстку — понимает структуру интерфейса, а не только текст.
  • Длинный контекст. До 1 000 000 токенов на входе позволяет держать в голове большой репозиторий, а не отдельные разрозненные файлы.
  • Масштабирование качеством. С ростом уровня усилий (test-time compute) качество растёт — сложную задачу можно «додавить» более глубокой проработкой.

Что показывают бенчмарки Claude Opus 5 по коду?

Ниже — подтверждённые метрики, релевантные для разработки. SWE-bench Verified — это набор реальных issue из открытых проектов, где модель должна внести правку, проходящую тесты; это самый показательный «кодовый» бенчмарк. Значения приведены по данным Anthropic.

БенчмаркЧто измеряетРезультат Opus 5
SWE-bench VerifiedРешение реальных задач из репозиториев96,0% (среднее по 5 прогонам)
SWE-bench ProБолее сложные инженерные задачи79,2%
SWE-bench MultilingualКод на разных языках программирования89,5%
SWE-bench MultimodalЗадачи с визуальным контекстом59,4%
BrowseCompАгентная работа в вебе90,8%
Toolathlon VerifiedИспользование инструментов (tool use)80,6%
GPQA DiamondЭкспертные научные рассуждения93,2%
Метрики Claude Opus 5, релевантные для разработки (по данным Anthropic)

Отдельно стоит смотреть на связку SWE-bench Verified (96,0%) и Toolathlon Verified (80,6%): первая говорит о качестве самих правок, вторая — о надёжности работы с инструментами. Именно их сочетание делает модель пригодной для агентных сценариев, где нужно не просто «предложить код», а самостоятельно применить его и проверить.

Что такое агентное программирование в Opus 5?

Агентное программирование — это режим, в котором модель не выдаёт одно сообщение с кодом, а работает как исполнитель: последовательно совершает шаги, наблюдает результат и корректирует план. Opus 5 заявлена как особенно сильная в длинных многошаговых задачах и мультиагентной координации — когда одна модель распределяет работу между субагентами по схеме «исполнитель — проверяющий».

  • Планирование. Модель разбивает задачу на подзадачи и определяет порядок их выполнения.
  • Итеративное исполнение. Правка → проверка → исправление ошибок → следующий шаг, без потери общей цели.
  • Самопроверка. Opus 5 охотнее перечитывает собственный результат и ищет в нём слабые места, прежде чем считать задачу выполненной.
  • Делегирование. В сложных сценариях модель охотнее распределяет работу на субагентов, где один пишет, а другой ревьюит.

Практический эффект: там, где раньше приходилось вести модель «за руку» шаг за шагом, Opus 5 способна пройти цепочку самостоятельно. Это меняет саму роль разработчика — от «набирать код» к «ставить задачу и принимать результат».

Как Opus 5 справляется с длинными задачами без заглушек?

Типичная боль работы с ассистентами — незаконченные ответы: функция с комментарием «здесь будет реализация», обрезанный файл, забытый импорт. Opus 5 ведёт себя иначе: ответы длиннее, модель чаще доводит реализацию до конца и сама проверяет свою работу. В сочетании с окном вывода до 128 000 токенов это означает, что даже крупный модуль модель способна выдать целиком, а не кусками.

Для длинных многошаговых задач важна и устойчивость к «потере нити»: с контекстом до 1 000 000 токенов модель удерживает в поле зрения ранее принятые решения, договорённости об именовании, стиль проекта и уже написанные части. Это снижает риск того, что во втором файле модель забудет, как устроен первый.

Насколько хорошо Opus 5 делает ревью кода и ищет баги?

Ревью кода и поиск багов Anthropic называет одной из ключевых сильных сторон Opus 5. Модель читает дифф или целый модуль, реконструирует намерение автора и указывает на дефекты — от очевидных до краевых случаев, которые легко пропустить при беглом просмотре.

  • Логические ошибки. Неверные условия, перепутанные границы диапазонов, ошибки в обработке пустых значений.
  • Краевые случаи. Пустой список, отрицательные числа, конкурентный доступ, таймауты — сценарии, которые редко покрыты тестами.
  • Безопасность. Потенциальные инъекции, утечки данных, небезопасная обработка ввода.
  • Читаемость и поддержка. Дублирование, лишняя сложность, места, где стоит упростить логику.

Зачем разработчику «зрение» Opus 5?

Opus 5 принимает на вход текст, изображения и файлы, а на выход выдаёт только текст — модель не рисует картинки и не генерирует видео. Но её «зрение» — это понимание визуального: графиков, документов, диаграмм и, что особенно ценно для фронтенда, скриншотов интерфейсов и макетов.

Практически это значит, что вы можете приложить скриншот нужного экрана и попросить воспроизвести вёрстку, разобрать по картинке структуру таблицы или диаграммы архитектуры, перенести дизайн из макета в разметку. Модель понимает, как устроен интерфейс, и переводит это в код, а не просто пересказывает, что видит на изображении.

Зачем разработчику контекст в 1 000 000 токенов?

Окно в 1 000 000 токенов — это и значение по умолчанию, и максимум. Для кода это одна из самых важных характеристик: чем больше проекта помещается в контекст, тем меньше модель «домысливает» недостающие части и тем точнее её правки.

  • Большая кодовая база целиком. Модель видит связи между модулями, а не отдельные файлы, вырванные из контекста.
  • Согласованность правок. Изменение в одном месте учитывает зависимости в других — меньше рассинхрона.
  • Разбор незнакомого репозитория. Можно загрузить проект и попросить объяснить архитектуру, точки входа и потоки данных.
  • Длинные сессии. История обсуждения, требования и уже написанный код остаются в поле зрения на протяжении всей работы.

Практические сценарии: где Opus 5 помогает разработчику?

Соберём сильные стороны модели в конкретные рабочие сценарии. Все они доступны прямо в чате СуперИнтеллекта — модель можно переключить одним кликом, не переписывая промпт.

Рефакторинг легаси-кода

Загрузите проблемный модуль (или несколько связанных файлов) и опишите цель: убрать дублирование, разбить «god object», выделить слои. Opus 5 благодаря длинному контексту видит зависимости и рефакторит согласованно, а благодаря самопроверке — реже ломает поведение. На уровне усилий high или xhigh модель дополнительно прогоняет логику через себя, отлавливая регрессии ещё на этапе рассуждения.

Фича end-to-end

Поставьте задачу целиком: «добавить эндпоинт, слой сервиса, валидацию и тесты». Здесь работает агентность — модель ведёт длинную многошаговую задачу без заглушек, доводя каждый слой до рабочего состояния. Приложите скриншот нужного экрана — и «зрение» поможет собрать соответствующую вёрстку.

Ревью пул-реквеста

Вставьте дифф и краткое описание задачи PR. Модель разберёт изменения, найдёт баги и краевые случаи, оценит влияние на смежный код и предложит правки. Попросите отранжировать замечания по важности — так проще решить, что блокирует мёрж, а что можно оставить на потом.

Разбор большого незнакомого репозитория

Загрузите проект и попросите объяснить: где точка входа, как устроены основные потоки данных, какие модули за что отвечают, где узкие места. Контекст до 1 000 000 токенов позволяет держать в голове весь проект, а не отвечать по обрывкам — модель строит связную карту, а не догадки по именам файлов.

Как управлять уровнем усилий (effort) в Opus 5?

«Мышление» в Opus 5 включено по умолчанию, а его глубину задаёт параметр усилий. Это прямой рычаг баланса «скорость против тщательности»: на низких уровнях модель отвечает быстрее и эффективнее, на высоких — глубже прорабатывает задачу и качественнее решает сложные случаи.

УровеньХарактер работыКогда использовать
lowБыстро и экономноМелкие правки, автодополнение, простые вопросы по коду
mediumБаланс скорости и глубиныТиповые задачи: небольшая фича, локальный рефакторинг
high (по умолчанию)Тщательная проработкаРевью, отладка, многошаговые задачи — базовый выбор
xhighУглублённые рассужденияСложная логика, нетривиальная архитектура, каверзные баги
maxМаксимальная глубинаСамые трудные задачи, где важнее качество, чем скорость
Уровни усилий Opus 5 и когда их применять в разработке

Как начать работать с Claude Opus 5 на СуперИнтеллекте?

Модель уже доступна в чате СуперИнтеллекта — в обычной версии и в ускоренной Claude Opus 5 (Fast). Она работает в России без VPN и без зарубежной карты, в одном окне с Claude Opus 4.8, Fable 5, Sonnet 5, а также GPT, Gemini и GigaChat. Смена модели — один клик в том же чате, без переписывания промптов.

  1. Зарегистрируйтесь и войдите в чат СуперИнтеллекта.
  2. Выберите в списке моделей Claude Opus 5 (или Fast-версию, если нужна скорость).
  3. Приложите нужные файлы, дифф или скриншот интерфейса.
  4. Сформулируйте задачу и, при необходимости, укажите желаемую глубину проработки.
  5. Получите результат, а для сложных задач — попросите модель проверить собственную работу.

Как Opus 5 соотносится с другими моделями?

В чистом кодировании топовые модели идут плотно: по независимым обзорам Claude Fable 5 набирает около 95% на SWE-bench Verified, а Opus 5 — 96,0% по данным Anthropic. Разницу чаще решают длина контекста, агентная надёжность и качество ревью, а не десятые доли процента. Подробные сопоставления мы собрали в отдельных материалах: Claude Opus 5 против Fable 5, Opus 5 против GPT-5.6 и Opus 5 против Gemini.

Если вам нужен более общий разбор возможностей и старта работы, начните с обзора Claude Opus 5, материала что умеет Claude Opus 5 и инструкции как пользоваться Claude Opus 5. Для бизнес-сценариев есть отдельный гайд Claude Opus 5 для бизнеса.


Частые вопросы о Claude Opus 5 для разработки

Действительно ли Opus 5 достигает 96% на SWE-bench Verified?

Да, по данным Anthropic результат составляет 96,0% как среднее по 5 прогонам на SWE-bench Verified. Это набор реальных задач из открытых репозиториев, где правка должна проходить тесты, поэтому метрика хорошо отражает практическую пригодность модели в разработке. Стоит помнить, что бенчмарк — ориентир, а не гарантия для любого конкретного проекта.

Может ли Claude Opus 5 сгенерировать иконки или картинки для интерфейса?

Нет. Opus 5 принимает на вход текст, изображения и файлы, но на выход выдаёт только текст — модель не создаёт изображения, аудио или видео. При этом её «зрение» помогает разработке: по скриншоту или макету она понимает вёрстку и воспроизводит структуру интерфейса в коде, а также разбирает диаграммы и графики.

Какой уровень усилий выбрать для отладки сложного бага?

Для нетривиальной отладки поднимайте усилия до xhigh или max — на этих уровнях модель глубже прорабатывает гипотезы и внимательнее анализирует краевые случаи. Для типовых задач достаточно уровня high (значение по умолчанию), а для мелких правок и автодополнения подойдут medium или low, где Opus 5 отвечает быстрее и эффективнее.

Хватит ли контекста, чтобы загрузить весь мой репозиторий?

Часто да: окно контекста Opus 5 — до 1 000 000 токенов, и это одновременно значение по умолчанию и максимум. Для многих проектов этого достаточно, чтобы модель видела кодовую базу целиком и вносила согласованные правки. Очень большие монорепозитории всё же имеет смысл сузить до релевантных модулей — так модель точнее сфокусируется на задаче.

Чем ускоренная версия Claude Opus 5 (Fast) отличается для работы с кодом?

Fast-версия ориентирована на скорость отклика и удобна для интерактивной работы — быстрых правок, коротких вопросов по коду, итеративного диалога. Для самых тяжёлых многошаговых задач, где важнее глубина, чем скорость, разумно использовать обычную версию с повышенным уровнем усилий. Обе доступны в одном окне, переключение — один клик.


Итог: Opus 5 закрывает полный цикл работы с кодом — от планирования и написания до ревью, поиска багов и разбора чужих репозиториев, с длинным контекстом и управляемой глубиной рассуждений. Проверьте на своей задаче прямо сейчас: начать бесплатно на СуперИнтеллекте.