Перейти к содержимому

Обучения

Claude Opus 5: полный обзор нового флагмана Anthropic

Claude Opus 5 — новый флагман Anthropic, вышедший 23 июля 2026. Контекст 1 млн токенов, «мышление» по умолчанию, #1 в независимом рейтинге. Разбираем, что нового относительно Opus 4.8, бенчмарки, сильные стороны, ограничения и как попробовать модель без VPN.

· ~13 мин

Claude Opus 5 — это новый флагман компании Anthropic, вышедший 23 июля 2026 года и уже доступный в чате СуперИнтеллекта. Это не инкремент, а полноценный шаг вперёд относительно предыдущего флагмана Opus 4.8: контекст расширен до 1 000 000 токенов, «мышление» (reasoning) включено по умолчанию, а глубину рассуждений можно регулировать пятью уровнями усилий — от low до max. Модель принимает на вход текст, изображения и файлы, а на выходе выдаёт только текст, и особенно сильна в глубоких рассуждениях, агентном программировании и длинных многошаговых задачах.

Что такое Claude Opus 5 и чем он отличается от Opus 4.8?

Claude Opus 5 — это старшая, самая «умная» модель линейки Claude, предназначенная для задач, где важнее всего качество мышления: сложный код, аналитика, планирование, многошаговые агентные сценарии. По позиционированию Anthropic это именно новое поколение флагмана, а не косметическое обновление Opus 4.8. Разница ощущается не только в цифрах бенчмарков, но и в поведении: модель отвечает более развёрнуто, чаще перепроверяет собственную работу и охотнее делит большую задачу между субагентами. Если сравнивать поколения на языке возможностей, ключевые сдвиги относительно Opus 4.8 такие:

  • Контекст 1 000 000 токенов — это и значение по умолчанию, и максимум; в один запрос помещаются большие кодовые базы и длинные документы целиком.
  • Мышление включено по умолчанию — модель рассуждает перед ответом, а не только когда её об этом попросили.
  • Пять уровней усилий (low → medium → high → xhigh → max) — вы управляете тем, сколько «думать» модели, балансируя глубину и скорость.
  • Более выраженная агентность — длинные автономные задачи, координация команд субагентов по схеме «исполнитель-проверяющий».
  • Рост качества с ростом усилий (test-time compute) при хорошей эффективности на низких уровнях.
  • Позиция №1 в независимом сводном рейтинге бенчмарков против №6 у Opus 4.8 (см. таблицу ниже).

Как работает «мышление» и уровни усилий low → max?

В Claude Opus 5 режим рассуждений (reasoning) активен по умолчанию: перед тем как выдать ответ, модель проводит внутреннюю проработку задачи. За глубину этой проработки отвечает параметр усилий. Чем выше уровень — тем больше вычислений модель тратит на обдумывание, тем тщательнее разбирает граничные случаи и тем чаще сама себя проверяет. По умолчанию используется уровень high, а max задействует максимальную глубину для самых трудных задач.

  • low — быстрые ответы с минимальными затратами вычислений; подходит для простых и типовых задач, где важнее скорость и экономичность.
  • medium — сбалансированный режим для повседневных задач средней сложности.
  • high — уровень по умолчанию: глубокая проработка для сложного кода, аналитики и многошаговых сценариев.
  • xhigh — ещё более тщательный разбор, когда цена ошибки высока.
  • max — максимальная глубина рассуждений и test-time compute для самых трудных задач: исследовательская математика, тонкая отладка, длинные агентные цепочки.

Какие результаты у Claude Opus 5 в бенчмарках?

Ниже — сводка результатов Claude Opus 5 по данным Anthropic и независимых обзоров. Обратите внимание: FrontierBench v0.1 — это внутренний тест Anthropic, поэтому его стоит воспринимать с соответствующей поправкой. Все числа приводятся с атрибуцией к источнику.

БенчмаркЧто проверяетРезультат Claude Opus 5
SWE-bench VerifiedРешение реальных задач из GitHub96,0% (среднее по 5 прогонам)
SWE-bench ProУсложнённые инженерные задачи79,2%
SWE-bench MultilingualКод на разных языках89,5%
SWE-bench MultimodalКод с визуальным контекстом59,4%
BrowseCompВеб-навигация и поиск90,8%
Toolathlon VerifiedРабота с инструментами80,6%
GPQA DiamondНаучные вопросы уровня PhD93,2%
Humanity's Last Exam (с инструментами)Экспертные знания64,7%
ARC-AGI-2Абстрактное рассуждение90,4%
ARC-AGI-1Абстрактное рассуждение97,5%
MMMU-ProМультимодальное понимание84,7%
OfficeQA ProОфисные задачи66,9%
IMO 2026Математическая олимпиада42/42
ArXivMath (с инструментами)Научная математика91,3%
FrontierBench v0.1Внутренний тест Anthropic43,3%
Бенчмарки Claude Opus 5. Источник: данные Anthropic и независимые обзоры; FrontierBench v0.1 — внутренний тест Anthropic, оценивать с поправкой.

Что показывает независимый сводный рейтинг моделей?

МестоМодельБалл
№1Claude Opus 585,88
№3Claude Fable 582,76
№4GPT-5.6 Sol81,46
№6Claude Opus 4.877,44
Сводный рейтинг независимого агрегатора бенчмарков из 215 моделей. В подборку включены ближайшие ориентиры — Claude Fable 5, GPT-5.6 Sol и предыдущий флагман Opus 4.8.

В чём сильные стороны Claude Opus 5?

Профиль Opus 5 — это модель для сложной интеллектуальной работы. Она заметно выигрывает там, где нужны рассуждения, самопроверка и способность удерживать длинный контекст, а не короткие фактические ответы. Вот основные сильные стороны:

  • Глубокие многошаговые рассуждения с привычкой самостоятельно перепроверять результат.
  • Агентное программирование и длинные автономные задачи, которые нужно доводить до конца за много шагов.
  • Ревью кода и поиск багов — модель хорошо замечает логические ошибки и уязвимые места.
  • Масштабирование качества с ростом усилий (test-time compute) и эффективность на низких уровнях.
  • Длинный контекст до 1 000 000 токенов — большие репозитории и документы целиком.
  • Офисные задачи: многолистовые таблицы со сложными формулами, подготовка презентаций.
  • Мультиагентная координация — управление командами субагентов по схеме «исполнитель-проверяющий».
  • «Зрение»: понимание графиков, документов и диаграмм, копирование UI и вёрстки по изображению.

Почему Opus 5 хорош для кода и агентных задач?

Сочетание высоких результатов на SWE-bench Verified (96,0% в среднем по 5 прогонам, по данным Anthropic), длинного контекста и склонности к самопроверке делает модель удобной для реальной разработки: она держит в голове большую кодовую базу, планирует изменения, пишет код, а затем сама ищет в нём ошибки. Для длинных сценариев Opus 5 охотнее делегирует части работы субагентам и координирует их, что важно в агентных пайплайнах. Подробный разбор рабочих сценариев — в материале Claude Opus 5 для кода, а полный список возможностей — в статье что умеет Claude Opus 5.

Чем модель полезна для офисных и бизнес-задач?

Opus 5 уверенно работает с документами и таблицами: разбирается в многолистовых книгах со сложными формулами, помогает готовить презентации, вычитывает и структурирует длинные тексты. Благодаря «зрению» модель понимает графики, диаграммы и сканы, извлекает из них смысл и переводит его в текстовый результат — сводку, план, черновик. Как встроить это в рабочие процессы, разбираем в гайде Claude Opus 5 для бизнеса.

Какие ограничения есть у Claude Opus 5?

Как и у любой модели, у Opus 5 есть рамки, которые важно понимать заранее, чтобы выбрать правильный инструмент под задачу.

  • Выход только текстовый — модель не создаёт изображения, аудио или видео.
  • Мультимодальность только на входе — принимаются текст, изображения и файлы, но результат всегда в виде текста.
  • Ответы стали длиннее — иногда стоит явно попросить краткость, если нужен сжатый вывод.
  • Для генерации медиа нужны отдельные инструменты — на СуперИнтеллекте для картинок и видео есть раздел МедиаЛаб.

Какое место Opus 5 занимает среди других моделей?

По сводному рейтингу независимого агрегатора Claude Opus 5 возглавляет список из 215 моделей, опережая Claude Fable 5, GPT-5.6 Sol и предыдущий флагман Opus 4.8 (баллы — в таблице выше). Сравнения по конкретным сценариям вынесены в отдельные материалы: Opus 5 против GPT-5.6, Opus 5 против Gemini и Opus 5 против Fable 5. Отдельно о паре Opus 5 и Fable 5: по данным обзоров, Fable 5 набирает около 95% на SWE-bench Verified — очень высокий результат, тогда как Opus 5, по данным Anthropic, показывает 96,0% (среднее по 5 прогонам). В сочетании с эффективностью на низких уровнях усилий это даёт выгодный баланс качества и вычислительных затрат — преимущество, которое мы описываем качественно, без привязки к конкретным цифрам стоимости. Если нужна не топовая, а более лёгкая модель Anthropic, посмотрите обзор Claude Sonnet 5.

Как попробовать Claude Opus 5 на СуперИнтеллекте?

Claude Opus 5 уже доступна в чате СуперИнтеллекта — в обычной версии и в ускоренной «Claude Opus 5 (Fast)». Модель работает в России без VPN и без зарубежной карты, в одном окне с другими моделями (Claude Opus 4.8, Fable 5, Sonnet 5, GPT, Gemini, GigaChat и другими). Оплата идёт «нейронами», есть бесплатный старт — создайте аккаунт и начните бесплатно.

  1. Зарегистрируйтесь на СуперИнтеллекте и войдите в чат.
  2. В выборе модели укажите Claude Opus 5 (или «Claude Opus 5 (Fast)» для ускоренных ответов).
  3. При необходимости отрегулируйте уровень усилий под задачу — от low до max.
  4. Прикрепите текст, изображения или файлы и опишите задачу.
  5. Переключайтесь между моделями в один клик прямо в том же чате, не переписывая промпт.

Частые вопросы о Claude Opus 5 (FAQ)

Генерирует ли Claude Opus 5 изображения, аудио или видео?

Нет. Claude Opus 5 принимает на вход текст, изображения и файлы, но на выходе выдаёт только текст. Модель умеет «читать» и понимать картинки, графики, диаграммы и документы, а также копировать вёрстку интерфейсов, но не создаёт изображения, аудио или видео. Для генерации медиа на СуперИнтеллекте используйте отдельный раздел МедиаЛаб.

Какой контекст и объём вывода у Claude Opus 5?

Контекст — 1 000 000 токенов, и это одновременно значение по умолчанию и максимум. Объём вывода — до 128 000 токенов. Такой размер контекста позволяет держать в одном запросе большие кодовые базы, длинные документы и многошаговые задачи, не теряя деталей по ходу работы. Как эффективнее использовать длинный контекст, разбираем в гайде как пользоваться Claude Opus 5.

Чем Opus 5 отличается от Fable 5 и GPT-5.6?

По сводному рейтингу независимого агрегатора Opus 5 занимает первое место (85,88), Fable 5 — третье (82,76), а GPT-5.6 Sol — четвёртое (81,46). На SWE-bench Verified Fable 5, по данным обзоров, набирает около 95%, тогда как Opus 5 — 96,0% (среднее по 5 прогонам, по данным Anthropic). Детальные сравнения по сценариям — в материалах Opus 5 против Fable 5 и Opus 5 против GPT-5.6.

Нужен ли VPN и зарубежная карта, чтобы пользоваться Claude Opus 5?

Нет. На СуперИнтеллекте Claude Opus 5 работает в России без VPN и без зарубежной карты. Модель доступна в одном окне с другими нейросетями, оплата — «нейронами», а начать можно с бесплатного старта. Если хотите сначала понять концепцию модели, загляните в статью что такое Claude Opus 5, а попробовать сразу — здесь.