Обучения
Claude Opus 5: полный обзор нового флагмана Anthropic
Claude Opus 5 — новый флагман Anthropic, вышедший 23 июля 2026. Контекст 1 млн токенов, «мышление» по умолчанию, #1 в независимом рейтинге. Разбираем, что нового относительно Opus 4.8, бенчмарки, сильные стороны, ограничения и как попробовать модель без VPN.
· ~13 мин

Claude Opus 5 — это новый флагман компании Anthropic, вышедший 23 июля 2026 года и уже доступный в чате СуперИнтеллекта. Это не инкремент, а полноценный шаг вперёд относительно предыдущего флагмана Opus 4.8: контекст расширен до 1 000 000 токенов, «мышление» (reasoning) включено по умолчанию, а глубину рассуждений можно регулировать пятью уровнями усилий — от low до max. Модель принимает на вход текст, изображения и файлы, а на выходе выдаёт только текст, и особенно сильна в глубоких рассуждениях, агентном программировании и длинных многошаговых задачах.
Что такое Claude Opus 5 и чем он отличается от Opus 4.8?
Claude Opus 5 — это старшая, самая «умная» модель линейки Claude, предназначенная для задач, где важнее всего качество мышления: сложный код, аналитика, планирование, многошаговые агентные сценарии. По позиционированию Anthropic это именно новое поколение флагмана, а не косметическое обновление Opus 4.8. Разница ощущается не только в цифрах бенчмарков, но и в поведении: модель отвечает более развёрнуто, чаще перепроверяет собственную работу и охотнее делит большую задачу между субагентами. Если сравнивать поколения на языке возможностей, ключевые сдвиги относительно Opus 4.8 такие:
- Контекст 1 000 000 токенов — это и значение по умолчанию, и максимум; в один запрос помещаются большие кодовые базы и длинные документы целиком.
- Мышление включено по умолчанию — модель рассуждает перед ответом, а не только когда её об этом попросили.
- Пять уровней усилий (low → medium → high → xhigh → max) — вы управляете тем, сколько «думать» модели, балансируя глубину и скорость.
- Более выраженная агентность — длинные автономные задачи, координация команд субагентов по схеме «исполнитель-проверяющий».
- Рост качества с ростом усилий (test-time compute) при хорошей эффективности на низких уровнях.
- Позиция №1 в независимом сводном рейтинге бенчмарков против №6 у Opus 4.8 (см. таблицу ниже).
Как работает «мышление» и уровни усилий low → max?
В Claude Opus 5 режим рассуждений (reasoning) активен по умолчанию: перед тем как выдать ответ, модель проводит внутреннюю проработку задачи. За глубину этой проработки отвечает параметр усилий. Чем выше уровень — тем больше вычислений модель тратит на обдумывание, тем тщательнее разбирает граничные случаи и тем чаще сама себя проверяет. По умолчанию используется уровень high, а max задействует максимальную глубину для самых трудных задач.
- low — быстрые ответы с минимальными затратами вычислений; подходит для простых и типовых задач, где важнее скорость и экономичность.
- medium — сбалансированный режим для повседневных задач средней сложности.
- high — уровень по умолчанию: глубокая проработка для сложного кода, аналитики и многошаговых сценариев.
- xhigh — ещё более тщательный разбор, когда цена ошибки высока.
- max — максимальная глубина рассуждений и test-time compute для самых трудных задач: исследовательская математика, тонкая отладка, длинные агентные цепочки.
Какие результаты у Claude Opus 5 в бенчмарках?
Ниже — сводка результатов Claude Opus 5 по данным Anthropic и независимых обзоров. Обратите внимание: FrontierBench v0.1 — это внутренний тест Anthropic, поэтому его стоит воспринимать с соответствующей поправкой. Все числа приводятся с атрибуцией к источнику.
| Бенчмарк | Что проверяет | Результат Claude Opus 5 |
|---|---|---|
| SWE-bench Verified | Решение реальных задач из GitHub | 96,0% (среднее по 5 прогонам) |
| SWE-bench Pro | Усложнённые инженерные задачи | 79,2% |
| SWE-bench Multilingual | Код на разных языках | 89,5% |
| SWE-bench Multimodal | Код с визуальным контекстом | 59,4% |
| BrowseComp | Веб-навигация и поиск | 90,8% |
| Toolathlon Verified | Работа с инструментами | 80,6% |
| GPQA Diamond | Научные вопросы уровня PhD | 93,2% |
| Humanity's Last Exam (с инструментами) | Экспертные знания | 64,7% |
| ARC-AGI-2 | Абстрактное рассуждение | 90,4% |
| ARC-AGI-1 | Абстрактное рассуждение | 97,5% |
| MMMU-Pro | Мультимодальное понимание | 84,7% |
| OfficeQA Pro | Офисные задачи | 66,9% |
| IMO 2026 | Математическая олимпиада | 42/42 |
| ArXivMath (с инструментами) | Научная математика | 91,3% |
| FrontierBench v0.1 | Внутренний тест Anthropic | 43,3% |
Что показывает независимый сводный рейтинг моделей?
| Место | Модель | Балл |
|---|---|---|
| №1 | Claude Opus 5 | 85,88 |
| №3 | Claude Fable 5 | 82,76 |
| №4 | GPT-5.6 Sol | 81,46 |
| №6 | Claude Opus 4.8 | 77,44 |
В чём сильные стороны Claude Opus 5?
Профиль Opus 5 — это модель для сложной интеллектуальной работы. Она заметно выигрывает там, где нужны рассуждения, самопроверка и способность удерживать длинный контекст, а не короткие фактические ответы. Вот основные сильные стороны:
- Глубокие многошаговые рассуждения с привычкой самостоятельно перепроверять результат.
- Агентное программирование и длинные автономные задачи, которые нужно доводить до конца за много шагов.
- Ревью кода и поиск багов — модель хорошо замечает логические ошибки и уязвимые места.
- Масштабирование качества с ростом усилий (test-time compute) и эффективность на низких уровнях.
- Длинный контекст до 1 000 000 токенов — большие репозитории и документы целиком.
- Офисные задачи: многолистовые таблицы со сложными формулами, подготовка презентаций.
- Мультиагентная координация — управление командами субагентов по схеме «исполнитель-проверяющий».
- «Зрение»: понимание графиков, документов и диаграмм, копирование UI и вёрстки по изображению.
Почему Opus 5 хорош для кода и агентных задач?
Сочетание высоких результатов на SWE-bench Verified (96,0% в среднем по 5 прогонам, по данным Anthropic), длинного контекста и склонности к самопроверке делает модель удобной для реальной разработки: она держит в голове большую кодовую базу, планирует изменения, пишет код, а затем сама ищет в нём ошибки. Для длинных сценариев Opus 5 охотнее делегирует части работы субагентам и координирует их, что важно в агентных пайплайнах. Подробный разбор рабочих сценариев — в материале Claude Opus 5 для кода, а полный список возможностей — в статье что умеет Claude Opus 5.
Чем модель полезна для офисных и бизнес-задач?
Opus 5 уверенно работает с документами и таблицами: разбирается в многолистовых книгах со сложными формулами, помогает готовить презентации, вычитывает и структурирует длинные тексты. Благодаря «зрению» модель понимает графики, диаграммы и сканы, извлекает из них смысл и переводит его в текстовый результат — сводку, план, черновик. Как встроить это в рабочие процессы, разбираем в гайде Claude Opus 5 для бизнеса.
Какие ограничения есть у Claude Opus 5?
Как и у любой модели, у Opus 5 есть рамки, которые важно понимать заранее, чтобы выбрать правильный инструмент под задачу.
- Выход только текстовый — модель не создаёт изображения, аудио или видео.
- Мультимодальность только на входе — принимаются текст, изображения и файлы, но результат всегда в виде текста.
- Ответы стали длиннее — иногда стоит явно попросить краткость, если нужен сжатый вывод.
- Для генерации медиа нужны отдельные инструменты — на СуперИнтеллекте для картинок и видео есть раздел МедиаЛаб.
Какое место Opus 5 занимает среди других моделей?
По сводному рейтингу независимого агрегатора Claude Opus 5 возглавляет список из 215 моделей, опережая Claude Fable 5, GPT-5.6 Sol и предыдущий флагман Opus 4.8 (баллы — в таблице выше). Сравнения по конкретным сценариям вынесены в отдельные материалы: Opus 5 против GPT-5.6, Opus 5 против Gemini и Opus 5 против Fable 5. Отдельно о паре Opus 5 и Fable 5: по данным обзоров, Fable 5 набирает около 95% на SWE-bench Verified — очень высокий результат, тогда как Opus 5, по данным Anthropic, показывает 96,0% (среднее по 5 прогонам). В сочетании с эффективностью на низких уровнях усилий это даёт выгодный баланс качества и вычислительных затрат — преимущество, которое мы описываем качественно, без привязки к конкретным цифрам стоимости. Если нужна не топовая, а более лёгкая модель Anthropic, посмотрите обзор Claude Sonnet 5.
Как попробовать Claude Opus 5 на СуперИнтеллекте?
Claude Opus 5 уже доступна в чате СуперИнтеллекта — в обычной версии и в ускоренной «Claude Opus 5 (Fast)». Модель работает в России без VPN и без зарубежной карты, в одном окне с другими моделями (Claude Opus 4.8, Fable 5, Sonnet 5, GPT, Gemini, GigaChat и другими). Оплата идёт «нейронами», есть бесплатный старт — создайте аккаунт и начните бесплатно.
- Зарегистрируйтесь на СуперИнтеллекте и войдите в чат.
- В выборе модели укажите Claude Opus 5 (или «Claude Opus 5 (Fast)» для ускоренных ответов).
- При необходимости отрегулируйте уровень усилий под задачу — от low до max.
- Прикрепите текст, изображения или файлы и опишите задачу.
- Переключайтесь между моделями в один клик прямо в том же чате, не переписывая промпт.
Частые вопросы о Claude Opus 5 (FAQ)
Генерирует ли Claude Opus 5 изображения, аудио или видео?
Нет. Claude Opus 5 принимает на вход текст, изображения и файлы, но на выходе выдаёт только текст. Модель умеет «читать» и понимать картинки, графики, диаграммы и документы, а также копировать вёрстку интерфейсов, но не создаёт изображения, аудио или видео. Для генерации медиа на СуперИнтеллекте используйте отдельный раздел МедиаЛаб.
Какой контекст и объём вывода у Claude Opus 5?
Контекст — 1 000 000 токенов, и это одновременно значение по умолчанию и максимум. Объём вывода — до 128 000 токенов. Такой размер контекста позволяет держать в одном запросе большие кодовые базы, длинные документы и многошаговые задачи, не теряя деталей по ходу работы. Как эффективнее использовать длинный контекст, разбираем в гайде как пользоваться Claude Opus 5.
Чем Opus 5 отличается от Fable 5 и GPT-5.6?
По сводному рейтингу независимого агрегатора Opus 5 занимает первое место (85,88), Fable 5 — третье (82,76), а GPT-5.6 Sol — четвёртое (81,46). На SWE-bench Verified Fable 5, по данным обзоров, набирает около 95%, тогда как Opus 5 — 96,0% (среднее по 5 прогонам, по данным Anthropic). Детальные сравнения по сценариям — в материалах Opus 5 против Fable 5 и Opus 5 против GPT-5.6.
Нужен ли VPN и зарубежная карта, чтобы пользоваться Claude Opus 5?
Нет. На СуперИнтеллекте Claude Opus 5 работает в России без VPN и без зарубежной карты. Модель доступна в одном окне с другими нейросетями, оплата — «нейронами», а начать можно с бесплатного старта. Если хотите сначала понять концепцию модели, загляните в статью что такое Claude Opus 5, а попробовать сразу — здесь.