Перейти к содержимому

Новости

NVIDIA Nemotron 3 Ultra на СуперИнтеллекте: модель для длинных агентов

NVIDIA представила Nemotron 3 Ultra — гибрид Mamba-Transformer с Mixture-of-Experts на 550 млрд параметров и контекстом свыше 500 000 токенов. Создана для оркестрации длинных агентных цепочек: сотни шагов, вызовы инструментов, меньше токенов на задачу. Уже доступна на СуперИнтеллекте без VPN.

· ~7 мин

Nemotron 3 Ultra — это флагманская модель линейки NVIDIA Nemotron 3: гибридная архитектура Mamba-Transformer с механизмом Mixture-of-Experts (MoE) на 550 млрд параметров, из которых на каждый проход активируется примерно 10%. По скорости это соответствует модели уровня ~55B, а по качеству рассуждений — заметно выше. Контекстное окно — свыше 500 000 токенов. Модель уже доступна на платформе «СуперИнтеллект» — без VPN, в одном окне с другими ИИ-моделями и агентными инструментами.

Архитектура: гибрид Mamba-Transformer и Mixture-of-Experts

NVIDIA собрала Nemotron 3 Ultra из трёх идей, которые обычно живут в разных моделях. Mamba-блоки эффективно работают с очень длинными последовательностями — именно это делает контекст свыше 500 000 токенов практичным, а не просто цифрой в спецификации. Transformer-блоки отвечают за точность внимания к деталям в сложных рассуждениях. А Mixture-of-Experts позволяет наращивать общий объём параметров модели (550 млрд), не заставляя каждый токен проходить через все параметры сразу — работает только подмножество экспертов, около 10% от общего числа.

Для чего создана: оркестрация длинных агентных цепочек

Nemotron 3 Ultra спроектирована не как модель «для быстрого ответа в чате», а как ядро для агентных систем, работающих автономно на протяжении сотен шагов. Она берёт на себя роль оркестратора: разбивает задачу на подзадачи, вызывает инструменты, делегирует часть работы под-агентам, читает и интерпретирует результаты, а если какой-то шаг в цепочке дал сбой — восстанавливается и продолжает выполнение, а не начинает всё заново. При этом, по данным NVIDIA, на сопоставимых агентных сценариях модель тратит меньше токенов, чем сопоставимые открытые модели — за счёт более компактных промежуточных рассуждений и меньшего числа повторных попыток.

  • Планирование многошаговых задач до того, как выполнено хотя бы одно действие
  • Вызов внешних инструментов и интерпретация их ответов
  • Делегирование части работы под-агентам и сведение результатов воедино
  • Восстановление после ошибок посередине длинной цепочки без перезапуска с нуля
  • Работа с большим объёмом накопленной истории действий — за счёт окна свыше 500 000 токенов

Бенчмарки: как Ultra проявляет себя на агентных тестах

По данным независимого анализа Artificial Analysis, Nemotron 3 Ultra показывает следующие результаты:

БенчмаркРезультатЧто измеряет
Intelligence Index47,7Сводный индекс качества рассуждений — заметно выше открытых моделей сопоставимого класса активных параметров
Terminal-Bench 2.156,4Способность доводить до конца многошаговые задачи в терминальной/агентной среде
τ-bench (TauBench) V3, среднее70,9Качество работы агента в сценариях с диалогом и вызовом инструментов
Бенчмарки Nemotron 3 Ultra, по данным независимого анализа Artificial Analysis

Nemotron 3 Ultra vs Nemotron 3 Super: два тира одного семейства

На СуперИнтеллекте уже работает Nemotron 3 Super — более лёгкий тир того же семейства NVIDIA. Ultra — следующая ступень: больше параметров, больше активных экспертов на проход и более высокие результаты на агентных бенчмарках. Подробное сравнение архитектур, скорости и качества — в материале Nemotron 3 Ultra vs Super. Если смотреть шире, рядом в каталоге MoE-моделей также стоит GLM 5.2 и DeepSeek V4 — у каждой свой баланс контекста, скорости и внимания к деталям.

Модальность на платформе: только текст

На СуперИнтеллекте Nemotron 3 Ultra работает в текстовом режиме: приём и генерация текста, работа с документами и базами знаний, вызов инструментов и интеграций. Генерация изображений, аудио и видео у этой модели не предусмотрена — для таких задач на платформе есть отдельный раздел MediaLab с профильными моделями. Для длинных агентных сценариев с планированием и инструментами текстовой модальности достаточно — это и есть основная область применения Ultra.

Как начать работать с Nemotron 3 Ultra

  1. Зарегистрируйтесь на СуперИнтеллекте — доступен бесплатный стартовый баланс нейронов
  2. В списке моделей найдите Nemotron 3 Ultra в разделе NVIDIA
  3. Для агентных сценариев подключите нужные интеграции и настройте режим подтверждения вызовов инструментов — авто, полный или «спрашивать каждый раз»
  4. Опишите задачу целиком, а не пошагово — модель сама разобьёт её на этапы и начнёт выполнение

agent-prompt.md

Задача: собрать сводку по 15 источникам, найти релевантные тезисы,
сверить цифры между источниками и оформить итог в виде таблицы.

Требования:
- используй инструмент веб-поиска для каждого источника;
- если источник недоступен — пропусти и отметь это в итоге, не прерывай цепочку;
- в конце проверь согласованность цифр между разделами таблицы.

Такой запрос — типичный пример длинной агентной цепочки: десятки шагов, вызовы инструментов, восстановление после сбоев по пути. Именно для таких сценариев и создавалась Nemotron 3 Ultra. Зарегистрируйтесь на СуперИнтеллекте и попробуйте модель на своей задаче — с бесплатным стартовым балансом это можно сделать сразу.

FAQ: коротко о главном

Что такое Nemotron 3 Ultra?

Nemotron 3 Ultra — флагманская модель NVIDIA линейки Nemotron 3: гибридная архитектура Mamba-Transformer с Mixture-of-Experts, 550 млрд параметров (активируется около 10% за проход) и контекст свыше 500 000 токенов. Создана для оркестрации длинных агентных цепочек — планирования, вызова инструментов и делегирования под-агентам.

Чем Nemotron 3 Ultra отличается от Nemotron 3 Super?

Обе модели — часть одного семейства NVIDIA Nemotron 3, но Super — более лёгкий тир, а Ultra — более мощная версия с бóльшим числом параметров и активных экспертов на проход. Подробности — в сравнении Nemotron 3 Ultra vs Super.

Для каких задач лучше всего подходит Nemotron 3 Ultra?

Лучше всего модель раскрывается в автономных агентных сценариях на сотни шагов: многоэтапный ресёрч, работа с несколькими инструментами и интеграциями, задачи, где важно не потерять цепочку после ошибки на одном из шагов. Для обычного диалога, коротких ответов или творческих задач на платформе есть и другие модели.

Как попробовать Nemotron 3 Ultra на СуперИнтеллекте?

Модель уже доступна в каталоге платформы. Зарегистрируйтесь на СуперИнтеллекте, выберите Nemotron 3 Ultra в списке моделей и опишите задачу целиком — благодаря бесплатному стартовому балансу первую агентную цепочку можно запустить сразу после регистрации.