Новости
JetBrains открыла Mellum 2.1: компактная модель для агента, который правит код
8 октября 2026 JetBrains выложила Mellum 2.1 на Hugging Face под лицензией Apache 2.0. Архитектура прежняя, 12 млрд параметров и 2,5 млрд активных. Изменилось дообучение: модель училась в настоящих средах.
Редакция SUIN.AI · · ~5 мин

8 октября 2026 года JetBrains выпустила Mellum 2.1. Это следующая версия модели, которую компания открыла в июне. Архитектура та же: mixture-of-experts, 12 миллиардов параметров, из них около 2,5 миллиарда активны на каждом шаге. Лицензия — Apache 2.0.
Что изменилось, если сеть та же
- Обучение с подкреплением стало основной частью, а не короткой полировкой в конце.
- Добавили задачи по математике, олимпиадному программированию, науке, инструментам и инженерии. Открытые наборы фильтровали: у части были сломанные тесты или задачи, которые нельзя проверить.
- Среди запускали тысячи сред и миллионы песочниц, чтобы модель училась на настоящем окружении, а не только на тексте патча.
С кем сравнивали
JetBrains прогнала одну и ту же оценку для Mellum 2.1, прошлой Mellum 2, Qwen3.5-9B и Gemma 4 E4B. Самый большой рост относительно своей прошлой версии — в агентном программировании. Плюс есть прирост в обычном коде, олимпиадных задачах, математике, вызове инструментов и общих вопросах.
По скорости архитектура не менялась, поэтому базовая Mellum 2.1 не медленнее Mellum 2. Под нагрузкой JetBrains называет её самой быстрой в этой четвёрке: она отдаёт почти вдвое больше токенов, чем Qwen3.5-9B. Предсказание нескольких токенов сразу ускоряет один запрос примерно в 1,6 раза. Эта голова пока в списке «скоро».
Кому она нужна
JetBrains видит модель как работника внутри агентной системы: найти причину упавшего теста, набросать правку, проверить её. Второй сценарий — свой сервер, когда код нельзя отправлять наружу. В чате SUIN.AI код по-прежнему можно отдать облачной модели, в том числе Claude. Mellum 2.1 — про другой путь: скачать веса и крутить агента у себя.
Рядом: Microsoft Decision-1 и агент Gemini для работы.