Перейти к содержанию

NVIDIA выпустила открытую модель Nemotron 3.5 Lightning 30B-A3B-BF16

7.0/10

NVIDIA опубликовала на Hugging Face новую модель с открытыми весами — NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16. Релиз привлёк внимание сообщества локальных LLM, поскольку модель ориентирована на запуск вне облака и уже имеет GGUF-вариант от ggml-org. В доступных данных отсутствуют бенчмарки, детали архитектуры и лицензионные условия, поэтому оценить практическую значимость выпуска пока сложно. Тем не менее появление ещё одной открытой модели от крупной лаборатории усиливает конкуренцию в сегменте локального инференса.

Контекст

Nemotron — семейство открытых языковых моделей NVIDIA, распространяемых через Hugging Face для исследовательского и локального использования. Новая версия Nemotron 3.5 Lightning использует архитектуру Mixture-of-Experts с 30 млрд общих и 3 млрд активных параметров, а также Multi-Token Prediction, что позиционируется как способ ускорить инференс в агентных сценариях.

Влияние

Для разработчиков агентных систем и локального инференса выпуск Nemotron 3.5 Lightning 30B-A3B означает доступную открытую MoE-модель с 3B активных параметров, оптимизированную для высоконагруженных низколатентных агентных рабочих процессов. По данным Artificial Analysis, она демонстрирует производительность, сопоставимую с gpt-oss-120b, при примерно четверти общего числа параметров, что может снизить требования к вычислительным ресурсам для аналогичных задач. Наличие GGUF-версии дополнительно упрощает локальное развертывание на пользовательском оборудовании.

Обсуждение сообщества

Комментаторы отмечают необычно плотную волну релизов: после Meta вышли модели NVIDIA, а далее ожидается Qwen. Часть пользователей выражает энтузиазм по поводу доступности новых открытых моделей, тогда как другие сохраняют осторожность из-за отсутствия подробностей и производительности; также сразу появилась ссылка на GGUF-версию для локального запуска.

Проверка фактов

Утверждение о публикации NVIDIA модели Nemotron 3.5 Lightning 30B-A3B в формате BF16 на Hugging Face подтверждается официальными карточками модели на Hugging Face и в каталоге NVIDIA NGC. Также подтверждается, что BF16-вариант является полноточным релизом опорных весов, предназначенным для посттренинга, доменной адаптации и создания собственных квантованных или GGUF-версий. Комментарий о доступности GGUF-варианта от ggml-org соответствует ссылке в обсуждении, однако независимая проверка самого GGUF-репозитория в предоставленных результатах не выполнена.

Источники