NVIDIA выпустила Nemotron 3.5 Lightning

Компания NVIDIA представила открытую языковую модель Nemotron 3.5 Lightning. Новинка оптимизирована для работы ИИ-агентов и позиционируется как быстрое и экономичное решение для рутинных задач, программирования и вызова инструментов. Модель рассчитана на использование как в дата-центрах, так и на локальных GPU, включая GeForce RTX 5090.

 

Архитектура и возможности

Nemotron 3.5 Lightning построена по схеме Mixture of Experts (MoE) и содержит 30 миллиардов параметров. При обработке каждого токена активируется лишь около 3 миллиардов параметров. Такой подход позволяет существенно снизить вычислительные затраты по сравнению с полноразмерными моделями.

Модель ориентирована на агентные сценарии: вызов инструментов, написание кода, выполнение большого количества простых операций. NVIDIA рекомендует использовать Lightning не как самостоятельную замену самым мощным моделям, а как часть многоуровневой системы. В такой схеме сложные модели отвечают за планирование и принятие решений, а Lightning — за быстрое выполнение массовых рутинных задач.

Для автоматического распределения запросов компания представила маршрутизатор NVIDIA NeMo Switchyard. Он анализирует задачу и направляет её наиболее подходящей модели.

 

Скорость и эффективность

Особое внимание разработчики уделили скорости работы. По данным внутренних тестов NVIDIA, в бенчмарке PinchBench модель достигла точности 86 % и выполнила 10 тысяч агентских задач примерно на 30 % быстрее, чем Qwen3.6 35B при сопоставимом качестве. Компания заявляет, что в ряде сценариев Lightning работает до четырёх раз быстрее аналогов своего класса.

Ускорение достигается за счёт спекулятивного декодирования (с использованием вспомогательных моделей DFlash и DSpark) и низкоточных форматов данных, в частности NVFP4. Формат BF16 обеспечивает баланс между скоростью и точностью.

 

Доступность и экосистема

Модель может работать на одном GPU и поддерживает локальный запуск, в том числе на DGX Spark, Jetson и GeForce RTX 5090. NVIDIA публикует веса, данные для обучения и инструкции по дообучению. В комплект входит открытый набор данных для тренировки агентных сценариев.

Релиз продолжает стратегию компании по развитию открытых ИИ-моделей. NVIDIA стремится конкурировать как с закрытыми системами (OpenAI, Anthropic), так и с открытыми китайскими моделями вроде Qwen и DeepSeek. Следующим крупным релизом ожидается Nemotron 4 с более чем триллионом параметров.

Nemotron 3.5 Lightning доступна на Hugging Face и ModelScope, а также через сервисы NVIDIA и OpenRouter.

 

Nemotron 3.5 Lightning — это практичный инструмент для построения эффективных ИИ-агентов. Модель сочетает относительно компактный размер, высокую скорость и открытость, что делает её удобной для локального использования и кастомизации.

NVIDIA продолжает выстраивать экосистему, в которой собственные модели, средства маршрутизации и программное обеспечение стимулируют применение её аппаратных платформ. Если заявленные показатели скорости подтвердятся независимыми тестами, Lightning может стать популярным выбором для компаний, которым нужна быстрая и экономичная обработка массовых агентных задач.

Лого

Spartacus_85 [Admin]

Администратор сайта — это специалист, который отвечает за техническую поддержку и бесперебойную работу веб-ресурса.



0 Комментарий(я)

Зарегистрируйтесь чтобы оставить комментарий