Компания NVIDIA представила открытую языковую модель Nemotron 3.5 Lightning. Новинка оптимизирована для работы ИИ-агентов и позиционируется как быстрое и экономичное решение для рутинных задач, программирования и вызова инструментов. Модель рассчитана на использование как в дата-центрах, так и на локальных GPU, включая GeForce RTX 5090.
Архитектура и возможности
Nemotron 3.5 Lightning построена по схеме Mixture of Experts (MoE) и содержит 30 миллиардов параметров. При обработке каждого токена активируется лишь около 3 миллиардов параметров. Такой подход позволяет существенно снизить вычислительные затраты по сравнению с полноразмерными моделями.
Модель ориентирована на агентные сценарии: вызов инструментов, написание кода, выполнение большого количества простых операций. NVIDIA рекомендует использовать Lightning не как самостоятельную замену самым мощным моделям, а как часть многоуровневой системы. В такой схеме сложные модели отвечают за планирование и принятие решений, а Lightning — за быстрое выполнение массовых рутинных задач.
Для автоматического распределения запросов компания представила маршрутизатор NVIDIA NeMo Switchyard. Он анализирует задачу и направляет её наиболее подходящей модели.
Скорость и эффективность
Особое внимание разработчики уделили скорости работы. По данным внутренних тестов NVIDIA, в бенчмарке PinchBench модель достигла точности 86 % и выполнила 10 тысяч агентских задач примерно на 30 % быстрее, чем Qwen3.6 35B при сопоставимом качестве. Компания заявляет, что в ряде сценариев Lightning работает до четырёх раз быстрее аналогов своего класса.
Ускорение достигается за счёт спекулятивного декодирования (с использованием вспомогательных моделей DFlash и DSpark) и низкоточных форматов данных, в частности NVFP4. Формат BF16 обеспечивает баланс между скоростью и точностью.
Доступность и экосистема
Модель может работать на одном GPU и поддерживает локальный запуск, в том числе на DGX Spark, Jetson и GeForce RTX 5090. NVIDIA публикует веса, данные для обучения и инструкции по дообучению. В комплект входит открытый набор данных для тренировки агентных сценариев.
Релиз продолжает стратегию компании по развитию открытых ИИ-моделей. NVIDIA стремится конкурировать как с закрытыми системами (OpenAI, Anthropic), так и с открытыми китайскими моделями вроде Qwen и DeepSeek. Следующим крупным релизом ожидается Nemotron 4 с более чем триллионом параметров.
Nemotron 3.5 Lightning доступна на Hugging Face и ModelScope, а также через сервисы NVIDIA и OpenRouter.
Nemotron 3.5 Lightning — это практичный инструмент для построения эффективных ИИ-агентов. Модель сочетает относительно компактный размер, высокую скорость и открытость, что делает её удобной для локального использования и кастомизации.
NVIDIA продолжает выстраивать экосистему, в которой собственные модели, средства маршрутизации и программное обеспечение стимулируют применение её аппаратных платформ. Если заявленные показатели скорости подтвердятся независимыми тестами, Lightning может стать популярным выбором для компаний, которым нужна быстрая и экономичная обработка массовых агентных задач.
0 Комментарий(я)
Зарегистрируйтесь чтобы оставить комментарий