12 августа 2026 года компания NVIDIA объявила о выпуске новой открытой модели Nemotron 3.5 Lightning. Это событие знаменует собой важный шаг в демократизации искусственного интеллекта, направленный на снижение стоимости и упрощение развертывания ИИ-агентов. Новая модель, разработанная для быстрого выполнения задач, обещает коренным образом изменить подход к автоматизации рутинных операций в корпоративном секторе и среди независимых разработчиков.
Архитектура Mixture-of-Experts: Больше мощности при меньших затратах
Ключевой особенностью Nemotron 3.5 Lightning является её уникальная архитектура. Несмотря на то, что модель насчитывает 30 миллиардов параметров, благодаря технологии Mixture-of-Experts (MoE), она активирует всего 3 миллиарда параметров для обработки каждого токена. Это инженерное решение позволяет достичь производительности, сопоставимой с мощными системами, при затратах вычислительных ресурсов, характерных для значительно более компактных моделей.
Такая оптимизация делает модель идеальным кандидатом для выполнения повторяющихся операций: проверки результатов, исполнения команд и форматирования данных. В то время как более крупные нейросети, такие как Nemotron 3 Ultra, продолжают отвечать за стратегическое планирование и решение сложных задач, Lightning берет на себя «грязную работу», освобождая мощные вычислительные узлы для более интеллектуальных функций.
Инструментарий для автоматизации и локальное развертывание
Для эффективного управления потоком задач NVIDIA выпустила библиотеку NeMo Switchyard. Этот инструмент анализирует сложность входящего запроса и автоматически перенаправляет простые инструкции на обработку моделью Lightning, экономя ресурсы и время. Разработчики подчеркивают, что это существенно снижает затраты на вычислительные мощности.
Особое внимание уделено доступности технологии. Модель оптимизирована для работы в популярных средах OpenClaw и Hermes Agent и поддерживает стек безопасности NVIDIA NemoClaw. Благодаря инструментам NeMo Automodel и NeMo Megatron Bridge, развертывание происходит быстрее и дешевле. Более того, модель можно запускать локально на платформах DGX Spark, Jetson, а также на персональных компьютерах с видеокартами GeForce RTX 5090, что делает её доступной для широкого круга пользователей.
Открытый код и экосистема для разработчиков
NVIDIA продолжает курс на открытость, предоставляя код, весовые коэффициенты и датасеты по лицензии OpenMDW-1.1. В комплекте с моделью поставляется открытый датасет Nemotron-RL Agentic Terminal Pivot, специально подготовленный для обучения ИИ-кодеров. Это решение призвано стимулировать развитие сообщества и ускорить создание новых приложений на базе ИИ-агентов.
В контексте текущей даты, 12 августа 2026 года, этот релиз выглядит как ответ на растущий спрос на эффективные и доступные инструменты автоматизации. Сделка NVIDIA не только укрепляет её позиции на рынке, но и задает новые стандарты для индустрии, где эффективность и доступность становятся ключевыми факторами успеха.