NVIDIA запустила более компактную открытую модель, предназначенную для выполнения повторяющихся высоконагруженных задач, которые поддерживают работу автономных агентов. Цель — снизить стоимость и задержку при длительных задачах агентской обработки.
Модель называется Nemotron 3.5 Lightning: у неё 30 миллиардов параметров в целом, но для каждого токена активируются только 3 миллиарда. NVIDIA утверждает, что такой подход «смешанных экспертов» позволяет получить производительность более крупной модели, используя вычисления ближе к возможностям намного меньшей.
Nemotron 3.5 Lightning также рассчитана на локальный запуск, включая NVIDIA DGX Spark, системы Jetson и графические карты GeForce RTX 5090. Её можно развертывать и в дата-центрах, предоставляя разработчикам варианты для выполнения высоконагруженных рабочих нагрузок ближе к тому месту, где данные генерируются.
Модель обучали с учетом популярных каркасных решений для агентов, включая OpenClaw и Hermes Agent. NVIDIA утверждает, что это обучение помогает агентам делать более точные вызовы инструментов, одновременно снижая задержку во время повторяющихся задач.#NVIDIA $NVDAB
