NVIDIA hat ein kleineres Open-Model auf den Markt gebracht, das für die Bewältigung repetitiver, hochvolumiger Aufgaben ausgelegt ist, die dafür sorgen, dass autonome Agenten dauerhaft laufen. Ziel ist es, die Kosten und die Latenz bei lang laufenden Agent-Workloads zu senken.

Das Modell heißt Nemotron 3.5 Lightning. Es hat 30 Milliarden Gesamtparameter, aktiviert aber nur 3 Milliarden pro Token. NVIDIA sagt, dass dieses Mischung-von-Experten-Design es ermöglicht, die Leistungsfähigkeit eines größeren Modells bereitzustellen, dabei aber Rechenleistung näher an die eines deutlich kleineren Modells zu nutzen.

Nemotron 3.5 Lightning ist außerdem darauf ausgelegt, lokal zu laufen, einschließlich auf NVIDIAs DGX Spark, Jetson-Systemen und GeForce RTX 5090-Grafikkarten. Es kann auch in Rechenzentren eingesetzt werden, sodass Entwickler Optionen haben, hochvolumige Workloads näher an den Orten auszuführen, an denen sie entstehen.

Das Modell wurde mit Blick auf gängige Agent-Frameworks trainiert, darunter OpenClaw und Hermes Agent. NVIDIA sagt, dass dieses Training dazu beiträgt, dass Agenten genauere Tool-Aufrufe machen und die Latenz bei repetitiven Aufgaben reduzieren.#NVIDIA $NVDAB

NVDAB
NVDAB
224.13
-0.15%