NVIDIA kündigt die vollständige Produktion des Groq 3 LPX an; die Inferenz-Effizienz mit Vera Rubin steigt um ein Vielfaches; SpaceXAI investiert weiter in Agenten- und Space-AI
NVIDIA zufolge erreicht die auf AgentX-Workloads basierende Arbeit von SemiAnalysis, die das DeepSeek-V4-Pro-Modell nutzt, beim Durchsatz pro Megawatt mit bis zu dem 30-Fachen der vorherigen Generation GB300 NVL72. Die Kosten pro Token sinken dabei um bis zu das 35-Fache. SpaceXAI wird die Vera-CPU-Beschleunigung für Anwendungen der nächsten Generation im Bereich Agenten-KI einsetzen und den Ausbau der Plattform auf Basis von Vera Rubin vorantreiben. SpaceXAI plant, eine optimierte Version von Vera Rubin NVL72 in den Weltraum zu erweitern, um die erste Starmind-AI-Satellitenmission zu unterstützen.
NVIDIA beschleunigt den Wettbewerb um die KI-Infrastruktur: vom traditionellen Modelltraining und der Inferenzleistung hin zu einer neuen Phase, in der die Token-Generierungsgeschwindigkeit, der Energieverbrauch und die Kosten rund um Agentic AI (Agenten-KI) in den Fokus rücken.