NVIDIA menyatakan bahwa berdasarkan beban kerja AgentX dari SemiAnalysis, dengan menggunakan model DeepSeek V4 Pro, throughput per megawatt tertinggi Vera Rubin dapat mencapai hingga 30 kali dari generasi sebelumnya GB300 NVL72, sementara biaya per token dapat diturunkan hingga 35 kali. SpaceXAI akan memakai akselerasi CPU Vera untuk aplikasi AI agen generasi berikutnya, serta memperluas pembangunan platform berbasis Vera Rubin. SpaceXAI berencana mengembangkan versi yang dioptimalkan dari Vera Rubin NVL72 untuk luar angkasa, guna digunakan pada satelit AI Starmind generasi pertama.
NVIDIA sedang mempercepat persaingan infrastruktur AI, beralih dari pelatihan model tradisional dan performa inferensi ke tahap baru yang berfokus pada kecepatan generasi token, konsumsi daya, dan biaya untuk AI agen (Agentic AI).