A NVIDIA afirma que, com cargas de trabalho do AgentX baseadas na SemiAnalysis e usando o modelo DeepSeek V4 Pro, o throughput por megawatt do Vera Rubin pode chegar a até 30 vezes o da geração anterior GB300 NVL72. O custo por token pode ser reduzido em até 35 vezes. A SpaceXAI vai adotar aceleração de CPU com o Vera para aplicações da próxima geração de IA de agentes, e pretende ampliar a construção de uma plataforma baseada no Vera Rubin. A SpaceXAI planeja estender a versão otimizada do Vera Rubin NVL72 ao espaço para a primeira geração de satélites de IA da Starmind.
A NVIDIA está acelerando a concorrência na infraestrutura de IA, avançando de desempenho de treinamento e inferência de modelos tradicionais para uma nova etapa focada na velocidade de geração de tokens, consumo de energia e custos em torno da IA de agentes (Agentic AI).