A AMD anunciou em agosto de 2026 que o sistema de racks Helios, voltado para data centers de IA, entrou em produção em massa, afirmando que, em relação ao mais recente rack de IA da Nvidia, a quantidade de tokens de inferência processados por dólar pode ser até cerca de 30% maior.

Em outras palavras, o Helios foca na relação custo-benefício de “quanto dá para calcular a mais com cada real/dólar”, e não apenas em maximizar o desempenho de pico. Para empresas que precisam arcar por muito tempo com os custos de inferência de modelos grandes, isso se parece mais com aliviar uma parte do “aluguel fixo do poder de computação”.

No mesmo período, a demanda de eletricidade dos data centers de IA continua a crescer. Operadores de gasodutos nos EUA estão avançando com mais projetos de expansão para dar suporte a cargas adicionais geradas pela geração de energia a gás. A oferta de capacidade de computação está ficando mais eficiente, enquanto a oferta de energia está sendo ampliada — atuando nos dois lados ao mesmo tempo.

O que vem a seguir é observar como o Helios se sai em implantações reais, se os clientes estão dispostos a transferir parte do orçamento da Nvidia e se a Nvidia vai responder com mudanças em produto ou em preços.