OpenAI,Anthropic entram numa fase de queda de preços de longo prazo, e o custo de inferência dos principais workloads diminui 40‑50%.
Os modelos ficam mais baratos, o que vai estimular as empresas a fazerem chamadas em larga escala, especialmente em cenários de alto consumo de tokens como o Agent.
Servidores de inferência, refrigeração líquida e interconexão de alta velocidade tendem a se beneficiar.
Outro ponto de vista: as empresas fabricantes de modelos grandes ficam diretamente envolvidas na guerra de preços, e a margem bruta também sofrerá pressão.
A queda de preços é claramente para aumentar o volume, não significa que o hardware vá ganhar escala imediatamente; no fim, tudo depende de a demanda real por tokens se concretizar. #openai
Os modelos ficam mais baratos, o que vai estimular as empresas a fazerem chamadas em larga escala, especialmente em cenários de alto consumo de tokens como o Agent.
Servidores de inferência, refrigeração líquida e interconexão de alta velocidade tendem a se beneficiar.
Outro ponto de vista: as empresas fabricantes de modelos grandes ficam diretamente envolvidas na guerra de preços, e a margem bruta também sofrerá pressão.
A queda de preços é claramente para aumentar o volume, não significa que o hardware vá ganhar escala imediatamente; no fim, tudo depende de a demanda real por tokens se concretizar. #openai