📰 A Anthropic reduziu de uma só vez o custo de inferência do Haiku 5.5 para um décimo do da geração anterior: US$ 0,1 por milhão de tokens de entrada e US$ 0,5 por milhão de tokens de saída em solicitações curtas. A “faixa de preços baixos”, antes dominada pelos grandes modelos chineses, foi rompida da noite para o dia por modelos americanos.

🔥 É também por isso que as ações de Zhipu e da MiniMax em Hong Kong... No gráfico de dispersão entre custo e desempenho de junho, a ponta mais barata era ocupada quase inteiramente pelo MiMo, da Xiaomi, pela DeepSeek, pela MiniMax e pela Zhipu; em 8 de outubro, Anthropic e OpenAI haviam assumido as posições de vanguarda.

Sinceramente, nos últimos dois anos, os modelos chineses atraíram desenvolvedores do mundo todo com código aberto e preços baixos. A DeepSeek V2 chegou a reduzir o preço de entrada para 1 yuan por milhão de tokens, e o preço de saída da DeepSeek-R1 era de apenas US$ 2,19 por milhão de tokens, enquanto o o1 da OpenAI custava US$ 60. Preços baixos realmente podem mudar as escolhas do mercado.

💡 Mas há uma questão bem concreta: usar muito não significa ganhar muito. Um relatório da Mozilla mostra que os modelos abertos chegaram a representar quase um quinto do uso na OpenRouter, mas ficaram com apenas cerca de 4% da receita gerada pelos modelos. No primeiro semestre, a plataforma aberta e as APIs representaram 86,5% da receita da Zhipu; a margem bruta desse negócio subiu para 24,6%, mas a empresa ainda registrou um prejuízo líquido de cerca de 2,072 bilhões de yuans.

👀 Essa guerra de preços agora parece estar passando de “modelos chineses pressionando os estrangeiros” para “todos os modelos continuando a baixar os preços uns dos outros”. Os desenvolvedores, claro, ficam felizes, mas a vida das empresas de modelos talvez não seja tão fácil. O que você acha: na próxima rodada, a disputa será primeiro por preço ou por quem consegue realmente ganhar dinheiro?

#人工智能 #大模型 #DeepSeek #Zhipu