A Kimi K3 da China ficou em primeiro lugar no ranking do “Frontend Code Arena”, ultrapassando o Claude Fable 5. Embora as capacidades gerais específicas não sejam tão boas quanto o gpt 5.6sol e o fable5.
Espera-se que a concorrência aumente → todo o ecossistema de IA expanda (lógica central mais importante): capacidades dos modelos melhoram + os preços caem, o que fará mais empresas e desenvolvedores realmente implantarem e usarem (das grandes empresas até PMEs e desenvolvedores individuais).
A geração de código no front-end é um cenário de alta frequência e necessidade imediata; assim que custo-benefício for suficientemente bom, vai substituir/auxiliar o desenvolvimento humano em larga escala, levando a um aumento explosivo no consumo de tokens. Portanto, mesmo que um modelo individual fique mais barato, a demanda total de computação tende a aumentar (mais pessoas usando, usando com mais frequência e com fluxos de trabalho de agentes mais complexos).
Por mais forte e barato que seja o modelo, para rodar ainda é preciso GPU/HBM/servidores/módulos ópticos/energia/data centers. No setor de IA da Nasdaq (EUA), empresas puramente de modelos/software (avaliação elevada dependente de “muralhas de proteção” baseadas em modelos) podem sofrer pressão no médio e longo prazo.
Pequeno efeito negativo: se o mercado interpretar que a “muralha de proteção” dos modelos dos EUA foi enfraquecida, no curto prazo pode haver pressão sobre algumas ações de software/aplicações de IA com valuation elevado.
Deixe-me estimar o custo de implantação do k3. Antes, um modelo de 1T provavelmente precisava de um cluster com 4 Mac Studios para conseguir funcionar de forma minimamente fluida; agora, com 2,8T, para lidar com mais contexto e processamento de memória, deve precisar de cerca de 21–32, no mínimo.
Provavelmente precisa atingir escala de 64+ GPUs: custo total do hardware US$ 2 milhões–10 milhões+ (só as GPUs podem chegar a alguns milhões de dólares).
#KIMI3