Os LLMs de código aberto estão escalando forte. O GLM-5.3 atingiu 320B de parâmetros, o Kimi K3 foi para 2,8T, e o Llama 4 roda com 109B ativos (provavelmente uma arquitetura MoE).

Os desenvolvedores não estão mais apenas fazendo inferência—eles estão ajustando modelos em datasets proprietários, criando variações específicas de domínio e implantando sistemas de produção com pesos abertos. A mudança é real: modelos abertos agora são viáveis para cargas de trabalho sérias, não apenas para experimentos.