A Anthropic lançou o Claude Sonnet 5.5 em 28 de setembro, o segundo da série Claude 5.5, enquanto a empresa se prepara para uma IPO. Isso marca uma mudança importante nos critérios usados para avaliar tecnologias de IA: embora o desempenho bruto em benchmarks continue sendo uma consideração-chave, as empresas agora também se preocupam com o quão caro pode ser entregar resultados com um modelo específico.
A Anthropic afirma que o Sonnet 5.5 opera mais rápido em mais de 30% em comparação ao Sonnet 5, e que sua aplicação pode custar até 30% menos para a maioria das tarefas, mesmo que os preços dos tokens permaneçam inalterados. De acordo com a página de lançamento da Anthropic, essa redução de custos é obtida por meio do uso menor de tokens para executar a mesma tarefa.
Mesmo preço no rótulo, menos tokens
O Sonnet 5.5 tem preço de US$ 2 por milhão de tokens de entrada, US$ 10 por tokens de saída usados e US$ 0,20 por tokens de cache-read usados. O Opus 5.5, que se especializa em operações complexas de raciocínio e julgamento, é precificado em US$ 4 e US$ 20 para tokens de entrada e saída, respectivamente. O Sonnet é voltado para tarefas simples como programação, geração de documentos e planilhas.
Isso eleva a eficiência ao centro da conversa. Para muitas tarefas, as empresas não precisam ir pelo modelo com melhor desempenho. Se um modelo de baixo custo consegue concluir a tarefa desejada de forma consistente, isso pode ser mais importante do que marcar alguns pontos a mais em um benchmark. Esse aspecto é especialmente importante para a Anthropic, já que a Reuters relata que cerca de 80% da receita da empresa vem de clientes corporativos.
Benchmarks deixam de ser a história toda
A Anthropic afirma que o Sonnet 5.5 tem 70,6% no Terminal-Bench 4.0, em comparação com 10,3% do Sonnet 5. Mas o ranking do Artificial Analysis mostra por que as pontuações dos benchmarks são apenas parte da história.
O Sonnet 5.5, no máximo esforço, atinge uma pontuação de 56 na escala de inteligência, custando aproximadamente US$ 7,60 para cada tarefa individual. O GPT-6 Sol pode obter 48 pontos a US$ 1,06 por tarefa, enquanto o MiMo-V2.6-Pro da Xiaomi alcança uma pontuação de 46 a um custo irrisório de apenas US$ 0,13. Essas diferenças de custo motivam as empresas a preferirem múltiplos caminhos: pode-se atribuir tarefas mais difíceis a sistemas de nível premium, enquanto todas as tarefas rotineiras podem ser feitas por sistemas mais baratos.
Claude Sonnet 5.5 vs GPT-6 Sol vs MiMo-V2.6-Pro: Custo por Tarefa vs Pontuação de Inteligência
O preço do pensamento continua caindo
Essa mudança se encaixa em uma tendência muito maior observada ao longo do tempo. De acordo com o relatório de 22 de setembro da Epoch AI, os custos para um nível específico de desempenho em IA diminuíram aproximadamente 47% a cada trimestre, a partir de 2023, o que equivale a uma redução anual de cerca de 13 vezes.
Um relatório da Cryptopolitan publicado em 29 de setembro afirma que compradores corporativos estão cada vez mais preferindo o modelo mais acessível que realiza as tarefas necessárias, enquanto preços baixos também permitem que as empresas justifiquem o uso de múltiplos modelos.
Tokens mais baratos, contas maiores
No entanto, custos menores não garantem despesas menores com IA. O relatório de 17 de agosto da Gartner, intitulado “Gartner Predicts AI Inference Costs Per Agentic Workflow Will Increase More Than Fivefold Through 2028”, fala do “paradoxo da inferência”. A queda no preço dos tokens estimula fluxos de trabalho mais complexos, o que resulta em aumento do uso total de tokens.
“Os líderes de produto não podem confiar em uma economia de tokens mais eficiente para justificar os custos da IA.”
— Will Sommer, Diretor Sênior de Análise da Gartner, no relatório de 17 de agosto de 2026 da Gartner,
Quem realmente consegue a IA mais barata
De acordo com o Global AI Diffusion Report publicado pela Microsoft, modelos de baixo custo e abertos têm potencial para aumentar a acessibilidade, especialmente no Global Sul. Embora seja verdade que custos menores de modelos vão melhorar a acessibilidade, infraestrutura, conectividade e habilidades são fatores determinantes para decidir se modelos de IA mais baratos serão usados.
Para compradores corporativos, o Sonnet 5.5 mostra para onde o mercado está caminhando: o melhor modelo não é necessariamente o mais poderoso, mas o que consegue fazer o trabalho bem a um custo razoável. O Haiku 5.5, previsto para as próximas semanas, pode levar essa mudança ainda mais longe ao tornar mais barato executar trabalhos de IA em grande volume e mais difícil para as empresas justificarem pagar preços mais altos por tarefas rotineiras.
As mentes mais inteligentes do cripto já leem nosso boletim. Quer entrar? Participe.
