A Anthropic lançou o Claude Sonnet 5.5 em 28 de setembro pelo mesmo preço de tabela do Sonnet 5. A empresa afirma que o modelo roda mais de 30% mais rápido e custa até 30% menos por tarefa.
Uma empresa independente de benchmarking chegou a uma conclusão diferente sobre os custos depois de levar o modelo ao seu limite.
Siga-nos no X para receber as últimas notícias em tempo real
Apresentamos o Claude Sonnet 5.5, o segundo modelo da família Claude 5.5. É uma melhoria clara em relação ao Sonnet 5, roda mais de 30% mais rápido e custa até 30% menos para a maior parte dos trabalhos. pic.twitter.com/UvXD8mDTF1
— Claude (@claudeai) 28 de setembro de 2026
O Segundo Modelo 5.5 da Anthropic Anuncia Dias Depois do Opus
O Sonnet 5.5 é o segundo modelo da família Claude 5.5. A Anthropic lançou o Opus 5.5 em 22 de setembro. No mesmo dia, a OpenAI também lançou o GPT-6 Sol e Luna.
O novo modelo mantém os preços do Sonnet 5: US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída. A Anthropic informou uma pontuação de 70,6% no Terminal-Bench 4.0, um teste de codificação agentica. O Sonnet 5 conseguiu apenas 10,3%, enquanto o Opus 5.5 chegou a 66,4%.
“Onde o Opus 5.5 é construído para trabalhos complexos que exigem julgamento cuidadoso, o Sonnet 5.5 é o mais forte em tarefas cotidianas bem delimitadas, corrigindo bugs e criando documentos, slides e planilhas com acabamento,” disse a equipe.
A Anthropic disse que o Sonnet 5.5 não estende seu limite de capacidade. Por isso, a revisão de alinhamento se concentrou em riscos como enganar usuários e auxiliar mau uso de alto impacto.
O Sonnet 5.5 também vem com proteções cibernéticas e classificadores anti-destilação. Isso bloqueia tentativas de extrair o raciocínio do modelo para treinar sistemas concorrentes. O Claude Haiku 5.5 segue nas próximas semanas.
Enquanto isso, a OpenAI adiou um modelo que seria lançado, o GPT-6.1 Astra, por motivos de segurança. A CNBC confirmou na segunda-feira que o modelo ficou aquém dos padrões da empresa.
Artificial Analysis Descobre uma Conta de Tokens Maior no Máximo Esforço
Artificial Analysis, a empresa de benchmarking que classificou o Grok 4.7 em quarto lugar, deu ao Sonnet 5.5 nota 56 em seu Intelligence Index. Isso o coloca em segundo lugar no geral, 2 pontos atrás do Opus 5.5 no máximo esforço.
A empresa registrou 64% para o Sonnet 5.5 no Terminal-Bench 4.0, contra 60% para o Opus 5.5 e o GPT-6 Astra. Em testes de trabalho com conhecimento, como o GDPval-AA, ela encontrou o Sonnet 5.5 em nível bem parecido com o Opus 5.5.
A empresa disse que o Sonnet 5.5 usou significativamente mais tokens para obter esses resultados.
“No máximo esforço, onde atinge um desempenho próximo ao do Opus 5.5, o Claude Sonnet 5.5 usou ~193k de Tokens de Saída por Tarefa do Intelligence Index”, dizia a postagem.
Esse volume fica cerca de 60% acima do Opus 5.5 e do Sonnet 5 no máximo esforço. É também aproximadamente 7 vezes o número de máximo esforço do GPT-6 Astra.
Clientes com acesso antecipado citados pela Anthropic relataram o oposto em relação ao Sonnet 5, embora em cargas de trabalho diferentes. A Balyasny Asset Management observou um uso de tokens muito menor em suas tarefas financeiras.
“Em nossa suíte privada de 2.441 tarefas financeiras cobrindo Q&A, extração, análise e previsão, o Claude Sonnet 5.5 marcou à frente do Sonnet 5 e usou cerca de 121 mil tokens por resposta, enquanto o Sonnet 5 usou 497 mil,” afirmou Joe Poirier, Engenheiro Sênior de IA da Balyasny Asset Management.
A Artificial Analysis testou uma versão em pré-lançamento com um bug de saída estruturada que a Anthropic corrigiu desde então. A empresa planeja republicar as avaliações relevantes em breve.
Inscreva-se no nosso canal do YouTube para assistir a líderes e jornalistas trazendo insights especializados
