Chegou no Arena: poucos dias após o lançamento do Claude Opus 5.5 da Anthropic, ele já subiu para o 1º lugar no ranking geral do Text Arena — cerca de 1509 pontos (±12), com base em uma pontuação de preferência acumulada por testes cegos e votação 1 a 1 com humanos. Nas primeiras dez posições, a Anthropic ocupou a maior parte.
Esta versão saiu em 22 de setembro. O custo fica em torno de US$ 4 por milhão de tokens de entrada e cerca de US$ 20 por milhão de tokens de saída, o que é aproximadamente 20% mais barato que a geração anterior do Opus 5; a janela de contexto chegou a 1 milhão de tokens. No benchmark, o Terminal-Bench ficou em cerca de 66,4%, e o CursorBench em cerca de 57,8%.
O Arena também separou o estilo de escrita: o uso de travessões caiu de aproximadamente 15,2/1k palavras para 0,8 (menos cerca de 95%), e os pontos e vírgulas também foram bem reduzidos; as frases ficaram mais curtas — mas, ainda assim, a resposta por vez ficou um pouco mais prolixa (de cerca de 453 para 481 palavras). A troca no topo acontece bem rápido, então fica registrado.
#AI #Anthropic #Claude
Esta versão saiu em 22 de setembro. O custo fica em torno de US$ 4 por milhão de tokens de entrada e cerca de US$ 20 por milhão de tokens de saída, o que é aproximadamente 20% mais barato que a geração anterior do Opus 5; a janela de contexto chegou a 1 milhão de tokens. No benchmark, o Terminal-Bench ficou em cerca de 66,4%, e o CursorBench em cerca de 57,8%.
O Arena também separou o estilo de escrita: o uso de travessões caiu de aproximadamente 15,2/1k palavras para 0,8 (menos cerca de 95%), e os pontos e vírgulas também foram bem reduzidos; as frases ficaram mais curtas — mas, ainda assim, a resposta por vez ficou um pouco mais prolixa (de cerca de 453 para 481 palavras). A troca no topo acontece bem rápido, então fica registrado.
#AI #Anthropic #Claude
