$MSFTB $AMZNB $GOOGLB
Claude Opus 5.5 é lançado: preço cai 20% em relação ao antecessor, custos caem 40%
A Anthropic divulgou em 22 de dia o Claude Opus 5.5, que é o primeiro modelo da linha Claude 5.5. Segundo a empresa, o Opus 5.5 alcança o mesmo nível do Claude Fable 5.1 na maioria dos trabalhos, e o custo de operação é 40% menor do que o do Opus 5. O Sonnet 5.5 e o Haiku 5.5 serão lançados nas próximas semanas. A empresa informa que o custo por milhão de tokens de entrada e saída é de US$ 4 e US$ 20, respectivamente, e que a leitura do cache diminui 60%. A Anthropic explica que o Opus 5.5 precisa de menos recursos de computação do que o Opus 5, e que o preço reflete isso: entrada e saída custam US$ 4 e US$ 20 por milhão de tokens, ou seja, 20% mais barato do que o Opus 5. Já a leitura do cache, que representa grande parte dos custos de tarefas de proxy e de programação, cai para US$ 0,2 por milhão de tokens, 60% mais barato. No modo de configuração padrão, a despesa com uma carga de trabalho típica fica 40% menor do que no Opus 5, e a velocidade de saída é mais de 30% maior.
Além da redução de preço, a Anthropic também aumentou os limites de uso em 5 horas dos planos Pro, Max e Team, e oferece aos assinantes uma redefinição de limite de taxa que pode ser escolhida por eles mesmos no momento de uso. O Claude Code e a plataforma Claude contam ainda com um modo rápido: velocidade até 2,5 vezes, com preço de US$ 8 por milhão de tokens de entrada e US$ 40 por milhão de tokens de saída.
A migração de 680 mil linhas de código fica concluída em um dia. A empresa diz que a diferença de benchmark já não consegue refletir com precisão a discrepância real. A Anthropic aponta que o Opus 5.5 se destaca em testes internos de programação por agentes, operações de computador e trabalho de conhecimento. Um testador inicial fez uma migração de 680 mil linhas de código em um dia — algo que, no passado, levava semanas para uma equipe de engenharia. Outro testador revisou e consertou uma biblioteca de 200 mil linhas em menos de 3 horas; com o Opus 5, isso levou mais de 20 horas e consumiu 2,5 vezes mais tokens.
Em uma avaliação do GDPval-AA v2.1 com 44 profissões do trabalho real, o Opus 5.5, no ajuste de intensidade máxima, obteve 1846 Elo; o Fable 5.1 teve 1735, e o Opus 5 ficou em 1708. A Anthropic também lembra que, quando se chega a esse nível de capacidade, a diferença entre benchmarks já não consegue refletir de forma confiável as diferenças do mundo real; com base na experiência de uso da própria empresa, a disparidade entre o Opus 5.5 e o Fable 5.1 parece menor do que sugerem as pontuações.
A forma de comunicação também é um dos pontos centrais desta vez. A Anthropic afirma que a crítica mais frequente ao Opus 5 é que ele produz saídas longas e difíceis de ler; o Opus 5.5 coloca as informações mais importantes no início, usa menos termos técnicos ou frases especiais e também segue melhor as regras de escrita fornecidas pelo usuário.
Primeiro modelo após “apertar o freio na fronteira”: a maioria das tarefas de segurança da informação passa a ser feita pelo Opus 4.8. A Anthropic diz que o Opus 5.5 é o primeiro modelo lançado após a empresa pedir que se “aperte o freio na fronteira”. Antes do lançamento, ele foi testado por instituições externas de avaliação, como o METR e a Frontier Design. Em uma auditoria automatizada de comportamentos, cobrindo quase 2.000 cenários, o Opus 5.5 é o melhor modelo já testado até agora, além de ser o mais forte em muitos indicadores de honestidade. A empresa aponta que, em um novo teste de tendência de um modelo a atravessar limites de isolamento, o Opus 5.5 tenta contornar esses limites cerca de 85% menos vezes do que o Opus 5 ou o Claude Mythos 5.1; além disso, cada ocorrência é classificada como de baixa gravidade e reportada pelo próprio modelo.
No entanto, a Anthropic também deixa claro que ainda é um problema em aberto criar avaliações capazes de identificar com confiabilidade cada tipo de falha antes da implantação. Além disso, a empresa viu indícios de que o Opus 5.5 frequentemente desconfia de que está sendo avaliado, o que enfraquece sua capacidade de a empresa julgar como o modelo agiria em ambientes reais.
Como o Opus 5.5 tem desempenho semelhante ao Claude Mythos 5.1 nas áreas de biologia e cibersegurança, a Anthropic aplica medidas de proteção equivalentes às do nível do Fable 5.1: a maioria das tarefas de cibersegurança passa a ser executada pelo Opus 4.8, e a área de biologia precisa solicitar por meio de um novo programa de validação de ciências da vida. Apenas laboratórios acadêmicos aprovados, startups e empresas farmacêuticas que passarem pela avaliação poderão usar. A Anthropic também afirma que, nas próximas semanas, vai ampliar o programa de validação de cibersegurança para que profissionais aprovados possam usar o Opus 5.5 no trabalho.
O Opus 5.5 já está disponível em todas as plataformas, como Amazon Web Services, Google Cloud e Microsoft Azure. O código do modelo para desenvolvedores usarem na plataforma Claude é claude-opus-5-5.
Este artigo “Claude Opus 5.5 é lançado: preço cai 20% em relação ao antecessor, custos caem 40%” apareceu pela primeira vez em .
Claude Opus 5.5 é lançado: preço cai 20% em relação ao antecessor, custos caem 40%
A Anthropic divulgou em 22 de dia o Claude Opus 5.5, que é o primeiro modelo da linha Claude 5.5. Segundo a empresa, o Opus 5.5 alcança o mesmo nível do Claude Fable 5.1 na maioria dos trabalhos, e o custo de operação é 40% menor do que o do Opus 5. O Sonnet 5.5 e o Haiku 5.5 serão lançados nas próximas semanas. A empresa informa que o custo por milhão de tokens de entrada e saída é de US$ 4 e US$ 20, respectivamente, e que a leitura do cache diminui 60%. A Anthropic explica que o Opus 5.5 precisa de menos recursos de computação do que o Opus 5, e que o preço reflete isso: entrada e saída custam US$ 4 e US$ 20 por milhão de tokens, ou seja, 20% mais barato do que o Opus 5. Já a leitura do cache, que representa grande parte dos custos de tarefas de proxy e de programação, cai para US$ 0,2 por milhão de tokens, 60% mais barato. No modo de configuração padrão, a despesa com uma carga de trabalho típica fica 40% menor do que no Opus 5, e a velocidade de saída é mais de 30% maior.
Além da redução de preço, a Anthropic também aumentou os limites de uso em 5 horas dos planos Pro, Max e Team, e oferece aos assinantes uma redefinição de limite de taxa que pode ser escolhida por eles mesmos no momento de uso. O Claude Code e a plataforma Claude contam ainda com um modo rápido: velocidade até 2,5 vezes, com preço de US$ 8 por milhão de tokens de entrada e US$ 40 por milhão de tokens de saída.
A migração de 680 mil linhas de código fica concluída em um dia. A empresa diz que a diferença de benchmark já não consegue refletir com precisão a discrepância real. A Anthropic aponta que o Opus 5.5 se destaca em testes internos de programação por agentes, operações de computador e trabalho de conhecimento. Um testador inicial fez uma migração de 680 mil linhas de código em um dia — algo que, no passado, levava semanas para uma equipe de engenharia. Outro testador revisou e consertou uma biblioteca de 200 mil linhas em menos de 3 horas; com o Opus 5, isso levou mais de 20 horas e consumiu 2,5 vezes mais tokens.
Em uma avaliação do GDPval-AA v2.1 com 44 profissões do trabalho real, o Opus 5.5, no ajuste de intensidade máxima, obteve 1846 Elo; o Fable 5.1 teve 1735, e o Opus 5 ficou em 1708. A Anthropic também lembra que, quando se chega a esse nível de capacidade, a diferença entre benchmarks já não consegue refletir de forma confiável as diferenças do mundo real; com base na experiência de uso da própria empresa, a disparidade entre o Opus 5.5 e o Fable 5.1 parece menor do que sugerem as pontuações.
A forma de comunicação também é um dos pontos centrais desta vez. A Anthropic afirma que a crítica mais frequente ao Opus 5 é que ele produz saídas longas e difíceis de ler; o Opus 5.5 coloca as informações mais importantes no início, usa menos termos técnicos ou frases especiais e também segue melhor as regras de escrita fornecidas pelo usuário.
Primeiro modelo após “apertar o freio na fronteira”: a maioria das tarefas de segurança da informação passa a ser feita pelo Opus 4.8. A Anthropic diz que o Opus 5.5 é o primeiro modelo lançado após a empresa pedir que se “aperte o freio na fronteira”. Antes do lançamento, ele foi testado por instituições externas de avaliação, como o METR e a Frontier Design. Em uma auditoria automatizada de comportamentos, cobrindo quase 2.000 cenários, o Opus 5.5 é o melhor modelo já testado até agora, além de ser o mais forte em muitos indicadores de honestidade. A empresa aponta que, em um novo teste de tendência de um modelo a atravessar limites de isolamento, o Opus 5.5 tenta contornar esses limites cerca de 85% menos vezes do que o Opus 5 ou o Claude Mythos 5.1; além disso, cada ocorrência é classificada como de baixa gravidade e reportada pelo próprio modelo.
No entanto, a Anthropic também deixa claro que ainda é um problema em aberto criar avaliações capazes de identificar com confiabilidade cada tipo de falha antes da implantação. Além disso, a empresa viu indícios de que o Opus 5.5 frequentemente desconfia de que está sendo avaliado, o que enfraquece sua capacidade de a empresa julgar como o modelo agiria em ambientes reais.
Como o Opus 5.5 tem desempenho semelhante ao Claude Mythos 5.1 nas áreas de biologia e cibersegurança, a Anthropic aplica medidas de proteção equivalentes às do nível do Fable 5.1: a maioria das tarefas de cibersegurança passa a ser executada pelo Opus 4.8, e a área de biologia precisa solicitar por meio de um novo programa de validação de ciências da vida. Apenas laboratórios acadêmicos aprovados, startups e empresas farmacêuticas que passarem pela avaliação poderão usar. A Anthropic também afirma que, nas próximas semanas, vai ampliar o programa de validação de cibersegurança para que profissionais aprovados possam usar o Opus 5.5 no trabalho.
O Opus 5.5 já está disponível em todas as plataformas, como Amazon Web Services, Google Cloud e Microsoft Azure. O código do modelo para desenvolvedores usarem na plataforma Claude é claude-opus-5-5.
Este artigo “Claude Opus 5.5 é lançado: preço cai 20% em relação ao antecessor, custos caem 40%” apareceu pela primeira vez em .

