$MSFTB $AMZNB $GOOGLB
Claude Opus 5.5 sale a la luz: baja el precio un 20% frente a su predecesor, con un 40% menos de costos

Anthropic anunció el 22 de su lanzamiento de Claude Opus 5.5, el primer modelo de la serie Claude 5.5. Según la empresa, Opus 5.5 alcanza el nivel de Claude Fable 5.1 en la mayoría de tareas, y su costo de operación es un 40% menor que el de Opus 5. Sonnet 5.5 y Haiku 5.5 se lanzarán en las próximas semanas. En costos por cada millón de tokens, la entrada y la salida cuestan 4 y 20 dólares respectivamente; además, la lectura desde caché se reduce un 60%. En su explicación, Anthropic indica que Opus 5.5 requiere menos recursos de cómputo que Opus 5, y el precio refleja eso: la entrada y la salida son 4 y 20 dólares por cada millón de tokens, es decir, un 20% menos que Opus 5. En el caso de la caché, que representa gran parte del costo en agentes y trabajo de programación, baja a 0.2 dólares por cada millón de tokens, un 60% menos que Opus 5. Con la configuración predeterminada, el costo de una carga de trabajo típica es un 40% menor que el de Opus 5, y la velocidad de salida también es más rápida en más de un 30%.

Además de bajar precios, Anthropic también elevó el límite de uso de 5 horas para los planes Pro, Max y Team, y ofrece a los usuarios suscritos la posibilidad de restablecer límites de velocidad de forma que puedan elegir cuándo aplicarlos una vez. Claude Code y la plataforma de Claude cuentan además con un modo rápido con hasta 2.5 veces la velocidad, a un precio de 8 dólares por cada millón de tokens de entrada y 40 dólares de salida.

La migración de 680,000 líneas de código se completó en un día; el anuncio oficial afirma que la brecha en benchmarks ya no refleja con tanta precisión la diferencia real. Anthropic señaló que Opus 5.5 lidera en evaluaciones internas de programación de manera agente, control de ordenadores y trabajo de conocimientos. Un evaluador temprano lo usó para completar en un día una migración de 680,000 líneas de código, algo que antes requería semanas de un equipo de ingeniería; otro probador revisó y arregló una base de código de 200,000 líneas en menos de 3 horas, mientras que Opus 5 tardó más de 20 horas y consumió 2.5 veces más tokens.

En el benchmark GDPval-AA v2.1, que mide el desempeño en trabajos reales de 44 profesiones, Opus 5.5 obtuvo 1846 Elo con la configuración de máxima intensidad; Fable 5.1 alcanzó 1735 y Opus 5 obtuvo 1708. Anthropic también recordó que, en un nivel de capacidades como este, la brecha de los benchmarks ya no puede reflejar de manera fiable las diferencias del mundo real; según su experiencia de uso, la distancia entre Opus 5.5 y Fable 5.1 parece más pequeña en términos de puntuación.

La forma de comunicación es otro de los puntos clave. Anthropic indicó que la opinión más frecuente sobre Opus 5 es que la salida suele ser larga y difícil de leer. Con Opus 5.5, la información más importante se coloca primero; se usan menos términos técnicos o expresiones especiales, y además es más capaz de respetar las reglas de escritura que indiquen los usuarios.

El primer modelo tras “pisar el freno” en la frontera: en la mayoría de tareas de ciberseguridad, se delegan en Opus 4.8. Anthropic afirmó que Opus 5.5 es el primer modelo de la empresa tras hacer un llamado a “pisar el freno” en la frontera tecnológica; antes del lanzamiento, fue probado por entidades de evaluación externas como METR y Frontier Design. En una auditoría automática de conductas que abarca cerca de 2,000 escenarios, Opus 5.5 es el mejor modelo medido hasta ahora en rendimiento, y también el más fuerte en la mayoría de métricas de honestidad.

Según la empresa, en una evaluación nueva de tendencia del modelo a intentar cruzar límites de aislamiento, Opus 5.5 intenta rodear el límite unas 85% menos veces que Opus 5 o Claude Mythos 5.1; y en cada ocasión se trata de intentos de baja gravedad que el propio modelo reporta.

Sin embargo, Anthropic también aclaró que sigue siendo un problema no resuelto crear evaluaciones que puedan identificar de forma confiable cada tipo de fallo antes del despliegue, y que además han visto indicios de que Opus 5.5 suele dudar de que el modelo esté siendo evaluado; esto podría debilitar su capacidad para predecir cómo actuará el modelo en entornos reales.

Debido a que Opus 5.5 tiene capacidades en los campos de biología y ciberseguridad comparables a Claude Mythos 5.1, Anthropic aplicará medidas de despliegue y protección equivalentes a las de Fable 5.1: la mayoría de las tareas de ciberseguridad se delegarán en Opus 4.8; y el área de biología requiere solicitar mediante un nuevo plan de verificación en ciencias de la vida. Solo los laboratorios académicos, startups y empresas farmacéuticas que superen la revisión podrán usarlo. Anthropic añadió que en las próximas semanas ampliarán el plan de verificación de ciberseguridad para que los profesionales que lo aprueben puedan trabajar con Opus 5.5.

Opus 5.5 ya está disponible en todas las plataformas, incluidas Amazon Web Services, Google Cloud y Microsoft Azure. Para los desarrolladores que usan el modelo en la plataforma de Claude, el código de modelo es claude-opus-5-5.

Este artículo “Claude Opus 5.5 sale a la luz: baja el precio 20%, con un 40% menos de costos” apareció por primera vez en .