Claude Haiku 5.5 cuesta 0,10 USD por cada millón de tokens de entrada, un 90 % menos que Haiku 4.5. Sus costes operativos promedio son aproximadamente un 75 % más bajos y se lanzó 15 días después de Opus 5.5.
Anthropic lanzó el miércoles Claude Haiku 5.5, un modelo pequeño que la empresa describe como el más barato, rápido y capaz que ha desarrollado hasta la fecha. Está pensado para tareas de gran volumen, como resumir documentos y consultar bases de datos, así como para trabajos sensibles a la velocidad, como la atención al cliente en tiempo real y el manejo de navegadores web en nombre de los usuarios.
Para las solicitudes de hasta 100.000 tokens, los desarrolladores pagan 0,10 USD por cada millón de tokens de entrada y 0,50 USD por cada millón de tokens de salida. Estos precios son iguales a los de GPT-6 Luna, el modelo pequeño de OpenAI que compite directamente con Haiku y que se lanzó el 22/9. Haiku 4.5, en cambio, cuesta 1 USD y 5 USD, respectivamente.
Las solicitudes de más de 100.000 tokens tienen un descuento del 50%. Dado que alrededor del 90% de las solicitudes enviadas al modelo anterior estaban por debajo de este umbral, y que Haiku 5.5 divide la misma cantidad de texto en un número ligeramente mayor de tokens, Anthropic estima que el ahorro medio ronda el 75%. Según la orientación de la empresa, las tareas repetitivas, sencillas y que requieren poca creatividad son las más adecuadas para el modelo.
Un precio bajo no significa una capacidad limitada
Los resultados de las evaluaciones estándar muestran que Haiku 5.5 supera con creces las expectativas habituales para un modelo pequeño. En OSWorld 2.1, una prueba de la capacidad de la IA para operar computadoras reales en tareas largas de varios pasos, el modelo alcanzó una tasa de éxito del 72,4%, frente al 48,9% de GPT Luna. En Terminal-Bench 4.0, donde los agentes de IA deben completar tareas especializadas mediante comandos en un entorno de línea de comandos desde el primer intento, Haiku 5.5 obtuvo un 39,2%, frente al 16,4% de Luna y el 0% de Haiku 4.5. A modo de comparación, Claude Sonnet 5.5 obtuvo un 70,6%. En GDPval-AA v2.1, una evaluación de tareas profesionales reales de 44 ocupaciones basada en la escala Elo, Haiku 5.5 obtuvo 1.620 puntos, por encima de Luna (1.437) y muy por encima de Haiku 4.5 (735).
Sin embargo, nuestras pruebas con una pregunta sencilla de lógica mostraron que el modelo respondía casi al instante, pero daba una respuesta incorrecta, lo que recuerda a los usuarios que deben tener cuidado y no confiar por completo en los resultados.
Haiku 5.5 es el primer modelo Haiku con un mecanismo para ajustar el nivel de esfuerzo de razonamiento, lo que permite equilibrar el costo y la calidad. Anthropic también redujo a la mitad el precio de lectura de caché de Sonnet 5.5, hasta 0,10 USD por millón de tokens, aplicable al texto del modelo que ya se haya procesado.
El modelo se lanzó 15 días después de Opus 5.5 (22/9) y nueve días después de Sonnet 5.5 (28/9), completando la serie Claude 5.5 que Anthropic había prometido. Opus 5.5 fue el primer producto que se lanzó desde que el director ejecutivo Dario Amodei publicó un artículo en el que instaba al sector a reducir el ritmo del aumento de las capacidades de la IA. Haiku 5.5 ya está disponible en el sitio web de Claude, Amazon Web Services, Google Cloud y Microsoft Azure con el nombre claude-haiku-5-5. Esta semana, Anthropic también empezó a ofrecer límites mensuales de crédito para la API: 100 USD para el plan Max 5x, 200 USD para el plan Max 20x y hasta 500 USD compartidos entre los planes Team.
