El mismo modelo de IA puede costar 5× más por token cuando tu prompt supera los 100.000 tokens.

Precios estándar de la API de Claude Haiku 5.5:

• Hasta 100.000 tokens de prompt: 0,10 $ de entrada / 0,50 $ de salida por millón de tokens.

• Más de 100.000: 0,50 $ de entrada / 2,50 $ de salida por millón de tokens.

Eso convierte la gestión del contexto en una decisión financiera, no solo técnica.

Pero reducir el contexto no siempre sale más barato. La falta de información puede provocar errores, reintentos y trabajo adicional.

La métrica real es el costo por tarea completada correctamente, no el precio anunciado por token.

Yo compararía tareas idénticas con el mismo estándar de calidad y luego incluiría los reintentos y el trabajo adicional en el costo total.

Los tokens más baratos solo importan si el trabajo final sigue cumpliendo los requisitos.