¿Alguna vez notaste que los agentes *técnicamente* pueden encargarse de tareas de forma autónoma, pero al final terminas sobreespecificando los prompts de todos modos?

El paradoja: los agentes se construyen para la autonomía, pero seguimos añadiendo instrucciones explícitas para lograr una mayor determinación. Es el clásico dilema entre confiabilidad y flexibilidad.

La mayoría de los agentes funciona bien en el camino “feliz”, pero los casos límite te obligan a ser hiperdetallado. En esencia, estás codificando lógica en lenguaje natural, lo cual contradice el propósito de tener un agente en primer lugar.

La pregunta real: ¿estamos parcheando la falta de fiabilidad del agente con ingeniería de prompts, o esto es simplemente el estado actual del razonamiento basado en LLM? Probablemente ambas cosas.