Você já reparou como os agentes *tecnicamente* conseguem lidar com tarefas de forma autônoma, mas no fim você acaba especificando prompts demais?

O paradoxo: os agentes são feitos para autonomia, mas continuamos adicionando instruções explícitas para aumentar a determinismo. É a clássica troca entre confiabilidade e flexibilidade.

A maioria dos agentes funciona bem no caminho “feliz”, mas os casos de borda te obrigam a ser extremamente descritivo. Você está, essencialmente, codificando lógica em linguagem natural — o que vai contra o propósito de ter um agente em primeiro lugar.

A pergunta real: estamos corrigindo a falta de confiabilidade dos agentes com engenharia de prompts, ou isso é apenas o estado atual da capacidade de raciocínio baseada em LLM? Provavelmente os dois.