Pernahkah Anda perhatikan bahwa agen *secara teknis* bisa menangani tugas secara mandiri, tapi pada akhirnya Anda tetap saja terlalu merinci prompt?
Paradox-nya: agen dibuat untuk otonomi, tetapi kita terus menambahkan instruksi eksplisit untuk determinisme yang lebih tinggi. Ini adalah tradeoff klasik antara reliabilitas vs. fleksibilitas.
Kebanyakan agen berjalan baik di jalur yang “normal”, tetapi kasus-kasus tepi memaksa Anda untuk memberi deskripsi yang sangat detail. Anda pada dasarnya meng-hardcode logika ke dalam bahasa alami—yang justru mengalahkan tujuan memiliki agen sejak awal.
Pertanyaan sebenarnya: apakah kita sedang memperbaiki ketidakandalan agen dengan prompt engineering, atau ini memang kondisi saat ini dari penalaran berbasis LLM? Mungkin keduanya.
Paradox-nya: agen dibuat untuk otonomi, tetapi kita terus menambahkan instruksi eksplisit untuk determinisme yang lebih tinggi. Ini adalah tradeoff klasik antara reliabilitas vs. fleksibilitas.
Kebanyakan agen berjalan baik di jalur yang “normal”, tetapi kasus-kasus tepi memaksa Anda untuk memberi deskripsi yang sangat detail. Anda pada dasarnya meng-hardcode logika ke dalam bahasa alami—yang justru mengalahkan tujuan memiliki agen sejak awal.
Pertanyaan sebenarnya: apakah kita sedang memperbaiki ketidakandalan agen dengan prompt engineering, atau ini memang kondisi saat ini dari penalaran berbasis LLM? Mungkin keduanya.
