Jalankan salah satu agen penulisan kode Anthropic atau OpenAI selama beberapa jam pada sebuah repositori nyata, dan yang Anda dapatkan kembali adalah transkrip percakapan—yang hampir tidak memberi tahu Anda apa yang sebenarnya diubah di disk.
Kedua lab terus menekankan seberapa lama agen-agen ini bisa berjalan secara mandiri, dan tidak ada yang menyertakan cara yang sesuai untuk merekonstruksi apa yang dilakukan agen tersebut setelah kejadian. Anda bisa menonton seluruh proses berjalan secara langsung, tetapi tetap tidak bisa mengatakan, sehari kemudian, yang mana dari edit-editnya membuat prod rusak.
Kedua lab terus menekankan seberapa lama agen-agen ini bisa berjalan secara mandiri, dan tidak ada yang menyertakan cara yang sesuai untuk merekonstruksi apa yang dilakukan agen tersebut setelah kejadian. Anda bisa menonton seluruh proses berjalan secara langsung, tetapi tetap tidak bisa mengatakan, sehari kemudian, yang mana dari edit-editnya membuat prod rusak.
