PESAN ME AI: Pendiri model Jev, Diogo Almeida, menyatakan bahwa GPT-4, ChatGPT, dan penulis bersama makalah InstructGPT/RLHF; ChatGPT “tetap menjawab meski tidak tahu”, yang mungkin berasal dari tujuan pelatihan RLHF itu sendiri. RLHF membuat model terus menyesuaikan diri dengan preferensi manusia, sehingga ketika model tidak pasti, ia juga mungkin lebih cenderung memberikan jawaban yang “terdengar benar” daripada mengakui tidak tahu. Ini juga merupakan salah satu kontradiksi besar saat ini, ketika AI bergerak dari “asisten” menuju otomatisasi yang benar-benar nyata. (Sumber: ME)
