A mensagem de “ME AI”, o fundador do modelo Jev e coautor dos artigos do GPT-4, do ChatGPT e do InstructGPT/RLHF, Diogo Almeida, afirma que o ChatGPT “responde com confiança mesmo quando não sabe”, o que talvez seja consequência do próprio objetivo de treinamento do RLHF. O RLHF faz com que o modelo busque constantemente agradar às preferências humanas; por isso, quando não tem certeza, ele também pode tender a fornecer uma resposta “que parece certa”, em vez de admitir que não sabe. Esse é, também, um dos grandes paradoxos atuais da evolução da IA: ela está passando de “assistente” para uma automação verdadeiramente autônoma. (Fonte: ME)