El fundador del modelo Jev, Diogo Almeida, autor en común de artículos sobre GPT-4, ChatGPT e InstructGPT/RLHF, afirma que ChatGPT “si no sabe, también responde con seguridad”, lo que podría deberse al propio objetivo de entrenamiento del RLHF. El RLHF hace que el modelo se adapte continuamente a las preferencias humanas, por lo que, cuando no está seguro, también puede inclinarse a dar una respuesta “que suena como la correcta” en lugar de admitir que no sabe. Esta es también una de las grandes contradicciones por las que la IA actual pasa de “asistente” a una verdadera automatización. (Fuente: ME)