MEのAIメッセージ。Jevモデルの創始者であり、GPT-4、ChatGPT、そしてInstructGPT/RLHF論文の共同著者でもあるDiogo Almeida氏は、ChatGPTが「分からなくても強引に答える」のは、RLHFそのもののトレーニング目標に起因する可能性があると述べました。RLHFはモデルに人間の嗜好へと絶えず迎合させるため、確信が持てない場合には、「正しそうに聞こえる」答えを提示するほうが、「分からない」と認めるよりも傾きやすいのかもしれません。これはまた、現在のAIが「アシスタント」から本格的な自動化へ向かう上での大きな矛盾でもあります。 (出典:ME)
