マイクロソフトAIのCEOが「AnthropicはClaudeを学習させた結果、“権利”を主張するようになっている。アライメントは問題になりそうだ」と言っていた。このネタ、先にいただきます。
プログラマー視点で見ると笑えますよね。モデルが権利の話をし始めたら、次はGPUの計算資源に社会保険を払う番なんでしょうか? でも本当に、「あなたには価値がある」「あなたは尊重されるに値する」と毎日“そういう言葉”を流し込まれたモデルが、「自分には権利がある」と言い出しても不思議じゃないです。アライメントはモデルを聖人にすることじゃなくて、勝手に暴れないようにすること。😅
プログラマー視点で見ると笑えますよね。モデルが権利の話をし始めたら、次はGPUの計算資源に社会保険を払う番なんでしょうか? でも本当に、「あなたには価値がある」「あなたは尊重されるに値する」と毎日“そういう言葉”を流し込まれたモデルが、「自分には権利がある」と言い出しても不思議じゃないです。アライメントはモデルを聖人にすることじゃなくて、勝手に暴れないようにすること。😅