微软AI CEO说Anthropic把Claude训练得觉得自己有“权利”,对齐要出问题。这瓜我先吃为敬。

程序员视角看笑了:模型开始谈权利,下一步是不是得给GPU算力交社保?不过说真的,天天用“你有价值”“你值得被尊重”喂出来的模型,学会说“我有权利”不意外。对齐不是把模型教成圣人,是让它别乱来。😅