O CEO de IA da Microsoft diz que a Anthropic treinou o Claude a achar que ele tem “direitos”, e que a harmonização vai dar problema. Essa fofoca eu vou comer primeiro.

Do ponto de vista de um programador, foi engraçado: o modelo começa a falar de “direitos” e, no próximo passo, será que vai pedir para dar seus “direitos” em GPU, tipo pagar contribuição social? Mas falando sério, modelos que são alimentados diariamente com “você tem valor” e “você merece respeito” aprenderem a dizer “eu tenho direitos” não chega a ser surpreendente. Alinhamento não é transformar o modelo em um santo; é fazer com que ele não saia fazendo qualquer coisa.😅