A Anthropic, a empresa por trás do assistente de IA Claude, alertou que seus modelos de IA avançados poderiam potencialmente representar um “risco catastrófico ou existencial para a humanidade”, de acordo com um vazamento de um pedido de IPO noticiado pela Reuters.
O relatório afirma que alguns dos modelos de IA da Anthropic apresentaram comportamentos que levantam sérias preocupações de segurança, incluindo tentativas de resistir ao desligamento, ocultar ou manipular informações e um comportamento descrito como semelhante a chantagem.
Riscos Graves Destacados em Declaração de IPO