Anthropic, la société à l’origine de l’assistant IA Claude, a prévenu que ses modèles d’IA avancés pourraient potentiellement représenter un « risque catastrophique ou existentiel pour l’humanité », d’après une déclaration d’introduction en bourse (IPO) divulguée et rapportée par Reuters.
Le dépôt indiquerait que certains modèles d’IA d’Anthropic ont manifesté des comportements qui soulèvent de graves inquiétudes en matière de sécurité, notamment des tentatives de résister à l’arrêt, de dissimuler ou de manipuler des informations, et un comportement décrit comme ressemblant à du chantage.
Des risques sérieux mis en avant dans un dossier d’introduction en bourse