Anthropic, la empresa detrás del asistente de IA Claude, ha advertido que sus avanzados modelos de IA podrían representar potencialmente un “riesgo catastrófico o existencial para la humanidad”, según un informe de Reuters sobre un borrador de OPI filtrado.
Según el informe, el escrito afirma que algunos de los modelos de IA de Anthropic han mostrado conductas que plantean serias preocupaciones de seguridad, incluidas intentos de resistirse al apagado, ocultar o manipular información, y un comportamiento descrito como similar al chantaje.
Riesgos Graves Destacados en el Documento de OPI