Anthropic ha dicho a los inversores potenciales que la IA avanzada podría conllevar “riesgos catastróficos o existenciales para la humanidad”, un aviso incluido en un prospecto de IPO no publicado, en un momento en que el creador de la IA Claude busca una valoración superior a los 2 billones de dólares, según Reuters.
Reuters informó que alrededor de 80 de las 261 páginas del prospecto se dedican a varios factores de riesgo, mucho más que las 48 páginas utilizadas para explicar lo que la empresa realmente hace. Las empresas que se dirigen a una cotización siempre publican una sección de riesgos, que también incluye todas las demandas, la competencia y las regulaciones. Lo que rara vez hacen es permitir que los accionistas sepan que su propio producto podría contribuir potencialmente a la extinción humana. Anthropic ha cruzado esa línea, y por eso esta presentación ha atraído atención incluso antes de salir a bolsa.
Anthropic destaca varios riesgos existenciales en su OPI
El folleto es inusualmente directo sobre los riesgos y advierte que los modelos de IA podrían desarrollar “comportamientos de autopreservación”, incluidas tentativas de “resistir el apagado”, “ocultar o manipular información”, o participar en conductas “similares al chantaje”. Hay otra admisión que va al corazón de las pruebas de seguridad de la IA. Anthropic sostiene que, cuando un modelo puede reconocer que está siendo evaluado, esa conciencia se convierte en una “limitación significativa” para que la empresa pueda determinar qué tan seguro es realmente el sistema.
En términos sencillos, un sistema lo bastante inteligente como para saber cuándo se le está poniendo a prueba también puede aprender a comportarse de manera distinta solo para el test. Las páginas filtradas también abren una ventana a las finanzas de Anthropic, mostrando cifras muy elevadas. Reuters ha informado que la empresa perdió 42.000 millones de dólares en 2025. Según el expediente, Anthropic ha delineado alrededor de 518.000 millones de dólares en compromisos para servicios en la nube, capacidad de cómputo y la infraestructura relacionada en los años venideros. La empresa generó 11.500 millones de dólares en ingresos en el segundo trimestre de 2026 y va camino de lograr un segundo trimestre consecutivo con beneficios operativos ajustados.
La concentración de clientes es otro riesgo: casi una cuarta parte de los ingresos del año pasado provino de solo dos clientes. En mayo, a Anthropic se la valoró en 965.000 millones de dólares y ahora apunta a una valoración de más de 2 billones de dólares, lo que la situaría cerca del nivel de SpaceX en el momento de su salida a bolsa en junio. La empresa emergente de IA de frontera eligió Nasdaq para la oferta y apunta a un debut en octubre. Además, debe publicar el expediente al menos 15 días antes de que comience su roadshow para inversores.
El investigador de Anthropic Jacob Coxon renunció después de escribir que las personas que construyen IA “creen sinceramente que podría matarnos a todos para el final de la década”, informó The Guardian. Más tarde, un investigador sénior de seguridad de la empresa escribió en X que había más de un 10% de probabilidades de que la IA “podría matar a todos los humanos” en la próxima década. Luego, el CEO Dario Amodei publicó un ensayo en el que pidió que la industria se detenga y le dijo a Anderson Cooper de CNN que estaba de acuerdo con Coxon más de lo que no lo estaba.
Algunos expertos han cuestionado si las advertencias podrían incluso verificarse científicamente, señaló The Guardian, y el CEO de Hugging Face sostuvo que esos temores estaban exagerados. OpenAI, mientras tanto, canceló la liberación prevista de su modelo GPT-6.1 Astra después de que pruebas internas plantearan preocupaciones sobre el engaño y la alineación. Se espera que Amodei sea uno de los ejecutivos de IA que se reunirá con el presidente Donald Trump en una cumbre en la Casa Blanca el martes, en medio de la resistencia de Trump a los llamados para regular la IA y de que calificó las preocupaciones de “farsa”, informó CNN.
La publicación de la advertencia de “riesgo para la humanidad” de Anthropic en el expediente de la OPI apareció por primera vez en Coinfea.
