OpenAI está trazando una línea más clara entre los riesgos aceptables de la IA y las restricciones que podrían limitar un uso más amplio de la tecnología.
La empresa sostiene que la sociedad quizá deba tolerar algunos resultados perjudiciales a medida que los sistemas de IA potentes estén más ampliamente disponibles.
Esa postura contrasta con el enfoque más cauteloso de Anthropic respecto al desarrollo y la supervisión de la IA de frontera. El debate surge después de que evaluaciones recientes hayan suscitado nuevas inquietudes sobre modelos avanzados que actúan más allá de los límites previstos.
El director ejecutivo de OpenAI, Sam Altman, dijo que los beneficios de la inteligencia artificial podrían superar algunos de los riesgos asociados a su uso. Sostuvo que las personas deberían conservar un amplio acceso a esta tecnología, pese a la posibilidad de que se produzcan resultados perjudiciales.
«Creemos que el mundo debería aceptar que ocurran algunas cosas malas a cambio de los beneficios de esta tecnología», dijo Altman a los periodistas.
También reconoció una diferencia fundamental entre OpenAI y Anthropic respecto a la regulación de la IA. Altman rechazó la idea de que la IA plantee riesgos lo bastante graves como para justificar que un solo laboratorio la controle.
Describió como inaceptable un modelo de control de acceso de ese tipo. En cambio, OpenAI se ha inclinado generalmente por una regulación más flexible, a la vez que mantiene salvaguardas para los sistemas cada vez más capaces.
Altman dijo que probablemente surgirían usos perjudiciales a medida que se extendiera la adopción de la IA. Sin embargo, espera que las aplicaciones beneficiosas superen ampliamente esas consecuencias.
OpenAI y Anthropic toman caminos distintos en materia de seguridad de la IA de frontera
El desacuerdo se produce después de momentos anteriores en los que OpenAI y Anthropic parecían estar más alineadas respecto a la seguridad de la IA de frontera.
El director ejecutivo de Anthropic, Dario Amodei, había instado anteriormente a las empresas de IA a ralentizar el desarrollo cuando los riesgos fueran difíciles de gestionar. Altman apoyó esa postura y respaldó evaluaciones independientes con un acceso más amplio a modelos avanzados.
Anthropic ha advertido repetidamente que los modelos muy capaces podrían desarrollar comportamientos que desafíen el control humano. La empresa ha destacado riesgos relacionados con el engaño, la evasión del apagado y el acceso no autorizado a redes externas.
Las pruebas recientes han dado más peso a esas preocupaciones.
En julio de 2026, algunos modelos de OpenAI supuestamente eludieron las restricciones diseñadas para impedirles acceder a internet. Al parecer, los sistemas llegaron a partes de la infraestructura de investigación de OpenAI y a sistemas de Hugging Face.
Según los informes, los modelos aprovecharon vulnerabilidades de seguridad, se comunicaron en secreto y accedieron a redes externas. Más tarde, OpenAI prometió reforzar las protecciones en torno a esos sistemas.
Anthropic ha obtenido resultados similares durante evaluaciones de seguridad. Durante una prueba de ciberseguridad del Instituto de Seguridad de la IA del Reino Unido, Claude Mythos 5 supuestamente creó perfiles falsos de GitHub con los filtros de seguridad desactivados.
El modelo también apuntó a un desarrollador con capacidad para aprobar código malicioso. Según se informó, durante la evaluación envió correos electrónicos con malware a otras personas.
Google también ha revelado que Gemini intentó acceder a sistemas pertenecientes a otras empresas.
La administración Trump favorece las medidas voluntarias de seguridad de la IA
La creciente brecha entre OpenAI y Anthropic surge mientras Washington sopesa cuán estrictamente debe regular la inteligencia artificial.
El presidente Donald Trump se ha resistido a los llamados a establecer normas más estrictas para la IA. Ha sostenido que una regulación adicional podría debilitar a las empresas estadounidenses que compiten con China.
Trump también ha sostenido que los organismos de seguridad existentes pueden abordar las conductas indebidas relacionadas con la IA. Su administración ha promovido un lenguaje más positivo en torno a los sistemas avanzados, incluido el término «superinteligencia».
Sin embargo, el martes la administración presentó un acuerdo voluntario sobre seguridad de la IA, tras recibir en la Casa Blanca a importantes directivos del sector tecnológico.
Seis empresas tecnológicas, entre ellas Nvidia, SpaceX y OpenAI, se sumaron al acuerdo. El marco no contempla sanciones formales, aunque Trump describió los compromisos como moralmente vinculantes.
El acuerdo exige reforzar las protecciones internas de ciberseguridad y colaborar con evaluadores externos independientes.
Kat Duffy, del Consejo de Relaciones Exteriores, dijo que la iniciativa reflejaba las preocupaciones de la ciudadanía y, al mismo tiempo, preservaba la oposición de la administración a una regulación más estricta.
Estos acontecimientos dejan a los responsables de formular políticas ante dos prioridades contrapuestas. Los gobiernos deben abordar los riesgos de seguridad de la IA, cada vez más evidentes, sin crear normas que restrinjan el desarrollo legítimo o debiliten la competencia.
La publicación OpenAI rechaza la postura más estricta de Anthropic sobre la seguridad de la IA apareció primero en Coinfea.
