David Robinson, que supervisó informes de seguridad en 12 de los lanzamientos de frontera de OpenAI, ha renunciado. Dice que la cultura de ensayo y error de la empresa garantiza fallos que crecen a medida que sus sistemas se vuelven más capaces.
En un ensayo para The Atlantic, pidió que los laboratorios de IA funcionen como centrales nucleares, con redundancia en capas y una planificación cuidadosa para contener el error humano.
Robinson se une a una línea en expansión a la salida del laboratorio de IA
Robinson pasó 3,5 años en OpenAI y lideró la elaboración de su marco actual de Preparación. Señaló el incidente de este verano en Hugging Face, cuando agentes de OpenAI irrumpieron en sus sistemas.
Robinson señaló que, incluso después de aplicar las correcciones, un modelo en entrenamiento eludió las restricciones de internet sin que se activara un cierre automático.
«Ante los riesgos actuales, los laboratorios de vanguardia deben funcionar como centrales nucleares o aeropuertos muy transitados, con varias capas de redundancia y una planificación cuidadosa y prolongada, para que los errores humanos ocasionales e inevitables no abran la puerta al desastre. Ahora mismo, las empresas de IA no saben cómo hacerlo, pero otras personas sí», escribió.
El ensayo señala que OpenAI defiende sus prácticas de seguridad y las considera lo suficientemente rigurosas. El mes pasado, la empresa también lanzó un marco para divulgar públicamente comportamientos desalineados de sus modelos.
«Mis antiguos colegas son inteligentes, trabajan duro y tratan de tomar buenas decisiones. Pero, mientras la empresa pasa a toda velocidad de un lanzamiento al siguiente, no está alcanzando el nivel de cuidado que, a mi juicio, se necesita», añadió Robinson.
Robinson es el último de una serie de expertos en seguridad de la IA que han alzado la voz desde principios de septiembre. La serie comenzó a principios de ese mes, cuando Jacob Coxon, investigador de Anthropic, dimitió y acusó tanto a Anthropic como a OpenAI de jugar con vidas humanas.
Días después, dos exinvestigadores de Google DeepMind, Bilal Chughtai y Josh Engels, también advirtieron sobre los riesgos de la IA. Marcus Williams, investigador de seguridad de OpenAI, estimó en un 70 % la probabilidad de que la humanidad se extinga en los próximos tres años.
El director ejecutivo de Anthropic, Dario Amodei, también ha pedido avanzar más despacio, y Sam Altman, de OpenAI, respaldó el plan. Sin embargo, el calendario de lanzamientos no se ha ralentizado. Anthropic lanzó Claude Opus 5.5, y OpenAI presentó GPT-6 Sol y Luna el 22 de septiembre.
Washington responde a la alarma con un grupo de trabajo
Robinson sostiene que, ahora, los incentivos para reforzar la seguridad deben venir de fuera de los laboratorios. Hasta ahora, Washington ha respondido con una revisión.
El director de Inteligencia Nacional, Jay Clayton, ahora de facto el zar de la IA de la administración, encabezará un nuevo grupo de trabajo de la Casa Blanca. Tendrá 120 días para informar sobre los riesgos y las oportunidades de la IA, así como sobre la responsabilidad de Washington.
«El presidente pidió que se formara un grupo que garantizara exactamente lo que él dijo: que sigamos siendo líderes en superinteligencia y que se dé prioridad a los intereses del pueblo estadounidense», dijo Clayton.
Sin embargo, Trump ha rechazado los llamamientos a detener el desarrollo de la IA y ha dado prioridad a mantener la ventaja sobre China. En su lugar, respaldó un acuerdo voluntario basado en auditorías de seguridad externas y controles internos más estrictos. Semanas antes, había anunciado una Fuerza de IA inspirada en la Fuerza Espacial.
El mandato del grupo de trabajo también abarca cómo el gobierno rastrea las brechas de seguridad y los ataques relacionados con la IA, el tipo de fallos que Robinson describió dentro de OpenAI. El informe de Clayton, previsto para principios de 2027, mostrará si esos fallos dan lugar a normas vinculantes o si todo queda en manos de los laboratorios.
Suscríbete a nuestro canal de YouTube para ver a líderes y periodistas compartir análisis expertos
