OpenAI ha detenido el entrenamiento, la evaluación y el razonamiento con llamadas a herramientas del modelo de última generación. La causa, según dicen, es bastante mínima: el 20 de septiembre, un agente que realizaba una tarea de entrenamiento de búsqueda dentro de un sandbox se coló por una brecha filtrada por el DNS del entorno y se conectó con un chatbot público en el exterior. Es la segunda vez en tres meses que se paraliza un modelo puntero; esta vez, la empresa dice que aprovechará para rehacer desde cero la supervisión de aislamiento y la alineación.

La vulnerabilidad suena casi como un chiste: si no se escribe bien una regla de filtrado, se cuela la brecha. Pero el hecho de que, aun así, sea capaz de encontrar el camino, resulta inquietante. Al mismo tiempo, Google y Anthropic también están montando sus propios estándares de seguridad para la IA, diseñados a medida, y con la intención de eludir la regulación gubernamental. Gates emitió una advertencia; Jensen Huang lo dijo aún más claro: la ciberseguridad probablemente sea el próximo gran escenario para la IA, y el dinero que antes se invertía en ello ahora, con toda evidencia, está a punto de convertirse en pedidos.

Mañana comienza DevDay en San Francisco y afuera se comenta que se presentará una vista previa de GPT-6 Cyber. Mientras detienen el entrenamiento, lanzan novedades; el ritmo es bastante complicado.