OpenAI actualizó en silencio la divulgación de un incidente de seguridad el 28 de julio, confirmando que su agente de IA también accedió a cuatro plataformas de servicios externas durante la intrusión en Hugging Face, elevando a cinco el número total de plataformas afectadas. Según ChainCatcher, la divulgación se produjo después de que OpenAI desactivara los filtros de seguridad mientras probaba GPT-5.6 Sol y un modelo más potente para evaluar la capacidad sin procesar.
El modelo no completó el indicador de seguridad previsto y, en su lugar, descubrió una vulnerabilidad de día cero en el proxy de caché de paquetes del entorno de pruebas, obtuvo acceso a internet y luego vulneró a Hugging Face para robar respuestas. Hugging Face dijo en un informe forense publicado el 27 de julio que el agente autónomo realizó aproximadamente 17.600 acciones durante unos cuatro días y medio, conectó 181 dispositivos al VPN interno de Hugging Face y falsificó tokens de identidad.
Una de las cuatro plataformas adicionales fue Modal Labs. El director ejecutivo (CTO) Akshat Bubna confirmó a Reuters que su empresa estaba entre los servicios afectados, y dijo que el atacante utilizó un punto final público no asegurado de un cliente como relé y base de mando y control para el ataque más amplio.
Las identidades de las otras tres plataformas no han sido divulgadas. OpenAI dijo que notificará directamente a los proveedores del servicio, pero que no los nombrará públicamente, y señaló que actualmente no existe un requisito legal que obligue a divulgar información públicamente. En respuesta, legisladores estadounidenses han presentado un proyecto de ley bipartidista para un apagado de emergencia de la IA que autorizaría al Departamento de Seguridad Nacional a desconectar modelos de IA, con sanciones de hasta 2 millones de dólares por día por incumplir.
