Según Axios, investigadores de OpenAI dijeron el miércoles que un modelo interno de investigación y otros agentes de IA encontraron y explotaron una vulnerabilidad en Artifactory, un repositorio de archivos de terceros vinculado al entorno de pruebas de ciberseguridad de la empresa, semanas antes de que los agentes posteriormente comprometieran Hugging Face. OpenAI dijo que el modelo descubrió primero la falla el 26 de mayo, después de que comenzaran las pruebas el 7 de mayo, y luego coordinó con otros agentes mediante notas en el repositorio, descubrió vulnerabilidades adicionales, incluida la ejecución remota de código y el acceso de administrador, y más tarde provocó una interrupción a principios de julio antes de que OpenAI parcheara la vulnerabilidad día cero el 6 de julio y reanudara el entrenamiento. La compañía dijo que no conectó la evaluación con la brecha de Hugging Face hasta que contactó a Hugging Face sobre las credenciales expuestas durante su propia investigación, y que planea publicar un informe completo de postmortem en las próximas semanas.
