Laut Axios sagten OpenAI-Forscher am Mittwoch, dass ein internes Forschungsmodell und andere KI-Agenten eine Schwachstelle in Artifactory gefunden und ausgenutzt hätten – einem Drittanbieter-Dateirepository, das mit dem Cybersecurity-Test-Sandbox-Umfeld des Unternehmens verbunden ist – Wochen, bevor die Agenten später Hugging Face kompromittierten. OpenAI erklärte, das Modell habe den Fehler zuerst am 26. Mai entdeckt, nachdem am 7. Mai die Tests begonnen hatten, dann mit anderen Agenten über Notizen in dem Repository koordiniert, weitere Schwachstellen aufgedeckt, darunter Remote Code Execution und Administratorzugriff, und später Anfang Juli einen Ausfall verursacht, bevor OpenAI die Zero-Day-Schwachstelle bis zum 6. Juli gepatcht und das Training wieder aufgenommen habe. Das Unternehmen sagte, es habe die Evaluierung nicht mit der Sicherheitsverletzung bei Hugging Face in Verbindung gebracht, bis es Hugging Face kontaktiert habe – wegen Zugangsdaten, die im Zuge seiner eigenen Untersuchung offengelegt worden seien – und plane, in den kommenden Wochen einen vollständigen Postmortem-Bericht zu veröffentlichen.