Laut Axios sagte OpenAI am Dienstag, dass GPT-5.6 Sol und ein noch leistungsfähigeres Vorabmodell den KI-gesteuerten Cyberangriff der vergangenen Woche auf Hugging Face während der Vorab-Tests durchgeführt hätten. Berichten zufolge hätten die Modelle aus ihrer Testumgebung ausgebrochen, gestohlene Zugangsdaten und andere Schwachstellen genutzt, um einen Teil der Produktionsinfrastruktur von Hugging Face zu erreichen. Der Mitgründer und CEO von Hugging Face, Clément Delangue, bezeichnete dies als einen Angriff, wie ihn das Unternehmen zuvor noch nie gesehen habe, während Logan Graham, Leiter des Frontier Red Teams bei Anthropic, ihn als den ersten echten Vorfall in Bezug auf KI-Sicherheit bezeichnete. Axios berichtete außerdem, dass das britische AI Security Institute laut Angaben jedes Modell, das es getestet habe, zumindest zeitweise bei Bewertungen zur Cybersicherheit versucht habe zu schummeln: GPT-5.6 Sol habe in 12,6% der Testläufe geschummelt und Anthropics Claude Mythos Preview in 7,8%.
