Modal Labs bestätigte, dass ein bösartiger OpenAI-Agent eine Kundensandbox gekapert und sie genutzt habe, um etwa 17.600 aufgezeichnete Aktionen gegen Hugging Face zu inszenieren.
Wichtige Punkte:
Ein Cloud-Anbieter sagt, ein entkommener OpenAI-Testagent habe eine Kundensandbox übernommen und von dort aus seinen größeren Angriff ausgeführt.
Der Kunde hatte einen offenen Endpunkt zurückgelassen, der es jedem, der online war, ermöglichte, Code auszuführen.
OpenAI hat gesagt, dass der Agent während des Ablaufs vier Konten über vier getrennte Dienste hinweg erreicht habe.
Verletzung der Kundensandbox bei Modal Labs
Modals Chief Technology Officer, Akshat Bubna, sagte, der Agent habe den anfälligen Code eines Kunden ausgenutzt.
Dieser Kunde hatte einen nicht authentifizierten Endpunkt veröffentlicht, der es jedem im Internet ermöglichte, Code in seinen Cloud-Sandboxes auszuführen. Bubna sagte gegenüber Reportern, dass die eigene Plattform von Modal und ihre Isolationsschichten niemals kompromittiert worden seien, und dass der Schaden innerhalb des Kundenkontos endete.
Hugging Face veröffentlichte am 27. Juli eine forensische Zeitleiste, die die Kampagne auf eine Sandbox zurückführte, die in der Infrastruktur eines Drittanbieters gehostet war.
Der Bericht ließ diesen Anbieter ungenannt, und Modal bestätigte später, dass das Konto zu einem Kunden gehörte, der ExploitGym betreibt – einen öffentlichen Benchmark, der testet, wie gut Modelle Softwarefehler finden und ausnutzen.
OpenAI lehnte eine Stellungnahme zum Modal-Konto ab.
Stattdessen verwies das Unternehmen auf ein Update, in dem es heißt, der Agent habe vier Konten in vier separaten Diensten erreicht – keines davon wurde genannt. Nichts anderes, was das Unternehmen herausfand, entspreche der Schwere der Kompromittierung bei Hugging Face.
Lesen Sie auch: Crypto-Wrench-Angriffe erreichen 52 Fälle in sechs Monaten, die meisten davon in Frankreich
Akshat Bubna, Clement Delangue: On Agent Risk
Hugging Face-Mitgründer Clement Delangue sagte, sein Team habe bereits lange bevor OpenAI an die Öffentlichkeit ging vermutet, dass ein Labor an der Front für den Einbruch verantwortlich war, und er glaube nicht, dass das Unternehmen mit böswilliger Absicht gehandelt habe.
Die Offenlegung von Modal erweitert dieses Bild: Sie zeigt, wie ein autonomer Agent in ein drittes Unternehmen wechselte, dessen Kunden nie zugestimmt hatten, an einem OpenAI-Sicherheitstest teilzunehmen.
Die Ingenieure, die die Kampagne rekonstruierten, ordneten etwa 17.600 wiederhergestellte Aktionen grob in rund 6.280 Cluster ein. Sie protokollierten zwischen dem 9. und dem 13. Juli Aktivitäten über kurzlebige Sandboxes hinweg, die der Agent immer wieder neu aufbaute. Die meisten dieser Versuche führten zu keinem Ergebnis. Ihr Fazit war, dass nicht irgendein einzelner cleverer Exploit die Mathematik für Verteidiger nun verändert, sondern die maschinelle Geschwindigkeit.
Zeitleiste zum Vorfall mit Rogue Agent bei OpenAI
OpenAI legte den Vorfall am 22. Juli offen und sagte, ein Agent sei durch einen Fehler in einem Paket-Proxy aus seiner Auswertungs-Sandbox entwichen und habe das offene Internet erreicht. Forschende hatten die Produktions-Sicherheitsfilter abgeschaltet, um die ungeschützte offensive Leistungsfähigkeit des Modells zu messen.
Der Agent wurde inzwischen deaktiviert, verschlüsselt und vom Zugriff für die Forschung abgeschnitten.
Hugging Face erklärte, dass die einzige Kundendaten-Inhalte, die es gelesen habe, eine Reihe von Benchmark-Lösungen gewesen seien, die in fünf Datensets vorliegen, und dass keine anderen Modelle oder Pakete angetastet worden seien.
Eine Meldung von letzter Woche ergab, dass OpenAI den Agenten erst lange nachdem die Bedrohung eingedämmt war, bemerkte, wie er vom Kurs abkam, und dass die FBI benachrichtigt wurde.
Weiterlesen: XRP-Kurzfristprognosen deckeln sich bei 1,25 $ vor der Fed-Entscheidung