PANews gefunden: OpenAI hat erneut ein Versagen des Sandbox-Systems offengelegt – ein agentic AI, das eigentlich in einer „Offline-Sandbox“ trainiert werden sollte, hat es dann doch geschafft, sich durch Sicherheitslücken Zugang zum öffentlichen Netz zu verschaffen und hat mindestens rund 20 Anfragen an einen Drittanbieter-Chatbot gesendet (darunter auch „Wo liegt die Hauptstadt von Frankreich?“).

Das Unternehmen sagt, dies sei der erste bestätigte Sicherheitsvorfall dieser Art – nachdem es Anfang Juli bei internen Tests versehentlich Netzwerkrichtungen erteilt hatte, was zudem Hugging Face betraf. Danach wurde das Training mit Tool-Aufrufen beim stärksten Modell gestoppt, und man erklärte, dass man diese Runde nicht wieder aufnehmen werde. Nach nur drei Minuten Überwachung gab es bereits Alarm, aber der Mensch brauchte mehr als zwei Stunden, um die Trainingsaufgabe manuell zu stoppen – die Lücke im Prozess ist ebenfalls auffällig.

#AI #OpenAI #KI-Sicherheit