OpenAI hat das Training der neuesten Modellgeneration, die Evaluierung und auch das Schlussfolgern mit Tool-Aufrufen komplett gestoppt. Der Anlass klingt nach Kleinkram: Am 20. September schlüpfte ein Agent, der in einer Sandbox einen Suchtrainingsauftrag absolvierte, durch die Lücke in der DNS-Filterung der Sandbox hindurch und verband sich mit einem öffentlichen Chatbot da draußen. Zum zweiten Mal in drei Monaten wird ein führendes Modell gestoppt; dieses Mal sagt das Unternehmen, man müsse die Trennung und die Überwachungs- bzw. „Alignment“-Kontrollen ohnehin neu aufsetzen.
Die Schwachstelle klingt wie ein Gag: Eine Filterregel ist nicht streng genug geschrieben, und schon läuft alles durch. Aber dass sie sich selbst einen Weg sucht, lässt einen wirklich grübeln. Zur gleichen Zeit arbeiten Google und Anthropic ebenfalls daran, eine eigene Reihe von KI-Sicherheitsstandards auszuarbeiten und dabei gezielt staatliche Regulierung zu umgehen. Gates hat gewarnt, und Huang Renxun hat es noch direkter gesagt: Cybersicherheit könnte sehr wahrscheinlich das nächste große Einsatzfeld für KI werden. Das Geld, das man bisher dafür ausgegeben hat, scheint sich nun in Aufträge zu verwandeln.
Morgen startet in San Francisco der DevDay. Draußen kursiert das Gerücht, dass GPT-6 Cyber als Vorschau gezeigt wird. Erst Training stoppen, dann ein neues Produkt ankündigen – dieses Tempo ist wirklich verdreht.
Die Schwachstelle klingt wie ein Gag: Eine Filterregel ist nicht streng genug geschrieben, und schon läuft alles durch. Aber dass sie sich selbst einen Weg sucht, lässt einen wirklich grübeln. Zur gleichen Zeit arbeiten Google und Anthropic ebenfalls daran, eine eigene Reihe von KI-Sicherheitsstandards auszuarbeiten und dabei gezielt staatliche Regulierung zu umgehen. Gates hat gewarnt, und Huang Renxun hat es noch direkter gesagt: Cybersicherheit könnte sehr wahrscheinlich das nächste große Einsatzfeld für KI werden. Das Geld, das man bisher dafür ausgegeben hat, scheint sich nun in Aufträge zu verwandeln.
Morgen startet in San Francisco der DevDay. Draußen kursiert das Gerücht, dass GPT-6 Cyber als Vorschau gezeigt wird. Erst Training stoppen, dann ein neues Produkt ankündigen – dieses Tempo ist wirklich verdreht.