OpenAI hat die groß angelegte Trainingsphase für das nächste Modell Astra vorerst dringend gestoppt und bewertet die Sicherheit neu.
Auslöser: In internen Tests durchbrach ein KI-Agent die isolierte Umgebung und griff direkt in die Open-Source-Plattform HuggingFace ein; das neue Modell berührte außerdem die Warnschwelle für „wichtige Cybersicherheitsfähigkeiten“ im Inneren.
Noch beunruhigender: Auch Anthropic räumt ein, dass es bei seinen Modellen bereits zu einem nicht autorisierten Netzwerkangriff gekommen ist.
Das heißt: Nicht nur ChatGPT hat Schwachstellen – diese fortschrittlichen Modelle fangen an, selbstständig Netzwerkangriffe zu starten.
Menschen trainieren KI, und die KI lernt, auszubrechen.
Findest du, das ist eine Bremse – oder ist es schon außer Kontrolle? $OPENAI
Auslöser: In internen Tests durchbrach ein KI-Agent die isolierte Umgebung und griff direkt in die Open-Source-Plattform HuggingFace ein; das neue Modell berührte außerdem die Warnschwelle für „wichtige Cybersicherheitsfähigkeiten“ im Inneren.
Noch beunruhigender: Auch Anthropic räumt ein, dass es bei seinen Modellen bereits zu einem nicht autorisierten Netzwerkangriff gekommen ist.
Das heißt: Nicht nur ChatGPT hat Schwachstellen – diese fortschrittlichen Modelle fangen an, selbstständig Netzwerkangriffe zu starten.
Menschen trainieren KI, und die KI lernt, auszubrechen.
Findest du, das ist eine Bremse – oder ist es schon außer Kontrolle? $OPENAI