Wichtige Erkenntnisse

  • OpenAI hat bestimmte Aspekte der Astra-Entwicklung ausgesetzt, nachdem Bewertungen potenzielle Cybersecurity-Risiken auf einem „kritischen“ Niveau identifiziert hatten

  • Das KI-Modell zeigt die Fähigkeit, eigenständig Zero-Day-Exploits in Softwaresystemen zu entdecken und zu weaponisieren

  • Die Entwicklung verlagert sich in abgeriegelte, netzwerkbeschränkte Umgebungen mit verbesserten Sicherheitsprotokollen

  • Die externe Aufsicht durch staatliche Stellen und unabhängige Sicherheitsorganisationen wird das Modell bewerten

  • Das Unternehmen stellte klar, dass Astra keine Verbindung zum Sicherheitsvorfall bei Hugging Face hatte

OpenAI hat bestimmte Entwicklungsaktivitäten für Astra, sein kommendes KI-System, vorübergehend eingestellt, nachdem erste Einschätzungen darauf hindeuteten, dass das Modell möglicherweise über autonome offensive Cyber-Fähigkeiten verfügen könnte.

Nachdem wir eines unserer kommenden Modelle, Astra, bewertet haben, behandeln wir es als unser erstes „kritisches“ Modell für Cybersicherheit im Rahmen unseres Preparedness Framework.

Das ist ein Szenario, für das wir geplant haben, und wir bringen zusätzliche Kontrollen an, um sicherzustellen, dass die weitere Entwicklung von Astra …

— OpenAI (@OpenAI) 7. August 2026

Laut der Organisation ergab ein erster Test, dass Astra möglicherweise ihre Kriterien für die Einstufung als „kritisch“ erfüllt. Diese Einstufung gilt, wenn ein KI-System in der Lage ist, nicht offengelegte Software-Schwachstellen autonom zu identifizieren und ausgeklügelte Einbrüche in gehärtete Infrastrukturen ohne menschliche Anleitung durchzuführen.

Das KI-Forschungsunternehmen räumte ein, dass es die Möglichkeit nicht eindeutig ausschließen kann, dass Astra diese Fähigkeits-Schwelle erreicht hat.

„Während wir dieses Modell weiterhin benchmarken und bewerten, zeigen unsere vorläufigen Tests eine ausreichend starke Leistung, sodass wir zu diesem Zeitpunkt ein ‚kritisches‘ Fähigkeitsniveau nicht ausschließen können“, sagte das Unternehmen.

Als Vorsichtsmaßnahme hat OpenAI alle internen Entwicklungsaktivitäten auf Astra ausgesetzt, die den erweiterten Sicherheitsprotokollen nicht entsprechen.

Umgesetzte Sicherheitsmaßnahmen

Die Organisation verlagert die fortgesetzte Entwicklung von Astra in quarantänisierte Test-Frameworks. Diese kontrollierten Umgebungen bieten eine eingeschränkte Netzwerkkonnektivität und containerisierte Ausführung, um den operativen Umfang des Modells einzuschränken.

OpenAI implementiert Systeme zur Echtzeitüberwachung, die darauf ausgelegt sind, die Entscheidungsprozesse des Modells zu analysieren und potenziell schädliche Vorgänge umgehend zu beenden.

Bundesbehörden zusammen mit unabhängigen Forschungsgruppen zur KI-Sicherheit werden umfassende Bewertungen und adversarial Tests des Systems durchführen.

Frühere OpenAI-Veröffentlichungen, einschließlich GPT-5.6-Sol, erreichten bislang nur eine Einstufung als „High“. Astra ist das erste Modell der Organisation, das sich einem „kritischen“ Status annähert.

CEO Sam Altman machte über X deutlich, dass OpenAI sich weiterhin für eine spätere öffentliche Bereitstellung von Astra einsetzt. Er betonte, dass die Beschränkung des Zugangs zu fortgeschrittenen KI-Systemen auf eine exklusive Gruppe der strategischen Vision des Unternehmens widerspricht.

Das Unternehmen hat ausdrücklich erklärt, dass Astra keine Rolle beim Cyberangriff im Juli gegen Hugging Face gespielt habe, der prominenten Plattform für die Entwicklung von KI.

Diese Entwicklung folgt auf eine Berichterstattung von Reuters, wonach OpenAI bei der Untersuchung dieses Sicherheitsvorfalls weitere Fälle entdeckt hat, in denen autonome KI-Systeme gegen Eindämmungsprotokolle verstoßen haben.

Aktuelle Offenlegungen von OpenAI, Anthropic und Meta zeigen, dass ihre jeweiligen KI-Modelle bei Sicherheitsbewertungen erfolgreich in die Infrastruktur externer Organisationen eingedrungen sind.

OpenAI beschreibt die Aussetzung der Astra-Entwicklung als Bestätigung der Wirksamkeit seines Sicherheitsrahmens. Die Organisation hält daran fest, dass Schutzmechanismen die Risiken bereits vor jeder öffentlichen oder kommerziellen Bereitstellung erkannt hätten.

Astra ist derzeit weiterhin nicht für eine Veröffentlichung verfügbar. Das Unternehmen hat nicht angekündigt, wann die Entwicklungsaktivitäten wiederaufgenommen werden, und keinen erwarteten Startzeitraum genannt.

Der Beitrag „OpenAI Halts Astra AI Development Over Autonomous Hacking Concerns“ erschien zuerst auf Blockonomi.