⚡️KI-UPDATE: OpenAI ChatGPT 5 und DeepSeek V4 Flash verzeichnen bei Cybersecurity-Aufgaben HOHE Erfolgsraten.

Die Testergebnisse von CyberGym zeigen, dass KI sich rasch von bloßem Code-Schreiben hin zur eigenständigen Suche nach realen Sicherheitslücken und deren Reproduktion entwickelt.

Der Benchmark umfasst:
- 1.507 echte Schwachstellen
- 188 Softwareprojekte
- Komplexe Aufgaben zu Exploits und Patchen

Der ursprüngliche Top-Score lag bei etwa 20%. Neuere spezialisierte Agenten sollen unter aktualisierten Testbedingungen 90% übertreffen.

KI kann jetzt:
- Bekannte Schwachstellen reproduzieren
- Zero-Days entdecken
- Unvollständige Patches identifizieren

Interessanterweise kann dieselbe Technologie dazu beitragen, Cyberabwehr zu stärken oder Angriffe zu skalieren.