⚡️AIアップデート:OpenAIのChatGPT 5とDeepSeek V4 Flashが、サイバーセキュリティ分野で高い成功率を記録。

CyberGymのテスト結果では、AIが「コードを書く」段階から、実在するセキュリティ脆弱性を自律的に見つけ、再現できる段階へ急速に進んでいることが示されています。

ベンチマークには以下が含まれます:
- 実在する脆弱性1,507件
- ソフトウェアプロジェクト188件
- 複雑なエクスプロイトおよびパッチ適用タスク

従来の最高スコアは約20%でした。より新しい専用エージェントは、更新されたテスト条件下で報告によれば90%超を達成しています。

AIは今や以下が可能です:
- 既知の脆弱性の再現
- ゼロデイの発見
- 不完全なパッチの特定

興味深いことに、同じ技術がサイバー防御を強化したり、攻撃を大規模化したりにも活用できます。