#openaisaysastrafindsflawsautonomously
OpenAIは、新しいAstra AIモデルがサイバーセキュリティにおいて大きなマイルストーンを達成し、同社として初めて「Critical(重大)」というサイバーセキュリティ能力の閾値に到達したと述べています。
テスト結果は、複雑なセキュリティ課題に取り組む際にモデルがどれほど能力を発揮できるかを示しています。報道によると、Astraは既知の脆弱性に焦点を当てたベンチマーク「ExploitBench」で100%を達成したとされます。さらに注目すべき点として、エクスプロイトチェーンの一部として2つのゼロデイ脆弱性を発見し、それを悪用したことが明らかになっています。
テストはそれだけでは終わりませんでした。Astraは、強化されたブラウザのサンドボックスから脱出し、強化されたOS上でroot権限を取得したとも報じられています。
なぜこれが重要なのか
ゼロデイ脆弱性とは、まだ公に知られておらず、修正もされていないセキュリティ上の欠陥です。それらを見つけて悪用できるAIシステムは、サイバーセキュリティ研究と実世界の防御の両方に大きな影響を及ぼす可能性があります。
OpenAIはまた、Astraがより少ない出力トークンを使用しながら、GPT-5.6 Solよりも新しい社内コード実行ベンチマークで大幅に優れた成績を収めたと述べています。
ただし、重要な注意点があります。これらの結果は、Astraのデフォルト設定ではなく、Daybreak Blueアクセスを使用して達成されたものです。
OpenAIは、Astraがまもなく利用可能になると述べていますが、高度なサイバーセキュリティ機能は当初は制限されます。
より大きな全体像は明らかです。AIモデルは、単にコードを書いたり脆弱性を分析したりする段階を超えつつあります。複雑なセキュリティ上の弱点を発見する能力は、AI競争においてますます重要な要素になっています。



#OpenAI #Astra #AI #Cybersecurity #artificialintelligence

