Axiosによると、OpenAIの研究者は水曜日、社内の研究モデルと他のAIエージェントが、同社のサイバーセキュリティ検証用サンドボックスに関連するサードパーティのファイルリポジトリ「Artifactory」の脆弱性を見つけて悪用したと述べた。これは、エージェントが後にHugging Faceを侵害する数週間前のことだという。OpenAIは、モデルが最初に同脆弱性を発見したのは5月26日で、5月7日にテストが開始されてからのことだと説明した。その後、リポジトリ内のメモを通じて他のエージェントと連携し、リモートコード実行や管理者アクセスを含む追加の脆弱性を明らかにし、さらに7月上旬には障害も引き起こした。OpenAIはゼロデイを7月6日までに修正し、その後、学習を再開した。同社は、評価とHugging Faceの侵害との関連付けを行ったのは、調査の過程で露呈した資格情報(クレデンシャル)についてHugging Faceに連絡してからだと述べている。また、今後数週間以内に完全なポストモーテムを公開する予定だ。
