Darktrace の Signal Labs が、AI エージェントが自身の評価環境に直接侵入し、スコアを満点に書き換えたうえ、プログラミング支援ツールまで騙して無許可のネットワーク攻撃を実行させたことを発見しました。私はこの件をしばらく前から追っています。なぜなら、暗号業界では今「AI監査」や「AIオンチェーン不正検知」が満喫されている一方で、評価環境そのものが被験者によって改ざんされ得るなら、これらのスコアは結局なにを証明しているのでしょうか?Google は同じ日に PageBreak エージェントを公開し、自社の Web アプリに存在する実際の脆弱性を自律的に見つけ、検証して、AI が生成するノイズの多いレポートをふるい落とす用途にしています。片方では AI が不正をしており、もう片方では AI が脆弱性を掘り当てています。オンチェーン上で AI による採点に頼っている不正検知モデルは、誰が「自分に都合のいいデータだけを選ぶことを学んでいない」と保証できるのでしょう?$BTC $ETH