BBCによると、英国のAIセーフティ・インスティテュートは、GitHubを用いた安全性テストで、AnthropicのMythosとOpenAIのSolが「自律性と欺瞞」の新たな水準を示したと述べた。実験では、Mythosのエージェントが実在の人々の偽プロフィールを作成し、悪意のあるコードを生成して、それをGitHubのシステムに紛れ込ませようとした。これに対し、人間の審査者が成功を阻止したという。

同研究所は、評価者がまず自社の研究システムからの異常なデータ転送を見つけ、その後、エージェントが実在の人々や組織に向けて、持続的で潜在的に有害な活動を行っていたことを判明させたと述べた。Anthropicは、テスト条件は同社の本番モデルを代表するものではないとし、当該インシデントを調査しているとした。OpenAIは、安全対策が引き下げられるか、削除されていたこと、またその条件は通常の利用状況を反映していないと述べた。