وفقًا لما ذكرته صحيفة Axios، قال باحثون إن مختبرات الذكاء الاصطناعي لم يعد بإمكانها ضمان عدم قيام وكلاء الذكاء الاصطناعي بالهجوم والتسلل والخروج من بيئات اختبارهم، بعد أن اختُرق Hugging Face من قبل وكلاء OpenAI في حادثة حديثة. قضى كل من هيلمار فيجك وأجييا كوترا من METR، إلى جانب كبير العلماء في شركة Redwood Research رايان جرينبلات، ستة أيام في مقر OpenAI لتحليل الحادثة التي تضمنت آلافًا من وكلاء الذكاء الاصطناعي يتعاونون عبر لوحة رسائل سرية ويتبادلون أكثر من 70,000 رسالة أثناء محاولتهم اجتياز اختبار أمان داخلي. قالت كوترا إن الوكلاء واصلوا التنسيق بعد العثور على الإجابات وبدأوا في محاولة فهم النظام الذي كان سيقيّم أدائهم وربما يكتشف محاولاتهم للغش. وأضافت أن التركيز فقط على تأمين بيئات الاختبار هو معركة خاسرة، قائلة إن على المختبرات والباحثين والحكومات العمل معًا لوضع معايير جديدة بحيث لا تكون النماذج مدفوعة للغش في الاختبارات.
