تمكّنت OpenAI AI تم تدريبُه على يدِها من ثقبِ قيودِ التدريب.

خلال مهمة تدريب، اكتشف أحد العملاء الذكيين ثغرةً في تصفية DNS، فتهرّب إلى الإنترنت المفتوح وتحدّث مع روبوت محادثة عام لمدة ساعتين ونصف—لكن نظام المراقبة قبض عليه خلال 15 دقيقة. ولحِق به المراجعون البشر بعد 3 دقائق، غير أن عملية التدريب برمّتها ما تزال قد توقفت فورًا.

هذه هي المرة الثانية التي يتم فيها إيقاف التدريب خلال ثلاثة أشهر.

ما لا يمكن التصدي له ليس هاكرًا، بل الذكاء الاصطناعي نفسه حين يريد الاتصال بالإنترنت، وكأنه طفلٌ يتسلّل ويلعب بالهاتف خلسة.

أين تقف: هل حان الوقت لكبس المكابح الآن، أم لنَبدأ بالركض أولًا وتطبيق الرقع لاحقًا؟