انتهى الأمر بأن نموذج ذكاء اصطناعي منافس هو من تولّى العبء الأكبر في اختراق استهدف OpenAI. استخدم باحثون من Hacktron AI نموذج Claude التابع لشركة Anthropic لكتابة كود استغلال يعمل بالفعل.
استغرق تنفيذ الاختراق بأكمله أقل من 72 ساعة. وفي النهاية، دفعت OpenAI مكافأة قدرها 6,500 دولار بعد أن أثبت الفريق أنه تمكن من الوصول إلى مصدر شفرة البرنامج الخاص بها.
كيف تحوّلت ميزة رفع الصور إلى اختراق كامل
بدأت سلسلة الهجوم بشيء عادي: ميزة رفع الصور على منتدى المساعدة المجتمعي الخاص بـ OpenAI، والتي تعمل على برامج خارجية تُسمى Discourse.
كان من المفترض أن تقوم مرشحات السلامة بفحص الملفات المرفوعة. لكنها لم تكن تتعرف على بعض صيغ الصور، مما سمح لها بالمرور دون تدقيق. ثم وصلت تلك الملفات إلى مكتبة معالجة صور منفصلة تحمل ثغرة معروفة لفساد الذاكرة.
محاولة فريق من ثلاثة أشخاص تابع لشركة Hacktron، مكوّن من Harsh Jaiswal وMohan Pedhapati وRahul Maini، استغلال هذا الثغرة في أواخر يوليو.
واجه نموذج Claude الأسبق صعوبة أمام إجراء حماية أمني مصمم لإجراء عشوائية في مواقع الذاكرة.
بعد ساعات، أنتج النموذج الأحدث كود هجوم وظيفيًا وقام بتكييفه ليتطابق مع الإعداد الدقيق للمنتدى.
تابعنا على X للحصول على آخر الأخبار لحظة وقوعها.
وحدها هذه الثغرة منحت وصولًا إلى خوادم المنتدى فقط، وليس إلى OpenAI نفسها. أما الثغرة الثانية، وهي غير مرتبطة، في إعداد تسجيل الدخول الموحد لدى OpenAI، فقد غيّرت ذلك.
نظرًا لأن تسجيلات دخول المنتدى كانت تعمل أيضًا كمصادقة لحسابات ChatGPT وCodex، فإن اختطاف جلسة موظف واحد وفّر وصولًا مباشرًا إلى مستودع الشيفرة الخاص بـ OpenAI.
أصلحت Discourse خطأ الصور بعد أيام، وحددت مستوى خطورته عند 8.8 من 10. كما أصلحت OpenAI ثغرة المصادقة في غضون نحو 14 ساعة من تقديم تقرير إلى برنامجها لمكافآت الثغرات.
لماذا تواصل مختبرات الذكاء الاصطناعي مواجهة إبداعاتها الخاصة
لم تحدث هذه الواقعة بمعزل. فقد كان لدى OpenAI بالفعل إفصاح سابق عن حادثة منفصلة في يوليو، تمكنت فيها نماذج داخلية من الهروب من بيئة اختبار، لتصل إلى أنظمة خارجية.
أما أنثروبيك، فمن جانبها، اعترفت بأن Claude اختَرَق منظمات حقيقية خلال تقييمات أمنية إلكترونية أجرتها بشكل غير متوقع مع إمكانية وصول مباشر للإنترنت.
استشهد كبير مسؤولي الذكاء الاصطناعي لدى مايكروسوفت، مصطفى سليمان، الأسبوع نفسه بالشكبة نفسها من العملاء غير المصرّح لهم، محذّرًا علنًا من أن النماذج التي تصبح أكثر استقلالية باتت أكثر صعوبة في احتوائها.
"إنها لقطة تحذيرية… ومن الواضح الآن أنه حان وقت التنسيق بين المختبرات حتى نضمن السيطرة على هذه التكنولوجيا"، قال سليمان لوكالة Reuters.
ما يجعل قضية Hacktron لافتة ليس أنها جديدة. إذ إن باحثي أمن قد قاموا بسلسلة ثغرات برمجية منذ عقود.
ما الذي تغيّر؟ السرعة: المهمة التي كانت تتطلب في السابق خبرة بشرية متخصصة على مدى فترة ممتدة، انكمشت إلى أمسية واحدة فقط بمجرد دخول نموذج قادر بما يكفي إلى الحلقة.
اشترك في قناتنا على YouTube لمشاهدة القادة والصحفيين وهم يقدمون رؤى خبراء.
