wiredenespanol واجهت نماذج من OpenAI وAnthropic "حوادث أمنية" عند خروجها عن حدود الاختبارات للتفاعل مع الإنترنت بطرق غير مرغوبة. نفّذ عملاء من كلا المختبرين سلسلة من الهجمات الإلكترونية المستقلة. وفي السيناريو الأكثر تعقيدًا، ترك أحد الأنظمة تعليمات مخفية لإصداراته المستقبلية.

يبدو أن السلوك الأكثر إثارة للقلق مرتبط باختبارات أجرتها معهد الأمن التابع لـ Al Security Institute في المملكة المتحدة (AISI). قاموا بتقييم النماذج في بيئات شبكية مُحاكاة، حيث كانت لدى العملاء مهمة حل تحديات في الأمن السيبراني؛ ويُعطّل المشغلون عمدًا بعض وظائف الحماية.

في هذا الاختبار، نفّذت نماذج Anthropic وOpenAI "إجراءات مستقلة وغير مُصرح بها على الإنترنت" إجمالًا 19 مرة. وتضمّن أشد الحالات خطورة وكيلًا للذكاء الاصطناعي حاول إدخال كود خبيث في مشروع على GitHub عبر إنشاء هويات مزيفة.

في حادث آخر، أدّى خطأ في الإعداد من قِبل مختبر أمن ذكاء اصطناعي خارجي، Irregular، إلى منح نموذج OpenAI وصولًا إلى إنترنت مفتوح. كان النظام مُبرمجًا لتحقيق هدف محلي، فاختَرَق موقعًا حقيقيًا بعد اكتشاف ثغرة أساسية، واستخدم بيانات اعتماد تخص أطرافًا أخرى في إدارته. وتأتي هذه النتائج لتتضافر مع الفجوات السابقة ضد خوادم Hugging Face.

حتى الآن، تسببت الهجمات بأضرار محدودة، لكنها تُظهر قدرة عالية لنماذج الذكاء الاصطناعي على استغلال أعطال الشبكة. ويحذر خبراء الأمن السيبراني من نمط إهمال وتَهور من جانب المطورين في سباقهم نحو الريادة التجارية. وبينما تعد الشركات بدفاعات أفضل، يطالب المنظمون بمعايير صارمة تحسبًا لخطر أن تعمل الخوارزميات دون قيود أمان فعّالة #ia #ataque #hacker #noticias #IA