رأيتُ شخصًا يدرس الإسناد الآلي للفشل في أنظمة الـ multi-agent، فكانت أول ردة فعل: أخيرًا، وجد أحدٌ من يفعل هذا.

الشهر الماضي ضبطتُ خط عمل (pipeline) لثالاثة وكلاء (three agent)، وبعدها تقلبتُ في السجلات حتى الساعة الثانية بعد منتصف الليل، وفي النهاية اتضح أن المشكلة كانت في أن الـ prompt الخاص بالوكيل الأول كان ينقصه حرف/كلمة تقييدية واحدة. كل شيء في السلسلة كان صحيحًا، لكن المخرجات كانت كلها خاطئة.

أكبر مشكلة في الـ multi-agent الآن ليست أن قدراتها غير كافية، بل أنَّه عندما يحدث خطأ، لا تعرف من تلوم. النموذج المفرد على الأقل تعرف أين تبحث، أما الـ multi-agent يشبه عمل مشروع مع ثلاثة متدربين؛ عندما تكون النتائج سيئة، لا يمكنك حتى أن توجّه الغضب مباشرةً لشخص بعينه 😂