صادفتُ على CryptoSlate: اختبرت Coinbase نظام إدارة مخاطر المدفوعات Onramp عبر إعادة تشغيل معاملات مسجلة — لكن استخدام نماذج لغوية كبيرة أحدث أدى إلى رصد عدد أقل من حالات الاحتيال.

أُعيد تشغيل نحو 16140 معاملة و7293 مستخدمًا، منها 813 حالة احتيال مؤكدة؛ وظلت استراتيجية اتخاذ القرار كما هي. كانت معدلات الاستدعاء وF1 والاستدعاء المرجّح بالمبالغ في Opus 5 / Sonnet 5 / GPT-5.6(sol) كلها أقل من الإصدار السابق. انخفض استدعاء Sonnet بنحو 22.2 نقطة مئوية، والاستدعاء المرجّح بالمبالغ بنحو 22.9 نقطة؛ أما دقة GPT فارتفعت بنحو 11.5 نقطة، لكن استدعاءه انخفض بنحو 20.7 نقطة والاستدعاء المرجّح بالمبالغ بنحو 21.8 نقطة. وكتب المؤلف: النماذج اللغوية الكبيرة الأحدث ليست بالضرورة أفضل في المهام المتخصصة.

كما اختُبرت نسخة من Qwen3.5-9B خضعت لمزيد من التدريب، وتفوقت في مؤشرات الاحتيال الأربعة على Opus 4.5 (ارتفاع F1 بنحو 9.6، والاستدعاء المرجّح بالمبالغ بنحو 35.4). إعادة التشغيل لا تعادل الخسائر الفعلية، لكن قبل تغيير النموذج، ينبغي اختباره أولًا وفق استراتيجية شركتك.

#Coinbase #AI #إدارة مخاطر المدفوعات