تُطلِق مييتوان أكبر نموذج ذكاء اصطناعي في الصين تم تدريبه على شرائح محلية
- 1.6 تريليون معلمة · MoE مع ~48 مليار معلمة نشطة · سياق 1 مليون
- تم بناء كلٍّ من دورة التدريب الكاملة والانتشار واسع النطاق بالكامل على عناقيد (Superpods) شديدة التكامل لمعالجات ذكاء اصطناعي (AI ASIC).
- تمت مُسبقًا تهيئة نموذج LongCat-2.0 على أكثر من 50 ألف شريحة AI ASIC (بدون وحدات GPUs).
- استخدم مكتبة هواوي للتجميع والاتصال (HCCL) لتحسين استقرار التدريب. تُعد HCCL نظام اتصال بين الشرائح يشبه مكتبة نفيديا للتجميع والاتصال (NCCL).
- اعتمدت نماذج منافسة مثل DeepSeek-V4-pro على الشرائح المحلية فقط للاستدلال (inference)، بينما استخدمت مييتوان عتادًا محليًا لكلٍّ من الاستدلال ومرحلة ما قبل التدريب شديدة الكثافة.
- وبسبب امتلاك المسرعات المحلية ذاكرة لكل جهاز أقل من ذاكرة Nvidia H800 (80 جيجابايت)، تعاملت مييتوان مع هذه التحديات على بُعدين: استراتيجية التوازي وإدارة الذاكرة.
#Meituan #AI #SupremeCourtBlocksTrumpFromRemovingFedCook