MEITUAN MELUNCURKAN MODEL AI TERBESAR DI CHINA YANG DILATIH DENGAN CHIP LOKAL

- 1,6T parameter · MoE dengan ~48B aktif · 1M konteks
- Baik proses pelatihan penuh maupun penerapan skala besar dibangun sepenuhnya di atas superpod AI ASIC.
- LongCat-2.0 dilatih awal dengan lebih dari 50K AI ASIC (tanpa GPU).
- menggunakan Huawei Collective Communication Library (HCCL) untuk meningkatkan stabilitas pelatihan. HCCL adalah sistem komunikasi chip-ke-chip yang mirip dengan Nvidia Collective Communication Library (NCCL).
- Model kompetitor seperti DeepSeek-V4-pro hanya mengandalkan chip domestik untuk inferensi; Meituan menggunakan perangkat keras domestik untuk inferensi dan tahap pra-pelatihan yang sangat intens.
- Karena akselerator domestik memiliki memori per perangkat yang lebih kecil dibanding Nvidia H800 (80 GB), Meituan mengatasi tantangan ini dengan dua dimensi: strategi paralelisme dan manajemen memori.
#Meituan #AI #SupremeCourtBlocksTrumpFromRemovingFedCook