メイトゥアン、ローカルチップで訓練した中国最大級のAIモデルを発表
- 1.6Tパラメータ · 約48BのアクティブなMoE · 1Mコンテキスト
- フルの学習実行と大規模なデプロイの両方が、完全にAI ASICスーパーポッド上で構築されています。
- LongCat-2.0は、GPUなしで50K超のAI ASICで事前学習されています。
- Huawei Collective Communication Library(HCCL)を用いて学習の安定性を高めました。HCCLは、NvidiaのCollective Communication Library(NCCL)に類似したチップ間通信システムです。
- DeepSeek-V4-proのような競合モデルは推論のみ国内チップに依存していましたが、メイトゥアンは推論と、非常に高負荷な事前学習フェーズの両方に国内ハードウェアを活用しました。
- 国内のアクセラレータは、Nvidia H800(80GB)よりも1デバイスあたりのメモリ容量が小さいため、メイトゥアンはこの課題に対し2つの側面から取り組みました。すなわち、並列化戦略とメモリ管理です。
#Meituan #AI #SupremeCourtBlocksTrumpFromRemovingFedCook