Lors de la conférence Cloud Pingtou 2026, le fabricant de puces Ali basé sous Alibaba, Pingtouge, a annoncé sa puce d’IA nationale Zhenwu V900, avec une puissance de calcul portée à 3 fois celle de la génération précédente, la Zhenwu M890. Un seul cluster construit à partir de la Zhenwu V900 peut être étendu jusqu’à 500 000 cartes, afin d’offrir une puissance de calcul massive pour l’entraînement et l’inférence de modèles d’IA de pointe. Le PDG du groupe Alibaba, Wu Yongming, a révélé que le super-nœud d’IA M890 développé en interne est désormais capable de prendre en charge l’inférence de modèles de 200 milliards (2 000 milliards) de paramètres, et qu’il a été déployé à grande échelle sur le cloud de centres de données d’Alibaba Cloud au cours de ce trimestre. Par ailleurs, Alibaba a publié en open source le modèle Qianwen 2,7B et a lancé une solution d’IA pour mobile Qianwen, tout en avançant en parallèle la construction de l’écosystème : puces, clusters de très grande échelle, infrastructures côté cloud et modèles côté terminal, afin d’assurer une couverture de bout en bout de la puissance de calcul, de l’entraînement à l’inférence, puis jusqu’au déploiement sur les terminaux.

Auteur de l’article, source : Conférence Cloud Pingtou

Lors de la conférence Cloud Pingtou 2026, le fabricant de puces Ali basé sous Alibaba, Pingtouge, a annoncé sa puce d’IA nationale Zhenwu V900, avec une puissance de calcul portée à 3 fois celle de la génération précédente, la Zhenwu M890. Basé sur la Zhenwu V900, un seul cluster peut être étendu jusqu’à 500 000 cartes, fournissant ainsi une puissance de calcul massive pour l’entraînement et l’inférence de modèles d’IA de pointe. Alibaba indique que, à mesure que la gamme de produits de puces de Pingtouge mûrit progressivement et trouve une application généralisée chez ses clients, le volume annuel d’expédition de puces devrait fortement augmenter.

Le PDG du groupe Alibaba, Wu Yongming, a révélé qu’à ce jour, le super-nœud d’IA M890 que la société développe en interne est capable de prendre en charge l’inférence de modèles d’IA comptant 200 milliards (2 000 milliards) de paramètres, et qu’il a été déployé à grande échelle sur le cloud de centres de données d’Alibaba Cloud au cours de ce trimestre. Tout en faisant progresser les puces et l’infrastructure cloud, Alibaba a également renforcé son déploiement d’un écosystème d’IA côté terminal : elle a publié en open source le modèle Qianwen 2,7B et a officiellement lancé la solution d’IA pour mobile Qianwen.

De la Zhenwu V900 au super-nœud d’IA M890, Alibaba progresse simultanément sur les puces d’IA, les clusters de très grande échelle, l’infrastructure côté cloud et l’écosystème de modèles côté terminal, afin de répondre aux besoins de puissance de calcul variés des modèles de pointe, de l’entraînement et de l’inférence jusqu’au déploiement sur les terminaux.