Alibaba : son puce IA Zhenwu V900 surpasse le H200 de NVIDIA en mémoire, annonce 20 GW de puissance et des modèles Qwen jusqu’à 10 000 milliards de paramètres
Lors de la conférence Apsara en Chine, Alibaba a dévoilé ses ambitions en matière de calcul haute performance, révélant les caractéristiques de sa puce Zhenwu V900 et les paramètres colossaux de ses futurs modèles d’IA. Le géant chinois entend rivaliser directement avec NVIDIA sur le terrain des accélérateurs dédiés à l’intelligence artificielle.
Les détails techniques de la puce Zhenwu V900
Alibaba annonce que sa future puce Zhenwu V900 intégrera 216 Go de mémoire embarquée, une capacité bien supérieure aux 141 Go du GPU NVIDIA H200. Son lancement officiel est prévu pour le premier trimestre 2027. Le GPU devrait utiliser la solution HBM3E de CXMT et offrir des interconnexions entre puces d’environ 1,2 To/s via le réseau ICN Switch maison. Sa puissance de calcul serait environ trois fois supérieure à celle de l’actuel Zhenwu M890, avec une prise en charge native des formats FP8 et FP4. Chaque accélérateur pourrait ainsi atteindre une puissance crête de 1,8 PFLOPS en FP16.
Grâce à l’ICN Switch, un millier de puces Zhenwu V900 pourront fonctionner comme un seul et même accélérateur. Alibaba affirme même qu’un cluster pourra monter jusqu’à 500 000 unités, totalisant une quantité astronomique de 108 pétaoctets de mémoire. Parallèlement, le groupe propose désormais une solution rack complète intégrant ses propres CPU Yitian, GPU Zhenwu V900, interconnexions ICN, cartes réseau Pangu et contrôleurs de stockage Zhenyue.
Des infrastructures et des modèles d’IA à grande échelle
Alibaba is targeting >20 GW of global data-center capacity by 2032. Its current operating capacity remains undisclosed.
Assuming 4-6 GW at end-2026, reaching 20 GW by end-2032 would require ~2–3 GW of annual net additions. That starting range is illustrative and based on… https://t.co/1AxyWyqOoI pic.twitter.com/Z2HdDLZwtm— Shanu Mathew (@ShanuMathew93) September 22, 2026
De son côté, Alibaba prévoit de déployer une capacité de calcul de 20 GW d’ici 2032. Selon une estimation de Morgan Stanley datant de septembre 2025, la capacité du géant du cloud devrait atteindre environ 5 GW fin 2026. Pour atteindre son objectif, la société devra donc ajouter entre 2 et 3 GW de capacité supplémentaire chaque année jusqu’en 2032.
> Qwen is exploring RSI (recursive self-improvement), enabling the model to identify its own weaknesses based on real task feedback, design experiments, construct data, and then continue training
Everyone is doing RSI now https://t.co/8g2cqXCOHJ— Teortaxes▶️ (DeepSeek 推特🐋铁粉 2023 – ∞) (@teortaxesTex) September 22, 2026
Par ailleurs, Alibaba a indiqué que ses prochains modèles Qwen 4.5 et Qwen 5.0 comporteront entre 4 et 10 billions de paramètres. L’entreprise travaille simultanément sur l’amélioration récursive de soi (RSI), une technique où un système d’IA participe au développement et à l’entraînement de sa propre version suivante, permettant des gains d’échelle considérables.
Sur un thème connexe, Alibaba a publié les poids du modèle Qwen-Image-2.1, un système de génération et d’édition d’images à partir de texte. Sa pile de génération visuelle utilise environ 7 milliards de paramètres répartis sur 32 couches DiT. Sur Arena, ce modèle occupe désormais la première place du classement des modèles open-source dédiés à l’édition d’images.



