Alibaba : son puce IA Zhenwu V900 surpasse le H200 de NVIDIA en mémoire, annonce 20 GW de puissance et des modèles Qwen jusqu’à 10 000 milliards de paramètres

Lors de la conférence Apsara en Chine, Alibaba a dévoilé ses ambitions en matière de calcul haute performance, révélant les caractéristiques de sa puce Zhenwu V900 et les paramètres colossaux de ses futurs modèles d’IA. Le géant chinois entend rivaliser directement avec NVIDIA sur le terrain des accélérateurs dédiés à l’intelligence artificielle.

Les détails techniques de la puce Zhenwu V900

Alibaba annonce que sa future puce Zhenwu V900 intégrera 216 Go de mémoire embarquée, une capacité bien supérieure aux 141 Go du GPU NVIDIA H200. Son lancement officiel est prévu pour le premier trimestre 2027. Le GPU devrait utiliser la solution HBM3E de CXMT et offrir des interconnexions entre puces d’environ 1,2 To/s via le réseau ICN Switch maison. Sa puissance de calcul serait environ trois fois supérieure à celle de l’actuel Zhenwu M890, avec une prise en charge native des formats FP8 et FP4. Chaque accélérateur pourrait ainsi atteindre une puissance crête de 1,8 PFLOPS en FP16.

Grâce à l’ICN Switch, un millier de puces Zhenwu V900 pourront fonctionner comme un seul et même accélérateur. Alibaba affirme même qu’un cluster pourra monter jusqu’à 500 000 unités, totalisant une quantité astronomique de 108 pétaoctets de mémoire. Parallèlement, le groupe propose désormais une solution rack complète intégrant ses propres CPU Yitian, GPU Zhenwu V900, interconnexions ICN, cartes réseau Pangu et contrôleurs de stockage Zhenyue.

Des infrastructures et des modèles d’IA à grande échelle

De son côté, Alibaba prévoit de déployer une capacité de calcul de 20 GW d’ici 2032. Selon une estimation de Morgan Stanley datant de septembre 2025, la capacité du géant du cloud devrait atteindre environ 5 GW fin 2026. Pour atteindre son objectif, la société devra donc ajouter entre 2 et 3 GW de capacité supplémentaire chaque année jusqu’en 2032.

À lire :  Hellraiser: Revival : la Configuration Génésis éclipse son inspirat

Par ailleurs, Alibaba a indiqué que ses prochains modèles Qwen 4.5 et Qwen 5.0 comporteront entre 4 et 10 billions de paramètres. L’entreprise travaille simultanément sur l’amélioration récursive de soi (RSI), une technique où un système d’IA participe au développement et à l’entraînement de sa propre version suivante, permettant des gains d’échelle considérables.

Sur un thème connexe, Alibaba a publié les poids du modèle Qwen-Image-2.1, un système de génération et d’édition d’images à partir de texte. Sa pile de génération visuelle utilise environ 7 milliards de paramètres répartis sur 32 couches DiT. Sur Arena, ce modèle occupe désormais la première place du classement des modèles open-source dédiés à l’édition d’images.

Guide Optimisation Pc Windows 11 Jeux Performance Bot Guide Optimisations Pc Windows 10 Jeux Performances Sur Omgpu.com Bot

Guide Comment Reduire Input Lag Latence Omgpu Bot Comment supprimer Coil Whine carte graphique

Vous pourriez aussi aimer