Le secteur de l’intelligence artificielle en Chine connaît une forte croissance, notamment auprès des entreprises locales qui cherchent à remplacer Nvidia. Dans ce contexte, DeepSeek, l’un des acteurs majeurs du domaine, a officiellement passé commande de 160 000 accélérateurs Ascend 950DT produits par Huawei. Cette commande massive marque la concrétisation d’une stratégie annoncée par le constructeur chinois à la fin de l’année précédente, visant à fournir une gamme complète de puces et de solutions à l’échelle du rack pour répondre à la demande nationale. La réalisation de tels volumes confirme l’engagement des laboratoires de recherche chinois envers les technologies développées localement pour maintenir leur compétitivité dans le domaine de l’IA générative.
Spécifications techniques et architecture mémoire
L’unité centrale de calcul mise en œuvre, l’Ascend 950DT, se distingue par une capacité mémoire intégrée de 144 Go. Cette mémoire haute bande passante (HBM) est conçue en interne par Huawei, permettant d’atteindre un taux de transfert proche de 4 To/s. En termes de puissance de calcul brute, la puce offre un pic de performance d’environ un PetaFLOP en précision FP8, ou deux PetaFLOPS en précision FP4. Ces caractéristiques techniques correspondent à la vision stratégique du fabricant visant à soutenir les charges de travail les plus exigeantes. L’architecture interne de la mémoire assure que les données nécessaires aux calculs complexes restent accessibles avec une latence minimale, un facteur critique pour les modèles d’inférence à grande échelle.
Capacité du centre de données et interconnexion
Le laboratoire DeepSeek prévoit d’utiliser cette flotte de 160 000 puces pour des opérations d’inférence à grande échelle. L’ensemble du système sera déployé dans un seul centre de données situé en Mongolie-Intérieure. Grâce à cette configuration, l’infrastructure globale devrait délivrer un pic de performance de 160 ExaFLOPS en FP8, soit environ 320 ExaFLOPS en FP4. La mémoire totale disponible pour ce projet s’élève à approximativement 23 pétaoctets (Po), une capacité suffisante pour servir des milliers de clients simultanément sans rencontrer de goulots d’étranglement.
La connectivité entre ces milliers de cartes repose sur un nouveau protocole d’interconnexion nommé Lingqu, couplé à des liens optiques. Cette architecture permet de relier des centaines de milliers de cartes Ascend 950. Bien que Huawei puisse théoriquement empiler jusqu’à 8 192 puces par SuperPoD Atlas 950, avec une capacité d’expansion jusqu’à 524 288 accélérateurs pour 64 SuperPoD, la commande actuelle de DeepSeek ne sollicitera qu’une fraction de cette limite maximale. Cette modularité permet une flexibilité d’expansion future sans nécessiter de refonte complète de l’infrastructure de base.
La mise en place de telles infrastructures souligne la dépendance croissante des laboratoires de recherche chinois envers les technologies développées localement. La commande de 160 000 unités démontre une confiance opérationnelle dans la maturité des solutions Ascend pour prendre en charge des charges de travail industrielles. Le déploiement sur un site unique en Mongolie-Intérieure optimise également la gestion thermique et énergétique, des paramètres essentiels pour une installation de cette envergure. Les rapports d’analystes confirment la matérialisation de ces commandes, validant ainsi la transition vers une souveraineté technologique accrue dans le secteur de l’IA.

