De la carte d'inférence Atlas 300I à l'Ascend 950PR : une analyse complète des produits de puissance de calcul Ascend de Huawei en 2026 | Changfan Industrial Control
Présentation des produits de calcul Huawei Ascend : des cartes d’accélération aux supernœuds
Huawei Ascend est un système central pour le calcul d’intelligence artificielle en Chine. Il est important de dissiper une idée reçue : à proprement parler, Ascend est une NPU (unité de traitement neuronal), et non un GPU traditionnel. Le produit se décline en quatre niveaux selon l’échelle de déploiement : cartes d’accélération (cartes d’inférence Atlas 300I et Atlas 350), serveurs d’IA (serveurs d’inférence Atlas 800I A2/A3 et serveurs d’entraînement Atlas 800T A2), supernœuds (Atlas 900 A3 / Atlas 950 SuperPoD) et clusters (SuperCluster). La première étape de l’acquisition consiste à déterminer le niveau auquel votre entreprise se situe : cartes d’accélération pour l’inférence monocarte, serveurs d’inférence pour l’inférence à l’échelle de l’entreprise et supernœuds pour l’entraînement de modèles et les clusters à grande échelle.
La compétitivité d’Ascend repose non seulement sur son matériel, mais aussi sur son écosystème complet (« puce + architecture de calcul hétérogène CANN + framework MindSpore + applications sectorielles ») et sur son avantage concurrentiel en matière de conformité, grâce à un contrôle indépendant dans le contexte de l’innovation informatique en Chine. C’est pourquoi les gouvernements, les institutions financières, les opérateurs, le secteur de l’énergie et d’autres secteurs privilégient les solutions Ascend.
Carte d’accélération d’inférence : Série Atlas 300I
La série Atlas 300I est la série de cartes d’inférence Ascend la plus répandue. Elle présente un format PCIe standard et s’insère directement dans les serveurs x86 ou Kunpeng. Elle est conçue pour l’inférence haute performance et l’analyse vidéo :
• Atlas 300I Pro : 140 TOPS INT8 / 70 TFLOPS FP16, 24 Go LPDDR4X, idéale pour la reconnaissance optique de caractères (OCR), la modération de contenu, l’inférence de modèles légers et d’autres applications.
• Atlas 300I Duo : Conception à double puce, 280 TOPS INT8, 48 Go/96 Go LPDDR4X (bande passante de 408 Go/s, prise en charge ECC), faible consommation de 150 W, haute efficacité énergétique de 1,86 TOPS/W, prise en charge de l’analyse en temps réel de 256 canaux vidéo HD 1080p, carte principale pour les projets de structuration vidéo des villes intelligentes et des transports intelligents.
• Atlas 300I A2 : Modèle phare de la série, 560 TOPS INT8 / 280 TFLOPS FP16, 32 Go (bande passante de 0,8 To/s) ou 64 Go (bande passante de 1,6 To/s) de mémoire embarquée avec prise en charge ECC, idéal pour l’inférence de modèles complexes, la modération de contenu et d’autres scénarios de calcul haute performance.
De plus, la carte d’accélération Atlas 350 (112 Go HBM, bande passante de 1,4 To/s, PCIe 5.0, compatible avec l’accélération de quantification basse précision mxFP4/FP8) répond aux besoins de performances plus élevés. Cette carte peut être intégrée au serveur comme carte à double usage pour l’entraînement et l’inférence. Conseil de sélection : les cartes d’inférence disposent d’une bande passante mémoire relativement limitée ; l’exécution de modèles volumineux (plus de 32 octets) nécessite la compression de la quantification et le parallélisme multi-cartes. Il est impératif de réaliser des tests avec votre modèle métier avant tout achat.
Serveur d’inférence : Atlas 800I A2 / A3
L’Atlas 800I A2 est un serveur d’inférence Ascend standard pour entreprises : un serveur rackable 2U basé sur quatre processeurs Kunlun 920 et huit NPU Ascend 910B (32 Go de mémoire HBM par puce, 256 Go de mémoire graphique HBM), équipé de 32 emplacements mémoire DDR4 et offrant des combinaisons de stockage SATA/NVMe flexibles. La gestion hors bande iBMC prend en charge IPMI et KVM sur IP. Ce serveur est largement utilisé dans les clouds publics, sur Internet, par les opérateurs télécoms, dans les administrations publiques, la finance, les universités et le secteur de l’énergie. Il constitue la solution standard pour le déploiement de modèles d’inférence à grande échelle (de 7 à 70 milliards d’itérations) en Chine.
La nouvelle génération de l’Atlas 800I A3 porte la capacité HBM totale à 768 Go, atteignant une puissance de calcul de 12,4 PFLOPS@mxFP4. Elle prend en charge l’interconnexion complète de deux machines (16 NPU) via le protocole Lingqu (UB), permettant ainsi la gestion de modèles à plus grand nombre de paramètres et de scénarios d’inférence simultanée plus importants. Pour l’entraînement, le serveur d’entraînement Atlas 800T A2 prend en charge les tâches d’entraînement des modèles. Pour les entreprises, l’acquisition d’un serveur d’inférence revient à investir dans un système complet et éprouvé : le rapport CPU/NPU, le refroidissement, l’alimentation et les capacités de gestion sont déjà optimisés, ce qui le rend bien plus fiable que l’assemblage d’un ordinateur en interne.
Huawei Ascend 950PR, optimisé par le supernœud Atlas 950 SuperPoD
Lors de la conférence Huawei Connect 2025, Huawei a dévoilé sa feuille de route pour ses puces Ascend : l’Ascend 950PR (optimisé pour le pré-remplissage d’inférences et les scénarios de recommandation) sera lancé au premier trimestre 2026, et le 950DT (optimisé pour l’entraînement et le décodage d’inférences) au quatrième trimestre 2026. Les versions 960 et 970 suivront respectivement au quatrième trimestre 2027 et au quatrième trimestre 2028. À ce rythme, la puce Ascend évoluera d’une génération par an, doublant ainsi sa puissance de calcul.
Le supernœud Atlas 950 SuperPoD a été lancé simultanément avec la puce. Il prend en charge l’interconnexion complète et non bloquante de 8 192 cartes Ascend, atteignant une puissance de calcul de 8 EFLOPS FP8 / 16 EFLOPS FP4, une capacité de mémoire de 1 152 To et une bande passante d’interconnexion tout optique de 16,3 Po/s. Doté d’une architecture orthogonale entièrement refroidie par liquide, il peut être intégré à un cluster Atlas 950 SuperCluster de plus de 500 000 cartes. L’intérêt de ce supernœud réside dans sa capacité à transformer des milliers de cartes en « ordinateurs logiques » grâce au protocole d’interconnexion Lingqiao, résolvant ainsi le problème de la communication inter-machines lors de l’entraînement de modèles à grande échelle. Pour les acheteurs, cela signifie qu’il n’est pas nécessaire de construire tous les supernœuds d’un seul coup ; il est possible de commencer avec la série Atlas 800I et d’étendre progressivement l’infrastructure en fonction de la croissance de l’activité.
Points clés à considérer pour l’acquisition de puissance de calcul Ascend
• Déterminez d’abord le niveau de puissance, puis sélectionnez le modèle : pour l’inférence en périphérie/légère, choisissez les cartes d’accélération de la série Atlas 300I ; pour l’inférence de modèles à grande échelle en entreprise, choisissez l’Atlas 800I A2/A3 ; pour l’entraînement et l’évaluation de clusters à très grande échelle, choisissez la solution SuperNode.
• Facturation de la mémoire de calcul et de la bande passante : pour l’inférence de modèles complexes, estimez d’abord la mémoire requise en fonction du nombre de paramètres et du cache KV. Les cartes Ascend offrent des bandes passantes mémoire très différentes (de 408 Go/s pour la LPDDR4X à plusieurs dizaines de To/s pour la HBM), ce qui influe directement sur le débit d’inférence.
• Compatibilité avec l’écosystème logiciel : Ascend utilise le système CANN + MindSpore. Avant tout achat, assurez-vous que le modèle cible dispose d’études de cas compatibles et prévoyez un délai pour la migration et l’optimisation du modèle.
• Conformité de la création d’informations : vérifiez le taux de localisation et les exigences du catalogue d’achats pour les projets des services gouvernementaux, financiers et des opérateurs. Les solutions Ascend présentent un avantage naturel dans les scénarios de création d’informations.
• Fiabilité globale : Vérifiez la redondance des alimentations, le remplacement à chaud des ventilateurs, la gestion hors bande de l’iBMC et les rapports complets de tests de vieillissement du système. L’assemblage complet du système est interdit en environnement de production.
• Approvisionnement et feuille de route : Le cycle d’itération des puces Ascend est clairement défini (950PR → 950DT → 960). Confirmez le cycle de livraison et la compatibilité pour les mises à niveau ultérieures lors de l’achat.
Pourquoi choisir Changfan Industrial Control ?
Changfan Industrial Control fournit des plateformes matérielles de systèmes de puissance de calcul et des services personnalisés aux entreprises d’IA, aux instituts de recherche et aux intégrateurs de systèmes. Ses principaux atouts sont :
• Plateforme intégrée complète : Propose des châssis de serveurs IA 2U/4U, intégrant des services compatibles avec les cartes d’accélération Ascend et prenant en charge la configuration à la demande du processeur, de la mémoire, du stockage et du réseau.
• Fiabilité de niveau industriel : Tous nos produits répondent aux normes de conception 24h/24 et 7j/7, et intègrent des alimentations redondantes, un refroidissement optimisé par flux d’air, une gestion hors bande, des tests de vieillissement complets et des tests de charge maximale.
• Capacités OEM/ODM étendues : La structure du châssis, la sérigraphie du panneau avant, le BIOS/BMC, la disposition des ports, les pilotes préinstallés et les images de l’environnement d’inférence sont entièrement personnalisables, permettant aux intégrateurs de créer rapidement leurs propres machines intégrant l’IA sous leur propre marque.
• Certifications complètes et réalisation de projets : Ce produit est certifié 3C, CE, FCC, RoHS et autres. Des spécifications bilingues et des rapports de test sont fournis, facilitant les appels d’offres gouvernementaux et d’entreprises, ainsi que la réalisation de projets à l’international.
• Assistance au niveau du projet : Nous proposons une tarification dégressive, des accords de garantie d’approvisionnement et une assistance technique personnalisée pour les achats en gros. Des tests de prototypes sont effectués au préalable afin de minimiser les risques liés au choix.
Que vous ayez besoin de déployer un cluster d’analyse vidéo local ou de concevoir une plateforme d’inférence de modèles à grande échelle pour votre entreprise, Changfan Industrial Control vous fournit le matériel complet adapté et des conseils d’experts pour le choix de votre solution. N’hésitez pas à contacter les ingénieurs commerciaux de Changfan Industrial Control pour obtenir des solutions et des devis.
Foire aux questions (FAQ)
Q : Quelle est la différence entre un NPU Ascend et un GPU NVIDIA ? R : Ascend est un NPU de calcul IA qui fonctionne avec l’écosystème complet CANN+MindSpore, offrant des avantages en matière de conformité dans les contextes d’innovation et de création nationaux et internationaux. L’écosystème GPU de NVIDIA est plus universel. Le choix dépend du contexte métier, des exigences de conformité et de la pile logicielle existante.
Q : L’Atlas 300I Duo peut-il exécuter des modèles volumineux ? R : Il convient aux modèles légers de moins de 10 octets et à l’analyse vidéo. Les modèles de 32 octets nécessitent une quantification parallèle sur plusieurs cartes. Pour l’inférence de modèles volumineux en entreprise, le serveur d’inférence Atlas 800I A2 est recommandé.
Quelle est la taille de la VRAM de l’Atlas 800I A2 ? La machine est équipée de huit puces Ascend 910B, chacune dotée de 32 Go de HBM, pour un total de 256 Go de VRAM HBM. La nouvelle génération Atlas 800I A3 offre une capacité HBM totale de 768 Go.
Quand l’Ascend 950PR sera-t-il disponible ? R : D’après la feuille de route annoncée lors de Huawei Connect 2025, l’Ascend 950PR sera lancé au premier trimestre 2026 et le 950DT au quatrième trimestre 2026. Veuillez consulter les informations officielles de Huawei concernant les dates de sortie.
Q : Est-il possible d’installer Windows sur le serveur Ascend ? R : Non. Le serveur Ascend repose sur l’architecture ARM Kunpeng et un système Linux similaire à OpenEuler. Les applications doivent être migrées conformément à la planification logicielle nationale.
Q : Changfan Industrial Control propose-t-il des solutions système complètes et personnalisées pour l’Ascend ? R : Oui. Nous proposons une personnalisation complète, de la structure du boîtier et l’apparence du panneau aux pilotes préinstallés et à l’environnement d’inférence, et nous garantissons l’approvisionnement pour les projets en série.
- Article précédent Lecture essentielle pour l'acquisition de serveurs d'entreprise : Serveurs à usage général vs. Serveurs GPU IA – 10 dimensions expliquant les différences et la logique de sélection |
- Article suivant Comment choisir les CPU/DCU Hygon ? Présentation des séries 3000/5000/7000 et de la carte d'accélération K100-AI | Changfan Industrial Control
