fr.wedoany.com Rapport : Microsoft a annoncé qu'elle déploiera à grande échelle le système Helios, une solution d'IA au niveau du rack fabriquée par AMD, dans ses centres de données afin de renforcer les capacités de calcul d'IA de la plateforme cloud Azure. Ce partenariat marque une avancée significative pour AMD sur le marché des GPU pour centres de données. Les clients d'Azure pourront utiliser la dernière génération de GPU AMD pour exécuter des charges de travail de modèles d'IA de pointe, couvrant à la fois les tâches d'entraînement et d'inférence.

L'AMD Helios est un système au niveau du rack conçu pour concurrencer le Nvidia Vera Rubin NVL72. Ce système intègre 72 GPU de dernière génération Instinct MI455X, avec une capacité totale de mémoire HBM4 de 31,1 To. Ses performances de calcul atteignent 1,4 exaFLOPS en précision FP8 et 2,9 exaFLOPS en précision FP4, optimisées pour les modèles d'IA modernes.

L'Helios offre une bande passante d'extension intra-rack de 260 To/s, comparable à celle du système Nvidia Vera Rubin NVL72. En matière d'extension hors rack, l'Helios fournit une bande passante de 43 To/s via la connexion UALink over Ethernet, soit le double de celle du Vera Rubin. Cependant, les performances réelles de l'UALink over Ethernet restent à valider en pratique. Ni Microsoft ni AMD n'ont divulgué l'ampleur des investissements de déploiement ni les indicateurs de consommation électrique. Auparavant, AMD avait établi des partenariats potentiels d'une valeur de plusieurs centaines de milliards de dollars avec OpenAI et Meta.
Outre l'Helios, Microsoft a également lancé deux nouvelles séries de machines virtuelles basées sur le processeur AMD Epyc Venice de sixième génération : la série HDv2 est destinée aux charges de travail d'agents d'IA et aux pipelines de données, tandis que la série HXv2 est conçue pour les flux de travail de conception de semi-conducteurs. Microsoft prévoit également d'intégrer le DPU AMD Pensando dans le service Azure Boost afin d'accélérer le traitement réseau et de stockage. Cette série de collaborations indique que les clients d'Azure disposent désormais d'options de calcul d'IA plus diversifiées, ne dépendant plus uniquement des GPU Nvidia. Avec l'émergence de modèles open source comme Kimi K3, la demande en calcul d'IA continue de croître, et les entreprises peuvent choisir l'infrastructure appropriée en fonction de leurs besoins en matière de performance, de coût et de disponibilité.
AMD prévoit de lancer l'Helios d'ici la fin de cette année, en même temps que la sortie du Nvidia Vera Rubin NVL72. La concurrence entre les deux géants des semi-conducteurs sur le marché des GPU pour centres de données devrait s'intensifier.










