AWS et NVIDIA prévoient d'ajouter 2 millions de GPU entre 2027 et 2028

2026-08-28 11:28
Favoris

fr.wedoany.com Rapport : Amazon Web Services (AWS) et NVIDIA ont annoncé une expansion majeure de leur partenariat stratégique pour répondre à la demande croissante en infrastructures d'intelligence artificielle (IA) à l'échelle mondiale. Les deux entreprises prévoient de déployer 2 millions de GPU NVIDIA supplémentaires dans l'infrastructure mondiale d'AWS, et d'approfondir leur collaboration dans les domaines des usines d'IA, des processeurs, des réseaux, des modèles ouverts, du traitement des données et de la robotique, afin de fournir aux clients des solutions d'IA co-conçues et d'accélérer le développement et le déploiement de l'IA.

Les charges de travail d'IA passent actuellement de la phase pilote à la phase de production, avec des applications qui s'étendent à l'IA agentique, à la découverte scientifique, à l'automatisation des entreprises et à la robotique. Les clients ont besoin d'un choix plus large de modèles, de pipelines de traitement de données plus rapides et de capacités pour de nouveaux cas d'usage tels que l'IA physique, tout en exigeant que l'infrastructure sous-jacente maintienne le plus haut niveau de sécurité et de fiabilité pour les charges de travail critiques, tout en soutenant la rapidité de l'innovation.

Forts de 16 ans d'innovation conjointe, AWS et NVIDIA vont étendre leurs capacités de calcul en IA et proposer plus rapidement aux clients de nouvelles solutions co-conçues. AWS offre la plus large gamme d'instances GPU parmi tous les fournisseurs de services cloud. Lors de la conférence NVIDIA GTC 2026, AWS a annoncé son intention d'ajouter plus d'un million de GPU NVIDIA à partir de 2026, et la demande réelle a depuis dépassé ces prévisions. AWS prévoit désormais de déployer 2 millions de GPU NVIDIA Blackwell Ultra, Rubin et Rubin Ultra supplémentaires dans son infrastructure mondiale (y compris les usines d'IA) entre 2027 et 2028, couvrant les charges de travail clients telles que l'IA agentique, la découverte scientifique, l'automatisation des entreprises et l'IA physique. Parallèlement, AWS étendra sa capacité NVIDIA Blackwell, notamment avec les GPU NVIDIA RTX PRO 4500 Blackwell Server Edition pour les instances Amazon EC2 G7. Les performances d'inférence IA des instances G7 sont 4,6 fois supérieures à celles des instances G6 de la génération précédente, et leurs performances graphiques sont 2,1 fois supérieures. AWS est le premier fournisseur de services cloud majeur à proposer des instances de calcul accélérées par RTX PRO 4500. En outre, les deux entreprises collaborent sur les réseaux NVIDIA Spectrum pour optimiser les performances réseau entre les clusters de GPU pour les charges de travail d'entraînement d'IA à grande échelle.

Dans le domaine du calcul CPU, AWS et NVIDIA prévoient d'introduire une infrastructure basée sur le CPU NVIDIA Vera sur AWS, offrant ainsi une option supplémentaire pour les charges de travail d'IA agentique nécessitant une synergie entre le calcul CPU haute performance et l'infrastructure accélérée. Vera est conçue pour l'IA de nouvelle génération et complète la stratégie d'AWS visant à offrir un large choix de solutions de calcul, allant de ses puces maison aux derniers accélérateurs et processeurs de ses partenaires.

Dans le domaine de l'interconnexion des puces et de la mémoire, AWS a annoncé lors de la conférence re:Invent 2025 la prise en charge de la technologie d'interconnexion haute vitesse NVIDIA NVLink Fusion dans ses puces Trainium de nouvelle génération. NVIDIA et Amazon Annapurna Labs étendent cette prise en charge en collaborant avec des fournisseurs de mémoire pour intégrer la nouvelle technologie de mémoire haute bande passante personnalisée NVIDIA (NVHBM) dans Trainium, permettant ainsi d'accéder à une mémoire plus rapide et plus économe en énergie. Combinée à NVLink Fusion, Annapurna Labs peut exploiter la technologie mémoire personnalisée de NVIDIA et son architecture scale-up pour améliorer les performances et l'efficacité des charges de travail d'IA, tout en intégrant Trainium et les GPU dans une architecture rack universelle.

Pour les clients gouvernementaux, AWS et NVIDIA prévoient de construire des usines d'IA pour le gouvernement américain, de livrer la pile logicielle d'IA NVIDIA, et de fournir 100 000 GPU sur une infrastructure AWS sécurisée pour les charges de travail fédérales et de sécurité nationale. Cette collaboration permet aux agences gouvernementales de déployer l'IA à grande échelle pour des charges de travail de niveau d'impact 6 (Impact Level 6, IL6) et supérieur.

Cette expansion de la collaboration s'appuie sur plusieurs intégrations technologiques déjà en place. Toutes les instances Amazon EC2 basées sur GPU NVIDIA et sur Trainium, y compris celles utilisant NVLink Fusion, sont construites sur le système AWS Nitro et interconnectées via l'adaptateur Elastic Fabric Adapter (EFA). Par ailleurs, les instances EC2 accélérées par GPU et basées sur Trainium continueront d'être construites sur le système Nitro et étendues via EFA. Nitro et EFA garantissent ensemble que, à mesure qu'AWS étend sa flotte de GPU NVIDIA et intègre de nouvelles technologies d'interconnexion, les clients continuent de bénéficier de la sécurité, de la fiabilité et des performances réseau dont dépendent leurs charges de travail d'IA en production. Côté écosystème logiciel, la famille de modèles ouverts NVIDIA Nemotron est disponible sur Amazon Bedrock sous forme de modèles entièrement gérés et sans serveur, et sur Amazon SageMaker pour que les clients puissent les déployer et les affiner eux-mêmes.

L'accélération du traitement des données est un autre résultat concret de cette collaboration. AWS et NVIDIA utilisent les instances Amazon EC2 G7 et la bibliothèque NVIDIA cuDF pour offrir un traitement de données accéléré par GPU sur Amazon EMR, avec des vitesses de traitement jusqu'à 3,7 fois supérieures et un rapport coût-performance amélioré de 30 % par rapport aux configurations basées sur CPU. Pour répondre à la demande de bases de données vectorielles à grande échelle générée par les applications d'IA, les pipelines de génération augmentée par récupération (RAG) et la recherche sémantique, les index vectoriels accélérés par GPU sur Amazon OpenSearch Service déchargent la construction d'index sur des GPU dédiés, offrant une vitesse d'indexation vectorielle jusqu'à 9 fois supérieure, pour un coût réduit au quart, applicable aux clusters gérés et à Amazon OpenSearch Serverless.

Dans le domaine de la robotique, Amazon Robotics collabore avec NVIDIA pour intégrer la plateforme physique d'IA complète de NVIDIA afin de développer la prochaine génération de robots. Cette plateforme comprend NVIDIA Jetson, les bibliothèques NVIDIA Omniverse et la plateforme ouverte de développement robotique NVIDIA Isaac. La collaboration couvre la simulation, la génération de données synthétiques, l'entraînement des robots, l'optimisation des parcours, la sécurité fonctionnelle et la validation du réel vers la simulation, le tout exécuté sur des instances Amazon EC2 accélérées par GPU pour prendre en charge les simulations à grande échelle, les données d'entraînement diversifiées et la validation continue dans le monde réel requises par les charges de travail robotiques.

Ce texte est rédigé, traduit et republié à partir des informations de l'Internet mondial et de partenaires stratégiques, uniquement pour la communication entre lecteurs. En cas d'infraction au droit d'auteur ou d'autres problèmes, veuillez nous en informer à temps pour la modification ou la suppression. La reproduction de cet article est strictement interdite sans autorisation formelle. Mail : news@wedoany.com