Amazon Web Services et Nvidia ont annoncé leur intention de déployer deux millions de nouveaux GPU Nvidia dans l'infrastructure mondiale d'AWS d'ici 2028, dans le cadre d'une extension pluriannale de la capacité de calcul pour l'IA.
La collaboration comprend l'intégration des GPU Nvidia de nouvelle génération, Blackwell Ultra, Rubin et Rubin Ultra, ainsi que des GPU Nvidia RTX PRO 4500 Server Edition pour les instances Amazon EC2 G7. AWS sera le premier grand fournisseur de cloud à proposer des instances de calcul accélérées par RTX PRO 4500, selon les deux sociétés.
Dans le cadre de cette initiative, AWS et Nvidia construiront des usines d'IA pour le gouvernement des États-Unis, afin d'héberger 100 000 accélérateurs CUDA dans l'infrastructure sécurisée d'AWS, pour prendre en charge les charges de travail de défense nationale et de sécurité fédérale classifiées au niveau 6 et supérieur.
L’extension comprend également l’intégration de l’infrastructure basée sur les processeurs Vera et le déploiement de Nvidia NVLink Fusion, avec une technologie de mémoire à bande passante élevée personnalisée. Cette amélioration est conçue pour améliorer la vitesse d’accès à la mémoire et l’efficacité énergétique des chips Trainium d’AWS.
AWS a souligné les gains de performance liés à l'accélération par GPU, notant que les instances Amazon EC2 G7 utilisant des GPU Nvidia offrent des vitesses de traitement des données jusqu'à 3,7 fois plus élevées et un rapport coût-performance 30 % meilleur par rapport aux configurations basées sur le CPU. De plus, l'indexation vectorielle accélérée par GPU sur Amazon OpenSearch Service est annoncée jusqu'à neuf fois plus rapide, à un quart du coût.
Au-delà des solutions de calcul dans le cloud, Amazon Robotics intégrera la plateforme d'intelligence artificielle physique de Nvidia pour soutenir le développement de robots de nouvelle génération. Les modèles open-sourcés de Nemotron de Nvidia seront disponibles sur Amazon Bedrock et Amazon SageMaker, ce qui élargira l'accessibilité des outils d'IA pour les applications d'entreprise et gouvernementales.
Matt Garman, PDG d'AWS, a précisé que les clients recherchent « la liberté de choisir les meilleurs outils pour leurs charges de travail d'IA ». Jensen Huang, fondateur et PDG de Nvidia, a souligné que le partenariat s'étend « sur l'ensemble de la pile – GPU, CPU, réseaux, modèles ouverts et logiciels ».












