ActualitésActionsNVIDIA et AWS étendent leur collaboration : infrastructure d'IA et usines de niveau gouvernemental

NVIDIA et AWS étendent leur collaboration : infrastructure d'IA et usines de niveau gouvernemental

Auteur: Metaverse Post·

Points clés

  • AWS déploiera deux millions de GPU NVIDIA supplémentaires, notamment les accélérateurs Blackwell Ultra, Rubin et Rubin Ultra, sur son infrastructure mondiale en 2027 et 2028, s'appuyant sur les plans annoncés précédemment visant à ajouter plus d'un million de GPU à partir de 2026.
  • AWS et NVIDIA prévoient de construire des usines d'IA dédiées fournissant cent mille GPU sur une infrastructure sécurisée certifiée pour les charges de travail fédérales de niveau d'impact 6 (Impact Level 6) et au-delà.
  • AWS introduira des instances propulsées par le CPU NVIDIA Vera pour les charges de travail d'IA agentique, ainsi que NVLink Fusion et une mémoire à haute bande passante personnalisée développée avec Annapurna Labs afin d'améliorer la vitesse et l'efficacité énergétique.
  • L'accélération GPU utilisant NVIDIA cuDF permettra un traitement des données jusqu'à 3,7 fois plus rapide sur Amazon EMR, tandis qu'Amazon OpenSearch Service atteindra une construction d'index vectoriels jusqu'à neuf fois plus rapide pour environ un quart du coût.
  • Amazon Robotics intégrera la plateforme Jetson, les bibliothèques Omniverse et le framework Isaac de NVIDIA afin de faire progresser l'automatisation des entrepôts grâce à la simulation, la génération de données synthétiques et l'optimisation des itinéraires.
NVIDIA et AWS étendent leur collaboration : infrastructure d'IA et usines de niveau gouvernemental

NVIDIA et Amazon Web Services ont annoncé une expansion importante de leur collaboration stratégique de seize ans, avec un accroissement significatif des capacités d'infrastructure d'IA et une intégration approfondie de l'ensemble de la pile technologique afin de faire progresser l'IA agentique et l'IA physique.

Ce partenariat couvre désormais le matériel GPU et CPU, la mise en réseau avancée, les modèles ouverts et les plateformes de robotique, alors que les deux entreprises répondent à une demande des entreprises et des gouvernements qui a dépassé les projections existantes. Cette annonce traduit une évolution plus large de l'industrie, qui passe des projets pilotes au déploiement à l'échelle de production dans les domaines de la découverte scientifique, de l'automatisation d'entreprise et de la robotique, où la disponibilité du calcul, la mise en réseau et l'intégration logicielle sont de plus en plus traitées comme un système unique.

L'élément central de cette expansion est le déploiement de deux millions de GPU NVIDIA supplémentaires sur l'infrastructure mondiale d'AWS en 2027 et 2028. Cette capacité comprendra les accélérateurs NVIDIA Blackwell Ultra, Rubin et Rubin Ultra, s'appuyant sur les plans annoncés précédemment visant à ajouter plus d'un million de GPU à partir de 2026. AWS introduira également des instances propulsées par le CPU NVIDIA Vera, conçu spécifiquement pour les charges de travail d'IA agentique, et mettra en œuvre NVIDIA NVLink Fusion ainsi qu'une technologie de mémoire à haute bande passante personnalisée développée avec Annapurna Labs afin d'améliorer la vitesse et l'efficacité énergétique des architectures GPU et Trainium.

Pour l'entraînement de l'IA à grande échelle, les deux entreprises collaborent sur la mise en réseau NVIDIA Spectrum afin d'optimiser les performances des clusters de GPU. Dans le domaine gouvernemental, AWS et NVIDIA prévoient de construire des usines d'IA dédiées fournissant cent mille GPU sur une infrastructure sécurisée certifiée pour les charges de travail fédérales de niveau d'impact 6 (Impact Level 6) et au-delà. Toutes les nouvelles instances continueront d'utiliser le AWS Nitro System et l'Elastic Fabric Adapter, garantissant le maintien des normes de sécurité et de fiabilité à mesure que la flotte s'étend.

Logiciels, traitement des données et IA physique

Au-delà de l'expansion matérielle, la collaboration met l'accent sur l'optimisation de la couche logicielle et sur de nouveaux cas d'usage. Les modèles ouverts NVIDIA Nemotron resteront disponibles en tant qu'offres entièrement gérées sur Amazon Bedrock et en tant que ressources déployables sur Amazon SageMaker, élargissant ainsi le choix de modèles pour les développeurs. Les capacités de traitement des données seront renforcées grâce à l'accélération GPU sur Amazon EMR utilisant NVIDIA cuDF, avec un traitement jusqu'à 3,7 fois plus rapide et un rapport performance-prix amélioré de 30 pour cent par rapport aux configurations CPU.

Par ailleurs, Amazon OpenSearch Service utilisera l'indexation vectorielle accélérée par GPU pour offrir une construction d'index jusqu'à neuf fois plus rapide pour environ un quart du coût, répondant ainsi aux goulets d'étranglement des pipelines de génération augmentée par récupération et de recherche sémantique qui dépendent d'une récupération rapide sur de vastes jeux de données. AWS deviendra également le premier grand fournisseur de cloud à proposer des instances EC2 G7 accélérées par des GPU NVIDIA RTX PRO 4500 Blackwell Server Edition, qui offrent 4,6 fois les performances d'inférence IA et 2,1 fois les performances graphiques des instances G6 de génération précédente.

Dans le secteur de la robotique, Amazon Robotics intégrera les technologies d'IA physique de bout en bout de NVIDIA, notamment la plateforme Jetson, les bibliothèques Omniverse et le framework de développement Isaac, afin de faire progresser l'automatisation des entrepôts grâce à la simulation, la génération de données synthétiques, l'optimisation des itinéraires et la validation du réel vers le simulé (real-to-sim).