AWS et Nvidia déploieront 2 millions de GPU supplémentaires pour l'IA physique et basée sur des agents

AWS et Nvidia déploieront 2 millions de GPU supplémentaires pour l'IA physique et basée sur des agents

Amazon Web Services (AWS) et Nvidia ont convenu de déployer deux millions de GPU supplémentaires sur l'infrastructure cloud AWS en 2027-2028.

Les entreprises élargissent leur partenariat dans un contexte de demande croissante d’informatique pour l’IA physique et basée sur des agents.

En plus d'un million de GPU

Le nouveau plan prévoit que plus de 2 millions de GPU seront livrés à l'infrastructure mondiale d'AWS au cours de 2027 et 2028. Cela s'ajoute aux accords précédents : lors du GTC 2026, AWS a annoncé son intention d'installer plus d'un million de GPU Nvidia à partir de 2026.

Nous parlons ainsi d'une flotte d'accélérateurs de plusieurs millions de dollars, qu'AWS entend utiliser pour la formation et l'inférence de modèles, ainsi que de nouveaux types de charges de travail associées aux agents et robots d'IA autonomes.

De Blackwell à Rubin

AWS intègre plusieurs générations de plateformes Nvidia dans ses clusters IA : Blackwell Ultra, Rubin et Rubin Ultra. En parallèle, les entreprises élargissent leur coopération dans le domaine des puces et des mémoires personnalisées.

AWS prépare notamment une infrastructure basée sur le processeur NVIDIA Vera. Le processeur est conçu spécifiquement pour les tâches qui se posent autour des agents IA : coordination des outils, exécution de code, traitement des données et simulations. Cela devrait compléter le GPU et permettre aux accélérateurs d'être utilisés plus efficacement dans des scénarios basés sur des agents en plusieurs étapes.

Une autre direction est l'intégration des technologies Nvidia avec les puces AWS Trainium. Annapurna Labs, une division d'Amazon, et Nvidia étendent la prise en charge précédemment annoncée de NVLink Fusion, notamment en utilisant la mémoire haute vitesse de Nvidia et les interconnexions évolutives dans les configurations au niveau du rack.

AWS recevra de nouvelles instances GPU

AWS a également introduit EC2 G7 – serveurs virtuels cloud (instances) avec GPU NVIDIA RTX PRO 4500 Blackwell Server Edition. La société les considère comme les premières offres de ce type parmi les principaux fournisseurs de cloud.

Selon Nvidia, les G7 apportent des améliorations par rapport à la génération précédente du G6 :

  • efficacité de l'inférence de l'IA jusqu'à 4,6 fois ;
  • Performances graphiques jusqu'à 2,1 fois.

Dans le même temps, les instances GPU et les systèmes basés sur Trainium continueront d'utiliser l'infrastructure réseau AWS Nitro et Elastic Fabric Adapter ainsi que les technologies réseau NVIDIA Spectrum.

100 000 GPU – pour l'État américain

Un domaine de partenariat distinct concerne les clients du gouvernement et de la défense.

AWS et Nvidia prévoient de créer des usines spécialisées en IA pour le gouvernement américain, qui recevra environ 100 000 GPU Nvidia. L’infrastructure sera conçue pour fonctionner avec des données sensibles et des exigences de sécurité de niveau d’impact 6 et supérieur.

Amazon mise sur l'IA physique

Le partenariat s’étend au monde physique. Amazon Robotics standardise l'utilisation de la plateforme d'IA physique de Nvidia, notamment Jetson, Omniverse et Isaac.

Les technologies seront utilisées pour automatiser les entrepôts, créer des données synthétiques et simuler le comportement des systèmes robotiques.

En parallèle, les modèles NVIDIA Nemotron open source resteront disponibles via Amazon Bedrock et SageMaker, à la fois en tant que services gérés et pour un déploiement personnalisé.

Nvidia a noté que l'accord avec AWS confirme la tendance de la concurrence sur le marché des infrastructures d'IA : il ne s'agit plus seulement du nombre de GPU, mais de la construction d'usines informatiques entières combinant accélérateurs, CPU, mémoire, réseaux, logiciels et systèmes spécialisés pour agents et robots.

Rappelons qu'en août SpaceXAI a annoncé l'expansion de l'utilisation de l'infrastructure Nvidia pour le développement de systèmes d'agents et Grok. Les plans incluent l'introduction des processeurs Vera et le déploiement de la plate-forme Vera Rubin dans l'espace.

Abonnez-vous à ForkLog sur les réseaux sociaux

Vous avez trouvé une erreur dans le texte ? Sélectionnez-le et appuyez sur CTRL+ENTRÉE

Voir l’article original en russe