AWS et NVIDIA annoncent la livraison de 2 millions de GPU supplémentaires pour l’IA agentique et physique

Suivez Intelligence-Artificielle

Amazon Web Services (AWS) et NVIDIA renforcent leur partenariat stratégique avec l’annonce d’une livraison massive de 2 millions de GPU supplémentaires. Cette expansion vise à répondre à la croissance exponentielle des besoins en calcul haute performance pour les applications d’intelligence artificielle, notamment celles liées à l’IA agentique et physique. Ces investissements témoignent aussi d’une volonté commune d’innover sur une technologie de nouvelle génération, intégrant non seulement les GPU mais également des CPUs NVIDIA Vera, des avancées en networking et des modèles ouverts destinés à accélérer le déploiement de solutions IA à large échelle.

Alors que les charges de travail en intelligence artificielle se multiplient dans des secteurs aussi variés que l’automatisation d’entreprise, la robotique avancée ou la découverte scientifique, cette collaboration stratégique s’appuie sur plus de 16 ans d’innovation conjointe. Le déploiement de cette infrastructure sans précédent assure aux clients une capacité scalable et sécurisée pour faire face à la complexité croissante des applications IA, tout en garantissant une interopérabilité fluide entre les différentes technologies co-optimisées. Par ailleurs, les initiatives concernent aussi bien les laboratoires de pointe que les entités gouvernementales nécessitant un accès à des GPU sécurisés pour des opérations critiques.

Expansion massive des capacités GPU pour l’infrastructure IA mondiale d’AWS

Le déploiement de 2 millions de GPU supplémentaires par AWS, entre 2027 et 2028, illustre clairement la montée en puissance des exigences en calcul pour l’intelligence artificielle. Cette décision fait suite à une précédente annonce de plus d’un million de GPU, laquelle a déjà vu une adoption client bien supérieure aux attentes. Les GPU concernés incluent les derniers modèles NVIDIA Blackwell Ultra, Rubin et Rubin Ultra, reconnus pour leurs performances optimales dans les environnements de calcul haute performance et d’inférence IA.

Youtube video

À travers cet accroissement, AWS confirme sa position de leader offrant la plus large gamme d’instances GPU adaptées aux besoins complexes des entreprises. Par exemple, les instances EC2 G7, intégrant des GPU RTX PRO 4500 Blackwell Server Edition, délivrent une performance d’inférence AI quatre fois supérieure à la génération précédente, tout en améliorant les capacités graphiques. Ce saut technologique permet de booster considérablement la vitesse de traitement d’algorithmes complexes tout en réduisant la latence.

Cette montée en charge ne se limite pas aux seules ressources GPU. Elle consiste également en une optimisation complète des réseaux, avec une collaboration sur la technologie NVIDIA Spectrum, assurant un trafic performant entre les clusters GPU. Une telle infrastructure réseau est vitale pour les workflows d’entraînement distribué et les scénarios multi-GPU, clé dans le contexte des modèles d’intelligence artificielle de grande échelle, utilisés notamment dans les projets nécessitant des performances en IA physique, comme la robotique avancée.

Intégration des CPUs NVIDIA Vera dans l’écosystème AWS pour hybrider les puissances de calcul

AWS et NVIDIA étendent leur collaboration en intégrant les CPUs basés sur l’architecture Vera, spécialement conçus pour répondre aux besoins des applications IA exigeantes. Cette infrastructure CPU vient compléter les offres GPU, pour former une plateforme hétérogène de calcul optimisée pour les charges agents et physiques. L’intérêt majeur de cette approche hybride est d’offrir plus de flexibilité aux clients dans leurs architectures IA.

aws et nvidia collaborent pour fournir 2 millions de gpu supplémentaires et une infrastructure de nouvelle génération, révolutionnant ainsi l'ia agentique et physique.

Les CPUs Vera offrent une flambée de performances pour les calculs séquentiels ou très parallèles parfois limités sur GPU. On observe ainsi des améliorations dans la rapidité des pipelines ETL, la gestion des données et le traitement concurrent, dans une parfaite symbiose avec la puissance brute des GPU Blackwell. Cette combinaison constitue un levier essentiel pour l’adoption d’architectures IA plus complexes et pour des modèles nécessitant simultanément une forte puissance CPU et GPU.

Cette architecture parallèle s’inscrit dans une stratégie globale d’AWS visant à offrir la meilleure combinaison possible d’outils de calcul. Un parallèle peut être fait avec les enjeux abordés dans la comparaison entre GPU et CPU pour l’intelligence artificielle (étude GPU vs CPU), soulignant que la complémentarité entre ces deux types de processeurs est incontournable pour les charges IA actuelles. Ces innovations reflètent aussi la volonté d’adapter la plateforme à l’évolution des modèles AI, y compris dans la robotique où la faible latence et le traitement temps réel sont cruciaux.

Sécurisation et performance réseau : la pierre angulaire des infrastructures IA agentique et physique

L’évolution de l’écosystème AWS-NVIDIA ne se limite pas au matériel : elle repose aussi sur des innovations majeures en matière de sécurité et de réseau, indispensables pour accompagner la montée en charge des applications IA dans des environnements sensibles. Le système AWS Nitro et l’adaptateur Elastic Fabric Adapter (EFA) assurent une connexion haute performance tout en garantissant la sécurité indispensable aux workloads mission-critical, notamment dans les secteurs fédéraux et gouvernementaux.

Cette approche sécuritaire se matérialise également par la construction d’AI factories dédiées aux gouvernements américains. Ces centres bénéficieront d’une capacité de 100 000 GPU sur des infrastructures garanties pour manipuler des données sensibles classifiées à Impact Level 6 (IL6) et au-delà. Ces initiatives traduisent une confiance accrue dans ces plateformes pour héberger des charges critiques liées à la défense et la sécurité nationale, renforçant la position d’AWS et NVIDIA comme piliers incontournables de l’IA physique et agentique.

Les technologies réseau avancées NVIDIA NVLink Fusion couplées à la mémoire haute bande passante NVHBM, apportent quant à elles une amélioration significative du débit entre GPU et CPU dans les racks. Ce lien rapide est crucial pour favoriser l’exécution fluide des workflows IA hybrides et confirmer la supériorité de cette architecture dans les environnements cloud à haute densité.

Youtube video

Modèles ouverts et accélération du traitement des données : nouvelles clés pour la scalabilité IA

La collaboration AWS-NVIDIA s’inscrit aussi dans une philosophie d’ouverture et d’accès simplifié aux outils IA. En intégrant la famille de modèles ouverts NVIDIA Nemotron à Amazon Bedrock et Amazon SageMaker, la plateforme offre aux utilisateurs une plus grande liberté pour déployer, ajuster ou créer des modèles adaptés à leurs besoins spécifiques. Cette disponibilité favorise une adoption plus large, en particulier dans des environnements nécessitant la personnalisation des modèles d’IA agentique.

En parallèle, la gestion et l’indexation des données sont accélérées par des bibliothèques GPU telles que cuDF et cuVS, intégrées dans Amazon EMR et Amazon OpenSearch. Ces composants optimisent de façon drastique les processus ETL (Extract, Transform, Load) et les applications d’analyse en temps réel, avec des gains jusqu’à 3,7 fois plus de vitesse et une réduction de 30 % des coûts liés au traitement.Ces améliorations participent directement à une meilleure efficacité opérationnelle pour les applications utilisant la technologie IA physique, comme la robotique ou la simulation en temps réel.

Cette stratégie prouve qu’au-delà du simple déploiement de puissance brute, le partenariat mise sur une optimisation complète de la chaîne technologique IA. Celle-ci inclut infrastructures, logiciels et modèles, afin d’accompagner efficacement l’ensemble des acteurs de l’industrie dans leurs processus de transformation digitale.

aws et nvidia s'associent pour fournir 2 millions de gpu supplémentaires et une infrastructure innovante, renforçant ainsi les capacités de l'ia agentique et physique de nouvelle génération.

Robotics et IA physique : une intégration avancée pour répondre aux défis de demain

Amazon Robotics collabore étroitement avec NVIDIA pour accélérer le développement de robots de nouvelle génération grâce à la plateforme complète d’IA physique. Cette plateforme regroupe le hardware NVIDIA Jetson, les bibliothèques Omniverse et la plateforme Isaac pour la simulation et la formation de robots. La synergie permet ensuite de simuler des environnements complexes, générer des données synthétiques et valider les performances dans des scénarios réels.

Cette approche a permis des avancées significatives dans l’automatisation des entrepôts, démontrant que l’IA physique peut transformer profondément les processus logistiques. En s’appuyant sur des GPU haute performance et une infrastructure cloud sécurisée, les robots bénéficient d’une meilleure réactivité et d’une adaptation continue aux nouvelles situations.

Le cas d’usage d’Amazon Robotics illustre parfaitement les bénéfices d’une infrastructure cloud optimisée pour l’IA. Il reflète également les tendances plus larges du marché où la convergence entre intelligence artificielle agentique et physique ouvre de nouvelles perspectives pour la robotique, les véhicules autonomes ou encore la maintenance prédictive.

Restez à la pointe de l'information avec
INTELLIGENCE-ARTIFICIELLE.COM !

Abonnez-vous à notre chaîne YouTube et rejoignez-nous sur Actualités

ARTICLES SIMILAIRES

pCloud : Guide complet du service de stockage en ligne

pCloud : Guide complet du service de stockage en ligne

pCloud, c’est la référence du stockage cloud avec un argument massue : l’abonnement à vie. Vous payez une fois, et l’espace vous appartient pour 99

28 juillet 2026

AWS soutient l’infrastructure mondiale du cloud depuis son lancement historique en 2006

AWS ou Amazon Web Service est une structure charnière de l’informatique d’entreprise avec 30 % de parts du marché cloud mondial. Elle génère 107,56 milliards USD

30 mai 2026

S3 Files d’AWS simplifie l’accès aux données pour l’IA

AWS lance S3 Files pour transformer le stockage cloud en système de fichiers réseau sans migration. Le géant renforce aussi sa cybersécurité avec Claude Mythos,

10 avril 2026

Économiser 80 % sur l’IA : API OpenAI ou serveurs locaux ?

L’utilisation des API OpenAI ou de serveurs locaux peut faire économiser jusqu’à 80 % sur vos coûts d’IA, selon votre volume de tokens et votre infrastructure.

27 mars 2026

Pourquoi le multi-cloud devient la norme pour les entreprises ?

La gestion des données définit désormais la puissance des entreprises modernes. Le multi-cloud s’impose comme une stratégie incontournable pour gagner en résilience informatique. En 2026,

19 mars 2026

Comment utiliser Puter.com : guide de l’OS Cloud 

Et si votre ordinateur devenait optionnel ? Aujourd’hui, en effet, la puissance informatique ne dépend plus uniquement de votre machine locale. Elle repose désormais sur

4 mars 2026