Aller directement au contenu

L’essentiel geek, le temps d’une pause.

L’essentiel geek, le temps d’une… pause!

retour à la « une »

🚀 AWS et NVIDIA annoncent deux millions de GPU supplémentaires : l’IA change encore d’échelle

Publié le

par

AWS et NVIDIA annoncent une extension majeure de leur partenariat : Amazon prévoit de déployer deux millions de GPU NVIDIA supplémentaires dans son infrastructure mondiale en 2027 et 2028. L’annonce, publiée le 26 août 2026, couvre aussi les CPU Vera, le réseau, les modèles ouverts et les outils de traitement de données. Autrement dit, on ne parle plus seulement de louer une carte graphique dans le cloud, mais d’industrialiser toute la chaîne.

La capacité annoncée doit reposer sur un mélange de GPU Blackwell Ultra, Rubin et Rubin Ultra. AWS avait déjà annoncé plus d’un million de GPU NVIDIA à partir de 2026, mais explique que la demande a dépassé ses prévisions. Les nouveaux volumes doivent servir l’entraînement de modèles, l’inférence, l’automatisation d’entreprise, la recherche scientifique et la robotique. Ce sont des objectifs de déploiement, pas une garantie que chaque région AWS disposera de la même capacité au même moment.

Le partenariat s’étend au réseau et à la sécurité. AWS veut intégrer la plateforme NVIDIA à son Nitro System et à Elastic Fabric Adapter, afin de réduire la latence et d’isoler davantage les workloads. Les deux entreprises travaillent également sur les commutateurs NVIDIA Spectrum pour les grands clusters d’entraînement. Pour l’utilisateur, la conséquence est simple : quand les GPU communiquent mal, multiplier les GPU ne multiplie pas les performances. Le câble reste parfois le patron.

AWS prévoit aussi d’introduire des infrastructures basées sur les CPU NVIDIA Vera. Ces processeurs sont présentés comme complémentaires des accélérateurs pour les workloads agentiques, où un CPU doit orchestrer des appels d’outils, du stockage, des files de tâches et des modèles. Amazon annonce en parallèle le support des modèles ouverts Nemotron sur Bedrock et SageMaker, ainsi que l’accélération du traitement et de l’indexation vectorielle dans EMR et OpenSearch avec les bibliothèques CUDA-X cuDF et cuVS.

Un volet gouvernemental est également annoncé, avec une « AI factory » AWS sécurisée pouvant atteindre 100 000 GPU pour des usages fédéraux et de sécurité nationale aux États-Unis. Ce chiffre illustre l’ampleur du marché visé, mais ne dit rien sur l’accès pour les entreprises européennes ni sur les tarifs. AWS et NVIDIA ne communiquent aucun prix public pour cette capacité supplémentaire : la facture dépendra de la région, du type d’instance, du stockage, du trafic et de la durée de réservation.

Pour les équipes IT, l’intérêt est la standardisation d’une pile cohérente : accélérateurs, CPU, réseau, sécurité et logiciels testés ensemble. Pour un homelab, l’annonce reste surtout un signal de marché. Elle peut améliorer la disponibilité des instances cloud à terme, mais elle ne fera pas apparaître un cluster Rubin dans un rack domestique. Ceux qui veulent déjà expérimenter localement ont davantage intérêt à optimiser le stockage, la mémoire et le réseau de leur matériel actuel qu’à attendre un miracle en 2027.

Sources : annonce AWS, Amazon EC2 et infrastructures NVIDIA.

En bref : deux millions de GPU, c’est impressionnant — surtout quand on ne doit ni les alimenter ni les refroidir chez soi. Pour l’instant, ce sont des capacités planifiées pour 2027–2028, sans prix ni calendrier régional détaillé : l’IA change d’échelle!

retour à la « une »

← Article précédent
Article suivant →