SysadminNews

AWS ajoute deux millions de GPU Nvidia en 2027 et 2028

Sur cette page
  1. Ce que contient réellement l'engagement
  2. La moitié de l'annonce qui ne concerne pas les GPU
  3. Acheter massivement du Nvidia tout en poussant Trainium
  4. Le cadre des résultats compte
  5. Quoi en faire
  6. Sources et pour aller plus loin

AWS et Nvidia ont annoncé le mercredi 26 août 2026 qu'AWS déploierait deux millions de GPU Nvidia supplémentaires sur 2027 et 2028, en Blackwell Ultra, Rubin et Rubin Ultra. Cet engagement arrive cinq mois après celui pris à GTC 2026, qui portait sur plus d'un million de GPU à partir de cette année, et Nvidia explique la révision en une phrase : la demande a dépassé ces prévisions. L'annonce va au delà du volume de silicium puisqu'elle couvre aussi les processeurs Vera, le réseau, les plateformes de robotique et les modèles ouverts Nemotron servis via Bedrock et SageMaker.

The short answer

AWS et Nvidia ont annoncé le 26 août 2026 qu'AWS déploierait deux millions de GPU Nvidia supplémentaires sur 2027 et 2028, en Blackwell Ultra, Rubin et Rubin Ultra. Cela représente à peu près le triple de l'engagement pris à GTC 2026, qui portait sur plus d'un million de GPU à partir de cette année. Nvidia indique que la demande a dépassé ces prévisions. L'extension couvre aussi les processeurs Vera, intégrés à Rubin ou livrés seuls, le réseau, les plateformes Omniverse, Cosmos, Isaac et Jetson, et les modèles ouverts Nemotron servis via Amazon Bedrock et SageMaker. Aucun montant n'a été communiqué.

2 millionsde GPU supplémentaires sur 2027 et 2028
89 Md$de revenus centre de données Nvidia, plus 117% sur un an
5 moisdepuis l'engagement d'AWS sur son premier million
Carte réponse résumant l'annonce AWS et Nvidia du 26 août 2026 : deux millions de GPU Blackwell Ultra, Rubin et Rubin Ultra déployés sur 2027 et 2028, cinq mois après un engagement portant sur un million de GPU, avec en plus des processeurs Vera, du réseau et les modèles ouverts Nemotron.
Ce sur quoi AWS et Nvidia se sont engagés le 26 août 2026. PNG

Cinq mois, c'est court pour tripler un chiffre déjà considérable. En mars, AWS annonçait l'ajout de plus d'un million de GPU Nvidia. Mercredi, l'entreprise en a annoncé deux millions de plus par dessus, et Nvidia a justifié la révision en une phrase : la demande a dépassé les prévisions.

Ce que contient réellement l'engagement

Les deux millions de GPU sont prévus pour 2027 et 2028, sur l'infrastructure mondiale d'AWS, y compris les sites que Nvidia appelle désormais des usines d'IA. Trois puces sont citées : Blackwell Ultra, Rubin et Rubin Ultra.

Cet étalement est le détail à remarquer. Un engagement qui couvre une seule génération est une décision d'achat. Un engagement qui traverse un changement de génération est un plan de capacité, car il doit survivre à la montée en cadence réelle de Rubin, quelle qu'elle soit. Vera Rubin est la plateforme autour de laquelle Nvidia construit tout son discours à l'échelle de la baie, et c'est le même silicium que l'on retrouve dans l'accélérateur de décodage passé en production cette semaine et dans le bail d'Anthropic en Virginie de l'Ouest.

Aucune des deux entreprises n'a communiqué le coût. Les estimations extérieures parlent de dizaines de milliards de dollars, ce qui correspond à l'échelle mais n'est confirmé par personne.

La moitié de l'annonce qui ne concerne pas les GPU

Passé le chiffre d'accroche, il s'agit d'un accord de conception commune plutôt que d'un contrat d'approvisionnement.

Nvidia livrera un nombre non précisé de processeurs Vera, son processeur serveur Arm pour la génération Rubin. Colette Kress, directrice financière de Nvidia, a indiqué qu'une partie arriverait intégrée à Rubin et l'autre seule. Le cas autonome est le plus intéressant, car il installe Nvidia sur le terrain du processeur serveur généraliste, à l'intérieur d'un nuage qui construit Graviton depuis dix ans pour exactement cette place.

Le reste couvre le réseau, la conception des usines d'IA, le traitement de données et la robotique via les plateformes Omniverse, Cosmos, Isaac et Jetson. Les modèles ouverts Nemotron de Nvidia seront servis par Amazon Bedrock et SageMaker. AWS étend également sa capacité Blackwell actuelle, avec notamment des GPU RTX PRO 4500 Blackwell Server Edition pour les instances Amazon EC2 G7.

Ce dernier point est la seule partie de l'annonce qui ait un effet à court terme sur ce que vous pouvez lancer aujourd'hui.

Carte de comparaison replaçant l'engagement AWS et Nvidia d'août 2026 dans son contexte : deux millions de GPU supplémentaires pour 2027 et 2028 face à plus d'un million engagé à GTC 2026 pour cette année, quatre vingt neuf milliards de dollars de revenus trimestriels centre de données en hausse de cent dix sept pour cent, quatre vingt seize virgule deux milliards de ventes totales, cent huit milliards de prévision, et vingt cinq milliards de rythme annualisé pour le silicium maison d'Amazon.
L'engagement rapporté aux revenus dans lesquels il s'inscrit. PNG

Acheter massivement du Nvidia tout en poussant Trainium

La tension évidente, c'est qu'Amazon passe des années à réduire sa dépendance à Nvidia et vient de s'engager sur deux millions de GPU supplémentaires de la marque.

Les deux faits sont vrais et aucun n'est un recul. L'activité silicium maison d'Amazon a dépassé un rythme annualisé de vingt cinq milliards de dollars, et Trainium continue de prendre une part des travaux d'entraînement, notamment ceux d'Anthropic. En parallèle, AWS fait état d'environ deux cent vingt cinq milliards de dollars d'engagements pris par des laboratoires d'IA, dont Anthropic et OpenAI. Quand le carnet est de cette taille, la question n'est plus de savoir quel fournisseur on préfère mais combien de mégawatts on peut raccorder et combien de silicium on peut physiquement obtenir.

La même logique traverse le secteur depuis le début de l'année. Microsoft exploitant 2,2 millions de puces IA sans l'électricité pour toutes les alimenter, Nvidia garantissant cent cinq milliards de dollars pour un campus OpenAI dans l'Ohio et trois mille milliards de dollars d'engagements IA hors bilan chez les géants racontent la même histoire vue de côtés différents. La capacité est le bien rare, et la fidélité à un fournisseur n'est pas vraiment une variable.

Le cadre des résultats compte

Nvidia a communiqué cette annonce pendant la présentation de ses résultats trimestriels, ce qui relève du choix et non du hasard.

Le trimestre lui même est important : quatre vingt seize virgule deux milliards de dollars de ventes totales, dont quatre vingt neuf milliards pour le segment centre de données, en hausse de cent dix sept pour cent sur un an, avec une prévision d'environ cent huit milliards pour le trimestre suivant. Annoncer un engagement client nommé dans ce cadre transforme un récit abstrait sur la demande en contrepartie identifiée avec une fenêtre de livraison. Cela fixe aussi un étalon auquel les autres nuages seront comparés, ce qui est généralement le but.

Quoi en faire

Si vous achetez ou planifiez de la capacité, la lecture pratique porte sur le calendrier plutôt que sur le volume. Les deux millions de GPU arrivent en 2027 et 2028 : ils ne disent rien de l'approvisionnement que vous disputez ce trimestre. Ils suggèrent en revanche que la tension actuelle est jugée assez durable pour justifier un engagement à deux ans, ce qui n'est pas la forme d'un marché sur le point de se détendre.

Si vous louez, surveillez les prix de la famille G7 et de ce que seront les premières instances adossées à Rubin. Les annonces mettent du temps à descendre dans les grilles tarifaires, mais c'est là qu'un engagement de capacité devient exploitable.

Et si vous arbitrez entre CUDA et un accélérateur à écosystème plus étroit, notez qu'aucun des deux côtés de cette décision n'est devenu plus simple cette semaine. AWS s'engage fortement sur les deux voies à la fois, ce qui veut dire qu'il ne tranchera pas à votre place.

Sources et pour aller plus loin

Questions fréquentes

Deux millions de GPU, est ce une nouvelle commande ou la même reformulée ?

C'est un ajout. À GTC 2026 en mars, AWS annonçait le déploiement de plus d'un million de GPU Nvidia à partir de 2026. Cette annonce ajoute deux millions par dessus, prévus pour 2027 et 2028, ce qui explique pourquoi la presse a parlé d'une commande à peu près triplée. Les puces diffèrent également. Le premier engagement portait pour l'essentiel sur du Blackwell de génération courante. Celui ci cite Blackwell Ultra, Rubin et Rubin Ultra, donc il traverse un changement de génération au lieu de racheter simplement le même silicium. Aucune des deux entreprises n'a communiqué de montant, et les estimations extérieures parlent de dizaines de milliards de dollars.

Cela signifie t il qu'AWS s'éloigne de Trainium ?

Les chiffres disent l'inverse. Amazon indique que son activité de puces maison a dépassé un rythme annualisé de vingt cinq milliards de dollars de revenus, et Trainium continue de prendre une part des travaux d'entraînement internes et clients. Ce qui se produit, c'est que les deux lignes croissent en même temps, parce que la contrainte est la capacité totale et non la préférence pour un fournisseur. AWS vend à des clients qui ont écrit leur code pour CUDA et ne le porteront pas, et à des clients qui ne regardent que le prix par jeton et iront là où c'est le moins cher. Servir les deux suppose d'acheter du Nvidia à grande échelle tout en continuant à concevoir du silicium qui réduit la dépendance à Nvidia.

Qu'est ce qu'un processeur Vera et pourquoi apparaît il dans une annonce GPU ?

Vera est le processeur serveur Arm de Nvidia, conçu comme hôte de la génération Rubin. La directrice financière de Nvidia, Colette Kress, a précisé qu'une partie serait intégrée à Rubin et l'autre livrée seule. Cela compte parce que les systèmes IA à l'échelle de la baie ne se vendent plus comme des accélérateurs à glisser dans le serveur de quelqu'un d'autre. Le processeur, l'interconnexion et le GPU sont conçus ensemble, et le côté hôte fait de plus en plus de travail réel dans les chaînes agentiques : orchestration, appels d'outils, recherche documentaire, préparation des données. Une option Vera autonome place aussi Nvidia sur un segment serveur disputé entre x86 et Graviton.

Quand tout cela atteint il une instance que je peux lancer ?

Pas de sitôt pour les deux millions. La fenêtre de déploiement est 2027 et 2028, et les annonces de capacité des hyperscalers décrivent des achats plutôt que de la disponibilité. L'élément le plus proche dans le temps est l'extension de la capacité Blackwell chez AWS, dont des GPU RTX PRO 4500 Blackwell Server Edition pour les instances Amazon EC2 G7, un étage orienté graphismes et inférence plutôt qu'entraînement. Si vous planifiez des charges, traitez le chiffre de deux millions comme un signal sur la direction des prix et de la disponibilité pour les deux ans à venir, pas comme une capacité réservable aujourd'hui.

Que nous apprend le contexte des résultats de Nvidia ?

Que l'argument de la demande n'est pas du marketing. Nvidia a publié quatre vingt seize virgule deux milliards de dollars de ventes totales sur le trimestre, dont quatre vingt neuf milliards pour le segment centre de données, en hausse de cent dix sept pour cent sur un an, avec une prévision d'environ cent huit milliards pour le trimestre suivant. Annoncer un engagement client pendant une présentation de résultats est un geste délibéré, car cela transforme une projection en contrepartie nommée. Amazon déclare par ailleurs environ deux cent vingt cinq milliards de dollars d'engagements venant de laboratoires d'IA, dont Anthropic et OpenAI, qui sont la demande que cette capacité doit servir.