AWS prévoit d’ajouter deux millions de GPU Nvidia à son infrastructure en 2027 et 2028. La commande comprend des accélérateurs Blackwell Ultra, Rubin et Rubin Ultra. Elle s’ajoute à un engagement précédent de plus d’un million de GPU Nvidia, dont le déploiement doit commencer en 2026.
Le total dépasse donc trois millions d’accélérateurs prévus sur plusieurs années. Il ne correspond ni à un stock déjà installé ni à trois millions de cartes graphiques indépendantes. Le calendrier des livraisons, la définition retenue pour un GPU et la capacité des data centers détermineront la quantité réellement disponible pour les clients d’AWS.
Deux millions de GPU pour AWS, mais pas immédiatement
Ces accélérateurs sont destinés aux centres de données d’AWS. Ils pourront servir à entraîner des modèles d’intelligence artificielle et à exécuter leurs réponses, une activité appelée inférence. Ces deux usages demandent beaucoup de calcul lorsque les modèles sont importants ou que les requêtes arrivent en grand nombre.
L’extension est liée à une demande supérieure aux prévisions initiales. Les besoins cités concernent les start-up, les grandes entreprises, les laboratoires d’IA et les administrations. Les deux groupes n’ont pas publié les conditions financières de l’accord.
Le prix des puces ne suffit pas à mesurer l’investissement. AWS doit aussi disposer de serveurs, de réseaux capables de relier les accélérateurs, de systèmes de refroidissement, d’électricité et de bâtiments adaptés. Une commande peut donc augmenter la capacité future sans produire immédiatement une quantité équivalente d’instances accessibles en ligne.
Pourquoi le total de trois millions prête à confusion
Le mot GPU ne désigne pas toujours une carte complète. Les systèmes récents peuvent réunir plusieurs dies de calcul dans un même package. Le nombre annoncé dépend alors de l’unité comptée: composant de calcul, package ou système plus large.
Le chiffre à suivre est donc celui des accélérateurs livrés, installés et utilisables. Leur répartition par région et par service comptera davantage que le total cumulé annoncé par les partenaires.
Pourquoi AWS continue d’acheter des GPU Nvidia
AWS développe ses propres puces. Trainium vise les charges d’intelligence artificielle, tandis que Graviton fournit des processeurs généralistes pour les serveurs. Ces composants donnent à Amazon une autre option et peuvent réduire sa dépendance à Nvidia pour certains usages.
L’accord avec Nvidia dépasse toutefois l’achat de puces. Il inclut aussi des équipements réseau pour relier de nombreux accélérateurs, des processeurs, des logiciels de traitement des données et une plateforme robotique. AWS peut ainsi conserver un environnement déjà compatible avec certaines charges d’IA tout en développant ses propres composants.
La demande explique aussi cette coexistence. Une entreprise peut rechercher un type d’accélérateur pour entraîner un modèle, un autre pour l’inférence ou une solution différente pour maîtriser son coût. Le volume commandé ne signifie donc pas qu’AWS abandonne Trainium, ni que toutes les charges utiliseront les mêmes puces.
Une partie de la capacité sera répartie entre plusieurs projets
Dans un projet distinct, AWS et HUMAIN prévoient de fournir, déployer et gérer jusqu’à 150 000 accélérateurs dans une zone dédiée à l’IA à Riyad, en Arabie saoudite. Cette infrastructure doit combiner des systèmes Nvidia GB300 et des puces Trainium d’AWS.
La zone doit répondre aux besoins d’IA de l’Arabie saoudite et accueillir des clients internationaux. AWS prévoit d’y proposer notamment ses services Bedrock, AgentCore et SageMaker. Le projet s’inscrit dans un plan annoncé en mai 2025, qui prévoit plus de 5 milliards de dollars pour l’infrastructure d’IA, les services cloud et la formation dans le pays.
Ce projet de Riyad ne permet pas de déduire combien des deux millions de GPU supplémentaires seront installés sur place. Il montre en revanche qu’AWS prépare sa capacité dans plusieurs environnements, avec des combinaisons de puces adaptées aux projets et aux régions.
Plus de capacité ne garantit pas des services moins chers
Des GPU supplémentaires peuvent réduire les files d’attente et faciliter l’accès à des instances spécialisées. Ils permettent aussi à des entreprises d’utiliser des modèles plus lourds sans acheter leurs propres serveurs.
La baisse des prix n’est toutefois pas automatique. Le coût d’une heure de calcul inclut l’accélérateur, mais aussi l’électricité, le refroidissement, le réseau, la maintenance et l’amortissement des data centers. Si la demande reste supérieure à l’offre, AWS peut utiliser la nouvelle capacité pour accepter davantage de clients sans réduire ses tarifs.
Le pari comporte enfin un risque de calendrier. Les GPU seront livrés sur plusieurs années, pendant que les modèles peuvent devenir plus efficaces et que les puces d’Amazon peuvent prendre une place plus importante. La rentabilité dépendra donc de l’utilisation réelle des installations, et pas seulement du volume commandé.
Le chiffre utile sera celui des GPU opérationnels
Les indicateurs à surveiller
Pour mesurer la portée de l’accord, il faudra vérifier:
- combien d’accélérateurs sont effectivement livrés et installés;
- dans quelles régions et quels services AWS ils deviennent disponibles;
- quels délais d’accès et quels niveaux d’utilisation ils permettent;
- comment AWS répartit les charges entre Nvidia, Trainium et les autres composants de ses data centers.
Cette capacité opérationnelle dira davantage sur la stratégie d’Amazon que le total annoncé. Les trois millions de GPU correspondent à des engagements étalés dans le temps, pas à une réserve immédiatement accessible.
Sources et références scientifiques
- Rahim Amir. 1.58-million-staff Amazon will soon have more Nvidia GPUs than employees, AWS to buy more than 3 million additional chips before 2029 in addition to thousands of existing H100, H200. 2026.
- l’équipe About Amazon. Amazon annonce un plan d'investissement de plus de 15 milliards d'euros en France qui créera plus de 7 000 emplois en CDI. 2026.
- AWS-and-HUMAIN-Expand-Partnership-with-NVIDIA-AI-Infrastructure-and-AWS-AI-Chip-Deal-to-Drive-Global-AI-Innovation – US Press Center.
- Amazon Staff. Amazon plans to invest more than €15 billion in France. 2026.
- l’équipe About Amazon. Amazon inaugure son 9e centre de distribution à Colombier-Saugnieu : plus de 1 000 emplois en CDI déjà pourvus. 2026.
- Amazon just tripled its order of Nvidia chips over ‘surging demand’. 2026.




