Uber étend son contrat AWS et adopte les puces Trainium3 d'Amazon pour ses workloads IA, rejoignant Anthropic, OpenAI et Apple.
TL;DR — En résumé
Uber élargit son partenariat AWS et adopte les puces Trainium3 d'Amazon. Les hyperscalers investissent 700 milliards en data centers IA en 2026.
En bref
- Uber étend massivement son contrat AWS et adopte les puces Trainium3 d'Amazon pour ses workloads IA.
- Le géant du VTC rejoint Anthropic, OpenAI et Apple parmi les grands clients des puces maison AWS.
- Le marché des puces IA alternatives à Nvidia s'accélère, avec 700 milliards de dollars d'investissements data centers prévus en 2026.
Ce qui s'est passé
Points clés à retenir
- Ce qui s'est passé
- Pourquoi c'est important
- Ce qu'il faut retenir
Amazon a annoncé qu'Uber élargissait considérablement son contrat avec AWS afin de faire tourner une part croissante des fonctionnalités de sa plateforme de VTC sur les processeurs conçus en interne par le géant du cloud. Le spécialiste de la mobilité prévoit d'intensifier son recours aux puces Graviton, déjà utilisées pour ses charges de travail classiques, tout en lançant un programme pilote autour de Trainium3. Ce dernier composant illustre la stratégie AWS Trainium puces IA, pensée pour concurrencer frontalement les GPU Nvidia sur l'entraînement et l'inférence des modèles. Pour Uber, l'enjeu est double : réduire la facture énergétique et financière de ses traitements massifs, tout en sécurisant des capacités de calcul dans un marché sous tension. Pour Amazon, ce contrat constitue une vitrine commerciale de poids, destinée à prouver que ses processeurs maison tiennent la comparaison face à l'écosystème CUDA.
Ce partenariat renforcé positionne Uber aux côtés d'acteurs majeurs de l'IA comme Anthropic, OpenAI et Apple, tous ayant récemment augmenté leur dépendance aux puces propriétaires AWS. Selon le PDG d'Amazon Andy Jassy, Trainium représente déjà un business de plusieurs milliards de dollars, confirmant la viabilité commerciale de l'alternative maison face au quasi-monopole de Nvidia.
Cette annonce s'inscrit dans un contexte d'investissements massifs des hyperscalers dans les infrastructures IA. D'après TechCrunch, Amazon prévoit 200 milliards de dollars de dépenses d'investissement en 2026, tandis que Google annonce entre 175 et 185 milliards. Au total, les géants du cloud prévoient de dépenser près de 700 milliards de dollars en projets de data centers cette année.
Pourquoi c'est important
La diversification des fournisseurs de puces IA est un enjeu stratégique majeur. La dépendance à Nvidia crée des goulots d'étranglement dans la chaîne d'approvisionnement et fait grimper les coûts pour les entreprises. L'adoption des puces Trainium par un acteur comme Uber, dont les besoins en inférence IA sont considérables pour l'optimisation des trajets et la tarification dynamique, valide la maturité de ces alternatives.
Pour les entreprises européennes, cette tendance signale une évolution du marché cloud vers des architectures hétérogènes. Les équipes infrastructure doivent anticiper cette diversification et évaluer les gains potentiels en coût et en performance des puces propriétaires des cloud providers, tout en mesurant les risques de verrouillage fournisseur que cela implique.
Ce qu'il faut retenir (2)
- AWS accélère sur ses puces maison et attire des clients majeurs hors du secteur IA pur, signe de maturité technologique.
- Les investissements data centers des hyperscalers atteindront 700 milliards de dollars en 2026, une course aux armements sans précédent.
- Les entreprises doivent évaluer les offres de puces propriétaires des cloud providers pour optimiser leurs coûts d'infrastructure IA.
Les puces Trainium d'AWS peuvent-elles vraiment concurrencer Nvidia ?
Trainium3 est conçu spécifiquement pour l'entraînement et l'inférence de modèles d'IA sur AWS. Si les GPU Nvidia restent la référence pour leur polyvalence et leur écosystème CUDA, les puces Trainium offrent un avantage coût significatif pour les workloads exécutés nativement sur AWS. L'adoption par des acteurs comme Anthropic, OpenAI et désormais Uber confirme leur compétitivité pour des cas d'usage à grande échelle.
Cette manœuvre d'Uber s'inscrit dans une tendance plus large de désengagement progressif — ou à tout le moins de diversification — vis-à-vis du quasi-monopole de Nvidia sur les puces d'entraînement et d'inférence IA. Depuis le lancement de Trainium2 en 2025, AWS a multiplié les partenariats stratégiques avec des acteurs technologiques de premier plan, Anthropic ayant notamment annoncé un engagement pouvant atteindre un million de puces Trainium dans le cadre du projet Rainier, son cluster de calcul dédié à l'entraînement des modèles Claude. L'arrivée d'Uber dans cet écosystème est significative car elle démontre que Trainium ne se limite plus aux seuls laboratoires d'IA générative : les cas d'usage s'étendent désormais aux entreprises technologiques traitant des volumes massifs de données en temps réel, comme l'optimisation d'itinéraires, la détection de fraude ou la tarification dynamique.
Sur le plan économique, ce repositionnement traduit une pression croissante sur les marges liée au coût des GPU Nvidia H100 et B200, dont la demande dépasse structurellement l'offre depuis plusieurs trimestres. Les puces Trainium, conçues en interne par Amazon via sa filiale Annapurna Labs, offrent généralement un rapport performance/prix inférieur de 30 à 40 % à celui des solutions Nvidia équivalentes pour certains workloads d'inférence, selon les chiffres communiqués par AWS lors de re:Invent. Cette différence tarifaire devient un argument déterminant pour des entreprises comme Uber, dont les besoins en inférence à grande échelle — des dizaines de millions de prédictions quotidiennes pour le matching chauffeurs-passagers — génèrent des coûts d'infrastructure considérables.
Ce qu'il faut retenir
- Uber devient le quatrième grand nom technologique à s'engager significativement sur Trainium, aux côtés d'Anthropic, OpenAI et Apple.
- Le programme pilote sur Trainium3 marque une phase de test avant un déploiement potentiellement plus large sur les workloads d'inférence critiques.
- L'écart de coût estimé de 30 à 40 % face à Nvidia constitue le principal levier d'adoption pour les entreprises à forte volumétrie de calcul IA.
- Cette diversification matérielle réduit la dépendance à un fournisseur unique, un enjeu de résilience pour les architectures cloud critiques.
Les puces Trainium3 d'AWS peuvent-elles vraiment concurrencer Nvidia ?
Techniquement, Trainium3, gravé en 3 nm, promet selon AWS un gain de performance de l'ordre de 4x par rapport à Trainium2 pour un même budget énergétique, un argument clé face aux contraintes croissantes d'alimentation électrique des data centers. Toutefois, l'écosystème logiciel reste le principal point de friction : contrairement à CUDA, la plateforme Nvidia disposant d'un support quasi universel dans les frameworks de machine learning, le SDK Neuron d'AWS nécessite encore des adaptations spécifiques pour certains modèles, ce qui limite pour l'instant son adoption aux entreprises disposant d'équipes MLOps suffisamment matures pour absorber ce coût de migration.
Besoin d'un accompagnement expert ?
Ayi NEDJIMI vous accompagne sur vos projets cybersécurité et IA.
Articles connexes :
📎 Articles complémentaires
Sources et références
À propos de l'auteur
Ayi NEDJIMI
Auditeur Senior Cybersécurité & Consultant IA
Expert Judiciaire — Cour d'Appel de Paris
Habilitation Confidentiel Défense
ayi@ayinedjimi-consultants.fr
Ayi NEDJIMI est un vétéran de la cybersécurité avec plus de 25 ans d'expérience sur des missions critiques. Ancien développeur Microsoft à Redmond sur le module GINA (Windows NT4) et co-auteur de la version française du guide de sécurité Windows NT4 pour la NSA.
À la tête d'Ayi NEDJIMI Consultants, il réalise des audits Lead Auditor ISO 42001 et ISO 27001, des pentests d'infrastructures critiques, du forensics et des missions de conformité NIS2 / AI Act.
Conférencier international (Europe & US), il a formé plus de 10 000 professionnels.
Domaines d'expertise
Ressources & Outils de l'auteur
Articles connexes
Miljödata : cyberattaque sur le RH suédois, 200 communes paralysées
Cyberattaque détectée le 23 août 2026 sur Miljödata, éditeur RH suédois : 200 communes privées de leurs outils de gestion des arrêts maladie et accidents du travail.
CVE-2026-60004 : faille RCE CVSS 9.8 dans Gitea activement exploitée
CVE-2026-60004, CVSS 9.8 : tout utilisateur avec accès écriture sur un dépôt Gitea peut exécuter du code arbitraire sur le serveur. CISA confirme l'exploitation active.
Gunra Ransomware : alerte CISA-FBI-NSA sur le RaaS issu de Conti
Advisory conjoint AA26-222A : CISA, FBI, NSA et la police coréenne alertent sur Gunra ransomware, un RaaS dérivé de Conti qui exploite des failles Fortinet non patchées.
Un projet cybersécurité ? Parlons-en.
Pentest, conformité NIS 2, ISO 27001, audit IA, RSSI externalisé… nos experts répondent sous 24h pour évaluer votre besoin et vous proposer un accompagnement sur mesure.
Commentaires
Aucun commentaire pour le moment. Soyez le premier à commenter !
Laisser un commentaire