Nvidia lance Vera Rubin pour optimiser l’orchestration des données IA

Le brief IA que les pros lisent chaque soir
Les 7 actus IA du jour, décryptées en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
L'orchestration des données devient un point névralgique à l'ère des centres de données à l'échelle des gigawatts. Nvidia met en avant une pile matérielle dédiée, dont l'architecture Vera Rubin et le CPU Vera, pour optimiser ce maillon. OpenAI suit une autre voie avec sa puce Jalapeño, pensée pour réduire au minimum les mouvements de données.
La bataille se déplace vers l’efficacité système, au-delà du seul GPU
La concurrence dans l’IA évolue vers une couche où la capacité à faire fonctionner l’ensemble du système efficacement prime sur la seule construction d’un GPU rival. Ce recentrage sur l’orchestration des données ne constitue pas automatiquement un avantage pour Nvidia, qui doit désormais affronter d’autres fabricants de puces et des hyperscalers, comme elle l’a fait sur les GPU. Nvidia dispose d’un matériel avancé pour gérer les systèmes autour du GPU, ce qui lui confère un atout dans ce segment, alors que l’exploitation efficace de centres de données à méga-échelle reste complexe et que ce défi s’accroît avec l’ampleur et la rapidité des déploiements. À l’échelle des gigawatts, l’orchestration devient encore plus difficile, et à ce stade, Nvidia semble bénéficier d’une avance notable.
Vera Rubin : une pile pour orchestrer données, stockage et réseau
Nvidia déploie l’architecture Vera Rubin, qui associe le GPU Rubin, le CPU Vera, l’accélérateur d’inférence Groq 3 LPX et des racks dédiés au stockage et au réseau. Ces systèmes sont conçus pour optimiser tout ce qui se situe en dehors du GPU. D’après Jason Hardy, vice-président de la technologie de stockage chez Nvidia, le CPU Vera vise à résoudre le problème de l’orchestration des données, dans un environnement où la quantité de mémoire pouvant être intégrée par serveur ou plateforme demeure contrainte et où il est difficile de garantir l’acheminement des données au moment opportun. À mesure que les entreprises tentent de diminuer la consommation de tokens par watt, la gestion du flux de données devient un enjeu majeur. Hardy précise que certaines tâches accélérées par le CPU Vera ont bénéficié d’une performance multipliée par plus de trois, ce qui, selon lui, permet d’utiliser pleinement le flash sans provoquer de goulet d’étranglement.
Des stratégies alternatives : OpenAI limite les mouvements de données
OpenAI a développé la puce Jalapeño pour réduire les mouvements de données. L’entreprise précise que Jalapeño est conçue pour minimiser ces mouvements ainsi que les délais de communication. Son large domaine permet de maintenir la charge de travail au sein d’un système connecté, ce qui limite les transferts et contribue à conserver des performances rapides et efficaces de bout en bout. Cette approche vise à accroître l’efficacité par un contrôle du trafic plus intelligent plutôt que par l’ajout de cycles processeur, et participe à l’émergence d’une nouvelle couche d’infrastructure sur laquelle les entreprises peuvent se différencier.
Contexte marché : la fin du monopole GPU et ses effets
Amazon et Google ont conçu leurs propres puces, et Nvidia n’est plus seul sur le marché des GPU. Sa position initiale comme unique source de GPU de pointe avait été très rentable. Des investisseurs se sont interrogés sur la durée de cet avantage, alors que la capitalisation de Nvidia a été multipliée par 10 entre le début de 2023 et la mi-2025, avant qu’une progression plus modeste ne s’installe l’an dernier, sur fond d’inquiétudes liées à la concurrence. Un nouveau récit a émergé à la suite de résultats publiés un mercredi, mettant l’accent sur les atouts au-delà du GPU. Parallèlement, l’augmentation de la puissance de calcul s’est accompagnée d’une hausse des capacités mémoire, et des acteurs comme Micron ont profité de la deuxième vague du boom des infrastructures.
Brief IA — L'actualité IA en français
L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.