Brief IA : AMD et Cerebras défient Nvidia avec l'inférence IA

AMD et Cerebras défient Nvidia avec l'inférence IA

Brief IA
Tom Levy·3 min·1 vues

AMD a annoncé un partenariat avec Cerebras pour promouvoir l'inférence désagrégée, redistribuant les charges de travail IA. Le système Helios d'AMD promet des performances supérieures à celles de Nvidia tout en optimisant les coûts. Cette alliance pourrait redéfinir le marché des puces IA et influencer les stratégies des géants technologiques.

En bref
1AMD s'associe à Cerebras pour promouvoir l'inférence désagrégée, redistribuant les charges de travail IA.
2Le système Helios d'AMD promet des performances supérieures à celles de Nvidia, avec un coût optimisé.
3L'inférence désagrégée, bien que prometteuse, pose des défis d'orchestration entre les puces.
💡Pourquoi c'est importantCette alliance pourrait redéfinir le marché des puces IA, influençant les stratégies des géants technologiques.
Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

AMD et Cerebras : une alliance stratégique pour l'avenir de l'IA

AMD a récemment annoncé un partenariat stratégique avec la startup de puces Cerebras, marquant un tournant significatif dans le domaine de l'inférence IA. L'entreprise mise sur une nouvelle méthode appelée "inférence désagrégée", qui consiste à répartir les charges de travail sur plusieurs types de matériel, plutôt que de s'appuyer sur une seule puce. Cette approche novatrice est incarnée par le système serveur Helios d'AMD, qui promet de rivaliser avec les solutions de Nvidia en termes de performance et de coût.

Une nouvelle approche de l'inférence IA

Lors d'une annonce faite par la PDG d'AMD, Lisa Su, il a été révélé que l'entreprise s'associe à Cerebras pour adopter cette nouvelle approche de l'inférence IA. L'inférence IA est le processus par lequel les modèles d'intelligence artificielle génèrent des réponses à partir de données. Traditionnellement, le même type de matériel était utilisé pour traiter les requêtes et générer les réponses. Cependant, AMD soutient que ces deux tâches nécessitent des types de matériel distincts. Le système Helios, conçu pour gérer un volume élevé de requêtes, travaille en tandem avec la puce géante de Cerebras, qui excelle dans la génération rapide de réponses.

Helios dans les centres de données de Cerebras

Le partenariat entre AMD et Cerebras prévoit l'intégration du système Helios dans les centres de données de Cerebras d'ici la fin de l'année. Cette collaboration intervient à un moment où la demande pour des puces IA explose, avec des entreprises comme Nvidia et Broadcom en tête de la conception de puces pour l'entraînement à l'IA. La compétition s'intensifie alors que l'industrie se tourne de plus en plus vers l'application pratique des modèles d'IA.

Un changement de paradigme dans l'industrie

L'accord entre AMD et Cerebras s'inscrit dans un mouvement plus large vers l'inférence désagrégée, un changement que les analystes observent déjà. En juin, UBS a souligné que les limitations des architectures actuelles poussent à cette transition. Nvidia, par exemple, a intégré la startup Groq pour explorer des configurations similaires, et Amazon Web Services suit également cette tendance pour améliorer l'efficacité et réduire les coûts. Cependant, cette approche présente des défis, notamment en matière d'orchestration, c'est-à-dire la coordination efficace entre différentes puces pour assurer un fonctionnement harmonieux.

AMD dévoile Helios lors de l'événement Advancing AI

Lors de l'événement Advancing AI, AMD a présenté Helios, son dernier système serveur, qui combine plusieurs types de puces IA. Cette annonce fait suite à la présentation du rack Vera Rubin NVL72 de Nvidia. AMD a également annoncé des partenariats d'infrastructure de plusieurs milliards de dollars avec des géants du cloud et des laboratoires d'IA tels qu'OpenAI, Meta, Microsoft, Oracle et Anthropic.

AMD défie Nvidia sur le terrain de la performance

AMD a profité de l'événement pour lancer une attaque directe contre Nvidia, affirmant que Helios offre jusqu'à 30 % de tokens d'inférence supplémentaires par dollar comparé au rack Vera Rubin NVL72 de Nvidia. Selon Lisa Su, chaque système Helios peut offrir des performances accrues pour les modèles les plus grands, une capacité étendue pour des contextes plus longs, et une bande passante capable de s'étendre sur des milliers de racks.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires