AMD et Cerebras défient Nvidia avec l'inférence IA

Le brief IA que les pros lisent chaque soir
Les 7 actus IA du jour, décryptées en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
AMD et Cerebras : une alliance stratégique pour l'avenir de l'IA
AMD a récemment annoncé un partenariat stratégique avec la startup de puces Cerebras, marquant un tournant significatif dans le domaine de l'inférence IA. L'entreprise mise sur une nouvelle méthode appelée "inférence désagrégée", qui consiste à répartir les charges de travail sur plusieurs types de matériel, plutôt que de s'appuyer sur une seule puce. Cette approche novatrice est incarnée par le système serveur Helios d'AMD, qui promet de rivaliser avec les solutions de Nvidia en termes de performance et de coût.
Une nouvelle approche de l'inférence IA
Lors d'une annonce faite par la PDG d'AMD, Lisa Su, il a été révélé que l'entreprise s'associe à Cerebras pour adopter cette nouvelle approche de l'inférence IA. L'inférence IA est le processus par lequel les modèles d'intelligence artificielle génèrent des réponses à partir de données. Traditionnellement, le même type de matériel était utilisé pour traiter les requêtes et générer les réponses. Cependant, AMD soutient que ces deux tâches nécessitent des types de matériel distincts. Le système Helios, conçu pour gérer un volume élevé de requêtes, travaille en tandem avec la puce géante de Cerebras, qui excelle dans la génération rapide de réponses.
Helios dans les centres de données de Cerebras
Le partenariat entre AMD et Cerebras prévoit l'intégration du système Helios dans les centres de données de Cerebras d'ici la fin de l'année. Cette collaboration intervient à un moment où la demande pour des puces IA explose, avec des entreprises comme Nvidia et Broadcom en tête de la conception de puces pour l'entraînement à l'IA. La compétition s'intensifie alors que l'industrie se tourne de plus en plus vers l'application pratique des modèles d'IA.
Un changement de paradigme dans l'industrie
L'accord entre AMD et Cerebras s'inscrit dans un mouvement plus large vers l'inférence désagrégée, un changement que les analystes observent déjà. En juin, UBS a souligné que les limitations des architectures actuelles poussent à cette transition. Nvidia, par exemple, a intégré la startup Groq pour explorer des configurations similaires, et Amazon Web Services suit également cette tendance pour améliorer l'efficacité et réduire les coûts. Cependant, cette approche présente des défis, notamment en matière d'orchestration, c'est-à-dire la coordination efficace entre différentes puces pour assurer un fonctionnement harmonieux.
AMD dévoile Helios lors de l'événement Advancing AI
Lors de l'événement Advancing AI, AMD a présenté Helios, son dernier système serveur, qui combine plusieurs types de puces IA. Cette annonce fait suite à la présentation du rack Vera Rubin NVL72 de Nvidia. AMD a également annoncé des partenariats d'infrastructure de plusieurs milliards de dollars avec des géants du cloud et des laboratoires d'IA tels qu'OpenAI, Meta, Microsoft, Oracle et Anthropic.
AMD défie Nvidia sur le terrain de la performance
AMD a profité de l'événement pour lancer une attaque directe contre Nvidia, affirmant que Helios offre jusqu'à 30 % de tokens d'inférence supplémentaires par dollar comparé au rack Vera Rubin NVL72 de Nvidia. Selon Lisa Su, chaque système Helios peut offrir des performances accrues pour les modèles les plus grands, une capacité étendue pour des contextes plus longs, et une bande passante capable de s'étendre sur des milliers de racks.
Brief IA — L'actualité IA en français
L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.