Brief IA : AMD s'empare de Taalas pour booster l'IA intégrée au silicium

AMD s'empare de Taalas pour booster l'IA intégrée au silicium

Brief IA
Tom Levy·1 min·1 vues

AMD a acquis Taalas, une startup canadienne fondée en 2023, pour intégrer des modèles d'IA dans ses puces, promettant des vitesses d'inférence atteignant 16 000 tokens par seconde avec Llama 3.1-8B. Cette acquisition pourrait révolutionner la vitesse et l'efficacité des puces d'IA, renforçant ainsi la position d'AMD face à des concurrents comme Google, qui explore également des technologies similaires pour son projet Gemini.

En bref
1AMD a acquis Taalas, une startup canadienne spécialisée dans l'intégration des modèles d'IA dans les puces.
2Les puces de Taalas promettent des vitesses impressionnantes, atteignant 16 000 tokens par seconde avec Llama 3.1-8B.
3Google explore une technologie similaire pour son projet Gemini, suivant la tendance de l'IA intégrée.
💡Pourquoi c'est importantCette acquisition pourrait révolutionner la vitesse et l'efficacité des puces d'IA, renforçant la position d'AMD face à ses concurrents comme Google.
Le brief IA que lisent les pros

L’IA qui transforme le business ?

Stratégies, mouvements et levées IA décryptés, chaque soir en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

AMD s'empare de Taalas pour booster l'IA intégrée au silicium

AMD acquiert la startup canadienne Taalas, qui développe des puces d'inférence spécialisées. Fondée à Toronto en 2023, Taalas a fait son apparition en février avec une approche originale : l'entreprise intègre l'architecture d'un modèle et ses paramètres entraînés directement dans la puce. Cela rend l'inférence extrêmement rapide, mais verrouille chaque puce à un seul modèle. Une puce de démonstration a atteint plus de 16 000 tokens par seconde par utilisateur en exécutant Llama 3.1-8B, bien plus rapidement que le matériel concurrent. Google travaillerait sur une puce similaire pour Gemini.

La puce de démonstration de Taalas, avec Llama codé en dur, surpasse toutes les autres puces d'inférence en termes de vitesse brute, mais elle est limitée à ce modèle unique.

AMD prévoit d'intégrer cette technologie dans sa feuille de route pour les accélérateurs et de l'offrir aux côtés des GPU Instinct comme solution au niveau système. Vamsi Boppana, vice-président senior de la division IA d'AMD, a déclaré que cet accord renforce le portefeuille IA de l'entreprise. Ljubisa Bajic, co-fondateur de Taalas, a ajouté qu'AMD offre l'échelle et la portée dont la startup a besoin. L'acquisition est soumise aux approbations réglementaires standard.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires