L’IA qui transforme le business ?
Stratégies, mouvements et levées IA décryptés, chaque soir en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
AMD s'empare de Taalas pour booster l'IA intégrée au silicium
AMD acquiert la startup canadienne Taalas, qui développe des puces d'inférence spécialisées. Fondée à Toronto en 2023, Taalas a fait son apparition en février avec une approche originale : l'entreprise intègre l'architecture d'un modèle et ses paramètres entraînés directement dans la puce. Cela rend l'inférence extrêmement rapide, mais verrouille chaque puce à un seul modèle. Une puce de démonstration a atteint plus de 16 000 tokens par seconde par utilisateur en exécutant Llama 3.1-8B, bien plus rapidement que le matériel concurrent. Google travaillerait sur une puce similaire pour Gemini.
La puce de démonstration de Taalas, avec Llama codé en dur, surpasse toutes les autres puces d'inférence en termes de vitesse brute, mais elle est limitée à ce modèle unique.
AMD prévoit d'intégrer cette technologie dans sa feuille de route pour les accélérateurs et de l'offrir aux côtés des GPU Instinct comme solution au niveau système. Vamsi Boppana, vice-président senior de la division IA d'AMD, a déclaré que cet accord renforce le portefeuille IA de l'entreprise. Ljubisa Bajic, co-fondateur de Taalas, a ajouté qu'AMD offre l'échelle et la portée dont la startup a besoin. L'acquisition est soumise aux approbations réglementaires standard.






