Tu veux les meilleurs outils IA avant les autres ?
On teste et on décrypte les nouveaux outils IA chaque soir, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
AMD a récemment présenté un mini PC capable de faire tourner des modèles d'intelligence artificielle (IA) gigantesques directement en local, éliminant ainsi le besoin de cloud ou d'abonnements mensuels. Ce développement pourrait représenter une avancée significative pour les utilisateurs cherchant à réduire leurs coûts tout en maintenant la confidentialité de leurs données.
Le cœur de cette innovation réside dans le processeur Ryzen AI Max+ 395, également connu sous le nom de code Strix Halo. Ce processeur est intégré dans des machines comme le GMKtec EVO-X2 et bénéficie d'une mémoire unifiée pouvant atteindre 128 Go. Une partie de cette mémoire est dédiée au processeur graphique, permettant jusqu'à 96 Go de VRAM. Cette configuration permet de charger des modèles d'IA bien plus volumineux que ceux gérés par la plupart des cartes graphiques grand public.
AMD affirme que son mini PC peut exécuter des modèles atteignant 235 milliards de paramètres en local, en utilisant des outils gratuits tels qu'Ollama. Cela signifie que les utilisateurs peuvent conserver leurs données sur leur propre machine, sans les envoyer vers un serveur distant, et sans être limités par des abonnements.
Lors de tests effectués par AMD, cette configuration a surpassé une RTX 5080 dans certaines tâches d'inférence IA, bien que cela dépende des scénarios spécifiques utilisés. Cependant, face à des cartes très haut de gamme comme la RTX 5090, certaines IA s'exécutent encore plus lentement.
Pour les entreprises manipulant des données sensibles, cette solution présente un avantage évident : les documents restent en local et les coûts liés aux services cloud peuvent être considérablement réduits. Un consultant spécialisé a témoigné avoir remplacé ses coûteuses locations de GPU par ce type de configuration, améliorant ainsi la rentabilité de son activité.
Néanmoins, tout n'est pas parfait. Les performances varient selon les modèles utilisés et le logiciel ROCm, l'écosystème d'AMD pour l'IA, doit encore rattraper son retard sur CUDA, la plateforme de Nvidia. Malgré ces défis, le mini PC d'AMD démontre que l'exécution locale de modèles géants est de plus en plus réalisable sur des machines compactes.




