Tu suis la course aux modèles IA ?
Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Le monde de l'intelligence artificielle a été bouleversé par l'annonce de DeepSeek V4, un modèle de la start-up chinoise DeepSeek, basée à Hangzhou. Ce modèle a été lancé le 24 avril, seulement un jour après la présentation de GPT-5.5 par OpenAI, le 23 avril. Ce qui rend DeepSeek V4 particulièrement notable, c'est son utilisation exclusive des puces Ascend de Huawei, sans aucun recours aux GPU NVIDIA.
Deux variantes, deux approches
DeepSeek a choisi de décliner son modèle V4 en deux versions distinctes : Pro et Flash. La version Pro est un véritable mastodonte avec 1 600 milliards de paramètres, mais grâce à l'architecture Mixture-of-Experts, seuls 49 milliards de paramètres sont activés lors de chaque requête. En parallèle, la version Flash est plus compacte, avec 284 milliards de paramètres, dont 13 milliards sont activés. Les deux versions partagent une fenêtre de contexte d'un million de jetons.
La version Pro est conçue pour gérer des tâches complexes et des capacités agentiques avancées, tandis que la version Flash est optimisée pour une inférence rapide et économique. Ces deux modèles sont accessibles via le site de DeepSeek, en mode "Instant" ou "Expert", ainsi que par API.
Un développement complexe et retardé
Le calendrier de lancement de DeepSeek V4 a été particulièrement chargé. Initialement prévu pour février, puis mars, le lancement a été retardé en raison de la nécessité de migrer l'intégralité du code d'entraînement de l'écosystème CUDA de NVIDIA vers le cadriciel maison de Huawei, CANN. Ce processus complexe a finalement abouti, permettant la sortie de ce modèle ambitieux. Une version intermédiaire, V4-Lite, avait même brièvement fait surface le 9 mars.
Un modèle pionnier sur silicium chinois
DeepSeek V4 est le premier modèle d'IA de classe frontier entièrement entraîné sur des puces chinoises, marquant une rupture significative avec la dépendance traditionnelle aux GPU NVIDIA. Jusqu'à présent, même les laboratoires les plus avancés de Pékin s'appuyaient sur les GPU NVIDIA pour leurs modèles lourds. En outre, DeepSeek a choisi de ne pas transmettre son modèle V4 à NVIDIA ou AMD pour optimisation, une pratique pourtant courante dans l'industrie, préférant offrir cette opportunité aux fabricants chinois.
Le timing du lancement de DeepSeek V4 est également significatif. Il est intervenu juste après la publication d'un mémo de la Maison-Blanche, le 23 avril, accusant la Chine de "pillage industriel par distillation". En publiant un modèle open source si rapidement après GPT-5.5, DeepSeek a réduit à quelques heures le monopole médiatique d'OpenAI, soulignant ainsi une nouvelle ère de compétition technologique où l'indépendance matérielle devient un atout stratégique majeur.


