Tu suis la course aux modèles IA ?
Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
DeepSeek dévoile ses nouveaux modèles V4
Le laboratoire d'intelligence artificielle chinois DeepSeek a récemment lancé deux nouvelles versions de son modèle de langage de grande taille, le DeepSeek V4. Ces modèles, nommés V4 Flash et V4 Pro, succèdent au modèle V3.2 de l'année dernière et au modèle de raisonnement R1, qui avait déjà marqué les esprits dans le secteur de l'IA.
Les modèles V4 de DeepSeek utilisent une technique de mélange d'experts, permettant d'activer uniquement certains paramètres pour chaque tâche, ce qui réduit les coûts d'inférence. Chaque modèle dispose d'une fenêtre de contexte de 1 million de tokens, facilitant ainsi l'intégration de grandes bases de code ou de documents dans les invites.
Des performances et une taille impressionnantes
Le modèle V4 Pro se distingue par ses 1,6 trillion de paramètres, dont 49 milliards sont activés, le plaçant en tête des modèles à poids ouverts. Il surpasse ainsi le Kimi K 2.6 de Moonshot AI et le M1 de MiniMax. Le modèle V4 Flash, plus petit, possède 284 milliards de paramètres avec 13 milliards actifs.
DeepSeek affirme que ces modèles sont plus performants et efficaces que leur prédécesseur, le V3.2, grâce à des améliorations architecturales. Ils auraient presque comblé l'écart avec les modèles leaders actuels, qu'ils soient ouverts ou fermés, en particulier sur les benchmarks de raisonnement.
Comparaison avec les modèles de pointe
Le modèle V4-Pro-Max de DeepSeek surpasserait ses concurrents open-source sur certains benchmarks de raisonnement, et rivaliserait avec GPT-5.2 et Gemini 3.0 Pro. En matière de compétition de codage, les performances des modèles V4 seraient comparables à celles de GPT-5.4.
Cependant, les modèles V4 montrent un léger retard dans les tests de connaissances par rapport aux modèles de pointe comme GPT-5.4 d'OpenAI et Gemini 3.1 Pro de Google. Ce retard est estimé à environ 3 à 6 mois par rapport aux leaders du marché.
Limitations et coût
Les modèles V4 Flash et V4 Pro ne supportent que le texte, contrairement à de nombreux homologues à code source fermé, qui offrent un support pour la compréhension et la génération d'audio, de vidéo et d'images. Un des atouts majeurs des modèles V4 est leur coût. Le modèle V4 Flash est proposé à 0,14 $ par million de tokens d'entrée et 0,28 $ par million de tokens de sortie, tandis que le V4 Pro est à 0,145 $ par million de tokens d'entrée et 3,48 $ par million de tokens de sortie. Ces tarifs sont inférieurs à ceux de nombreux modèles de pointe, tels que GPT-5.4 Nano, Gemini 3.1 Flash, et Claude Haiku 4.5.
Contexte de tensions internationales
Le lancement de ces modèles intervient dans un contexte tendu, un jour après que les États-Unis ont accusé la Chine de vol de propriété intellectuelle à grande échelle dans le domaine de l'IA. DeepSeek a été spécifiquement accusé par Anthropic et OpenAI de "distillation", c'est-à-dire de copie de leurs modèles d'IA.


