Brief IA : DeepSeek V4 : Huawei remplace NVIDIA, défiant GPT-5.5

DeepSeek V4 : Huawei remplace NVIDIA, défiant GPT-5.5

Brief IA
Tom Levy·2 min·2 vues

Deepseek, une start-up chinoise, a lancé son modèle IA V4 en deux variantes, Pro et Flash, le 24 avril 2023, juste après la sortie de GPT-5.5 par OpenAI. Ce modèle est entièrement basé sur du silicium Huawei, sans composants NVIDIA, marquant une avancée significative dans l'autonomie technologique de la Chine et redéfinissant la concurrence dans le secteur de l'IA.

En bref
1DeepSeek a lancé son modèle V4, utilisant exclusivement des puces Huawei, juste après GPT-5.5 d'OpenAI.
2Le modèle V4 se décline en deux versions : Pro avec 1 600 milliards de paramètres et Flash avec 284 milliards.
3Le développement a nécessité de migrer de CUDA de NVIDIA vers CANN de Huawei, retardant sa sortie initiale.
💡Pourquoi c'est importantDeepSeek V4 marque un tournant vers l'indépendance technologique chinoise, défiant la domination des puces NVIDIA.
Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

Le monde de l'intelligence artificielle a été bouleversé par l'annonce de DeepSeek V4, un modèle de la start-up chinoise DeepSeek, basée à Hangzhou. Ce modèle a été lancé le 24 avril, seulement un jour après la présentation de GPT-5.5 par OpenAI, le 23 avril. Ce qui rend DeepSeek V4 particulièrement notable, c'est son utilisation exclusive des puces Ascend de Huawei, sans aucun recours aux GPU NVIDIA.

Deux variantes, deux approches

DeepSeek a choisi de décliner son modèle V4 en deux versions distinctes : Pro et Flash. La version Pro est un véritable mastodonte avec 1 600 milliards de paramètres, mais grâce à l'architecture Mixture-of-Experts, seuls 49 milliards de paramètres sont activés lors de chaque requête. En parallèle, la version Flash est plus compacte, avec 284 milliards de paramètres, dont 13 milliards sont activés. Les deux versions partagent une fenêtre de contexte d'un million de jetons.

La version Pro est conçue pour gérer des tâches complexes et des capacités agentiques avancées, tandis que la version Flash est optimisée pour une inférence rapide et économique. Ces deux modèles sont accessibles via le site de DeepSeek, en mode "Instant" ou "Expert", ainsi que par API.

Un développement complexe et retardé

Le calendrier de lancement de DeepSeek V4 a été particulièrement chargé. Initialement prévu pour février, puis mars, le lancement a été retardé en raison de la nécessité de migrer l'intégralité du code d'entraînement de l'écosystème CUDA de NVIDIA vers le cadriciel maison de Huawei, CANN. Ce processus complexe a finalement abouti, permettant la sortie de ce modèle ambitieux. Une version intermédiaire, V4-Lite, avait même brièvement fait surface le 9 mars.

Un modèle pionnier sur silicium chinois

DeepSeek V4 est le premier modèle d'IA de classe frontier entièrement entraîné sur des puces chinoises, marquant une rupture significative avec la dépendance traditionnelle aux GPU NVIDIA. Jusqu'à présent, même les laboratoires les plus avancés de Pékin s'appuyaient sur les GPU NVIDIA pour leurs modèles lourds. En outre, DeepSeek a choisi de ne pas transmettre son modèle V4 à NVIDIA ou AMD pour optimisation, une pratique pourtant courante dans l'industrie, préférant offrir cette opportunité aux fabricants chinois.

Le timing du lancement de DeepSeek V4 est également significatif. Il est intervenu juste après la publication d'un mémo de la Maison-Blanche, le 23 avril, accusant la Chine de "pillage industriel par distillation". En publiant un modèle open source si rapidement après GPT-5.5, DeepSeek a réduit à quelques heures le monopole médiatique d'OpenAI, soulignant ainsi une nouvelle ère de compétition technologique où l'indépendance matérielle devient un atout stratégique majeur.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires