Brief IA : Mistral lance ML4, poids ouverts annoncés sous trois semaines

Mistral lance ML4, poids ouverts annoncés sous trois semaines

Brief IA
Tom Levy·3 min·3 vues

Mistral AI lance ML4, un modèle multimodal d'un trillion de paramètres, accessible d'abord via un point d'accès public avec garde-fous Les poids doivent être publiés dans trois semaines après des tests de sécurité, avec une collaboration prévue avec partenaires et pouvoirs publics L'entraînement a mobilisé 4 000 GPU Nvidia, un volume inférieur à celui de concurrents chinois et fermés.

⚡
En bref
1Mistral AI lance ML4, un modèle multimodal d'un trillion de paramètres, accessible d'abord via un point d'accès public avec garde-fous
2Les poids doivent être publiés dans trois semaines après des tests de sécurité, avec une collaboration prévue avec partenaires et pouvoirs publics
3L'entraînement a mobilisé 4 000 GPU Nvidia, un volume inférieur à celui de concurrents chinois et fermés
4ML4 cible des usages comme la cybersécurité, la finance et la conception de puces, soutenu par ASML et Samsung
💡Pourquoi c'est important — ML4 incarne la stratégie de Mistral de proposer une alternative européenne aux modèles fermés et ouverts dominés par la Chine, tout en répondant à des enjeux industriels clés.
⚡Le brief IA que lisent les pros

Tu suis la course aux modèles IA ?

Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

Mistral AI présente ML4, un modèle multimodal d'un trillion de paramètres d'abord proposé via un point d'accès public avec garde-fous. Les poids doivent être publiés après des tests de sécurité, tandis que l'entreprise souligne ses priorités sectorielles et ses moyens d'entraînement propres.

Mistral revendique un statut de laboratoire de pointe après ses tours C et D

Samsung a dirigé la série D de Mistral le mois dernier, valorisant l'entreprise à 21 milliards d'euros, soit environ 24,39 milliards de dollars. La conception de puces, citée parmi les usages visés par ML4, est essentielle pour ASML, qui a mené la série C. Mistral a précisé que l'hébergement de modèles chinois ne signifiait pas un changement de cap vers un simple fournisseur d'inférence. Avec ML4 Le Chonk, l'entreprise estime devoir être considérée comme un laboratoire à la pointe de la technologie. Les résultats de benchmarks du nouveau modèle sont encore en attente.

Accès via API, ouverture des poids annoncée et cap sur la sécurité

ML4 n'est pas encore proposé en accès à ses poids et reste pour l'heure disponible uniquement via un endpoint public muni de dispositifs de protection. Mistral prévoit de publier les poids dans trois semaines, une fois les vérifications de sécurité effectuées. Pierre Stock indique que l'entreprise travaillera avec des partenaires de confiance et des gouvernements pour que des poids ouverts servent à la défense et non à des attaques malveillantes. Les préoccupations de sécurité ont augmenté ces derniers mois chez les entreprises et les institutions ciblées. Selon lui, un modèle à poids ouverts est plus facile à auditer.

Capacités annoncées, entraînement sur 4 000 GPU et cibles métiers

Mistral AI a lancé ML4, un grand modèle multimodal surnommé Le Chonk en référence à 1 trillion de paramètres. L'ensemble de l'entraînement du modèle a été réalisé sur l'infrastructure interne de Mistral, mobilisant 4 000 GPU Nvidia, une quantité que Pierre Stock estime être deux à trois fois moindre que celle utilisée par les concurrents chinois et nettement inférieure à celle des acteurs à source fermée. La société cherche à prendre l'avantage sur ses concurrents américains et chinois et ambitionne que ML4 se positionne comme le meilleur modèle à poids ouverts de sa catégorie, en particulier en dehors de la Chine. Grâce à un entraînement spécialisé, ML4 pourrait dépasser certains modèles fermés dans des secteurs précis jugés stratégiques pour la clientèle, comme la cybersécurité, la finance ou la conception de puces. Cette stratégie s'inscrit dans un contexte décrit comme de plus en plus polarisé entre modèles fermés et modèles ouverts, tandis que Mistral met en avant ML4 comme une option alternative aux deux, dans l'esprit de la « troisième voie » mentionnée par Emmanuel Macron.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires