Tu suis la course aux modèles IA ?
Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Mistral AI présente ML4, un modèle multimodal d'un trillion de paramètres d'abord proposé via un point d'accès public avec garde-fous. Les poids doivent être publiés après des tests de sécurité, tandis que l'entreprise souligne ses priorités sectorielles et ses moyens d'entraînement propres.
Mistral revendique un statut de laboratoire de pointe après ses tours C et D
Samsung a dirigé la série D de Mistral le mois dernier, valorisant l'entreprise à 21 milliards d'euros, soit environ 24,39 milliards de dollars. La conception de puces, citée parmi les usages visés par ML4, est essentielle pour ASML, qui a mené la série C. Mistral a précisé que l'hébergement de modèles chinois ne signifiait pas un changement de cap vers un simple fournisseur d'inférence. Avec ML4 Le Chonk, l'entreprise estime devoir être considérée comme un laboratoire à la pointe de la technologie. Les résultats de benchmarks du nouveau modèle sont encore en attente.
Accès via API, ouverture des poids annoncée et cap sur la sécurité
ML4 n'est pas encore proposé en accès à ses poids et reste pour l'heure disponible uniquement via un endpoint public muni de dispositifs de protection. Mistral prévoit de publier les poids dans trois semaines, une fois les vérifications de sécurité effectuées. Pierre Stock indique que l'entreprise travaillera avec des partenaires de confiance et des gouvernements pour que des poids ouverts servent à la défense et non à des attaques malveillantes. Les préoccupations de sécurité ont augmenté ces derniers mois chez les entreprises et les institutions ciblées. Selon lui, un modèle à poids ouverts est plus facile à auditer.
Capacités annoncées, entraînement sur 4 000 GPU et cibles métiers
Mistral AI a lancé ML4, un grand modèle multimodal surnommé Le Chonk en référence à 1 trillion de paramètres. L'ensemble de l'entraînement du modèle a été réalisé sur l'infrastructure interne de Mistral, mobilisant 4 000 GPU Nvidia, une quantité que Pierre Stock estime être deux à trois fois moindre que celle utilisée par les concurrents chinois et nettement inférieure à celle des acteurs à source fermée. La société cherche à prendre l'avantage sur ses concurrents américains et chinois et ambitionne que ML4 se positionne comme le meilleur modèle à poids ouverts de sa catégorie, en particulier en dehors de la Chine. Grâce à un entraînement spécialisé, ML4 pourrait dépasser certains modèles fermés dans des secteurs précis jugés stratégiques pour la clientèle, comme la cybersécurité, la finance ou la conception de puces. Cette stratégie s'inscrit dans un contexte décrit comme de plus en plus polarisé entre modèles fermés et modèles ouverts, tandis que Mistral met en avant ML4 comme une option alternative aux deux, dans l'esprit de la « troisième voie » mentionnée par Emmanuel Macron.




