Mistral : données UE et accès prioritaire limités

Le brief IA que les pros lisent chaque soir
Les 7 actus IA du jour, décryptées en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Mistral : données UE et accès prioritaire limités
Mistral offre désormais aux clients la possibilité de traiter des demandes d'IA via des serveurs situés en Europe ou aux États-Unis, tout en vendant un accès prioritaire pendant les périodes de forte affluence. Cependant, ces options sont assorties de limites importantes.
Lorsque les entreprises intègrent l'IA de Mistral dans leurs propres produits, les demandes sont envoyées à l'un des serveurs du fournisseur. Deux questions sont cruciales pour les clients professionnels : où se trouve réellement ce serveur et que se passe-t-il lorsque de nombreuses demandes sont envoyées simultanément ? Mistral propose désormais des réponses à ces questions, les présentant dans un article de blog dans le cadre d'une stratégie plus large de souveraineté européenne en matière d'IA.
L'inférence régionale est désormais généralement disponible. Les clients peuvent envoyer des demandes à un point de terminaison européen (api.eu.mistral.ai) ou à un point de terminaison américain (api.us.mistral.ai), et le traitement reste dans cette région. Cela est important pour les banques, les agences gouvernementales et les assureurs qui doivent prouver que les données des clients ne quittent jamais l'UE. Des chemins réseau plus courts signifient également une latence réduite. Quiconque utilisant le point de terminaison par défaut n'a aucune garantie quant à l'endroit où sa demande est traitée. Le routage régional coûte 10 % en plus des tarifs standards.
Le traitement des données UE comporte des limites significatives
Cependant, parmi les outils supplémentaires de la plateforme, seule l'appel de fonction fonctionne avec les points de terminaison régionaux, ce qui signifie la capacité du modèle à déclencher des API externes. Les agents, le traitement par lots et la gestion de fichiers ne sont pas disponibles aux adresses régionales. La sélection de modèles varie également selon la région. Mistral ne publie pas de liste fixe ; les clients doivent interroger chaque point de terminaison pour voir ce qui est proposé.
La raison probable est l'écart entre une simple requête de modèle et le stockage d'un état intermédiaire. Un appel de modèle standard n'a pas besoin de stockage persistant. Les agents, les travaux par lots et le stockage de fichiers conservent des données au-delà d'un seul appel, comme des étapes intermédiaires ou des documents téléchargés. Mistral qualifie ces fonctionnalités de "stateful". Elles nécessitent probablement une infrastructure supplémentaire sur site, bien que la société ne l'ait pas confirmé.
Le champ d'application est également plus étroit que ne le suggère le terme "souveraineté". Les paramètres de compte, les clés API, la facturation et les statistiques d'utilisation peuvent toujours être traités en dehors de la région choisie, selon la documentation. L'article de blog mentionne également des transferts limités et sécurisés vers des sous-traitants en dehors de la région. Ce qui est régional, c'est l'étape de calcul, et non l'ensemble de la plateforme. Que les demandes soient stockées ou enregistrées par la suite dépend d'un paramètre distinct appelé Zero Data Retention.
Ce que cela signifie en pratique, c'est que les clients qui envoient directement un texte de contrat à un modèle peuvent le traiter via le point de terminaison de l'UE. Quiconque a besoin d'agents ou de gestion de fichiers via l'API Files ne bénéficiera pas de la même garantie.
Pourquoi les entreprises paieraient pour une file d'attente plus rapide
La deuxième offre est le Priority Tier, actuellement en bêta ouverte. Tous les clients partagent les mêmes centres de données. Lorsque de nombreuses demandes arrivent en même temps, les temps de réponse augmentent. Le Priority Tier est une voie rapide : les demandes des clients payants sont traitées avant le trafic régulier lorsque la charge est élevée. Mistral cible des cas d'utilisation où la latence coûte de l'argent réel, comme un chatbot de service client ou un système de production sur un site de fabrication.
Ce niveau inclut un SLA de disponibilité de 99,5 %, un niveau de service contractuellement garanti qui permet environ trois heures et demie de temps d'arrêt par mois. Le niveau standard de Mistral n'offre pas une telle garantie.
Les clients activent l'accès prioritaire via un seul paramètre API appelé service_tier. En le définissant sur "auto", la demande est envoyée par la voie rapide lorsque la capacité est disponible. La valeur par défaut est "standard_only", qui suit le chemin régulier. Chaque client bénéficie également de limites de taux négociées individuellement concernant le nombre de demandes par minute bénéficiant d'un traitement prioritaire. Dépasser cette limite ne fait pas échouer la demande ; elle revient simplement au traitement standard. La réponse API indique quel niveau a effectivement traité la demande, permettant aux clients de vérifier s'ils obtiennent ce pour quoi ils paient.
Mistral facture 1,75 fois le prix standard, soit une majoration de 75 %. Les réductions provenant du prompt caching, où les segments de texte répétés sont stockés et facturés à des tarifs inférieurs, s'appliquent toujours. Ces réductions peuvent atteindre 90 % et sont calculées en premier selon la documentation, avec la majoration prioritaire appliquée ensuite. Le Priority Tier n'est pas en libre-service. Les clients doivent signer un contrat avec l'équipe commerciale de Mistral.
Des modèles tiers rejoignent la plateforme
Mistral ouvre également sa plateforme à des modèles ouverts d'autres fournisseurs. Le premier est GLM-5.2 de la société chinoise d'IA Z.ai, qui fonctionne selon les mêmes règles et garanties régionales que les propres modèles de Mistral. Pour financer la capacité de calcul requise, Mistral collecte des engagements d'achat pluriannuels de clients importants, regroupés sous forme d'Unités de Calcul Européennes. L'idée est que la construction de nouveaux centres de données en Europe ne soit rentable que si suffisamment d'entreprises s'engagent sur le long terme.
Mistral est membre de l'Open Secure AI Alliance et de la coalition Nemotron de Nvidia. La société considère l'hébergement de poids de modèles tiers sur sa plateforme comme une extension naturelle de ce travail.
Brief IA — L'actualité IA en français
L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.