L’IA qui transforme le business ?
Stratégies, mouvements et levées IA décryptés, chaque soir en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Mistral révolutionne la synthèse vocale avec Voxtral
La startup française Mistral, spécialisée dans l'intelligence artificielle, a récemment introduit Voxtral TTS, son premier modèle de synthèse vocale. Ce modèle innovant supporte neuf langues, dont l'allemand, l'anglais, le français et l'espagnol, et se distingue par sa compacité, intégrant quatre milliards de paramètres.
Voxtral TTS se démarque par sa capacité à produire une parole réaliste et émotionnellement expressive. Une de ses caractéristiques les plus impressionnantes est sa faculté à s'adapter à de nouvelles voix en utilisant seulement trois secondes d'audio de référence.
Performances et accessibilité
En termes de performance, Voxtral TTS affiche une latence de 70 millisecondes pour une configuration typique, avec un échantillon de parole de 10 secondes et 500 caractères. Lors de tests de comparaison humaine, Voxtral a surpassé ElevenLabs Flash v2.5 en termes de naturalité, bien que ElevenLabs ait depuis introduit une version améliorée, la v3.
Voxtral TTS est accessible via une API, avec un tarif de 0,016 $ par 1 000 caractères. Les utilisateurs peuvent également tester le modèle dans Mistral Studio, et il est disponible en version open-weight sur la plateforme Hugging Face.

