Suno lance Speech, voix IA et musique en bêta publique

Le brief IA que les pros lisent chaque soir
Les 7 actus IA du jour, décryptées en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Suno étend sa plateforme au texte parlé avec Speech, capable d'associer voix et musique dans une piste unique. La bêta publique, disponible sur le web et le mobile, arrive avec deux modes de création et une durée maximale d’environ huit minutes, tandis que l’éditeur reconnaît des imperfections et promet des améliorations.
Des limites annoncées pour la bêta et une durée d’environ huit minutes
Suno indique que Speech est encore imparfait et qu’il continuera à l’affiner en fonction des retours des utilisateurs. Jack Brody résume l’état du produit en rappelant que « la bêta signifie vraiment bêta ». Il cite des comportements actuels, comme des accents britanniques qui peuvent dériver vers l’australien puis revenir, ou des pauses dramatiques très appuyées. Il anticipe également que des usages inattendus émergeront. La génération est en outre limitée à une durée maximale d’environ huit minutes.
Voix seule ou piste mixte, et deux modes de création
Speech peut produire une piste unique combinant voix off et musique de fond, mais l’accompagnement musical reste optionnel et peut être désactivé pour ne garder qu’une voix claire. Deux modalités sont disponibles : Simple, qui utilise uniquement un prompt descriptif — comme « un capitaine pirate ralliant son équipage » —, et Avancé, qui prend en charge un script sur mesure. Le mode Avancé offre également la possibilité de modifier le genre vocal, le style d’élocution et la diversité de chaque rendu. Pour accéder à cette fonctionnalité, il faut passer par l’onglet Créer et sélectionner l’option Speech.
Disponibilité en bêta et positionnement face aux acteurs de la voix
Speech est disponible en bêta publique sur les plateformes web et mobiles de Suno. La société ajoute ainsi un générateur de voix parlée à son offre, Jack Brody rappelant que la musique demeure centrale pour Suno, tout en élargissant la plateforme à d’autres formes d’expression. Il présente Speech comme un modèle audio capable de produire voix et musique ensemble en une piste cohérente. Le lancement intervient dans un paysage où DeepMind explore la synthèse vocale depuis une décennie, où Adobe propose un outil dédié et où ElevenLabs s’est imposée depuis 2023. Le générateur de musique de Suno a par ailleurs fait l’objet de nombreuses poursuites judiciaires. Suno évoque des usages potentiels comme une ambiance apaisante pour des poèmes ou plus énergique pour des voix off dramatiques et des discours encourageants.
Brief IA — L'actualité IA en français
L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.