⚡
Brief IA
›

Suno lance Speech, voix IA et musique en bêta publique

🎨 Creative AI·Tom Levy·

Suno lance Speech, voix IA et musique en bêta publique

Suno lance Speech, voix IA et musique en bêta publique
⚡
Key Takeaways
1Suno lance Speech, une fonctionnalité générant voix parlée et musique dans une même piste
2Speech est disponible en bêta publique sur web et mobile, avec deux modes de création
3La durée maximale est d’environ huit minutes et la musique de fond est optionnelle
💡Why it matters — Suno élargit son offre au-delà de la musique, entrant sur le marché de la synthèse vocale face à des acteurs établis comme DeepMind, Adobe et ElevenLabs.
⚡Le brief IA que lisent les pros

Le brief IA que les pros lisent chaque soir

Les 7 actus IA du jour, décryptées en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
Full Analysis

Suno étend sa plateforme au texte parlé avec Speech, capable d'associer voix et musique dans une piste unique. La bêta publique, disponible sur le web et le mobile, arrive avec deux modes de création et une durée maximale d’environ huit minutes, tandis que l’éditeur reconnaît des imperfections et promet des améliorations.

Des limites annoncées pour la bêta et une durée d’environ huit minutes

Suno indique que Speech est encore imparfait et qu’il continuera à l’affiner en fonction des retours des utilisateurs. Jack Brody résume l’état du produit en rappelant que « la bêta signifie vraiment bêta ». Il cite des comportements actuels, comme des accents britanniques qui peuvent dériver vers l’australien puis revenir, ou des pauses dramatiques très appuyées. Il anticipe également que des usages inattendus émergeront. La génération est en outre limitée à une durée maximale d’environ huit minutes.

Voix seule ou piste mixte, et deux modes de création

Speech peut produire une piste unique combinant voix off et musique de fond, mais l’accompagnement musical reste optionnel et peut être désactivé pour ne garder qu’une voix claire. Deux modalités sont disponibles : Simple, qui utilise uniquement un prompt descriptif — comme « un capitaine pirate ralliant son équipage » —, et Avancé, qui prend en charge un script sur mesure. Le mode Avancé offre également la possibilité de modifier le genre vocal, le style d’élocution et la diversité de chaque rendu. Pour accéder à cette fonctionnalité, il faut passer par l’onglet Créer et sélectionner l’option Speech.

Disponibilité en bêta et positionnement face aux acteurs de la voix

Speech est disponible en bêta publique sur les plateformes web et mobiles de Suno. La société ajoute ainsi un générateur de voix parlée à son offre, Jack Brody rappelant que la musique demeure centrale pour Suno, tout en élargissant la plateforme à d’autres formes d’expression. Il présente Speech comme un modèle audio capable de produire voix et musique ensemble en une piste cohérente. Le lancement intervient dans un paysage où DeepMind explore la synthèse vocale depuis une décennie, où Adobe propose un outil dédié et où ElevenLabs s’est imposée depuis 2023. Le générateur de musique de Suno a par ailleurs fait l’objet de nombreuses poursuites judiciaires. Suno évoque des usages potentiels comme une ambiance apaisante pour des poèmes ou plus énergique pour des voix off dramatiques et des discours encourageants.

⚡

Brief IA — L'actualité IA en français

L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.