Du texte à la voix accompagnée, Suno ajoute Speech à son générateur
Suno étend son générateur audio avec Speech, un modèle capable de produire une voix parlée et sa musique d’accompagnement au sein d’une même génération. La fonction arrive en bêta après un mois de tests auprès d’un groupe restreint d’utilisateurs.
Une génération commune pour la voix et la musique
Un poème, une histoire ou une simple note vocale peuvent désormais être transformés en contenu parlé accompagné d’une bande-son originale.
Avec Speech, Suno ne traite pas la voix et la musique comme deux éléments à produire séparément. Le modèle génère les deux au sein d’une même piste audio afin de faire correspondre l’interprétation vocale et l’accompagnement musical.
Suno le présente comme le premier modèle audio conçu pour générer conjointement ces deux composantes. Cette affirmation provient de l’entreprise et n’est accompagnée d’aucun benchmark comparatif dans les informations publiées. Décrire la voix et l’univers musical
Le fonctionnement reprend une interaction déjà familière aux utilisateurs de la plateforme. Un texte ou une idée sert de point de départ, puis une instruction décrit la voix recherchée et le style musical qui doit l’accompagner.
Speech peut ainsi produire des lectures dramatiques, des méditations, des poèmes, des discours courts ou des histoires, avec une musique générée spécifiquement pour la séquence parlée.
L’approche diffère d’un workflow associant un modèle text-to-speech à une génération musicale indépendante : ici, Suno indique que voix et musique sont produites comme une seule piste cohérente. Une bêta encore imparfaite
Speech a été testé pendant un mois auprès d’un groupe restreint avant l’ouverture de la bêta à l’ensemble de la communauté Suno.
L’entreprise signale encore plusieurs comportements instables. Certains accents peuvent dériver au cours d’une génération, tandis que les pauses demandées peuvent devenir excessivement longues ou théâtrales.
Suno ne fournit pour l’instant aucun détail sur l’architecture du modèle, ses performances, les langues prises en charge ou le niveau de contrôle indépendant disponible sur la voix et la musique après génération.
La bêta est accessible depuis la dernière version de l’application Suno.