Passer au contenu principal
Seed-Audio 1.0 selectionne la voix via audio_references dans l’API de generation audio. Chaque element peut etre:
  • ID de voix preconfiguree — utilisez un voice_type du tableau ci-dessous, par ex. zh_female_vv_uranus_bigtts
  • URL audio de reference — televersez un clip de reference pour le clonage de voix
Toutes les voix preconfigurees permettent de controler l’emotion, le ton et le style via des invites en langage naturel. Les voix chinoises peuvent aussi lire du texte anglais.
Dans prompt, utilisez @audioN pour referencer le Nieme element de audio_references (la numerotation commence a 1), ce qui permet de melanger plusieurs voix dans un meme clip. Le “2.0” dans un nom de voix indique la version de la bibliotheque de voix, sans rapport avec la version du modele.

Voix generales

288 voix au total: majoritairement chinois, plus 15 voix de personnage ICL (anglais americain / australien / britannique).