Zum Hauptinhalt springen
Seed-Audio 1.0 wählt die Stimme über audio_references in der Audio-Generierungs-API. Jeder Eintrag kann sein:
  • Voreingestellte Stimmen-ID — verwenden Sie einen voice_type aus der Tabelle unten, z. B. zh_female_vv_uranus_bigtts
  • Referenz-Audio-URL — laden Sie einen Referenzclip für die Stimmklonung hoch
Alle voreingestellten Stimmen lassen sich per natürlichsprachlichem Prompt in Emotion, Ton und Stil steuern. Chinesische Stimmen können auch englischen Text lesen.
Verwenden Sie im prompt @AudioN, um den N-ten Eintrag in audio_references zu referenzieren (Nummerierung ab 1) — so lassen sich mehrere Stimmen in einem Clip mischen. Das “2.0” in einem Stimmnamen bezeichnet die Version der Stimmbibliothek und steht in keinem Zusammenhang mit der Modellversion.

Allgemeine Stimmen

Insgesamt 288 Stimmen — überwiegend Chinesisch, plus 15 ICL-Charakterstimmen (amerikanisches / australisches / britisches Englisch).