メインコンテンツへスキップ
Seed-Audio 1.0 は音声生成 APIaudio_references でボイスを指定します。各項目は次のいずれかです:
  • プリセットボイス ID — 下の表の voice_type を入力します(例:zh_female_vv_uranus_bigtts
  • 参照音声 URL — ボイスクローン用の参照クリップをアップロードします
すべてのプリセットボイスは、自然言語のプロンプトで感情・トーン・スタイルを制御できます。中国語ボイスは英語テキストの読み上げにも対応します。
prompt 内で @音声N を使うと audio_references の N 番目の項目を参照でき(番号は 1 から)、1 つのクリップで複数のボイスを混在させられます。ボイス名の「2.0」はボイスライブラリのバージョンを表し、モデルのバージョンとは関係ありません。

汎用ボイス

合計 288 種類 — 大半が中国語、加えて ICL キャラクターボイス 15 種類(アメリカ / オーストラリア / イギリス英語)。