Skip to main content
Qwen Audio 3.1 TTS Flash は音声合成 APIの voice パラメータで音声を選択します。68 種類のシステム音声は、事前に作成せず直接使用できます。
  • voice は大文字と小文字を区別します。表の値をそのまま指定してください
  • voice 未指定時は longanhuan_v3.1
  • リクエストには表の voice 列を使用します。名称、性別、声の特徴、用途は選択の参考情報です
  • 選択した音声が対応する言語のテキストを使用してください。非対応言語では発音が不正確になったり不自然になったりする場合があります

使用例

次のリクエスト本文を POST /v1/audios/generations に送信し、voice を希望の音声 ID に置き換えてください。全パラメータとタスク照会は音声合成 APIを参照してください。
すべての音声で instruction とテキスト内の感情タグ([excited]、[laughing] など)を使って感情や口調を制御できます。音声合成 APIの prompt と instruction の説明を参照してください。

多言語・方言音声

4 種類。いずれも次のすべての方言・言語に対応します:
  • 方言:上海語、広東語、中国東北部、重慶、陝西、雲南、寧波、甘粛の方言
  • 言語:日本語、韓国語、フランス語、ドイツ語、ポルトガル語、イタリア語、ベトナム語、インドネシア語
方言で合成する場合は、instruction に 请用上海话表达(上海語で話す)などを指定します。

高品質の中国語音声

22 種類。標準中国語のみに対応します。

高品質の英語音声

15 種類。英語のみに対応します。

その他のシステム音声

27 種類。このグループは各音声の対応言語を個別に記載していません。目的の言語のテキストで合成品質を確認してください。

カスタム音声

自分の音声が必要な場合は Voice Enrollment を使用します。録音から複製するか、テキストの説明から設計できます。タスク完了後、返された完全な voice 名を音声合成 API に渡してください。
  • 作成したアカウントのみ使用できます
  • デフォルトで作成タスク完了から 6 時間で期限切れになります。合成しても期限は延長されません
  • 期限後の合成は 404(voice_expired)。Voice Enrollment で再作成してください
  • 旧 qwen-voice-design で作成した音声は使用できません。移行時は Voice Enrollment で再作成してください