Skip to main content
POST

承認

Authorization
string
header
必須

すべての API で Bearer トークン認証が必要です

API キーの取得:

API キー管理で API キーを取得してください

リクエストヘッダーに追加:

ボディ

application/json

人物の録音から音声を作成します。audio_url で複製モードになります。設計用の voice_prompt、preview_text、sample_rate、response_format は省略してください。空でない設計テキスト、ゼロ以外のサンプルレート、空でない形式は 400。sample_rate: 0/null と response_format: ""/null は未指定として扱います。

model
enum<string>
デフォルト:voice-enrollment
必須

モデル名

利用可能なオプション:
voice-enrollment
例:

"voice-enrollment"

audio_url
string<uri>
必須

複製する録音の URL。このフィールドは音声複製を選択し、voice_prompt とは同時に指定できません

URL の要件:

  • 認証なしで公開アクセスできる HTTP または HTTPS
  • ローカルやプライベートネットワークのアドレスは 400(invalid_media_url)
  • 最大 2048 文字
  • FTP など非 HTTP(S) プロトコルは 400(invalid_media_url)
  • URL のみ対応。Base64 data URI は 400(invalid_parameter)

音声の要件(満たさない場合はタスクが失敗することがあります):

  • WAV、MP3、M4A
  • 最大 60 秒。発話が短すぎても失敗します(テストでは 2 秒の録音が失敗)
  • ファイルサイズは最大 10 MB
  • サンプルレートは 16 kHz 以上
  • 明瞭な人の声が必要です。無音、音楽など発話でない音声は拒否されます

録音の推奨事項:

  • 10~20 秒、そのうち少なくとも 5 秒は連続した明瞭な朗読。ポーズは 2 秒以下
  • モノラル。ステレオは最初のチャンネルのみ使用
  • 背景音楽、雑音、他人の声を含めず、歌わずに通常の話し方で録音

ダウンロードできない、または要件を満たさない場合はタスクが失敗し、クレジットは全額返還されます

自分の声、または明確な許可を得た声のみ複製してください

Maximum string length: 2048
Pattern: [^\u0009-\u000D\u0020\u0085\u00A0\u1680\u2000-\u200A\u2028\u2029\u202F\u205F\u3000]
例:

"https://your-cdn.com/samples/my-voice.wav"

preferred_name
string
必須

音声名のプレフィックス

制約:

  • 英字と数字のみ、1~10 文字。アンダースコアなどの記号は非対応
  • 大文字は小文字に変換
  • 一意である必要はありません

完全な音声名:複製は qwen-audio-3.1-tts-flash-{preferred_name}-{32-character-id}、設計は qwen-audio-3.1-tts-flash-vd-{preferred_name}-{32-character-id}

myvoice の複製例:qwen-audio-3.1-tts-flash-myvoice-5996beec833d41f4982158347ba97fae

Maximum string length: 10
Pattern: ^[a-zA-Z0-9]+$
例:

"myvoice"

language
enum<string>

複製では録音の言語を指定し、音声の特徴をより正確に抽出します。設計では音声の言語傾向を指定します。preview_text と同じ言語を推奨します

未指定時は zh

利用可能なオプション:
zh,
en,
ja,
ko,
de,
fr,
it,
ru,
pt,
es
例:

"zh"

target_model
enum<string>
デフォルト:qwen-audio-3.1-tts-flash

音声を使用する TTS モデル。現在は 1 種類のみで、未指定時もこの値になります。他の値は 400

利用可能なオプション:
qwen-audio-3.1-tts-flash
例:

"qwen-audio-3.1-tts-flash"

callback_url
string<uri>

タスク結果の HTTPS コールバック URL

送信タイミング:

  • タスク完了(completed)または失敗(failed)時
  • 課金確定後に送信

セキュリティ要件:

  • HTTPS のみ
  • プライベート IP は禁止(127.0.0.1、10.x.x.x、172.16~31.x.x、192.168.x.x など)
  • URL は最大 2048 文字

配信:

  • タイムアウト:10 秒
  • 失敗後は最大 3 回、1 / 2 / 4 秒後に再試行
  • 本文形式はタスク照会 API のレスポンスと同じ
  • 2xx は成功、それ以外は再試行
例:

"https://your-domain.com/webhooks/voice-completed"

レスポンス

音声作成タスクを受け付けました

created
integer

タスク作成時刻のタイムスタンプ

例:

1775123456

id
string

タスク ID

例:

"task-unified-1775123456-abcd1234"

model
string

実際に使用されたモデル名

例:

"voice-enrollment"

object
enum<string>

タスクオブジェクトの具体的な種類

利用可能なオプション:
audio.generation.task
progress
integer

タスク進捗率(0~100)

必須範囲: 0 <= x <= 100
例:

0

status
enum<string>

タスクの状態

利用可能なオプション:
pending,
processing,
completed,
failed
例:

"pending"

task_info
object

音声タスクの詳細

type
enum<string>

タスクの出力タイプ

利用可能なオプション:
audio
例:

"audio"

usage
object

使用量と課金情報