Skip to main content
POST

Autorisations

Authorization
string
header
requis

Tous les points d’accès exigent une authentification par token Bearer

Obtenir une clé API :

Rendez-vous dans Gestion des clés API pour obtenir votre clé

Ajoutez cet en-tête :

Corps

application/json

Créez une voix depuis l’enregistrement d’une personne. audio_url sélectionne le clonage ; omettez les champs de conception voice_prompt, preview_text, sample_rate et response_format. Un texte de conception non vide, une fréquence non nulle ou un format non vide renvoie 400. sample_rate: 0/null et response_format: ""/null sont traités comme absents.

model
enum<string>
défaut:voice-enrollment
requis

Nom du modèle

Options disponibles:
voice-enrollment
Exemple:

"voice-enrollment"

audio_url
string<uri>
requis

URL de l’enregistrement à cloner. Ce champ sélectionne le clonage vocal et ne peut pas être fourni avec voice_prompt

Exigences de l’URL :

  • HTTP ou HTTPS, accès public sans authentification
  • Adresse locale ou privée : 400 (invalid_media_url)
  • Maximum 2048 caractères
  • Protocole non HTTP(S), comme FTP : 400 (invalid_media_url)
  • Liens uniquement, pas de Base64 ; une URI de données Base64 renvoie 400 (invalid_parameter)

Exigences audio (sinon la tâche peut échouer) :

  • WAV, MP3 ou M4A
  • Au plus 60 secondes ; trop peu de parole peut aussi échouer (un enregistrement de 2 secondes a échoué lors des tests)
  • Taille maximale 10 MB
  • Fréquence d’échantillonnage d’au moins 16 kHz
  • Voix humaine claire obligatoire ; silence, musique et autres sons sans parole sont refusés

Conseils d’enregistrement :

  • 10–20 secondes, dont au moins 5 secondes de lecture continue et claire ; pauses d’au plus 2 secondes
  • Mono ; seul le premier canal d’un enregistrement stéréo est utilisé
  • Sans musique, bruit de fond ou autre voix ; parlez normalement, sans chanter

Si l’audio ne peut pas être téléchargé ou ne respecte pas les exigences, la tâche échoue avec remboursement intégral

Clonez uniquement votre propre voix ou une voix avec autorisation explicite

Maximum string length: 2048
Pattern: [^\u0009-\u000D\u0020\u0085\u00A0\u1680\u2000-\u200A\u2028\u2029\u202F\u205F\u3000]
Exemple:

"https://your-cdn.com/samples/my-voice.wav"

preferred_name
string
requis

Préfixe du nom de voix

Contraintes :

  • 1–10 lettres anglaises ou chiffres ; ni underscore ni autre symbole
  • Les majuscules sont converties en minuscules
  • L’unicité n’est pas requise

Nom complet : qwen-audio-3.1-tts-flash-{preferred_name}-{32-character-id} pour le clonage, qwen-audio-3.1-tts-flash-vd-{preferred_name}-{32-character-id} pour la conception

Exemple avec myvoice : qwen-audio-3.1-tts-flash-myvoice-5996beec833d41f4982158347ba97fae

Maximum string length: 10
Pattern: ^[a-zA-Z0-9]+$
Exemple:

"myvoice"

language
enum<string>

Pour le clonage, langue parlée dans l’enregistrement, afin de mieux extraire la voix. Pour la conception, préférence linguistique de la voix ; utilisez la même langue que preview_text

Par défaut zh si absent

Options disponibles:
zh,
en,
ja,
ko,
de,
fr,
it,
ru,
pt,
es
Exemple:

"zh"

target_model
enum<string>
défaut:qwen-audio-3.1-tts-flash

Modèle TTS qui utilisera la voix. Une seule valeur est actuellement acceptée et utilisée par défaut ; les autres renvoient 400

Options disponibles:
qwen-audio-3.1-tts-flash
Exemple:

"qwen-audio-3.1-tts-flash"

callback_url
string<uri>

URL HTTPS de rappel pour le résultat de la tâche

Déclenchement :

  • À la fin (completed) ou à l’échec (failed) de la tâche
  • Après confirmation de la facturation

Sécurité :

  • HTTPS uniquement
  • Adresses IP privées interdites (127.0.0.1, 10.x.x.x, 172.16–31.x.x, 192.168.x.x, etc.)
  • URL de 2048 caractères maximum

Livraison :

  • Délai d’expiration : 10 secondes
  • Au plus 3 nouvelles tentatives après un échec, avec délais de 1 / 2 / 4 secondes
  • Corps du rappel au même format que la réponse de consultation de tâche
  • Un statut 2xx indique le succès ; les autres déclenchent une nouvelle tentative
Exemple:

"https://your-domain.com/webhooks/voice-completed"

Réponse

Tâche de création de voix acceptée

created
integer

Horodatage de création de la tâche

Exemple:

1775123456

id
string

ID de tâche

Exemple:

"task-unified-1775123456-abcd1234"

model
string

Modèle effectivement utilisé

Exemple:

"voice-enrollment"

object
enum<string>

Type précis de l’objet de tâche

Options disponibles:
audio.generation.task
progress
integer

Progression de la tâche en pourcentage (0–100)

Plage requise: 0 <= x <= 100
Exemple:

0

status
enum<string>

État de la tâche

Options disponibles:
pending,
processing,
completed,
failed
Exemple:

"pending"

task_info
object

Détails de la tâche audio

type
enum<string>

Type de sortie de la tâche

Options disponibles:
audio
Exemple:

"audio"

usage
object

Informations d’utilisation et de facturation