Skip to main content
Qwen Audio 3.1 TTS Flash는 음성 합성 API의 voice 매개변수로 음성을 선택합니다. 시스템 음성 68개는 먼저 생성할 필요 없이 바로 사용할 수 있습니다.
  • voice는 대소문자를 구분합니다. 아래 값을 그대로 입력하세요
  • voice를 생략하면 longanhuan_v3.1 사용
  • 요청에는 표의 voice 열을 사용합니다. 이름, 성별, 음색 특성, 용도는 선택을 돕는 정보입니다
  • 선택한 음성이 지원하는 언어의 텍스트를 사용하세요. 그렇지 않으면 발음이 틀리거나 음성이 부자연스러울 수 있습니다

사용 예시

다음 요청 본문을 POST /v1/audios/generations에 보내고 voice를 원하는 음성 ID로 바꾸세요. 전체 매개변수와 작업 조회 방법은 음성 합성 API를 참고하세요.
모든 음성은 instruction과 텍스트 내 감정 태그([excited], [laughing] 등)로 감정과 말투를 조절할 수 있습니다. 음성 합성 API의 prompt와 instruction 설명을 참고하세요.

다국어 및 방언 음성

4개. 각 음성은 아래 방언과 언어를 모두 지원합니다:
  • 방언: 상하이어, 광둥어, 중국 동북부, 충칭, 산시(陝西), 윈난, 닝보, 간쑤 방언
  • 언어: 일본어, 한국어, 프랑스어, 독일어, 포르투갈어, 이탈리아어, 베트남어, 인도네시아어
방언 합성 시 instruction에 请用上海话表达(상하이어로 말하기)처럼 지정할 수 있습니다.

고품질 중국어 음성

22개. 표준 중국어만 지원합니다.

고품질 영어 음성

15개. 영어만 지원합니다.

기타 시스템 음성

27개. 이 그룹은 각 음성의 지원 언어를 따로 표시하지 않습니다. 대상 언어 텍스트로 합성 품질을 확인하세요.

사용자 지정 음성

자신만의 음성이 필요하면 Voice Enrollment를 사용하세요. 녹음으로 복제하거나 텍스트 설명으로 설계할 수 있습니다. 작업 완료 후 반환된 전체 voice 이름을 음성 합성 API에 전달하세요.
  • 생성한 계정만 사용할 수 있습니다
  • 기본적으로 생성 작업 완료 후 6시간 뒤 만료됩니다. 합성 호출로 유효 기간이 늘어나지 않습니다
  • 만료 후 합성은 404(voice_expired). Voice Enrollment로 다시 생성하세요
  • 이전 qwen-voice-design 음성은 사용할 수 없습니다. 마이그레이션 시 Voice Enrollment로 다시 생성하세요