Skip to main content
Qwen Audio 3.1 TTS Flash 在语音合成接口中通过 voice 参数指定音色,共 68 个系统音色。系统音色可以直接使用,无需先创建音色。
  • voice 取值区分大小写,请按下表原样填写
  • 不传 voice 时默认使用 longanhuan_v3.1
  • 请求中填写表格的 voice 列;名称、性别、声线特质和适用场景用于帮助选择音色
  • 待合成文本须在所选音色支持的语言范围内,否则可能出现发音错误或语音不自然

使用示例

向 POST /v1/audios/generations 提交以下请求体,将 voice 替换为所需音色的 ID。完整参数与任务查询方式见语音合成接口。
所有音色都可以配合 instruction 指令和文本内的情感标签(如 [excited]、[laughing])控制情感与语气,用法见语音合成接口的 prompt 与 instruction 参数说明。

多语种与方言音色

共 4 个。以下音色均支持全部方言和语言:
  • 方言:上海话、广东话、东北话、重庆话、陕西话、云南话、宁波话、甘肃话
  • 语言:日语、韩语、法语、德语、葡萄牙语、意大利语、越南语、印尼语
用方言合成时,可在 instruction 中指定,例如 请用上海话表达。

精品中文音色

共 22 个,仅支持中文普通话。

精品英文音色

共 15 个,仅支持英文。

其他系统音色

共 27 个。此组未逐项标注支持的语言,请使用目标语言文本确认合成效果。

自定义音色

如果需要自己的音色,可通过 Voice Enrollment 创建:提供录音进行声音复刻,或提供文字描述进行声音设计。创建任务完成后,将返回的完整 voice 名称传给语音合成接口。
  • 自定义音色仅可由创建它的账号使用
  • 默认在创建任务完成后 6 小时到期,合成调用不会延长有效期
  • 到期后合成返回 404(voice_expired),请重新调用 Voice Enrollment 创建音色
  • 旧版 qwen-voice-design 创建的音色不能用于本模型;迁移时请通过 Voice Enrollment 重新创建音色