跳转到主要内容
Seed-Audio 1.0 在音频生成接口中通过 audio_references 指定音色,每一项可以是:
  • 预置音色 ID —— 直接填写下表的 voice_type,例如 zh_female_vv_uranus_bigtts
  • 参考音频 URL —— 上传一段参考音频做声音复刻,由模型还原音色
所有预置音色都支持通过自然语言提示控制情感、语气与风格。中文音色同样具备英文朗读能力。
prompt 中用 @音频N 引用 audio_references 的第 N 项(编号从 1 开始),即可在一段音频里混合多个音色。音色名称中的 “2.0” 为音色版本标识,与模型版本无关。

通用音色

288 个,以中文为主,另含 15 个 ICL 角色音色(美式 / 澳洲 / 英式英语)。