| 模型名称 | 厂商 | 特性 | 价格 (星元) | 简介 |
|---|---|---|---|---|
qwen-voice-design | ![]() | 音频处理音色生成 | 200/ 次 | 千问voice-design模型是千问语音模型的声音设计系列模型,仅需输入简单的文字描述,即可迅速设计出符合要求的相关声音。 |
Qwen3-TTS-VD | ![]() | 音频处理音色生成 | 文本字数计费: 0.08/ 字 | Qwen3-TTS-VD模型是通义最新推出的实时语音合成大模型,可对qwen3-voice-design服务设计的声音进行高保真实时语音合成,且同一音色支持11个语种的语音输出。 |
qwen-voice-enrollment | ![]() | 音色生成 | 10/ 次 | 千问voice-enrollment模型是千问语音模型的声音复刻系列模型,仅需5s以上的音频,即可迅速复刻高相似度声音。 |



