模型名称厂商特性价格 (星元)简介
glm-tts
厂商
音频处理
文本字数计费: 0.2/ 字

GLM-TTS 语音合成模型以新一代智谱语音大模型为核心,突破传统语音合成框架,通过上下文智能预判文本情绪与语调,显著提升语音自然度与表现力,让合成语音具备真实情感与生命力。

qwen3-tts-instruct-flash
厂商
音频处理
文本字数计费: 0.08/ 字

Qwen3-TTS-Flash模型是通义实验室最新推出的实时语音合成大模型,Instruct模型可通过自然语言进行合成效果的处理,确保在不同语境下,合成情感、表达高度贴合的语音。

qwen-voice-design
厂商
音频处理音色生成
200/ 次

千问voice-design模型是千问语音模型的声音设计系列模型,仅需输入简单的文字描述,即可迅速设计出符合要求的相关声音。

Qwen3-TTS-VD
厂商
音频处理音色生成
文本字数计费: 0.08/ 字

Qwen3-TTS-VD模型是通义最新推出的实时语音合成大模型,可对qwen3-voice-design服务设计的声音进行高保真实时语音合成,且同一音色支持11个语种的语音输出。

qwen-voice-enrollment
厂商
音色生成
10/ 次

千问voice-enrollment模型是千问语音模型的声音复刻系列模型,仅需5s以上的音频,即可迅速复刻高相似度声音。

联系我们联系我们