qwen-voice-design

更新时间:
复制 MD 格式

千问voice-design模型是千问语音模型的声音设计系列模型,仅需输入简单的文字描述,即可迅速设计出符合要求的相关声音。结合qwen3-tts-vd-realtime模型使用,可设计输出10个语种的语音。且合成音频可以根据文本自适应调节语气,对复杂文本合成也有较好的处理能力。

推理服务供应商

qwen-voice-design模型的推理服务供应商为阿里云百炼。

模型能力

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Audio

模型体验

不支持

Function Calling

不支持

结构化输出

不支持

联网搜索

不支持

前缀续写

不支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数 参数

最大输入长度

最大输出长度

上下文长度

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。

华北2(北京)

计费项 价格(元) 单位

声音复刻及声音设计

0.2

每次

新加坡

部署范围:国际

计费项 价格(元) 单位

声音复刻及声音设计

0.2

每次

限流

华北2(北京)

参数

RPM(每分钟请求数)

180

新加坡

部署范围:国际

参数

RPM(每分钟请求数)

180