qwen-audio-3.0-tts-plus

更新时间:
复制 MD 格式

Qwen-Audio-3.0-TTS-Plus是面向高质量语音生成场景打造的高性能语音合成大模型。相比前一版本,模型支持更多小语种和中文方言,显著提升方言发音的正宗程度,并增强了 free-style 指令遵循能力和细粒度标签控制能力,可更准确地控制情绪、语气、角色、语速、音量和合成风格。同时,模型在噪声、混响等复杂声学条件下具备更强鲁棒性,进一步提升了音质、清晰度、分辨率和整体表现力。Plus 版本更强调合成效果和细节表现,适用于有更高音质、自然度和表现力要求的专业场景,如内容创作、有声书、影视配音、品牌声音设计和高品质语音服务。

推理服务供应商

qwen-audio-3.0-tts-plus模型的推理服务供应商为阿里云百炼。

模型能力

能力项支持情况能力项支持情况

输入模态

Text

输出模态

Audio

模型体验

不支持

Function Calling

不支持

结构化输出

不支持

联网搜索

不支持

前缀续写

不支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数值参数值

最大输入长度

—

最大输出长度

—

上下文长度

—

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。

华北2(北京)

计费项价格(元)单位

语音合成

1.4

每万字符

新加坡

部署范围:国际

计费项价格(元)单位

语音合成

1.49884

每万字符

限流

华北2(北京)

参数值

RPM(每分钟请求数)

180

新加坡

部署范围:国际

参数值

RPM(每分钟请求数)

180