cosyvoice-v3-flash

更新时间:
复制 MD 格式

合成能力:CosyVoice-v3-Flash是通义实验室CosyVoice系列最新版高性能的语音合成大模型,较之前版本在自然度、音质、韵律、情感表现力上有更好的表现。该模型支持文本至语音的实时流式合成。克隆能力:CosyVoice-v3-Flash也是通义实验室CosyVoice系列最新版的语音克隆大模型,较之前版本提升了发音准确性、音色相似度,并且增加了更多小语种支持(德、西、法、意、俄)。仅需提供5-20s的参考音频,即可迅速生成高度相似且听感自然的定制声音。

推理服务供应商

cosyvoice-v3-flash模型的推理服务供应商为阿里云百炼。

模型能力

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Audio

模型体验

不支持

Function Calling

不支持

结构化输出

不支持

联网搜索

不支持

前缀续写

不支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数 参数

最大输入长度

最大输出长度

上下文长度

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。

华北2(北京)

计费项 价格(元) 单位

语音合成

1

每万字符

新加坡

部署范围:国际

新加坡地域当前仅支持语音合成能力,暂不支持复刻音色功能。如需使用复刻音色,请使用华北2(北京)地域。

计费项 价格(元) 单位

语音合成

0.9541

每万字符

限流

华北2(北京)

参数

RPM(每分钟请求数)

180

新加坡

部署范围:国际

新加坡地域当前仅支持语音合成能力,暂不支持复刻音色功能。

参数

RPM(每分钟请求数)

180