本文介绍声音复刻的HTTP API接口详情,包括创建音色、查询音色列表、查询音色详情、更新音色和删除音色等操作。
用户指南:声音复刻。
服务端点(Qwen-Audio-TTS/CosyVoice/Qwen-TTS)
华北2(北京)
POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/audio/tts/customization
调用时请将{WorkspaceId}替换为真实的Workspace ID。
新加坡
POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/audio/tts/customization
调用时请将{WorkspaceId}替换为真实的Workspace ID。
阿里云百炼为华北2(北京)、新加坡地域推出了业务空间专属域名,能够为推理请求提供卓越的性能和更高的稳定性,建议迁移至新域名:
华北2(北京)地域:从
dashscope.aliyuncs.com迁移至{WorkspaceId}.cn-beijing.maas.aliyuncs.com新加坡地域:从
dashscope-intl.aliyuncs.com迁移至{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com
{WorkspaceId}需要替换为真实的Workspace ID。现有域名仍可正常使用。
服务端点(MiniMax)
HTTP请求地址:POST https://dashscope.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation
SDK调用配置的base_url:https://dashscope.aliyuncs.com/api/v1
第三方模型(MiniMax)目前仅支持通过dashscope.aliyuncs.com域名调用,暂不支持专属域名。请求头
参数 | 类型 | 是否必选 | 说明 |
Authorization | string | 是 | 鉴权令牌,格式为 |
Content-Type | string | 是 | 请求体的媒体类型。Qwen-Audio-TTS/CosyVoice/Qwen-TTS固定为 |
创建音色(Qwen-Audio-TTS/CosyVoice/Qwen-TTS)
请求体 | 以下为华北2(北京)地域的配置,调用时请将"{WorkspaceId}"替换为真实的业务空间ID,各地域的配置不同。 Qwen-Audio-TTS/CosyVoice声音复刻Qwen-TTS声音复刻 |
model 声音复刻模型。取值:
| |
input 输入参数对象。 | |
返回体 | Qwen-Audio-TTS/CosyVoice声音复刻Qwen-TTS声音复刻重要 Qwen-Audio-TTS/CosyVoice返回 |
request_id 本次调用的唯一标识符。 | |
output 模型返回的数据。 | |
usage 本次请求用量信息。 |
创建音色(MiniMax)
音色复刻请求会生成一段试听音频,试听音频按所选模型的同步语音合成单价额外计费。
请求体 | |
model 指定合成试听音频使用的语音模型。 支持的模型:
| |
input |
返回体 | |
request_id 本次调用的唯一标识符。 | |
output | |
usage 本次请求的字符用量。 |
查询音色列表
MiniMax不支持通过本接口查询音色列表。如需查询 MiniMax 系列模型(如 MiniMax/speech-2.8-turbo)的可用音色 ID(含系统音色与已复刻音色),请参见声音管理。
请求体 | 以下为华北2(北京)地域的配置,调用时请将"{WorkspaceId}"替换为真实的业务空间ID,各地域的配置不同。 Qwen-Audio-TTS/CosyVoiceQwen-TTS声音复刻 |
model 声音复刻模型。取值:
| |
input 输入参数对象。 |
返回体 | Qwen-Audio-TTS/CosyVoiceQwen重要 Qwen-Audio-TTS/CosyVoice返回 |
request_id 本次调用的唯一标识符。 | |
output 模型返回的数据。 | |
usage 本次请求用量信息。 |
查询音色详情
仅适用于Qwen-Audio-TTS/CosyVoice(model为voice-enrollment时)。Qwen和MiniMax模型不支持查询音色详情操作。
请求体 | 以下为华北2(北京)地域的配置,调用时请将"{WorkspaceId}"替换为真实的业务空间ID,各地域的配置不同。 Qwen-Audio-TTS/CosyVoice |
model 固定为 | |
input 输入参数对象。 |
返回体 | |
request_id 本次调用的唯一标识符。 | |
output 模型返回的数据。 | |
usage 本次请求用量信息。 |
更新音色
仅适用于Qwen-Audio-TTS/CosyVoice声音复刻(model为voice-enrollment时)。Qwen和MiniMax模型不支持更新操作。
请求体 | 以下为华北2(北京)地域的配置,调用时请将"{WorkspaceId}"替换为真实的业务空间ID,各地域的配置不同。 |
model 固定为 | |
input 输入参数对象。 |
返回体 | |
request_id 本次调用的唯一标识符。 | |
output 模型返回的数据,更新操作返回空对象。 | |
usage 本次请求用量信息。 |
删除音色
MiniMax不支持通过本接口查询音色列表。如需查询 MiniMax 系列模型(如 MiniMax/speech-2.8-turbo)的可用音色 ID(含系统音色与已复刻音色),请参见声音管理。
请求体 | 以下为华北2(北京)地域的配置,调用时请将"{WorkspaceId}"替换为真实的业务空间ID,各地域的配置不同。 Qwen-Audio-TTS/CosyVoiceQwen-TTS声音复刻 |
model 声音复刻模型。取值:
| |
input 输入参数对象。 |
返回体 | Qwen-Audio-TTS/CosyVoiceQwen重要 Qwen-Audio-TTS/CosyVoice的output为空对象,Qwen返回 |
request_id 本次调用的唯一标识符。 | |
output 模型返回的数据。Qwen-Audio-TTS/CosyVoice返回空对象,Qwen返回已删除的音色名称。 | |
usage 本次请求用量信息。 |
音色状态说明
音色创建后会经过审核流程,以下是各状态的含义。此状态体系仅适用于Qwen-Audio-TTS/CosyVoice(model为voice-enrollment时),Qwen的查询和列表返回中不包含status字段。
状态 | 说明 |
DEPLOYING | 审核中/处理中。 |
OK | 审核通过,可正常使用。 |
UNDEPLOYED | 审核未通过,不可使用。 |