本文介绍非实时语音合成Qwen-Audio-TTS/CosyVoice的HTTP调用方法,支持非流式和流式两种调用模式。
用户指南:参见非实时语音合成。
本文描述的功能仅在华北2(北京)地域可用。
阿里云百炼为华北2(北京)地域推出了业务空间专属域名,能够为推理请求提供卓越的性能和更高的稳定性,建议从 dashscope.aliyuncs.com 迁移至 {WorkspaceId}.cn-beijing.maas.aliyuncs.com。
{WorkspaceId}需要替换为真实的Workspace ID。现有域名仍可正常使用。
服务端点
POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/audio/tts/SpeechSynthesizer
调用时请将{WorkspaceId}替换为真实的Workspace ID。
请求头
参数 | 类型 | 是否必选 | 说明 |
Authorization | string | 是 | 鉴权令牌,格式为 |
Content-Type | string | 是 | 请求体的媒体类型,固定为 |
X-DashScope-SSE | string | 否 | 用于控制是否以流式方式返回输出结果。仅在流式合成时使用该参数,参数值固定为 |
请求体 | 非流式流式 |
model 语音合成模型。 取值范围:
| |
input 输入参数对象。 |
返回体 | 非流式流式中间结果: 最终结果: |
request_id 本次调用的唯一标识符。 | |
output 模型返回的数据。 | |
usage 本次请求的字符用量。 |