爱诗-视频对口型模型支持输入 视频 和 音频 (或 TTS 文本),生成与音频同步的对口型视频。
重要本文档仅适用于华北2(北京)地域,且必须使用该地域的API Key。
服务开通
- 前往阿里云百炼控制台,搜索 PixVerse,找到 PixVerse 模型卡片,单击立即开通;
- 在弹窗内确认开通及授权。
适用范围
为确保调用成功,请务必保证模型、Endpoint URL 和 API Key 均属于同一地域。跨地域调用将会失败。
- 选择模型:确认模型所属的地域。
- 选择 URL:选择对应的地域 Endpoint URL。
- 配置 API Key:选择地域并获取与配置 API Key,再配置API Key到环境变量。
说明本文的视频对口型示例适用于华北2(北京)地域。
HTTP调用
由于视频对口型任务耗时较长(通常为1-5分钟),API采用异步调用。整个流程包含 "创建任务 -> 轮询获取" 两个核心步骤,具体如下:
步骤1:创建任务获取任务ID
北京地域:POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis
调用时请将{WorkspaceId}替换为真实的业务空间ID。
说明
- 创建成功后,使用接口返回的
task_id查询结果,task_id 有效期为 24 小时。请勿重复创建任务,轮询获取即可。 - 新手指引请参见Postman。
请求参数请求头(Headers)Content-Type 请求内容类型。此参数必须设置为 Authorization 请求身份认证。接口使用阿里云百炼API Key进行身份认证。示例值:Bearer sk-xxxx。 X-DashScope-Async 异步处理配置参数。HTTP请求只支持异步,必须设置为 重要缺少此请求头将报错:“current user api does not support synchronous calls”。 请求体(Request Body)model 模型名称。固定值: input 输入的基本信息,包括人脸视频和音频来源。 parameters 视频生成参数。如设置是否添加水印等。 | 音频驱动传入视频和音频文件,生成对口型视频。 Python SDKTTS 文本驱动传入视频和 TTS 文本,由模型合成语音并生成对口型视频。 |
步骤2:根据任务ID查询结果
北京地域:GET https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/tasks/{task_id}
请求参数请求头(Headers)Authorization 请求身份认证。接口使用阿里云百炼API Key进行身份认证。示例值:Bearer sk-xxxx。 URL路径参数(Path parameters)task_id 任务ID。 | 查询任务结果将 |
响应参数output 任务输出信息。 usage 输出信息统计。只对成功的结果计数。 | 任务执行成功任务执行失败若任务执行失败,task_status将置为 FAILED,并提供错误码和信息。请参见错误码进行解决。 任务查询过期task_id查询有效期为 24 小时,超时后将无法查询,返回以下报错信息。 |
错误码
如果模型调用失败并返回报错信息,请参见错误码进行解决。