本文介绍通过 OpenAI 兼容接口调用 qwen3-livetranslate-flash 模型的输入与输出参数。
相关文档:音视频文件翻译-千问
不支持通过 DashScope 接口调用。
OpenAI 兼容
北京地域
SDK 调用配置的base_url为:https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
HTTP 调用配置的endpoint:POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1/chat/completions
新加坡地域
SDK 调用配置的base_url为:https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1
HTTP 调用配置的endpoint:POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1/chat/completions
阿里云百炼为华北2(北京)、新加坡地域推出了业务空间专属域名,能够为推理请求提供卓越的性能和更高的稳定性,建议迁移至新域名:
-
华北2(北京)地域:从
https://dashscope.aliyuncs.com迁移至https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com -
新加坡地域:从
https://dashscope-intl.aliyuncs.com迁移至https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com
其中 {WorkspaceId} 为您的业务空间 ID,可在阿里云百炼控制台的业务空间详情页面查看。现有域名仍可正常使用。
您需要已获取API Key并配置API Key到环境变量。若通过OpenAI SDK进行调用,需要安装SDK。
请求体 |
|
|
model 模型名称。支持的模型:qwen3-livetranslate-flash、qwen3-livetranslate-flash-2025-12-01。 |
|
|
messages 消息数组,用于向大模型传递上下文。仅支持传入一个 User Message。 |
|
|
stream 是否以流式方式输出回复。模型仅支持流式输出方式调用,仅可设为 |
|
|
stream_options 流式输出的配置项,仅在 |
|
|
modalities 输出数据的模态。可选值:
|
|
|
audio 输出音频的音色与格式。 |
|
|
max_tokens 用于限制模型输出的最大 Token 数。若生成内容超过此值,响应将被截断。 默认值与最大值均为模型的最大输出长度,请参见模型选型。 |
|
|
seed 随机数种子。用于确保在相同输入和参数下生成结果可复现。若调用时传入相同的 取值范围: |
|
|
speech_rate 控制输出音频的语速。1.0为正常语速,小于1.0为慢速,大于1.0为快速。 取值范围:[0.5, 2.0]。 |
|
|
temperature 采样温度,控制模型生成内容的多样性。temperature越高,生成的内容更多样,反之更确定。 取值范围: [0, 2) 为了翻译的准确性,不建议修改该值。 |
|
|
top_p 核采样的概率阈值,控制模型生成内容的多样性。 top_p越高,生成的内容更多样。反之更确定。 取值范围:(0,1.0] 为了翻译的准确性,不建议修改该值。 |
|
|
presence_penalty 控制模型生成文本时的内容重复度。 取值范围:[-2.0, 2.0]。正值降低重复度,负值增加重复度。为了翻译的准确性,不建议修改该值。 |
|
|
top_k 生成过程中采样候选集的大小。例如,取值为50时,仅将单次生成中得分最高的50个Token组成随机采样的候选集。取值越大,生成的随机性越高;取值越小,生成的确定性越高。取值为None或当top_k大于100时,表示不启用top_k策略,此时仅有top_p策略生效。 取值需要大于或等于0。为了翻译的准确性,不建议修改该值。 该参数非OpenAI标准参数。通过 Python SDK调用时,请放入 extra_body 对象中,配置方式为: |
|
|
repetition_penalty 模型生成时连续序列中的重复度。提高repetition_penalty时可以降低模型生成的重复度,1.0表示不做惩罚。取值大于0即可。为了翻译的准确性,不建议修改该值。 该参数非OpenAI标准参数。通过 Python SDK调用时,请放入 extra_body 对象中,配置方式为: |
|
|
translation_options 需配置的翻译参数。 该参数非OpenAI标准参数。通过 Python SDK调用时,请放入 extra_body 对象中,配置方式为: |
chat响应chunk对象(流式输出) |
文本输出chunk
音频输出chunk
Token 消耗chunk
|
|
id 本次调用的唯一标识符。每个chunk对象有相同的 id。 |
|
|
choices 模型生成内容的数组。若设置 |
|
|
created 本次请求被创建时的时间戳。每个chunk有相同的时间戳。 |
|
|
model 本次请求使用的模型。 |
|
|
object 始终为 |
|
|
service_tier 该值固定为 |
|
|
system_fingerprint 该值固定为 |
|
|
usage 本次请求消耗的Token。只在 |