面向音视频理解和内容分析,支持文本、图片、音频、视频输入及文本输出。
推理服务供应商
qwen3.8-omni-flash 模型的推理服务供应商为阿里云百炼。
模型能力
支持地域:华北2(北京)、新加坡、中国香港、日本(东京)、德国(法兰克福)、美国(弗吉尼亚)。需使用对应地域的 API Key。
| 能力项 | 支持情况 | 能力项 | 支持情况 |
|---|---|---|---|
| 输入模态 | 文本、图片、音频、视频 | 输出模态 | 文本 |
| Function Calling | 支持自定义工具调用 | 深度思考 | 默认开启,支持调节思考强度,详见深度思考 |
| 联网搜索 | 支持联网搜索;Responses 内置工具为 web_search | 上下文缓存 | 支持自动生效的隐式缓存及Responses Session缓存 |
| 音频输入语种 | 113 种语言和方言,与 Qwen3.5-Omni 一致,完整列表见模型选型 | 多通道音频 | 支持空间音频输入;Chat Completions 通过 use_multichannel 开启 |
通过 Chat Completions 或 Responses 调用,示例见非实时调用指南。
上下文限制
| 参数 | 值 | 参数 | 值 |
|---|---|---|---|
| 上下文长度 | 1M Token | 最大输入长度(非思考模式) | 991808 Token |
| 最大输入长度(思考模式) | 983616 Token | 最大输出长度 | 131072 Token |
模型价格
模型调用价格请参见模型价格。
限流
模型调用的限流说明请参见限流。
该文章对您有帮助吗?