2.4万亿参数的MoE架构旗舰模型,在编程与办公场景能力提升,适用于法律、金融、设计等专业任务。具备原生视觉理解能力,支持超长文档与长视频的语义解析,并支持长程任务的自主规划与迭代。
模型调用 ID(model 参数取值):qwen3.8-max
快照版本:qwen3.8-max-0902(别名 qwen3.8-max-2026-09-02)
模型能力
华北2(北京)
能力项 | 支持情况 | 能力项 | 支持情况 |
|---|---|---|---|
输入模态 | Image Text Video | 输出模态 | Text |
模型体验 | 支持 | Function Calling | 支持 |
结构化输出 | 支持 | 联网搜索 | 支持 |
前缀续写 | 支持 | 上下文缓存 | 支持 |
批量推理 | 支持 | 模型调优 | 不支持 |
新加坡
部署范围:国际
能力项 | 支持情况 | 能力项 | 支持情况 |
|---|---|---|---|
输入模态 | Image Text Video | 输出模态 | Text |
模型体验 | 支持 | Function Calling | 支持 |
结构化输出 | 支持 | 联网搜索 | 支持 |
前缀续写 | 支持 | 上下文缓存 | 支持 |
批量推理 | 不支持 | 模型调优 | 不支持 |
德国(法兰克福)
部署范围:全球
能力项 | 支持情况 | 能力项 | 支持情况 |
|---|---|---|---|
输入模态 | Image Text Video | 输出模态 | Text |
模型体验 | 支持 | Function Calling | 支持 |
结构化输出 | 支持 | 联网搜索 | 不支持 |
前缀续写 | 支持 | 上下文缓存 | 支持 |
批量推理 | 不支持 | 模型调优 | 不支持 |
美国(弗吉尼亚)
部署范围:全球
能力项 | 支持情况 | 能力项 | 支持情况 |
|---|---|---|---|
输入模态 | Image Text Video | 输出模态 | Text |
模型体验 | 支持 | Function Calling | 支持 |
结构化输出 | 支持 | 联网搜索 | 不支持 |
前缀续写 | 支持 | 上下文缓存 | 支持 |
批量推理 | 不支持 | 模型调优 | 不支持 |
日本(东京)
部署范围:全球
能力项 | 支持情况 | 能力项 | 支持情况 |
|---|---|---|---|
输入模态 | Image Text Video | 输出模态 | Text |
模型体验 | 支持 | Function Calling | 支持 |
结构化输出 | 支持 | 联网搜索 | 不支持 |
前缀续写 | 支持 | 上下文缓存 | 支持 |
批量推理 | 不支持 | 模型调优 | 不支持 |
中国香港
部署范围:全球
能力项 | 支持情况 | 能力项 | 支持情况 |
|---|---|---|---|
输入模态 | Image Text Video | 输出模态 | Text |
模型体验 | 支持 | Function Calling | 支持 |
结构化输出 | 支持 | 联网搜索 | 不支持 |
前缀续写 | 支持 | 上下文缓存 | 支持 |
批量推理 | 不支持 | 模型调优 | 不支持 |
上下文限制
参数 | 值 | 参数 | 值 |
|---|---|---|---|
最大输入长度 | 991808 | 最大输出长度 | 131072 |
最大输入长度(思考模式下) | 983616 | 最大输出长度(思考模式下) | 131072 |
上下文长度 | 1000000 | 最大思维链长度 | 262144 |
在不同的API输入参数组合下,模型支持的长度可能会有变化。
模型价格
本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。
华北2(北京)
计费项 | 价格(元) | 单位 |
|---|---|---|
输入 | 12 | 每百万tokens |
输出 | 36 | 每百万tokens |
输入(缓存命中) | 1.5 | 每百万tokens |
输入(Batch File) | 6 | 每百万tokens |
输出(Batch File) | 18 | 每百万tokens |
显式缓存创建 | 15 | 每百万tokens |
显式缓存命中 | 1 | 每百万tokens |
输入(Batch Chat) | 12 | 每百万tokens |
输出(Batch Chat) | 36 | 每百万tokens |
新加坡
部署范围:国际
计费项 | 价格(元) | 单位 |
|---|---|---|
输入 | 14.988 | 每百万tokens |
输出 | 44.965 | 每百万tokens |
输入(缓存命中) | 1.874 | 每百万tokens |
显式缓存创建 | 18.736 | 每百万tokens |
显式缓存命中 | 1.274 | 每百万tokens |
德国(法兰克福)
部署范围:全球
计费项 | 价格(元) | 单位 |
|---|---|---|
输入 | 12 | 每百万tokens |
输出 | 36 | 每百万tokens |
输入(缓存命中) | 1.5 | 每百万tokens |
显式缓存创建 | 15 | 每百万tokens |
显式缓存命中 | 1 | 每百万tokens |
美国(弗吉尼亚)
部署范围:全球
计费项 | 价格(元) | 单位 |
|---|---|---|
输入 | 12 | 每百万tokens |
输出 | 36 | 每百万tokens |
输入(缓存命中) | 1.5 | 每百万tokens |
显式缓存创建 | 15 | 每百万tokens |
显式缓存命中 | 1 | 每百万tokens |
日本(东京)
部署范围:全球
计费项 | 价格(元) | 单位 |
|---|---|---|
输入 | 12 | 每百万tokens |
输出 | 36 | 每百万tokens |
输入(缓存命中) | 1.5 | 每百万tokens |
显式缓存创建 | 15 | 每百万tokens |
显式缓存命中 | 1 | 每百万tokens |
限流
说明该模型在华北2(北京)与新加坡地域采用动态限流机制:TPM 限额根据百炼月消费档位调整;RPM 限额较高,正常使用不会触发限流,无需单独设置。
华北2(北京)
本地域采用动态限流机制,TPM 限流值按百炼平台月消费额度分档,RPM 限额较高、正常使用不会触发限流。各档位数值请参见动态限流。
新加坡
部署范围:国际
本地域采用动态限流机制,TPM 限流值按百炼平台月消费额度分档,RPM 限额较高、正常使用不会触发限流。各档位数值请参见动态限流。
德国(法兰克福)
部署范围:全球
参数 | 值 |
|---|---|
RPM(每分钟请求数) | 30,000 |
TPM(每分钟tokens) | 5,000,000 |
美国(弗吉尼亚)
部署范围:全球
参数 | 值 |
|---|---|
RPM(每分钟请求数) | 30,000 |
TPM(每分钟tokens) | 5,000,000 |
日本(东京)
部署范围:全球
参数 | 值 |
|---|---|
RPM(每分钟请求数) | 30,000 |
TPM(每分钟tokens) | 5,000,000 |
中国香港
部署范围:全球
参数 | 值 |
|---|---|
RPM(每分钟请求数) | 30,000 |
TPM(每分钟tokens) | 5,000,000 |
快照版本
qwen3.8-max-0902
Qwen3.8-Max-0902(别名qwen3.8-max-2026-09-02)是qwen3.8-max的快照版本。编码深度再突破,可驾驭更复杂的工程级项目与长程自主开发;协作智能体能力显著增强,在多工具调度与端到端交付中表现更从容;视觉理解全面精进,图表推理、文档解析与多模态感知更敏锐准确。延续 100 万上下文、思考模式与完整工具生态,在更高智能水平上持续进化。
模型能力
华北2(北京)
能力项 | 支持情况 | 能力项 | 支持情况 |
|---|---|---|---|
输入模态 | Image Text Video | 输出模态 | Text |
模型体验 | 支持 | Function Calling | 支持 |
结构化输出 | 支持 | 联网搜索 | 支持 |
前缀续写 | 支持 | 上下文缓存 | 支持 |
批量推理 | 不支持 | 模型调优 | 不支持 |
新加坡
部署范围:国际
能力项 | 支持情况 | 能力项 | 支持情况 |
|---|---|---|---|
输入模态 | Image Text Video | 输出模态 | Text |
模型体验 | 支持 | Function Calling | 支持 |
结构化输出 | 支持 | 联网搜索 | 支持 |
前缀续写 | 支持 | 上下文缓存 | 支持 |
批量推理 | 不支持 | 模型调优 | 不支持 |
德国(法兰克福)
部署范围:全球
能力项 | 支持情况 | 能力项 | 支持情况 |
|---|---|---|---|
输入模态 | Image Text Video | 输出模态 | Text |
模型体验 | 支持 | Function Calling | 支持 |
结构化输出 | 支持 | 联网搜索 | 支持 |
前缀续写 | 支持 | 上下文缓存 | 支持 |
批量推理 | 不支持 | 模型调优 | 不支持 |
美国(弗吉尼亚)
部署范围:全球
能力项 | 支持情况 | 能力项 | 支持情况 |
|---|---|---|---|
输入模态 | Image Text Video | 输出模态 | Text |
模型体验 | 支持 | Function Calling | 支持 |
结构化输出 | 支持 | 联网搜索 | 支持 |
前缀续写 | 支持 | 上下文缓存 | 支持 |
批量推理 | 不支持 | 模型调优 | 不支持 |
日本(东京)
部署范围:全球
能力项 | 支持情况 | 能力项 | 支持情况 |
|---|---|---|---|
输入模态 | Image Text Video | 输出模态 | Text |
模型体验 | 支持 | Function Calling | 支持 |
结构化输出 | 支持 | 联网搜索 | 支持 |
前缀续写 | 支持 | 上下文缓存 | 支持 |
批量推理 | 不支持 | 模型调优 | 不支持 |
中国香港
部署范围:全球
能力项 | 支持情况 | 能力项 | 支持情况 |
|---|---|---|---|
输入模态 | Image Text Video | 输出模态 | Text |
模型体验 | 支持 | Function Calling | 支持 |
结构化输出 | 支持 | 联网搜索 | 支持 |
前缀续写 | 支持 | 上下文缓存 | 支持 |
批量推理 | 不支持 | 模型调优 | 不支持 |
上下文限制
参数 | 值 | 参数 | 值 |
|---|---|---|---|
最大输入长度 | 991808 | 最大输出长度 | 131072 |
最大输入长度(思考模式下) | 983616 | 最大输出长度(思考模式下) | 131072 |
上下文长度 | 1000000 | 最大思维链长度 | 262144 |
在不同的API输入参数组合下,模型支持的长度可能会有变化。
模型价格
本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。
华北2(北京)
计费项 | 价格(元) | 单位 |
|---|---|---|
输入 | 12 | 每百万tokens |
输出 | 36 | 每百万tokens |
输入(缓存命中) | 1.5 | 每百万tokens |
显式缓存创建 | 15 | 每百万tokens |
显式缓存命中 | 1 | 每百万tokens |
新加坡
部署范围:国际
计费项 | 价格(元) | 单位 |
|---|---|---|
输入 | 14.988 | 每百万tokens |
输出 | 44.965 | 每百万tokens |
输入(缓存命中) | 1.874 | 每百万tokens |
显式缓存创建 | 18.736 | 每百万tokens |
显式缓存命中 | 1.274 | 每百万tokens |
德国(法兰克福)
部署范围:全球
计费项 | 价格(元) | 单位 |
|---|---|---|
输入 | 12 | 每百万tokens |
输出 | 36 | 每百万tokens |
输入(缓存命中) | 1.5 | 每百万tokens |
显式缓存创建 | 15 | 每百万tokens |
显式缓存命中 | 1 | 每百万tokens |
美国(弗吉尼亚)
部署范围:全球
计费项 | 价格(元) | 单位 |
|---|---|---|
输入 | 12 | 每百万tokens |
输出 | 36 | 每百万tokens |
输入(缓存命中) | 1.5 | 每百万tokens |
显式缓存创建 | 15 | 每百万tokens |
显式缓存命中 | 1 | 每百万tokens |
日本(东京)
部署范围:全球
计费项 | 价格(元) | 单位 |
|---|---|---|
输入 | 12 | 每百万tokens |
输出 | 36 | 每百万tokens |
输入(缓存命中) | 1.5 | 每百万tokens |
显式缓存创建 | 15 | 每百万tokens |
显式缓存命中 | 1 | 每百万tokens |
限流
说明该模型在华北2(北京)与新加坡地域采用动态限流机制:TPM 限额根据百炼月消费档位调整;RPM 限额较高,正常使用不会触发限流,无需单独设置。
华北2(北京)
本地域采用动态限流机制,TPM 限流值按百炼平台月消费额度分档,RPM 限额较高、正常使用不会触发限流。各档位数值请参见动态限流。
新加坡
部署范围:国际
本地域采用动态限流机制,TPM 限流值按百炼平台月消费额度分档,RPM 限额较高、正常使用不会触发限流。各档位数值请参见动态限流。
德国(法兰克福)
部署范围:全球
参数 | 值 |
|---|---|
RPM(每分钟请求数) | 30,000 |
TPM(每分钟tokens) | 150,000 |
美国(弗吉尼亚)
部署范围:全球
参数 | 值 |
|---|---|
RPM(每分钟请求数) | 30,000 |
TPM(每分钟tokens) | 150,000 |
日本(东京)
部署范围:全球
参数 | 值 |
|---|---|
RPM(每分钟请求数) | 30,000 |
TPM(每分钟tokens) | 150,000 |
中国香港
部署范围:全球
参数 | 值 |
|---|---|
RPM(每分钟请求数) | 30,000 |
TPM(每分钟tokens) | 150,000 |