qwen-plus

更新时间:
复制 MD 格式

Qwen3系列Plus模型,实现思考模式和非思考模式的有效融合,可在对话中切换模式。推理能力显著超过QwQ、通用能力显著超过Qwen2.5-Plus,达到同规模业界SOTA水平。该模型版本功能等同于快照模型 qwen-plus-2025-07-28。

推理服务供应商

qwen-plus模型的推理服务供应商为阿里云百炼。

模型能力

华北2(北京)

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

支持

结构化输出

支持

联网搜索

支持

前缀续写

支持

上下文缓存

支持

批量推理

支持

模型调优

不支持

新加坡

部署范围:国际

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

不支持

结构化输出

支持

联网搜索

不支持

前缀续写

支持

上下文缓存

支持

批量推理

支持

模型调优

不支持

德国(法兰克福)

部署范围:欧盟、全球

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

不支持

结构化输出

支持

联网搜索

不支持

前缀续写

支持

上下文缓存

支持

批量推理

不支持

模型调优

不支持

美国(弗吉尼亚)

部署范围:全球

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

不支持

结构化输出

支持

联网搜索

不支持

前缀续写

支持

上下文缓存

支持

批量推理

不支持

模型调优

不支持

上下文限制

参数 参数

最大输入长度

997952

最大输出长度

32768

上下文长度

1000000

最大输入长度(思考模式下)

995904

最大输出长度(思考模式下)

32768

最大思维链长度

81920

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。

华北2(北京)

输入<=128k

计费项 价格(元) 单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

输入(缓存命中)

0.16

每百万tokens

输入(思考模式缓存命中)

0.16

每百万tokens

思考模式输出(Batch File)

4

每百万tokens

输入(Batch File)

0.4

每百万tokens

输出(Batch File)

1

每百万tokens

输入(思考模式 Batch File)

0.4

每百万tokens

显式缓存创建

1

每百万tokens

显式缓存命中

0.08

每百万tokens

显式缓存创建(思考)

1

每百万tokens

显式缓存命中(思考)

0.08

每百万tokens

输入(Batch Chat)

0.8

每百万tokens

输出(Batch Chat)

2

每百万tokens

输入(思考模式 Batch Chat)

0.8

每百万tokens

输出(思考模式 Batch Chat)

8

每百万tokens

128k<输入<=256k

计费项 价格(元) 单位

输入

2.4

每百万tokens

输出

20

每百万tokens

输入(思考)

2.4

每百万tokens

输出(思考)

24

每百万tokens

输入(缓存命中)

0.48

每百万tokens

输入(思考模式缓存命中)

0.48

每百万tokens

思考模式输出(Batch File)

12

每百万tokens

输入(Batch File)

1.2

每百万tokens

输出(Batch File)

10

每百万tokens

输入(思考模式 Batch File)

1.2

每百万tokens

显式缓存创建

3

每百万tokens

显式缓存命中

0.24

每百万tokens

显式缓存创建(思考)

3

每百万tokens

显式缓存命中(思考)

0.24

每百万tokens

输入(Batch Chat)

2.4

每百万tokens

输出(Batch Chat)

20

每百万tokens

输入(思考模式 Batch Chat)

2.4

每百万tokens

输出(思考模式 Batch Chat)

24

每百万tokens

256k<输入<=1m

计费项 价格(元) 单位

输入

4.8

每百万tokens

输出

48

每百万tokens

输入(思考)

4.8

每百万tokens

输出(思考)

64

每百万tokens

输入(缓存命中)

0.96

每百万tokens

输入(思考模式缓存命中)

0.96

每百万tokens

思考模式输出(Batch File)

32

每百万tokens

输入(Batch File)

2.4

每百万tokens

输出(Batch File)

24

每百万tokens

输入(思考模式 Batch File)

2.4

每百万tokens

显式缓存创建

6

每百万tokens

显式缓存命中

0.48

每百万tokens

显式缓存创建(思考)

6

每百万tokens

显式缓存命中(思考)

0.48

每百万tokens

输入(Batch Chat)

4.8

每百万tokens

输出(Batch Chat)

48

每百万tokens

输入(思考模式 Batch Chat)

4.8

每百万tokens

输出(思考模式 Batch Chat)

64

每百万tokens

新加坡

部署范围:国际

Input<=256k

计费项 价格(元) 单位

输入

2.936

每百万tokens

输出

8.807

每百万tokens

输入(思考)

2.936

每百万tokens

输出(思考)

29.357

每百万tokens

输入(缓存命中)

0.587

每百万tokens

输入(思考模式缓存命中)

0.587

每百万tokens

思考模式输出(Batch File)

14.678

每百万tokens

输入(Batch File)

1.468

每百万tokens

输出(Batch File)

4.404

每百万tokens

输入(思考模式 Batch File)

1.468

每百万tokens

显式缓存创建

3.67

每百万tokens

显式缓存命中

0.294

每百万tokens

显式缓存创建(思考)

3.67

每百万tokens

显式缓存命中(思考)

0.294

每百万tokens

256k<Input<=1m

计费项 价格(元) 单位

输入

8.807

每百万tokens

输出

26.421

每百万tokens

输入(思考)

8.807

每百万tokens

输出(思考)

88.071

每百万tokens

输入(缓存命中)

1.761

每百万tokens

输入(思考模式缓存命中)

1.761

每百万tokens

思考模式输出(Batch File)

44.035

每百万tokens

输入(Batch File)

4.404

每百万tokens

输出(Batch File)

13.211

每百万tokens

输入(思考模式 Batch File)

4.404

每百万tokens

显式缓存创建

11.009

每百万tokens

显式缓存命中

0.881

每百万tokens

显式缓存创建(思考)

11.009

每百万tokens

显式缓存命中(思考)

0.881

每百万tokens

德国(法兰克福)

部署范围:欧盟

输入<=256k

计费项 价格(元) 单位

输入

2.998

每百万tokens

输出

8.993

每百万tokens

输入(思考)

2.998

每百万tokens

输出(思考)

29.977

每百万tokens

输入(缓存命中)

0.6

每百万tokens

输入(思考模式缓存命中)

0.6

每百万tokens

显式缓存创建

3.747

每百万tokens

显式缓存命中

0.3

每百万tokens

显式缓存创建(思考)

3.747

每百万tokens

显式缓存命中(思考)

0.3

每百万tokens

256k<输入<=1m

计费项 价格(元) 单位

输入

8.993

每百万tokens

输出

26.979

每百万tokens

输入(思考)

8.993

每百万tokens

输出(思考)

89.93

每百万tokens

输入(缓存命中)

1.799

每百万tokens

输入(思考模式缓存命中)

1.799

每百万tokens

显式缓存创建

11.241

每百万tokens

显式缓存命中

0.899

每百万tokens

显式缓存创建(思考)

11.241

每百万tokens

显式缓存命中(思考)

0.899

每百万tokens

部署范围:全球

输入<=128k

计费项 价格(元) 单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

输入(缓存命中)

0.16

每百万tokens

输入(思考模式缓存命中)

0.16

每百万tokens

显式缓存创建

1

每百万tokens

显式缓存命中

0.08

每百万tokens

显式缓存创建(思考)

1

每百万tokens

显式缓存命中(思考)

0.08

每百万tokens

128k<输入<=256k

计费项 价格(元) 单位

输入

2.4

每百万tokens

输出

20

每百万tokens

输入(思考)

2.4

每百万tokens

输出(思考)

24

每百万tokens

输入(缓存命中)

0.48

每百万tokens

输入(思考模式缓存命中)

0.48

每百万tokens

显式缓存创建

3

每百万tokens

显式缓存命中

0.24

每百万tokens

显式缓存创建(思考)

3

每百万tokens

显式缓存命中(思考)

0.24

每百万tokens

256k<输入<=1m

计费项 价格(元) 单位

输入

4.8

每百万tokens

输出

48

每百万tokens

输入(思考)

4.8

每百万tokens

输出(思考)

64

每百万tokens

输入(缓存命中)

0.96

每百万tokens

输入(思考模式缓存命中)

0.96

每百万tokens

显式缓存创建

6

每百万tokens

显式缓存命中

0.48

每百万tokens

显式缓存创建(思考)

6

每百万tokens

显式缓存命中(思考)

0.48

每百万tokens

美国(弗吉尼亚)

部署范围:全球

输入<=128k

计费项 价格(元) 单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

输入(缓存命中)

0.16

每百万tokens

输入(思考模式缓存命中)

0.16

每百万tokens

显式缓存创建

1

每百万tokens

显式缓存命中

0.08

每百万tokens

显式缓存创建(思考)

1

每百万tokens

显式缓存命中(思考)

0.08

每百万tokens

128k<输入<=256k

计费项 价格(元) 单位

输入

2.4

每百万tokens

输出

20

每百万tokens

输入(思考)

2.4

每百万tokens

输出(思考)

24

每百万tokens

输入(缓存命中)

0.48

每百万tokens

输入(思考模式缓存命中)

0.48

每百万tokens

显式缓存创建

3

每百万tokens

显式缓存命中

0.24

每百万tokens

显式缓存创建(思考)

3

每百万tokens

显式缓存命中(思考)

0.24

每百万tokens

256k<输入<=1m

计费项 价格(元) 单位

输入

4.8

每百万tokens

输出

48

每百万tokens

输入(思考)

4.8

每百万tokens

输出(思考)

64

每百万tokens

输入(缓存命中)

0.96

每百万tokens

输入(思考模式缓存命中)

0.96

每百万tokens

显式缓存创建

6

每百万tokens

显式缓存命中

0.48

每百万tokens

显式缓存创建(思考)

6

每百万tokens

显式缓存命中(思考)

0.48

每百万tokens

限流

华北2(北京)

参数

RPM(每分钟请求数)

30000

TPM(每分钟tokens)

5,000,000

新加坡

部署范围:国际

参数

RPM(每分钟请求数)

600

TPM(每分钟tokens)

1,000,000

德国(法兰克福)

部署范围:欧盟

参数

RPM(每分钟请求数)

600

TPM(每分钟tokens)

1,000,000

部署范围:全球

参数

RPM(每分钟请求数)

600

TPM(每分钟tokens)

1,000,000

美国(弗吉尼亚)

部署范围:全球

参数

RPM(每分钟请求数)

600

TPM(每分钟tokens)

1,000,000

动态更新

qwen-plus-latest

千问系列能力均衡的模型,推理效果和速度介于千问-Max和千问-Turbo之间,适合中等复杂任务。本模型是动态更新版本,模型更新不会提前通知。

推理服务供应商

qwen-plus-latest模型的推理服务供应商为阿里云百炼。

模型能力

华北2(北京)

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

支持

结构化输出

支持

联网搜索

支持

前缀续写

支持

上下文缓存

不支持

批量推理

支持

模型调优

不支持

新加坡

部署范围:国际

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

不支持

结构化输出

支持

联网搜索

不支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数 参数

最大输入长度

995904

最大输出长度

32768

上下文长度

1000000

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。

华北2(北京)

输入<=128k

计费项 价格(元) 单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

思考模式输出(Batch File)

4

每百万tokens

输入(Batch File)

0.4

每百万tokens

输出(Batch File)

1

每百万tokens

输入(思考模式 Batch File)

0.4

每百万tokens

128k<输入<=256k

计费项 价格(元) 单位

输入

2.4

每百万tokens

输出

20

每百万tokens

输入(思考)

2.4

每百万tokens

输出(思考)

24

每百万tokens

思考模式输出(Batch File)

12

每百万tokens

输入(Batch File)

1.2

每百万tokens

输出(Batch File)

10

每百万tokens

输入(思考模式 Batch File)

1.2

每百万tokens

256k<输入<=1m

计费项 价格(元) 单位

输入

4.8

每百万tokens

输出

48

每百万tokens

输入(思考)

4.8

每百万tokens

输出(思考)

64

每百万tokens

思考模式输出(Batch File)

32

每百万tokens

输入(Batch File)

2.4

每百万tokens

输出(Batch File)

24

每百万tokens

输入(思考模式 Batch File)

2.4

每百万tokens

新加坡

部署范围:国际

Input<=128k

计费项 价格(元) 单位

输入

2.936

每百万tokens

输出

8.807

每百万tokens

输入(思考)

2.936

每百万tokens

输出(思考)

29.357

每百万tokens

256k<Input<=1m

计费项 价格(元) 单位

输入

8.807

每百万tokens

输出

26.421

每百万tokens

输入(思考)

8.807

每百万tokens

输出(思考)

88.071

每百万tokens

限流

华北2(北京)

参数

RPM(每分钟请求数)

15000

TPM(每分钟tokens)

1,200,000

新加坡

部署范围:国际

参数

RPM(每分钟请求数)

600

TPM(每分钟tokens)

1,000,000

快照版本

qwen-plus-2025-12-01

本版本为2025121日快照,相较728日快照在推理能力上有提升;智能体能力、多轮工具调用能力进一步增强;主观创作类任务表现更优。支持1M上下文长度,按照上下文长度进行阶梯计费。

推理服务供应商

qwen-plus-2025-12-01模型的推理服务供应商为阿里云百炼。

模型能力

华北2(北京)

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

支持

结构化输出

支持

联网搜索

支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

新加坡

部署范围:国际

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

不支持

Function Calling

不支持

结构化输出

不支持

联网搜索

不支持

前缀续写

不支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

德国(法兰克福)

部署范围:欧盟、全球

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

不支持

Function Calling

不支持

结构化输出

不支持

联网搜索

不支持

前缀续写

不支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

美国(弗吉尼亚)

部署范围:全球

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

不支持

Function Calling

不支持

结构化输出

不支持

联网搜索

不支持

前缀续写

不支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数 参数

最大输入长度

997952

最大输出长度

32768

上下文长度

1000000

最大输入长度(思考模式下)

995904

最大输出长度(思考模式下)

32768

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。

华北2(北京)

输入<=128k

计费项 价格(元) 单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

128k<输入<=256k

计费项 价格(元) 单位

输入

2.4

每百万tokens

输出

20

每百万tokens

输入(思考)

2.4

每百万tokens

输出(思考)

24

每百万tokens

256k<输入<=1m

计费项 价格(元) 单位

输入

4.8

每百万tokens

输出

48

每百万tokens

输入(思考)

4.8

每百万tokens

输出(思考)

64

每百万tokens

新加坡

部署范围:国际

Input<=256k

计费项 价格(元) 单位

输入

2.936

每百万tokens

输出

8.807

每百万tokens

输入(思考)

2.936

每百万tokens

输出(思考)

29.357

每百万tokens

256k<Input<=1m

计费项 价格(元) 单位

输入

8.807

每百万tokens

输出

26.421

每百万tokens

输入(思考)

8.807

每百万tokens

输出(思考)

88.071

每百万tokens

德国(法兰克福)

部署范围:欧盟

输入<=256k

计费项 价格(元) 单位

输入

2.998

每百万tokens

输出

8.993

每百万tokens

输入(思考)

2.998

每百万tokens

输出(思考)

29.977

每百万tokens

256k<输入<=1m

计费项 价格(元) 单位

输入

8.993

每百万tokens

输出

26.979

每百万tokens

输入(思考)

8.993

每百万tokens

输出(思考)

89.93

每百万tokens

部署范围:全球

输入<=128k

计费项 价格(元) 单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

128k<输入<=256k

计费项 价格(元) 单位

输入

2.4

每百万tokens

输出

20

每百万tokens

输入(思考)

2.4

每百万tokens

输出(思考)

24

每百万tokens

256k<输入<=1m

计费项 价格(元) 单位

输入

4.8

每百万tokens

输出

48

每百万tokens

输入(思考)

4.8

每百万tokens

输出(思考)

64

每百万tokens

美国(弗吉尼亚)

部署范围:全球

输入<=128k

计费项 价格(元) 单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

128k<输入<=256k

计费项 价格(元) 单位

输入

2.4

每百万tokens

输出

20

每百万tokens

输入(思考)

2.4

每百万tokens

输出(思考)

24

每百万tokens

256k<输入<=1m

计费项 价格(元) 单位

输入

4.8

每百万tokens

输出

48

每百万tokens

输入(思考)

4.8

每百万tokens

输出(思考)

64

每百万tokens

限流

华北2(北京)

参数

RPM(每分钟请求数)

120

TPM(每分钟tokens)

1,000,000

新加坡

部署范围:国际

参数

RPM(每分钟请求数)

120

TPM(每分钟tokens)

1,000,000

德国(法兰克福)

部署范围:欧盟

参数

RPM(每分钟请求数)

120

TPM(每分钟tokens)

1,000,000

部署范围:全球

参数

RPM(每分钟请求数)

120

TPM(每分钟tokens)

1,000,000

美国(弗吉尼亚)

部署范围:全球

参数

RPM(每分钟请求数)

120

TPM(每分钟tokens)

1,000,000

qwen-plus-2025-09-11

本版本为2025911日快照,相较728日快照在思考模式下指令遵循能力有提升、模型总结回复更加精简;在非思考模式下中文文本理解能力更佳、逻辑推理能力有增强。支持1M上下文长度,按照上下文长度进行阶梯计费。

推理服务供应商

qwen-plus-2025-09-11模型的推理服务供应商为阿里云百炼。

模型能力

华北2(北京)

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

不支持

Function Calling

不支持

结构化输出

不支持

联网搜索

不支持

前缀续写

不支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

新加坡

部署范围:国际

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

不支持

结构化输出

支持

联网搜索

不支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

德国(法兰克福)

部署范围:全球

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

不支持

结构化输出

支持

联网搜索

不支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

美国(弗吉尼亚)

部署范围:全球

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

不支持

结构化输出

支持

联网搜索

不支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数 参数

最大输入长度

995904

最大输出长度

32768

上下文长度

1000000

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。

华北2(北京)

输入<=128k

计费项 价格(元) 单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

128k<输入<=256k

计费项 价格(元) 单位

输入

2.4

每百万tokens

输出

20

每百万tokens

输入(思考)

2.4

每百万tokens

输出(思考)

24

每百万tokens

256k<输入<=1m

计费项 价格(元) 单位

输入

4.8

每百万tokens

输出

48

每百万tokens

输入(思考)

4.8

每百万tokens

输出(思考)

64

每百万tokens

新加坡

部署范围:国际

Input<=256k

计费项 价格(元) 单位

输入

2.936

每百万tokens

输出

8.807

每百万tokens

输入(思考)

2.936

每百万tokens

输出(思考)

29.357

每百万tokens

256k<Input<=1m

计费项 价格(元) 单位

输入

8.807

每百万tokens

输出

26.421

每百万tokens

输入(思考)

8.807

每百万tokens

输出(思考)

88.071

每百万tokens

德国(法兰克福)

部署范围:全球

输入<=128k

计费项 价格(元) 单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

128k<输入<=256k

计费项 价格(元) 单位

输入

2.4

每百万tokens

输出

20

每百万tokens

输入(思考)

2.4

每百万tokens

输出(思考)

24

每百万tokens

256k<输入<=1m

计费项 价格(元) 单位

输入

4.8

每百万tokens

输出

48

每百万tokens

输入(思考)

4.8

每百万tokens

输出(思考)

64

每百万tokens

美国(弗吉尼亚)

部署范围:全球

输入<=128k

计费项 价格(元) 单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

128k<输入<=256k

计费项 价格(元) 单位

输入

2.4

每百万tokens

输出

20

每百万tokens

输入(思考)

2.4

每百万tokens

输出(思考)

24

每百万tokens

256k<输入<=1m

计费项 价格(元) 单位

输入

4.8

每百万tokens

输出

48

每百万tokens

输入(思考)

4.8

每百万tokens

输出(思考)

64

每百万tokens

限流

华北2(北京)

参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

1,000,000

新加坡

部署范围:国际

参数

RPM(每分钟请求数)

120

TPM(每分钟tokens)

1,000,000

德国(法兰克福)

部署范围:全球

参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

1,000,000

美国(弗吉尼亚)

部署范围:全球

参数

RPM(每分钟请求数)

120

TPM(每分钟tokens)

1,000,000

qwen-plus-2025-07-28

Qwen3系列Plus模型,实现思考模式和非思考模式的有效融合,可在对话中切换模式。相较上个版本在中英文能力、工具调用上进行了专用增强。本版本为2025728日快照,首次支持1M上下文长度,按照上下文长度进行阶梯计费。

推理服务供应商

qwen-plus-2025-07-28模型的推理服务供应商为阿里云百炼。

模型能力

华北2(北京)

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

支持

结构化输出

支持

联网搜索

支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

新加坡

部署范围:国际

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

不支持

结构化输出

支持

联网搜索

不支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

德国(法兰克福)

部署范围:全球

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

不支持

结构化输出

支持

联网搜索

不支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

美国(弗吉尼亚)

部署范围:全球

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

不支持

结构化输出

支持

联网搜索

不支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数 参数

最大输入长度

995904

最大输出长度

32768

上下文长度

1000000

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。

华北2(北京)

输入<=128k

计费项 价格(元) 单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

128k<输入<=256k

计费项 价格(元) 单位

输入

2.4

每百万tokens

输出

20

每百万tokens

输入(思考)

2.4

每百万tokens

输出(思考)

24

每百万tokens

256k<输入<=1m

计费项 价格(元) 单位

输入

4.8

每百万tokens

输出

48

每百万tokens

输入(思考)

4.8

每百万tokens

输出(思考)

64

每百万tokens

新加坡

部署范围:国际

Input<=256k

计费项 价格(元) 单位

输入

2.936

每百万tokens

输出

8.807

每百万tokens

输入(思考)

2.936

每百万tokens

输出(思考)

29.357

每百万tokens

256k<Input<=1m

计费项 价格(元) 单位

输入

8.807

每百万tokens

输出

26.421

每百万tokens

输入(思考)

8.807

每百万tokens

输出(思考)

88.071

每百万tokens

德国(法兰克福)

部署范围:全球

输入<=128k

计费项 价格(元) 单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

128k<输入<=256k

计费项 价格(元) 单位

输入

2.4

每百万tokens

输出

20

每百万tokens

输入(思考)

2.4

每百万tokens

输出(思考)

24

每百万tokens

256k<输入<=1m

计费项 价格(元) 单位

输入

4.8

每百万tokens

输出

48

每百万tokens

输入(思考)

4.8

每百万tokens

输出(思考)

64

每百万tokens

美国(弗吉尼亚)

部署范围:全球

输入<=128k

计费项 价格(元) 单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

128k<输入<=256k

计费项 价格(元) 单位

输入

2.4

每百万tokens

输出

20

每百万tokens

输入(思考)

2.4

每百万tokens

输出(思考)

24

每百万tokens

256k<输入<=1m

计费项 价格(元) 单位

输入

4.8

每百万tokens

输出

48

每百万tokens

输入(思考)

4.8

每百万tokens

输出(思考)

64

每百万tokens

限流

华北2(北京)

参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

1,000,000

新加坡

部署范围:国际

参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

100,000

德国(法兰克福)

部署范围:全球

参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

1,000,000

美国(弗吉尼亚)

部署范围:全球

参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

100,000

qwen-plus-2025-07-14

Qwen3系列Plus模型,实现思考模式和非思考模式的有效融合,可在对话中切换模式。此版本为2025714日快照模型,相较上个版本在非thinking模式下中英文能力均有大幅提升,工具调用能力专项增强。

推理服务供应商

qwen-plus-2025-07-14模型的推理服务供应商为阿里云百炼。

模型能力

华北2(北京)

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

支持

结构化输出

支持

联网搜索

支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

新加坡

部署范围:国际

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

不支持

结构化输出

不支持

联网搜索

不支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数 参数

最大输入长度

98304

最大输出长度

16384

上下文长度

131072

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。

华北2(北京)

计费项 价格(元) 单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

新加坡

部署范围:国际

计费项 价格(元) 单位

输入

2.936

每百万tokens

输出

8.807

每百万tokens

输入(思考)

2.936

每百万tokens

输出(思考)

29.357

每百万tokens

限流

华北2(北京)

参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

100,000

新加坡

部署范围:国际

参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

100,000

qwen-plus-2025-04-28

Qwen3系列Plus模型,实现思考模式和非思考模式的有效融合,可在对话中切换模式。推理能力显著超过QwQ、通用能力显著超过Qwen2.5-Plus,达到同规模业界SOTA水平。此版本为2025428日快照模型。

推理服务供应商

qwen-plus-2025-04-28模型的推理服务供应商为阿里云百炼。

模型能力

华北2(北京)

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

支持

结构化输出

支持

联网搜索

不支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

新加坡

部署范围:国际

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

不支持

结构化输出

支持

联网搜索

不支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数 参数

最大输入长度

98304

最大输出长度

16384

上下文长度

131072

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。

华北2(北京)

计费项 价格(元) 单位

输入

0.8

每百万tokens

输出

2

每百万tokens

输入(思考)

0.8

每百万tokens

输出(思考)

8

每百万tokens

新加坡

部署范围:国际

计费项 价格(元) 单位

输入

2.936

每百万tokens

输出

8.807

每百万tokens

输入(思考)

2.936

每百万tokens

输出(思考)

29.357

每百万tokens

限流

华北2(北京)

参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

1,000,000

新加坡

部署范围:国际

参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

1,000,000

qwen-plus-2025-01-25

千问系列能力均衡的模型,推理效果和速度介于千问-Max和千问-Turbo之间,适合中等复杂任务。相对于通义千问-Plus-2025-0112版本,整体中英文能力都有综合能力升级,中英文code能力、逻辑能力、多语言能力显著提升,回复风格面向人类偏好进行大幅调整,尤其是数学、逻辑推理、知识问答等客观类query,模型回复详实程度和格式清晰度明显改善,创作类专项、json格式遵循专项、角色扮演专项能力均定向提升,预计维护至下一个快照上线前一个月。

推理服务供应商

qwen-plus-2025-01-25模型的推理服务供应商为阿里云百炼。

模型能力

华北2(北京)

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

支持

结构化输出

支持

联网搜索

不支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

新加坡

部署范围:国际

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

不支持

结构化输出

支持

联网搜索

不支持

前缀续写

支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数 参数

最大输入长度

129024

最大输出长度

8192

上下文长度

131072

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。

华北2(北京)

计费项 价格(元) 单位

输入

0.8

每百万tokens

输出

2

每百万tokens

新加坡

部署范围:国际

计费项 价格(元) 单位

输入

2.936

每百万tokens

输出

8.807

每百万tokens

限流

华北2(北京)

参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

150,000

新加坡

部署范围:国际

参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

100,000

qwen-plus-0112

千问系列能力均衡的模型,推理效果和速度介于千问-Max和千问-Turbo之间,适合中等复杂任务。相对于千问-Plus-2024-1220版本,中英文整体能力有提升,中英常识知识类、阅读理解能力提升较为显著,codeswtich现象相比上一版有显著改善,中文指令遵循能力显著提升。

推理服务供应商

qwen-plus-0112模型的推理服务供应商为阿里云百炼。

模型能力

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

不支持

结构化输出

不支持

联网搜索

不支持

前缀续写

不支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数 参数

最大输入长度

129024

最大输出长度

8192

上下文长度

131072

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。

华北2(北京)

计费项 价格(元) 单位

输入

0.8

每百万tokens

输出

2

每百万tokens

限流

华北2(北京)

参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

150,000

qwen-plus-1220

千问系列能力均衡的模型,推理效果和速度介于千问-Max和千问-Turbo之间,适合中等复杂任务。相对于千问-Plus-1125版本,中英文整体能力有提升,中英常识知识类、阅读理解能力提升较为显著,codeswtich现象相比上一版有显著改善,中文指令遵循能力显著提升。

推理服务供应商

qwen-plus-1220模型的推理服务供应商为阿里云百炼。

模型能力

能力项 支持情况 能力项 支持情况

输入模态

Text

输出模态

Text

模型体验

支持

Function Calling

不支持

结构化输出

不支持

联网搜索

不支持

前缀续写

不支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数 参数

最大输入长度

129024

最大输出长度

8192

上下文长度

131072

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。

华北2(北京)

计费项 价格(元) 单位

输入

0.8

每百万tokens

输出

2

每百万tokens

限流

华北2(北京)

参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

150,000