qwen-audio-3.0-realtime-plus

更新时间:
复制 MD 格式

千问实时语音大模型 是一款登顶全球权威评测的下一代实时双工语音大模型,它在全球权威第三方评测平台 Artificial Analysis Speech-to-Speech子项中取得综合排名第一。千问实时语音大模型 兼顾了模型智商与双工对话节奏,在保持流畅、自然的实时交互体验的同时,语音推理能力不打折扣;并通过并行推理和全向流式等工程优化,将端到端响应时延控制在低水平,实现"又快又聪明"的对话体验。标准版更注重高质量的回复结果。

模型能力

能力项 支持情况 能力项 支持情况

输入模态

Audio Text

输出模态

Audio Text

模型体验

不支持

Function Calling

支持

结构化输出

不支持

联网搜索

不支持

前缀续写

不支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数 参数

最大输入长度

16384

最大输出长度

8192

上下文长度

40960

最大输入长度(思考模式下)

16384

最大输出长度(思考模式下)

8192

最大思维链长度

1024

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。

华北2(北京)

计费项 价格(元) 单位

输入:音频

40

每百万tokens

输入:文本

5

每百万tokens

输出:文本

40

每百万tokens

输出:文本+音频(输出的文本不计费)

150

每百万tokens

限流

华北2(北京)

参数

RPM(每分钟请求数)

60

TPM(每分钟tokens)

100,000