paraformer-mtl-v1

更新时间:
复制 MD 格式

Paraformer多语言语音识别模型,支持16kHz及以上采样率的音频或视频语音识别。 支持的语种/方言包括:中文普通话、中文方言(粤语、吴语、闽南语、东北话、甘肃话、贵州话、河南话、湖北话、湖南话、宁夏话、山西话、陕西话、山东话、四川话、天津话)、英语、日语、韩语、西班牙语、印尼语、法语、德语、意大利语、马来语。

推理服务供应商

paraformer-mtl-v1模型的推理服务供应商为阿里云百炼。

模型能力

能力项 支持情况 能力项 支持情况

输入模态

Audio

输出模态

Text

模型体验

支持

Function Calling

不支持

结构化输出

不支持

联网搜索

不支持

前缀续写

不支持

上下文缓存

不支持

批量推理

不支持

模型调优

不支持

上下文限制

参数 参数

最大输入长度

最大输出长度

上下文长度

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。

华北2(北京)

计费项 价格(元) 单位

音频时长

0.00008

每秒

限流

华北2(北京)

参数

RPM(每分钟请求数)

600

TPM(每分钟tokens)

6,000,000