qwen3.7-text-embedding-flash

更新时间:
复制 MD 格式

基于Qwen3.7训练的轻量级多语言文本向量模型,面向成本和吞吐敏感场景。相较text-embedding-v4,在多语言覆盖(100→201种)、长文本处理(32K→128K)和Sparse Embedding等能力上大幅升级;在语义、跨语言及代码检索评测上整体效果基本持平,其中AIRBench-zh提升约3%。支持256、512、768、1024维用户自定义向量维度,默认1024维。

推理服务供应商

qwen3.7-text-embedding-flash模型的推理服务供应商为阿里云百炼。

模型能力

能力项支持情况能力项支持情况

输入模态

Text

输出模态

Text

模型体验

不支持

Function Calling

不支持

结构化输出

不支持

联网搜索

不支持

前缀续写

不支持

上下文缓存

不支持

批量推理

支持

模型调优

不支持

上下文限制

参数参数

最大输入长度

131072

最大输出长度

上下文长度

131072

模型价格

本文仅展示模型调用原价,不包含限时优惠等活动信息,请前往百炼控制台查看活动优惠。

华北2(北京)

计费项价格(元)单位

文本输入

0.125

每百万tokens

限流

华北2(北京)

参数

RPM(每分钟请求数)

24000

TPM(每分钟tokens)

1,000,000