通用文本向量模型可将文本数据转换为数值向量,用于语义搜索、推荐、聚类、分类等下游任务。
模型概览
北京
| 模型名称 | 向量维度 | 最大行数 | 单行最大Token数 | 单价(每千输入Token) | 支持语种 | 免费额度(注) |
|---|---|---|---|---|---|---|
qwen3.7-text-embedding | 2560、2,048、1,536、1,024(默认)、768、512、256 | 20 | 128,000 | 0.0005元 Batch调用:0.00025元 | 中文、英语、西班牙语、法语、葡萄牙语、印尼语、日语、韩语、德语、俄罗斯语等201种主流语种与方言 | 各100万Token 有效期:百炼开通后90天内 |
qwen3.7-text-embedding-flash | 1,024(默认)、768、512、256 | 20 | 128,000 | 0.000125元 Batch调用:0.000063元 | 中文、英语、西班牙语、法语、葡萄牙语、印尼语、日语、韩语、德语、俄罗斯语等201种主流语种与方言 | |
text-embedding-v4
| 2,048、1,536、1,024(默认)、768、512、256、128、64 | 10 | 8,192 | 0.0005元 Batch调用:0.00025元 | 中文、英语、西班牙语、法语、葡萄牙语、印尼语、日语、韩语、德语、俄罗斯语等100+主流语种及多种编程语言 | |
text-embedding-v3 | 1,024(默认)、768、512、256、128或64 | 中文、英语、西班牙语、法语、葡萄牙语、印尼语、日语、韩语、德语、俄罗斯语等50+主流语种 | ||||
text-embedding-v2 | 1,536 | 25 | 2,048 | 0.0007元 Batch调用:0.00035元 | 中文、英语、西班牙语、法语、葡萄牙语、印尼语、日语、韩语、德语、俄罗斯语 | 各50万Token 有效期:百炼开通后90天内 |
text-embedding-v1 | 中文、英语、西班牙语、法语、葡萄牙语、印尼语 |
新加坡
| 模型名称 | 向量维度 | 最大行数 | 单行最大Token数 | 单价(每千输入Token) | 支持语种 | 免费额度 |
|---|---|---|---|---|---|---|
qwen3.7-text-embedding | 2560、2,048、1,536、1,024(默认)、768、512、256 | 20 | 128,000 | 0.000525元 | 中文、英语、西班牙语、法语、葡萄牙语、印尼语、日语、韩语、德语、俄罗斯语等201种主流语种与方言 | 无免费额度 |
text-embedding-v4
| 2,048、1,536、1,024(默认)、768、512、256、128、64 | 10 | 8,192 | 0.000514元 | 中文、英语、西班牙语、法语、葡萄牙语、印尼语、日语、韩语、德语、俄罗斯语等100+主流语种及多种编程语言 | 无免费额度 |
text-embedding-v3 | 1,024(默认)、768、512 | 中文、英语、西班牙语、法语、葡萄牙语、印尼语、日语、韩语、德语、俄罗斯语等50+主流语种 | 50万Token 有效期:百炼开通后90天内 |
关于模型限流,请参考限流。
前提条件
若熟悉OpenAI生态,可使用兼容API快速迁移;DashScope API则提供更丰富的独有特性。请根据您的需求选择。
您需要已获取与配置 API Key并配置API Key到环境变量。如果通过SDK调用,还需要安装DashScope SDK。请将示例代码中的 DASHSCOPE_API_HOST 替换为获取的 API Host。
OpenAI兼容
公共云
使用SDK调用时需配置的base_url:https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
使用HTTP方式调用时需配置的endpoint:POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1/embeddings
调用时请将{WorkspaceId}替换为真实的业务空间ID。
请求体model 调用的模型名称,参考模型概览表格中的模型名称进行选择。 input 输入待处理的文本。可以是字符串(string)、字符串列表(array)或文件(file)。不同模型版本支持的文本长度和批量大小不同,具体如下:
dimensions 指定的向量维度,必须为以下值之一: encoding_format 用于控制返回的Embedding格式,入参支持
| 输入字符串输入字符串列表输入文件PythonJavacurl
|
响应对象data 任务输出信息。 model 本次调用的模型名。 objectstring 本次调用返回的data类型,默认为list。 usage 本次请求的 Token 用量。 idstring 请求唯一标识。可用于请求明细溯源和问题排查。 | |
DashScope
公共云
使用SDK调用时需配置的base_url:https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1
使用HTTP方式调用时需配置的endpoint:POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/embeddings/text-embedding/text-embedding
调用时请将{WorkspaceId}替换为真实的业务空间ID。
请求体model 调用的模型,参考模型概览表格中的模型名称进行选择。 input 输入待处理的文本。可以是字符串(string)、字符串列表(array)或文件(file)。不同模型版本支持的文本长度和批量大小不同,具体如下:
text_type
文本转换为向量后可以应用于检索、聚类、分类等下游任务,对检索这类非对称任务为了达到更好的检索效果建议区分查询文本(query)和底库文本(document)类型,入库、聚类、分类等对称任务可以不用特殊指定,采用系统默认值 dimension
指定的向量维度,必须为以下值之一: output_type
用户指定输出离散向量表示只适用于 instruct 添加自定义任务说明,可用于指导模型理解查询意图。建议使用英文撰写,通常可带来约 1%–5% 的效果提升。 该参数仅在 | 输入字符串输入字符串列表输入文件PythonJavacurl
|
响应对象status_code 状态码,表示请求的执行结果(如 200 表示成功)。 request_id 请求唯一标识。可用于请求明细溯源和问题排查。 code 请求失败,表示错误码,成功时返回参数中该参数为空。 message 请求失败,表示失败详细信息,成功时返回参数中该参数为空。 output 任务输出信息。 usage 本次请求的 Token 用量。 | |
错误码
如果模型调用失败并返回报错信息,请参见错误码进行解决。