EMR Serverless Spark 已内置多个常用模型,您可以在 AI Function 或多模态算子市场的 Daft 算子中直接调用模型能力。如果内置模型无法满足您的业务需求,还可以注册外部模型服务,支持对接百炼、PAI-EAS 及自建模型服务。
前提条件
使用AI中心的模型服务,需要开通AI中心。
内置模型
Serverless Spark 已内置下述模型,无需额外注册即可使用。其中文本生成模型和向量模型可以在 AI Function 或多模态算子市场的 Daft 算子中直接调用,模型服务由 EMR Serverless Spark 内置的 Model Manager 提供,您无需配置服务地址或鉴权信息。
模型类型 | 模型服务名称 | 模型名称 |
文本生成 | qwen3.8-max | qwen3.8-max |
qwen3.7-max | qwen3.7-max | |
qwen3.7-plus | qwen3.7-plus | |
qwen3.7-flash | qwen3.7-flash | |
qwen3.6-plus | qwen3.6-plus | |
qwen3.5-plus | qwen3.5-plus | |
qwen-plus | qwen-plus | |
deepseek-v4-pro | deepseek-v4-pro | |
deepseek-v4-flash | deepseek-v4-flash | |
glm-5.2 | glm-5.2 | |
向量(Embedding) | qwen3.7-text-embedding | qwen3.7-text-embedding |
text-embedding-v4 | text-embedding-v4 | |
tongyi-embedding-vision-plus | tongyi-embedding-vision-plus | |
tongyi-embedding-vision-plus-2026-03-06 | tongyi-embedding-vision-plus-2026-03-06 | |
语音合成 | qwen-audio-3.0-tts-plus | qwen-audio-3.0-tts-plus |
qwen-audio-3.0-tts-flash | qwen-audio-3.0-tts-flash | |
语音识别 | qwen-audio-3.0-asr-flash | qwen-audio-3.0-asr-flash |
内置模型按调用量计费,不同模型类型的计量方式不同:文本生成模型和向量模型按 Token 计量,语音合成模型按字符数计量,语音识别模型按音频时长计量。各模型的地域单价请参见模型调用(按量付费)。
tongyi-embedding-vision-plus 和 tongyi-embedding-vision-plus-2026-03-06 仅下述地域支持使用:华北2(北京)、华东2(上海)、华东1(杭州)、华南1(深圳)、华北6(乌兰察布)、西南1(成都)、华北3(张家口)。其余内置模型除上述地域外,还支持中国香港、新加坡、德国(法兰克福)、美国(弗吉尼亚)、美国(硅谷)、日本(东京)、印度尼西亚(雅加达)、菲律宾(马尼拉)和墨西哥地域。
添加外部模型
如果上述内置模型无法满足您的业务需求,可以通过以下步骤添加自建模型服务。
进入模型服务页面。
在左侧导航栏,选择。
在Spark页面,单击目标工作空间名称。
在EMR Serverless Spark页面,单击左侧导航栏中的。
在模型服务页签,单击创建外部模型服务,并配置以下信息:
字段
值示例
说明
模型服务名称
my_qwen_service该名称用于后续
AI Function中endpointName入参的值,工作空间中唯一,不支持后续修改。Endpoint
http://12*******39.vpc.cn-hangzhou.pai-eas.aliyuncs.com/api/predict/<ServiceName>/v1填写外部模型服务的Endpoint,如果是PAI-EAS模型,需要在末尾加上/v1。
说明如果使用的模型服务提供的是公网Endpoint,在Serverless Spark中使用该模型时需要给Spark任务配置具备公网访问能力的网络连接,详情请参见网络连接。
模型名称
Qwen3.5-Plus实际调用时的model名称。
模型类型
Chat根据部署的模型类型选择
Chat还是Embedding。API KEY
nMzI**********************Zg==模型服务的API Key。
描述
千问最新多模态模型服务
填写服务的简要描述,便于识别。
确认所有配置项无误后,单击创建完成模型服务注册。