AI Function 是 EMR Serverless StarRocks 提供的 SQL 内置 AI 推理函数,支持在 SQL 中直接调用 qwen 系列大模型。本文介绍其计费规则、各地域各模型的 Token 单价以及费用计算示例。AI Function 的具体使用方法(包括 SQL 调用语法、参数说明、示例查询等),请参见AI 函数。
计费说明
首月每位用户可享 100 万 Token 免费额度。超出免费额度的部分,将按标准单价正常收费。
|
特性 |
说明 |
|
计费规则 |
按照内置模型的Token用量计费,不同内置模型的计费规则不同:
模型调用费用为: |
|
上下文缓存 |
支持上下文缓存的模型,命中缓存的输入Token按缓存命中单价计费,缓存命中单价为该地域输入单价的20%。各模型是否支持缓存及具体单价,请参见下方各模型的价格表。 |
|
计费周期 |
按照每小时整点计算一次费用(以UTC+8时间为准),结算完毕后进入新的结算周期。在每个计费周期结束后,系统会生成账单,并从您账户中扣除相应费用。账单流水数据相对于实际费用消耗可能会有延迟,详情请参见了解阿里云账单。 |
计费信息
实际价格请以产品购买页面为准。
当前AI Function支持以下内置模型进行推理,均按输入Token和输出Token分别计费。
qwen3.6-plus
|
地域 |
Token范围 |
输入单价(元/千Token) |
输出单价(元/千Token) |
缓存命中单价(元/千Token) |
|
0<T≤256K |
0.002400 |
0.014400 |
0.000480 |
|
256K<T≤1M |
0.009600 |
0.057600 |
0.001920 |
|
|
0<T≤256K |
0.004497 |
0.026979 |
0.000899 |
|
256K<T≤1M |
0.017986 |
0.053958 |
0.003597 |
qwen3.7-max
|
地域 |
Token范围 |
输入单价(元/千Token) |
输出单价(元/千Token) |
缓存命中单价(元/千Token) |
|
0<T≤1M |
0.014400 |
0.043200 |
0.002880 |
|
0<T≤1M |
0.022483 |
0.067448 |
0.004497 |
qwen3.7-plus
|
地域 |
Token范围 |
输入单价(元/千Token) |
输出单价(元/千Token) |
缓存命中单价(元/千Token) |
|
0<T≤256K |
0.002400 |
0.009600 |
0.000480 |
|
256K<T≤1M |
0.007200 |
0.028800 |
0.001440 |
|
|
0<T≤256K |
0.003598 |
0.014389 |
0.000720 |
|
256K<T≤1M |
0.010792 |
0.043166 |
0.002158 |
qwen3.6-flash
|
地域 |
Token范围 |
输入单价(元/千Token) |
输出单价(元/千Token) |
|
0<T≤256K |
0.001440 |
0.008640 |
|
256K<T≤1M |
0.005760 |
0.034560 |
|
|
0<T≤256K |
0.001440 |
0.008640 |
|
256K<T≤1M |
0.005760 |
0.034560 |
qwen3.8-max
|
地域 |
Token范围 |
输入单价(元/千Token) |
输出单价(元/千Token) |
缓存命中单价(元/千Token) |
|
0<T≤1M |
0.014400 |
0.043200 |
0.002880 |
|
0<T≤1M |
0.017986 |
0.053958 |
0.003597 |
qwen3.7-flash
|
地域 |
Token范围 |
输入单价(元/千Token) |
输出单价(元/千Token) |
缓存命中单价(元/千Token) |
|
0<T≤32K |
0.000240 |
0.000960 |
0.000048 |
|
32K<T≤256K |
0.000720 |
0.002880 |
0.000144 |
|
|
256K<T≤1M |
0.001440 |
0.005760 |
0.000288 |
|
|
0<T≤32K |
0.000270 |
0.001169 |
0.000054 |
|
32K<T≤256K |
0.000899 |
0.003598 |
0.000180 |
|
|
256K<T≤1M |
0.001799 |
0.007194 |
0.000360 |
glm-5.2
|
地域 |
Token范围 |
输入单价(元/千Token) |
输出单价(元/千Token) |
缓存命中单价(元/千Token) |
|
不区分阶梯 |
0.009600 |
0.033600 |
0.001920 |
|
不区分阶梯 |
0.012590 |
0.039569 |
0.002518 |
deepseek-v4-pro
|
地域 |
Token范围 |
输入单价(元/千Token) |
输出单价(元/千Token) |
缓存命中单价(元/千Token) |
|
0<T≤1M |
0.014400 |
0.028800 |
0.002880 |
|
0<T≤1M |
0.021583 |
0.043166 |
0.004317 |
kimi-k3
|
地域 |
Token范围 |
输入单价(元/千Token) |
输出单价(元/千Token) |
缓存命中单价(元/千Token) |
|
0<T≤1M |
0.024000 |
0.120000 |
0.004800 |
该模型仅在上述中国内地地域提供。
qwen-mt-plus
qwen-mt-plus 为翻译模型,按翻译文本的输入Token和输出Token计费。所有地域定价统一。
|
地域 |
计费类型 |
输入单价(元/千Token) |
输出单价(元/千Token) |
|
所有地域 |
上下文翻译 |
0.002160 |
0.006480 |
Embedding模型
以下Embedding模型仅按输入Token计费,无输出Token费用。
|
模型 |
计费类型 |
地域 |
输入单价(元/千Token) |
|
qwen3-vl-embedding |
context_embedding |
中国内地地域 |
0.000840 |
|
image_embedding |
0.002160 |
||
|
tongyi-embedding-vision-plus |
image_embedding |
中国内地地域 |
0.000600 |
|
text-embedding-v4 |
context_embedding |
中国内地地域 |
0.000600 |
|
text-embedding-v4 |
context_embedding |
所有国际地域 |
0.000617 |
计费示例
以下示例说明AI Function的费用计算方式。
|
计费条件 |
费用(元) |
|
费用 = 输入费用 + 输出费用 = 0.000960 × 750/1000 + 0.002400 × 20/1000 = 0.000720 + 0.000048 = 0.000768(元) |
|
费用 = 未命中输入费用 + 缓存命中费用 + 输出费用 = 0.014400 × 2000/1000 + 0.002880 × 8000/1000 + 0.043200 × 500/1000 = 0.028800 + 0.023040 + 0.021600 = 0.073440(元) |