AI Function 计费

更新时间:
复制 MD 格式

AI Function 是 EMR Serverless StarRocks 提供的 SQL 内置 AI 推理函数,支持在 SQL 中直接调用 qwen 系列大模型。本文介绍其计费规则、各地域各模型的 Token 单价以及费用计算示例。AI Function 的具体使用方法(包括 SQL 调用语法、参数说明、示例查询等),请参见AI 函数

计费说明

说明

首月每位用户可享 100 万 Token 免费额度。超出免费额度的部分,将按标准单价正常收费。

特性

说明

计费规则

按照内置模型的Token用量计费,不同内置模型的计费规则不同:

  • qwen-plus/qwen3.5-plus/qwen3.6-plus/qwen3.7-max/qwen3.7-plus/qwen3.6-flash/qwen3.8-max/qwen3.7-flash/glm-5.2/deepseek-v4-pro/kimi-k3:按输入Token和输出Token计费,命中上下文缓存的输入Token按缓存命中单价计费。

  • qwen-mt-plus:翻译模型,按输入Token和输出Token计费。

  • qwen3-vl-embedding/tongyi-embedding-vision-plus/text-embedding-v4:Embedding模型,按输入Token计费(无输出Token费用)。

模型调用费用为:1小时内Token用量 × 对应地域、模型、计费维度单价

上下文缓存

支持上下文缓存的模型,命中缓存的输入Token按缓存命中单价计费,缓存命中单价为该地域输入单价的20%。各模型是否支持缓存及具体单价,请参见下方各模型的价格表。

计费周期

按照每小时整点计算一次费用(以UTC+8时间为准),结算完毕后进入新的结算周期。在每个计费周期结束后,系统会生成账单,并从您账户中扣除相应费用。账单流水数据相对于实际费用消耗可能会有延迟,详情请参见了解阿里云账单

计费信息

重要

实际价格请以产品购买页面为准。

当前AI Function支持以下内置模型进行推理,均按输入Token和输出Token分别计费。

qwen3.6-plus

地域

Token范围

输入单价(元/千Token)

输出单价(元/千Token)

缓存命中单价(元/千Token)

  • 华北2(北京)

  • 华东2(上海)

  • 华东1(杭州)

  • 华南1(深圳)

  • 华北1(青岛)

  • 华北3(张家口)

  • 华北6(乌兰察布)

0<T≤256K

0.002400

0.014400

0.000480

256K<T≤1M

0.009600

0.057600

0.001920

  • 中国香港

  • 新加坡

  • 印度尼西亚(雅加达)

  • 日本(东京)

  • 德国(法兰克福)

  • 美国(弗吉尼亚)

  • 美国(硅谷)

0<T≤256K

0.004497

0.026979

0.000899

256K<T≤1M

0.017986

0.053958

0.003597

qwen3.7-max

地域

Token范围

输入单价(元/千Token)

输出单价(元/千Token)

缓存命中单价(元/千Token)

  • 华北2(北京)

  • 华东2(上海)

  • 华东1(杭州)

  • 华南1(深圳)

  • 华北1(青岛)

  • 华北3(张家口)

  • 华北6(乌兰察布)

  • 中国香港

  • 日本(东京)

  • 德国(法兰克福)

  • 美国(弗吉尼亚)

  • 美国(硅谷)

0<T≤1M

0.014400

0.043200

0.002880

  • 新加坡

  • 印度尼西亚(雅加达)

0<T≤1M

0.022483

0.067448

0.004497

qwen3.7-plus

地域

Token范围

输入单价(元/千Token)

输出单价(元/千Token)

缓存命中单价(元/千Token)

  • 华北2(北京)

  • 华东2(上海)

  • 华东1(杭州)

  • 华南1(深圳)

  • 华北1(青岛)

  • 华北3(张家口)

  • 华北6(乌兰察布)

  • 中国香港

  • 日本(东京)

  • 德国(法兰克福)

  • 美国(弗吉尼亚)

  • 美国(硅谷)

0<T≤256K

0.002400

0.009600

0.000480

256K<T≤1M

0.007200

0.028800

0.001440

  • 新加坡

  • 印度尼西亚(雅加达)

0<T≤256K

0.003598

0.014389

0.000720

256K<T≤1M

0.010792

0.043166

0.002158

qwen3.6-flash

地域

Token范围

输入单价(元/千Token)

输出单价(元/千Token)

  • 华北2(北京)

  • 华东2(上海)

  • 华东1(杭州)

  • 华南1(深圳)

  • 华北1(青岛)

  • 华北3(张家口)

  • 华北6(乌兰察布)

0<T≤256K

0.001440

0.008640

256K<T≤1M

0.005760

0.034560

  • 新加坡

  • 中国香港

  • 德国(法兰克福)

  • 美国(弗吉尼亚)

  • 美国(硅谷)

  • 日本(东京)

  • 印度尼西亚(雅加达)

0<T≤256K

0.001440

0.008640

256K<T≤1M

0.005760

0.034560

qwen3.8-max

地域

Token范围

输入单价(元/千Token)

输出单价(元/千Token)

缓存命中单价(元/千Token)

  • 华北2(北京)

  • 华东2(上海)

  • 华东1(杭州)

  • 华南1(深圳)

  • 华北1(青岛)

  • 华北3(张家口)

  • 华北6(乌兰察布)

  • 中国香港

  • 日本(东京)

  • 德国(法兰克福)

  • 美国(弗吉尼亚)

  • 美国(硅谷)

0<T≤1M

0.014400

0.043200

0.002880

  • 新加坡

  • 印度尼西亚(雅加达)

0<T≤1M

0.017986

0.053958

0.003597

qwen3.7-flash

地域

Token范围

输入单价(元/千Token)

输出单价(元/千Token)

缓存命中单价(元/千Token)

  • 华北2(北京)

  • 华东2(上海)

  • 华东1(杭州)

  • 华南1(深圳)

  • 华北6(乌兰察布)

  • 日本(东京)

  • 德国(法兰克福)

  • 美国(弗吉尼亚)

  • 美国(硅谷)

0<T≤32K

0.000240

0.000960

0.000048

32K<T≤256K

0.000720

0.002880

0.000144

256K<T≤1M

0.001440

0.005760

0.000288

  • 新加坡

0<T≤32K

0.000270

0.001169

0.000054

32K<T≤256K

0.000899

0.003598

0.000180

256K<T≤1M

0.001799

0.007194

0.000360

glm-5.2

地域

Token范围

输入单价(元/千Token)

输出单价(元/千Token)

缓存命中单价(元/千Token)

  • 华北2(北京)

  • 华东2(上海)

  • 华东1(杭州)

  • 华南1(深圳)

  • 华北6(乌兰察布)

  • 德国(法兰克福)

  • 美国(弗吉尼亚)

不区分阶梯

0.009600

0.033600

0.001920

  • 新加坡

不区分阶梯

0.012590

0.039569

0.002518

deepseek-v4-pro

地域

Token范围

输入单价(元/千Token)

输出单价(元/千Token)

缓存命中单价(元/千Token)

  • 华北2(北京)

  • 华东2(上海)

  • 华东1(杭州)

  • 华南1(深圳)

  • 华北6(乌兰察布)

  • 日本(东京)

  • 德国(法兰克福)

  • 美国(弗吉尼亚)

0<T≤1M

0.014400

0.028800

0.002880

  • 新加坡

0<T≤1M

0.021583

0.043166

0.004317

kimi-k3

地域

Token范围

输入单价(元/千Token)

输出单价(元/千Token)

缓存命中单价(元/千Token)

  • 华北2(北京)

  • 华东2(上海)

  • 华东1(杭州)

  • 华南1(深圳)

  • 华北6(乌兰察布)

0<T≤1M

0.024000

0.120000

0.004800

说明

该模型仅在上述中国内地地域提供。

qwen-mt-plus

qwen-mt-plus 为翻译模型,按翻译文本的输入Token和输出Token计费。所有地域定价统一。

地域

计费类型

输入单价(元/千Token)

输出单价(元/千Token)

所有地域

上下文翻译

0.002160

0.006480

Embedding模型

以下Embedding模型仅按输入Token计费,无输出Token费用。

模型

计费类型

地域

输入单价(元/千Token)

qwen3-vl-embedding

context_embedding

中国内地地域

0.000840

image_embedding

0.002160

tongyi-embedding-vision-plus

image_embedding

中国内地地域

0.000600

text-embedding-v4

context_embedding

中国内地地域

0.000600

text-embedding-v4

context_embedding

所有国际地域

0.000617

计费示例

以下示例说明AI Function的费用计算方式。

计费条件

费用(元)

  • 地域:华东1(杭州)

  • 调用函数:ai_complete()

  • 输入Token:750

  • 输出Token:20

费用 = 输入费用 + 输出费用

= 0.000960 × 750/1000 + 0.002400 × 20/1000

= 0.000720 + 0.000048

= 0.000768(元)

  • 地域:华东1(杭州)

  • 模型:qwen3.7-max(0<T≤1M)

  • 输入Token:10,000,其中8,000命中上下文缓存、2,000未命中

  • 输出Token:500

费用 = 未命中输入费用 + 缓存命中费用 + 输出费用

= 0.014400 × 2000/1000 + 0.002880 × 8000/1000 + 0.043200 × 500/1000

= 0.028800 + 0.023040 + 0.021600

= 0.073440(元)