AI Function 是 EMR Serverless StarRocks 提供的 SQL 内置 AI 推理函数,支持在 SQL 中直接调用 qwen 系列大模型。本文介绍其计费规则、各地域各模型的 Token 单价以及费用计算示例。AI Function 的具体使用方法(包括 SQL 调用语法、参数说明、示例查询等),请参见AI 函数。
计费说明
首月每位用户可享 100 万 Token 免费额度。超出免费额度的部分,将按标准单价正常收费。
|
特性 |
说明 |
|
计费规则 |
按照内置模型的Token用量计费,不同内置模型的计费规则不同:
模型调用费用为: |
|
上下文缓存 |
支持上下文缓存的模型,命中缓存的输入Token按缓存命中单价计费,缓存命中单价为该地域输入单价的20%。各模型是否支持缓存及具体单价,请参见下方各模型的价格表。 |
|
计费周期 |
按照每小时整点计算一次费用(以UTC+8时间为准),结算完毕后进入新的结算周期。在每个计费周期结束后,系统会生成账单,并从您账户中扣除相应费用。账单流水数据相对于实际费用消耗可能会有延迟,详情请参见了解阿里云账单。 |
计费信息
实际价格请以产品购买页面为准。
当前AI Function支持以下内置模型进行推理,均按输入Token和输出Token分别计费。
qwen-plus
|
地域 |
Token范围 |
输入单价($/千Token) |
输出单价($/千Token) |
|
0<T≤128K |
0.000138 |
0.000344 |
|
128K<T≤256K |
0.000414 |
0.003442 |
|
|
256K<T≤1M |
0.000827 |
0.008257 |
|
|
0<T≤256K |
0.000480 |
0.001440 |
|
256K<T≤1M |
0.001440 |
0.004320 |
qwen3.5-plus
|
地域 |
Token范围 |
输入单价($/千Token) |
输出单价($/千Token) |
|
0<T≤128K |
0.000138 |
0.000826 |
|
128K<T≤256K |
0.000344 |
0.002064 |
|
|
256K<T≤1M |
0.000688 |
0.004128 |
|
|
0<T≤256K |
0.000480 |
0.002880 |
|
256K<T≤1M |
0.000600 |
0.003600 |
qwen3.6-plus
|
地域 |
Token范围 |
输入单价(元/千Token) |
输出单价(元/千Token) |
缓存命中单价(元/千Token) |
|
0<T≤256K |
0.002400 |
0.014400 |
0.000480 |
|
256K<T≤1M |
0.009600 |
0.057600 |
0.001920 |
|
|
0<T≤256K |
0.004497 |
0.026979 |
0.000899 |
|
256K<T≤1M |
0.017986 |
0.053958 |
0.003597 |
|
地域 |
Token范围 |
输入单价($/千Token) |
输出单价($/千Token) |
|
0<T≤256K |
0.000331 |
0.001981 |
|
256K<T≤1M |
0.001321 |
0.007927 |
|
|
0<T≤256K |
0.000600 |
0.003600 |
|
256K<T≤1M |
0.002400 |
0.007200 |
Embedding模型
以下Embedding模型仅按输入Token计费,无输出Token费用。
|
模型 |
计费类型 |
地域 |
输入单价($/千Token) |
|
qwen3-vl-embedding |
image_embedding |
中国内地地域 |
0.0003096 |
|
text-embedding-v4 |
context_embedding |
中国内地地域 |
0.000086 |
|
text-embedding-v4 |
context_embedding |
所有国际地域 |
0.000084 |
|
tongyi-embedding-vision-plus |
image_embedding |
所有国际地域 |
0.000108 |
计费示例
以下示例说明AI Function的费用计算方式。
|
计费条件 |
费用(USD) |
|
费用 = 输入费用 + 输出费用 = 0.000480 × 750/1000 + 0.001440 × 20/1000 = 0.000360 + 0.000029 = 0.000389(USD) |