AI Function 是 EMR Serverless StarRocks 提供的 SQL 內建 AI 推理函數,支援在 SQL 中直接調用 qwen 系列大模型。本文介紹其計費規則、各地區各模型的 Token 單價以及費用計算樣本。AI Function 的具體使用方法(包括 SQL 調用文法、參數說明、樣本查詢等),請參見AI 函數。
計費說明
首月每位使用者可享 100 萬 Token 免費額度。超出免費額度的部分,將按標準單價正常收費。
|
特性 |
說明 |
|
計費規則 |
按照內建模型的Token用量計費,不同內建模型的計費規則不同:
模型調用費用為: |
|
上下文緩衝 |
支援上下文緩衝的模型,命中緩衝的輸入Token按快取命中單價計費,快取命中單價為該地區輸入單價的20%。各模型是否支援緩衝及具體單價,請參見下方各模型的價格表。 |
|
計費周期 |
按照每小時整點計算一次費用(以UTC+8時間為準),結算完畢後進入新的結算周期。在每個計費周期結束後,系統會產生賬單,並從您賬戶中扣除相應費用。賬單流水資料相對於實際費用消耗可能會有延遲,詳情請參見瞭解阿里雲賬單。 |
計費資訊
實際價格請以產品購買頁面為準。
當前AI Function支援以下內建模型進行推理,均按輸入Token和輸出Token分別計費。
qwen-plus
|
地區 |
Token範圍 |
輸入單價($/千Token) |
輸出單價($/千Token) |
|
0<T≤128K |
0.000138 |
0.000344 |
|
128K<T≤256K |
0.000414 |
0.003442 |
|
|
256K<T≤1M |
0.000827 |
0.008257 |
|
|
0<T≤256K |
0.000480 |
0.001440 |
|
256K<T≤1M |
0.001440 |
0.004320 |
qwen3.5-plus
|
地區 |
Token範圍 |
輸入單價($/千Token) |
輸出單價($/千Token) |
|
0<T≤128K |
0.000138 |
0.000826 |
|
128K<T≤256K |
0.000344 |
0.002064 |
|
|
256K<T≤1M |
0.000688 |
0.004128 |
|
|
0<T≤256K |
0.000480 |
0.002880 |
|
256K<T≤1M |
0.000600 |
0.003600 |
qwen3.6-plus
|
地區 |
Token範圍 |
輸入單價(元/千Token) |
輸出單價(元/千Token) |
快取命中單價(元/千Token) |
|
0<T≤256K |
0.002400 |
0.014400 |
0.000480 |
|
256K<T≤1M |
0.009600 |
0.057600 |
0.001920 |
|
|
0<T≤256K |
0.004497 |
0.026979 |
0.000899 |
|
256K<T≤1M |
0.017986 |
0.053958 |
0.003597 |
|
地區 |
Token範圍 |
輸入單價($/千Token) |
輸出單價($/千Token) |
|
0<T≤256K |
0.000331 |
0.001981 |
|
256K<T≤1M |
0.001321 |
0.007927 |
|
|
0<T≤256K |
0.000600 |
0.003600 |
|
256K<T≤1M |
0.002400 |
0.007200 |
Embedding模型
以下Embedding模型僅按輸入Token計費,無輸出Token費用。
|
模型 |
計費類型 |
地區 |
輸入單價($/千Token) |
|
qwen3-vl-embedding |
image_embedding |
中國內地地區 |
0.0003096 |
|
text-embedding-v4 |
context_embedding |
中國內地地區 |
0.000086 |
|
text-embedding-v4 |
context_embedding |
所有國際地區 |
0.000084 |
|
tongyi-embedding-vision-plus |
image_embedding |
所有國際地區 |
0.000108 |
計費樣本
以下樣本說明AI Function的費用計算方式。
|
計費條件 |
費用(USD) |
|
費用 = 輸入費用 + 輸出費用 = 0.000480 × 750/1000 + 0.001440 × 20/1000 = 0.000360 + 0.000029 = 0.000389(USD) |