隨用隨付是一種先使用後付費的計費方式,根據您工作空間實際的 AI 中心內建模型 Token 用量進行結算。
AI 中心已於 2026 年 4 月 27 日全面開啟商業化收費,詳情請參見EMR Serverless Spark AI中心商業化公告。
隨用隨付說明
特性 | 說明 |
計費規則 | 按照工作空間一個周期內(1 小時)內建模型服務的 Token 用量計費,不同內建模型的計費規則不同:
模型調用費用為: 例如,在新加坡地區調用 ai_query() 10,000 次,每次調用輸入 Token 260、輸出 Token 50(非思考模式)。對應的費用為: 說明 Token 用量預估可參考模型調用。 |
計費周期 | 按照每小時整點計算一次費用(以 UTC+8 時間為準),計算完畢後進入新的計費周期。在每個計費周期結束後,系統會產生賬單,並從您賬戶中扣除相應費用。賬單流水資料相對於實際費用消耗可能會有延遲,詳情請參見瞭解阿里雲賬單。 |
地區單價
qwen3.6-plus
qwen3.6-plus 的思考模式和非思考模式同價。
地區名稱 | 單次請求的輸入Token範圍 | 輸入單價($/百萬Tokens) | 輸出單價($/百萬Tokens) |
| 0<Token≤128K | 0.331 | 1.981 |
128K<Token≤256K | 1.321 | 7.927 | |
| 0<Token≤256K | 0.6 | 3.6 |
256K<Token≤1M | 2.4 | 7.2 |
qwen3.5-plus
qwen3.5-plus 的思考模式和非思考模式同價。
地區名稱 | 單次請求的輸入Token範圍 | 輸入單價($/百萬Tokens) | 輸出單價($/百萬Tokens) |
| 0<Token≤128K | 0.138 | 0.826 |
128K<Token≤256K | 0.344 | 2.064 | |
256K<Token≤1M | 0.688 | 4.128 | |
| 0<Token≤256K | 0.48 | 2.88 |
256K<Token≤1M | 0.6 | 3.6 |
qwen-plus
地區名稱 | 模式 | 單次請求的輸入 Token 範圍 | 輸入單價($/百萬Tokens) | 輸出單價($/百萬Tokens) |
| 非思考模式 | 0 < Token ≤ 128K | 0.138 | 0.344 |
128K < Token ≤ 256K | 0.414 | 3.442 | ||
256K < Token ≤ 1M | 0.827 | 8.257 | ||
思考模式 | 0 < Token ≤ 128K | 0.138 | 0.344 | |
128K < Token ≤ 256K | 0.414 | 3.442 | ||
256K < Token ≤ 1M | 0.827 | 8.257 | ||
| 非思考模式 | 0 < Token ≤ 256K | 0.48 | 1.44 |
256K < Token ≤ 1M | 1.44 | 4.32 | ||
思考模式 | 0 < Token ≤ 256K | 0.48 | 1.44 | |
256K < Token ≤ 1M | 1.44 | 4.32 |
text-embedding-v4
地區名稱 | 輸入單價($/百萬Tokens) |
| 0.086 |
| 0.084 |
tongyi-embedding-vision-plus
地區名稱 | 輸入模態 | 輸入單價($/百萬Tokens) |
| 圖片/視頻/文本 | 0.09 |