全部產品
Search
文件中心

Platform For AI:PAI Token服務計費說明

更新時間:Jul 09, 2026

PAI Token服務提供開源和閉源大模型的調用能力,可在模型評測、蒸餾、DSW、FeatureStore中使用,按Token用量計費。

計費規則

開通PAI Token服務時預設同步開通隨用隨付(後付費)功能,按使用者輸入和輸出的Token數目計費,即按實際用量結算費用,先使用,後付費。

計費規則:按量費用 = 輸入 Token 數量 × 輸入單價 + 輸出 Token 數量 × 輸出單價

緩衝折扣:針對命中上下文緩衝的請求,其輸入Token享有折扣,詳見附錄:上下文緩衝折扣

文本產生-千問

千問Max

中國內地

該部署範圍支援的地區:華北2(北京)。

模型 ID(Model ID)

模式

單次請求的輸入Token數

輸入單價(每百萬Token)

輸出單價(每百萬Token)

思維鏈+回答

qwen3.7-max

非思考和思考模式

0<Token≤1M

$1.98

$5.9412

國際

該部署範圍支援的地區:新加坡。

模型 ID(Model ID)

模式

單次請求的輸入Token數

輸入單價(每百萬Token)

輸出單價(每百萬Token)

思維鏈+回答

qwen3.7-max

非思考和思考模式

0<Token≤1M

$3

$9

千問Plus

中國內地

該部署範圍支援的地區:華北2(北京)。

模型 ID(Model ID)

單次請求的輸入Token範圍

輸入單價(每百萬Token)

輸出單價(每百萬Token)

非思考模式

思考模式(思維鏈+回答)

qwen3.7-plus

0<Token≤256K

$0.3444

$1.3764

$1.3764

256K<Token≤1M

$1.032

$4.128

$4.128

qwen3.6-plus

0<Token≤256K

$0.3312

$1.9812

$1.9812

256K<Token≤1M

$1.3212

$7.9224

$7.9224

qwen3.5-plus

0<Token≤128K

$0.138

$0.8256

$0.8256

128K<Token≤256K

$0.3444

$2.064

$2.064

256K<Token≤1M

$0.6876

$4.128

$4.128

國際

該部署範圍支援的地區:新加坡。

模型 ID(Model ID)

單次請求的輸入Token範圍

輸入單價 (每百萬Token)

輸出單價 (每百萬Token)

非思考模式

思考模式(思維鏈+回答)

qwen3.6-plus

0<Token≤256K

$0.48

$1.92

$1.92

256K<Token≤1M

$1.44

$5.76

$5.76

qwen3.6-plus

0<Token≤256K

$0.6

$3.6

$3.6

256K<Token≤1M

$2.4

$7.2

$7.2

qwen3.5-plus

0<Token≤256K

$0.48

$2.88

$2.88

256K<Token≤1M

$0.6

$3.6

$3.6

千問VL

中國內地

該部署範圍支援的地區:華北2(北京)。

模型 ID(Model ID)

模式

單次請求的輸入Token數

輸入單價(每百萬Token)

輸出單價(每百萬Token)

思維鏈+回答

qwen3-vl-plus

非思考和思考模式

0<Token≤32K

$0.1716

$1.7208

32K<Token≤128K

$0.258

$2.58

128K<Token≤256K

$0.516

$5.1612

國際

該部署範圍支援的地區:新加坡。

模型 ID(Model ID)

模式

單次請求的輸入Token數

輸入單價(每百萬Token)

輸出單價(每百萬Token)

思維鏈+回答

qwen3-vl-plus

非思考和思考模式

0<Token≤32K

$0.24

$1.92

32K<Token≤128K

$0.36

$2.88

128K<Token≤256K

$0.72

$5.76

文本產生-第三方模型

DeepSeek

中國內地

該部署範圍支援的地區:華北2(北京)。

模型 ID(Model ID)

輸入單價(每百萬Token)

輸出單價(每百萬Token)

思維鏈+回答

deepseek-v4-pro

$1.98

$3.9612

deepseek-v4-flash

$0.1656

$0.33

國際

該部署範圍支援的地區:新加坡。

模型 ID(Model ID)

輸入單價(每百萬Token)

輸出單價(每百萬Token)

思維鏈+回答

deepseek-v4-pro

$2.88

$5.76

deepseek-v4-flash

$0.24

$0.48

Kimi

中國內地

該部署範圍支援的地區:華北2(北京)。

模型 ID(Model ID)

輸入單價(每百萬Token)

輸出單價(每百萬Token)

kimi-k2.7-code

$1.0728

$4.4556

GLM

中國內地

該部署範圍支援的地區:華北2(北京)。

模型 ID(Model ID)

模式

單次請求的輸入Token數

輸入單價(每百萬Token)

輸出單價(每百萬Token)

思維鏈和回答

glm-5.2

非思考和思考模式

不區分階梯

$1.32

$4.6212

glm-5.1

非思考和思考模式

0<Token≤32K

$0.99

$3.9612

32K<Token≤200K

$1.32

$4.6212

glm-5

非思考和思考模式

0<Token≤32K

$0.6876

$3.096

32K<Token≤166K

$1.032

$3.7848

國際

該部署範圍支援的地區:新加坡。

模型 ID(Model ID)

模式

單次請求的輸入Token數

輸入單價(每百萬Token)

輸出單價(每百萬Token)

思維鏈和回答

glm-5.1

非思考和思考模式

0<Token≤200K

$1.68

$5.28

文本向量

計費規則:按輸入Token計費,輸出不計費。

中國內地

該部署範圍支援的地區:華北2(北京)。

模型 ID(Model ID)

輸入單價(每百萬Token)

text-embedding-v4

$0.0864

國際

該部署範圍支援的地區:新加坡。

模型 ID(Model ID)

輸入單價(每百萬Token)

text-embedding-v4

$0.084

text-embedding-v3

$0.084

多模態向量

計費規則:按輸入Token計費,輸出不計費。

中國內地

該部署範圍支援的地區:華北2(北京)。

模型 ID(Model ID)

輸入單價(每百萬Token)

qwen3-vl-embedding

圖片/視頻:$0.3096

文本:$0.12

multimodal-embedding-v1

免費試用

國際

該部署範圍支援的地區:新加坡。

模型 ID(Model ID)

輸入單價(每百萬輸入Token)

tongyi-embedding-vision-plus

$0.108

tongyi-embedding-vision-flash

圖片/視頻:$0.036

文本:$0.108

附錄:上下文緩衝折扣

專案

顯式緩衝

隱式緩衝

用於建立緩衝Token計費

輸入 Token 單價的125%

輸入 Token 單價的100%

命中緩衝的輸入 Token 計費

輸入 Token 單價的10%

輸入 Token 單價的20%