全部产品
Search
文档中心

人工智能平台 PAI:PAI Token服务计费说明

更新时间:Jul 08, 2026

PAI Token服务提供开源和闭源大模型的调用能力,可在模型评测、蒸馏、DSW、FeatureStore中使用,按Token用量计费。

计费规则

开通PAI Token服务时默认同步开通按量付费(后付费)功能,按用户输入和输出的Token数目计费,即按实际用量结算费用,先使用,后付费。

计费规则:按量费用 = 输入 Token 数量 × 输入单价 + 输出 Token 数量 × 输出单价

缓存折扣:针对命中上下文缓存的请求,其输入Token享有折扣,详见附录:上下文缓存折扣

文本生成-千问

千问Max

中国内地

该部署范围支持的地域:华北2(北京)。

模型 ID(Model ID)

模式

单次请求的输入Token数

输入单价(每百万Token)

输出单价(每百万Token)

思维链+回答

qwen3.7-max

非思考和思考模式

0<Token≤1M

$1.98

$5.9412

国际

该部署范围支持的地域:新加坡。

模型 ID(Model ID)

模式

单次请求的输入Token数

输入单价(每百万Token)

输出单价(每百万Token)

思维链+回答

qwen3.7-max

非思考和思考模式

0<Token≤1M

$3

$9

千问Plus

中国内地

该部署范围支持的地域:华北2(北京)。

模型 ID(Model ID)

单次请求的输入Token范围

输入单价(每百万Token)

输出单价(每百万Token)

非思考模式

思考模式(思维链+回答)

qwen3.7-plus

0<Token≤256K

$0.3444

$1.3764

$1.3764

256K<Token≤1M

$1.032

$4.128

$4.128

qwen3.6-plus

0<Token≤256K

$0.3312

$1.9812

$1.9812

256K<Token≤1M

$1.3212

$7.9224

$7.9224

qwen3.5-plus

0<Token≤128K

$0.138

$0.8256

$0.8256

128K<Token≤256K

$0.3444

$2.064

$2.064

256K<Token≤1M

$0.6876

$4.128

$4.128

国际

该部署范围支持的地域:新加坡。

模型 ID(Model ID)

单次请求的输入Token范围

输入单价 (每百万Token)

输出单价 (每百万Token)

非思考模式

思考模式(思维链+回答)

qwen3.6-plus

0<Token≤256K

$0.48

$1.92

$1.92

256K<Token≤1M

$1.44

$5.76

$5.76

qwen3.6-plus

0<Token≤256K

$0.6

$3.6

$3.6

256K<Token≤1M

$2.4

$7.2

$7.2

qwen3.5-plus

0<Token≤256K

$0.48

$2.88

$2.88

256K<Token≤1M

$0.6

$3.6

$3.6

千问VL

中国内地

该部署范围支持的地域:华北2(北京)。

模型 ID(Model ID)

模式

单次请求的输入Token数

输入单价(每百万Token)

输出单价(每百万Token)

思维链+回答

qwen3-vl-plus

非思考和思考模式

0<Token≤32K

$0.1716

$1.7208

32K<Token≤128K

$0.258

$2.58

128K<Token≤256K

$0.516

$5.1612

国际

该部署范围支持的地域:新加坡。

模型 ID(Model ID)

模式

单次请求的输入Token数

输入单价(每百万Token)

输出单价(每百万Token)

思维链+回答

qwen3-vl-plus

非思考和思考模式

0<Token≤32K

$0.24

$1.92

32K<Token≤128K

$0.36

$2.88

128K<Token≤256K

$0.72

$5.76

文本生成-第三方模型

DeepSeek

中国内地

该部署范围支持的地域:华北2(北京)。

模型 ID(Model ID)

输入单价(每百万Token)

输出单价(每百万Token)

思维链+回答

deepseek-v4-pro

$1.98

$3.9612

deepseek-v4-flash

$0.1656

$0.33

国际

该部署范围支持的地域:新加坡。

模型 ID(Model ID)

输入单价(每百万Token)

输出单价(每百万Token)

思维链+回答

deepseek-v4-pro

$2.88

$5.76

deepseek-v4-flash

$0.24

$0.48

Kimi

中国内地

该部署范围支持的地域:华北2(北京)。

模型 ID(Model ID)

输入单价(每百万Token)

输出单价(每百万Token)

kimi-k2.7-code

$1.0728

$4.4556

GLM

中国内地

该部署范围支持的地域:华北2(北京)。

模型 ID(Model ID)

模式

单次请求的输入Token数

输入单价(每百万Token)

输出单价(每百万Token)

思维链和回答

glm-5.2

非思考和思考模式

不区分阶梯

$1.32

$4.6212

glm-5.1

非思考和思考模式

0<Token≤32K

$0.99

$3.9612

32K<Token≤200K

$1.32

$4.6212

glm-5

非思考和思考模式

0<Token≤32K

$0.6876

$3.096

32K<Token≤166K

$1.032

$3.7848

国际

该部署范围支持的地域:新加坡。

模型 ID(Model ID)

模式

单次请求的输入Token数

输入单价(每百万Token)

输出单价(每百万Token)

思维链和回答

glm-5.1

非思考和思考模式

0<Token≤200K

$1.68

$5.28

文本向量

计费规则:按输入Token计费,输出不计费。

中国内地

该部署范围支持的地域:华北2(北京)。

模型 ID(Model ID)

输入单价(每百万Token)

text-embedding-v4

$0.0864

国际

该部署范围支持的地域:新加坡。

模型 ID(Model ID)

输入单价(每百万Token)

text-embedding-v4

$0.084

text-embedding-v3

$0.084

多模态向量

计费规则:按输入Token计费,输出不计费。

中国内地

该部署范围支持的地域:华北2(北京)。

模型 ID(Model ID)

输入单价(每百万Token)

qwen3-vl-embedding

图片/视频:$0.3096

文本:$0.12

multimodal-embedding-v1

免费试用

国际

该部署范围支持的地域:新加坡。

模型 ID(Model ID)

输入单价(每百万输入Token)

tongyi-embedding-vision-plus

$0.108

tongyi-embedding-vision-flash

图片/视频:$0.036

文本:$0.108

附录:上下文缓存折扣

项目

显式缓存

隐式缓存

用于创建缓存Token计费

输入 Token 单价的125%

输入 Token 单价的100%

命中缓存的输入 Token 计费

输入 Token 单价的10%

输入 Token 单价的20%