PAI Token服务提供开源和闭源大模型的调用能力,可在模型评测、蒸馏、DSW、FeatureStore中使用,按Token用量计费。
计费规则
开通PAI Token服务时默认同步开通按量付费(后付费)功能,按用户输入和输出的Token数目计费,即按实际用量结算费用,先使用,后付费。
计费规则:按量费用 = 输入 Token 数量 × 输入单价 + 输出 Token 数量 × 输出单价
缓存折扣:针对命中上下文缓存的请求,其输入Token享有折扣,详见附录:上下文缓存折扣
文本生成-千问
千问Max
中国内地
该部署范围支持的地域:华北2(北京)。
模型 ID(Model ID) | 模式 | 单次请求的输入Token数 | 输入单价(每百万Token) | 输出单价(每百万Token) 思维链+回答 |
qwen3.7-max | 非思考和思考模式 | 0<Token≤1M | $1.98 | $5.9412 |
国际
该部署范围支持的地域:新加坡。
模型 ID(Model ID) | 模式 | 单次请求的输入Token数 | 输入单价(每百万Token) | 输出单价(每百万Token) 思维链+回答 |
qwen3.7-max | 非思考和思考模式 | 0<Token≤1M | $3 | $9 |
千问Plus
中国内地
该部署范围支持的地域:华北2(北京)。
模型 ID(Model ID) | 单次请求的输入Token范围 | 输入单价(每百万Token) | 输出单价(每百万Token) | |
非思考模式 | 思考模式(思维链+回答) | |||
qwen3.7-plus | 0<Token≤256K | $0.3444 | $1.3764 | $1.3764 |
256K<Token≤1M | $1.032 | $4.128 | $4.128 | |
qwen3.6-plus | 0<Token≤256K | $0.3312 | $1.9812 | $1.9812 |
256K<Token≤1M | $1.3212 | $7.9224 | $7.9224 | |
qwen3.5-plus | 0<Token≤128K | $0.138 | $0.8256 | $0.8256 |
128K<Token≤256K | $0.3444 | $2.064 | $2.064 | |
256K<Token≤1M | $0.6876 | $4.128 | $4.128 | |
国际
该部署范围支持的地域:新加坡。
模型 ID(Model ID) | 单次请求的输入Token范围 | 输入单价 (每百万Token) | 输出单价 (每百万Token) | |
非思考模式 | 思考模式(思维链+回答) | |||
qwen3.6-plus | 0<Token≤256K | $0.48 | $1.92 | $1.92 |
256K<Token≤1M | $1.44 | $5.76 | $5.76 | |
qwen3.6-plus | 0<Token≤256K | $0.6 | $3.6 | $3.6 |
256K<Token≤1M | $2.4 | $7.2 | $7.2 | |
qwen3.5-plus | 0<Token≤256K | $0.48 | $2.88 | $2.88 |
256K<Token≤1M | $0.6 | $3.6 | $3.6 | |
千问VL
中国内地
该部署范围支持的地域:华北2(北京)。
模型 ID(Model ID) | 模式 | 单次请求的输入Token数 | 输入单价(每百万Token) | 输出单价(每百万Token) 思维链+回答 |
qwen3-vl-plus | 非思考和思考模式 | 0<Token≤32K | $0.1716 | $1.7208 |
32K<Token≤128K | $0.258 | $2.58 | ||
128K<Token≤256K | $0.516 | $5.1612 |
国际
该部署范围支持的地域:新加坡。
模型 ID(Model ID) | 模式 | 单次请求的输入Token数 | 输入单价(每百万Token) | 输出单价(每百万Token) 思维链+回答 |
qwen3-vl-plus | 非思考和思考模式 | 0<Token≤32K | $0.24 | $1.92 |
32K<Token≤128K | $0.36 | $2.88 | ||
128K<Token≤256K | $0.72 | $5.76 |
文本生成-第三方模型
DeepSeek
中国内地
该部署范围支持的地域:华北2(北京)。
模型 ID(Model ID) | 输入单价(每百万Token) | 输出单价(每百万Token) 思维链+回答 |
deepseek-v4-pro | $1.98 | $3.9612 |
deepseek-v4-flash | $0.1656 | $0.33 |
国际
该部署范围支持的地域:新加坡。
模型 ID(Model ID) | 输入单价(每百万Token) | 输出单价(每百万Token) 思维链+回答 |
deepseek-v4-pro | $2.88 | $5.76 |
deepseek-v4-flash | $0.24 | $0.48 |
Kimi
中国内地
该部署范围支持的地域:华北2(北京)。
模型 ID(Model ID) | 输入单价(每百万Token) | 输出单价(每百万Token) |
kimi-k2.7-code | $1.0728 | $4.4556 |
GLM
中国内地
该部署范围支持的地域:华北2(北京)。
模型 ID(Model ID) | 模式 | 单次请求的输入Token数 | 输入单价(每百万Token) | 输出单价(每百万Token) 思维链和回答 |
glm-5.2 | 非思考和思考模式 | 不区分阶梯 | $1.32 | $4.6212 |
glm-5.1 | 非思考和思考模式 | 0<Token≤32K | $0.99 | $3.9612 |
32K<Token≤200K | $1.32 | $4.6212 | ||
glm-5 | 非思考和思考模式 | 0<Token≤32K | $0.6876 | $3.096 |
32K<Token≤166K | $1.032 | $3.7848 |
国际
该部署范围支持的地域:新加坡。
模型 ID(Model ID) | 模式 | 单次请求的输入Token数 | 输入单价(每百万Token) | 输出单价(每百万Token) 思维链和回答 |
glm-5.1 | 非思考和思考模式 | 0<Token≤200K | $1.68 | $5.28 |
文本向量
计费规则:按输入Token计费,输出不计费。
中国内地
该部署范围支持的地域:华北2(北京)。
模型 ID(Model ID) | 输入单价(每百万Token) |
text-embedding-v4 | $0.0864 |
国际
该部署范围支持的地域:新加坡。
模型 ID(Model ID) | 输入单价(每百万Token) |
text-embedding-v4 | $0.084 |
text-embedding-v3 | $0.084 |
多模态向量
计费规则:按输入Token计费,输出不计费。
中国内地
该部署范围支持的地域:华北2(北京)。
模型 ID(Model ID) | 输入单价(每百万Token) |
qwen3-vl-embedding | 图片/视频:$0.3096 文本:$0.12 |
multimodal-embedding-v1 | 免费试用 |
国际
该部署范围支持的地域:新加坡。
模型 ID(Model ID) | 输入单价(每百万输入Token) |
tongyi-embedding-vision-plus | $0.108 |
tongyi-embedding-vision-flash | 图片/视频:$0.036 文本:$0.108 |
附录:上下文缓存折扣
项目 | 显式缓存 | 隐式缓存 |
用于创建缓存Token计费 | 输入 Token 单价的125% | 输入 Token 单价的100% |
命中缓存的输入 Token 计费 | 输入 Token 单价的10% | 输入 Token 单价的20% |