全部产品
Search
文档中心

大模型服务平台百炼:模型训练与部署计费

更新时间:Aug 26, 2026

本文介绍阿里云百炼平台的模型训练、模型部署的计费规则及价格。

模型训练计费

文本生成模型-千问

说明模型训练流程请参见千问模型调优。训练完成后的新模型需先完成模型部署,才能评测和调用。

计费方式

按训练Token计费

计费公式

模型训练费用 = (训练数据 Token 总数 + 混合训练数据 Token 总数)× 循环次数 × 训练单价(最小计费单位:1 token)

您可以查看模型训练控制台底部的预估训练费用,并单击计费详情,查看训练 Token 总数、循环次数和训练单价。

训练单价

以下为预置模型的训练单价,自定义模型的训练单价与对应的预置模型单价相同。

千问

模型服务

模型规格

价格

千问3-32B

qwen3-32b

$0.008/千Token

千问3-14B

qwen3-14b

$0.0016/千Token

千问 VL

模型服务

模型规格

价格

千问3-VL-8B-Instruct

qwen3-vl-8b-instruct

$0.002/千Token

千问3-VL-8B-Thinking

qwen3-vl-8b-thinking

$0.002/千Token

图像生成模型-万相

说明模型训练流程请参见图像生成模型调优。训练完成后的新模型需先完成模型部署,才能调用。

计费方式

按训练Token计费

计费公式

模型训练费用 = 训练Token总量 × 训练单价(计费单位:每千Token)

训练Token总量的计算公式

训练Token总量 ≈ max_steps × Lstep

其中:

  • max_steps:训练时指定的超参数,表示最大训练步数(创建微调任务时配置)。

  • Lstep:每步的Token消耗量,计算公式为:

    Lstep = ∑i∈batch Litem(i) ≤ Lmax

    Lstep 近似等于 Lmax。Lmax 由 max_token_length 和 generation_type 共同决定,具体取值如下表:

generation_type

max_token_length

Lmax

t2i(文生图)

1k

12,800

2k

23,220

i2i(图生图)

1k

23,220

2k

32,000

模型服务

模型名称

训练价格(每千Token)

万相-图像生成

wan2.7-image-pro

$0.015

万相-图像生成

wan2.7-image

$0.015

计费示例

假设使用 wan2.7-image-pro 模型进行 t2i 微调,max_steps = 200,max_token_length = "1k",训练单价 = $0.015/千Token:

  • 查表得 Lmax = 12,800(generation_type=t2i,max_token_length=1k),Lstep ≈ Lmax = 12,800
  • 训练Token总量 ≈ 200 × 12800 = 2560000 = 2560千Token
  • 模型训练费用 ≈ 2560 × 0.015 = $38.4

视频生成模型-万相

说明模型训练流程请参见模型调优。训练完成后的新模型需先完成模型部署,才能调用。

计费方式

按训练Token计费

计费公式

模型训练费用 = 训练Token总量 × 训练单价(计费单位:每千Token)

训练Token总量的计算公式

训练Token总量 = (∑i=1N 视频i的计费时长) × (max_pixels / 1024) × n_epochs

其中:

  • N:训练集中的视频总数。

  • max_pixels:训练时指定的超参数,表示视频的最大像素数(创建微调任务时配置)。

  • n_epochs:训练时指定的超参数,表示循环次数(创建微调任务时配置)。

    • n_epochs 与 steps 的换算关系为:steps = n_epochs × ⌈数据集大小 / batch_size⌉,即 n_epochs = steps / ⌈数据集大小 / batch_size⌉
    • 当数据集仅包含 1 条数据且 batch_size = 1 时,n_epochs = steps。建议总步数(steps)≥ 800。
  • 单个视频计费时长计算规则:先将原始视频时长(秒)四舍五入取整,再根据模型限制取最终值。

    • wan2.7模型:计费时长=min(10, 四舍五入后的时长),即单条视频最多按 10 秒计算。
    • wan2.6模型:计费时长=min(10, 四舍五入后的时长),即单条视频最多按 10 秒计算。
    • wan2.5模型:计费时长=min(10, 四舍五入后的时长),即单条视频最多按 10 秒计算。
    • wan2.2模型:计费时长=min(5, 四舍五入后的时长),即单条视频最多按 5 秒计算。

模型服务

模型名称

训练价格(每千Token)

图生视频-基于首帧

wan2.7-i2v

$0.3

wan2.6-i2v

$0.08

wan2.5-i2v-preview

$0.05

wan2.2-i2v-flash

$0.03

图生视频-基于首尾帧

wan2.2-kf2v-flash

$0.03

计费示例

  1. wan2.7-i2v 费用预估(一条数据)

假设训练集包含 1 条视频,时长为10秒。由于 batch_size = 1(推荐值),此时 n_epochs = steps / ⌈1(数据集大小) / 1(batch_size)⌉ = steps

训练单价 = $0.3/千Token,以 max_pixels = 36864、n_epochs = 800 为例:

  • 训练Token总量 = 10 ×(36864 / 1024)× 800 = 288,000 = 288千Token
  • 模型训练费用 = 288 × $0.3 = $86.4

max_pixels

常见 steps

n_epochs

Token 消耗预估

费用预估(美元)

36864

800

800

288,000

$86.4

1,000

1,000

360,000

$108

2,000

2,000

720,000

$216

65536

800

800

512,000

$153.6

1,000

1,000

640,000

$192

2,000

2,000

1,280,000

$384

102400

800

800

800,000

$240

1,000

1,000

1,000,000

$300

2,000

2,000

2,000,000

$600

  1. wan2.7-i2v 费用预估(多条数据)

假设训练集包含 2 条视频,时长分别为 3.4 秒 和 11.5 秒。参数设置:max_pixels = 36864、n_epochs = 800,训练单价 = $0.3/千Token:

  • 时长计算:

    • 视频 1:3.4 → 四舍五入 → 3 秒 → 计费时长 = min(10, 3) = 3
    • 视频 2:11.5 → 四舍五入 → 11 秒 → 计费时长 = min(10, 11) = 10
    • 总计费时长 = 3 + 10 = 13 秒
  • 训练Token总量 = 13 ×(36864/1024)× 800 = 374400 = 374.4千Token

  • 模型训练费用 = 374.4 × 0.3 = $112.32

  1. wan2.5-i2v-preview 费用预估(多条数据)

假设微调wan2.5模型,训练集包含 2 条视频,时长分别为 3.4 秒 和 11.5 秒,max_pixels = 36864,n_epochs = 400,训练单价 = $0.05/千Token:

  • 时长计算:

    • 视频 1:3.4 → 四舍五入 → 3 秒 → 计费时长 = min(10, 3) = 3
    • 视频 2:11.5 → 四舍五入 → 11 秒 → 计费时长 = min(10,11) = 10
    • 总计费时长 = 3 + 10 = 13 秒
  • 训练Token总量 = 13 ×(36864/1024)× 400 = 187200 = 187.2千Token

  • 模型训练费用 = 187.2 × 0.05 = $9.36

模型部署计费

文本生成模型-千问

按使用时长计费(预置吞吐)

费用 = 使用时长 × (输入 TPM 单价 × 输入 TPM + 输出 TPM 单价 × 输出 TPM)

后付费按小时计算:使用时长单位为小时,单价取下表"持续 1 小时"列;预付费按天计算:使用时长单位为天,单价取下表"持续 1 天"列。

  • 预付费订单支付后实时生效,有效期 N 天至第 N 天 23:59 结束。若在 22:00 后下单,到期日将自动顺延1天。
  • 预付费订单到期后,将延后2小时停止服务,停止后资源保留14小时后释放。
  • 预付费订单无法提前终止服务。
  • 后付费时,如果账户欠费,部署的资源将继续保留并计费 24 小时,在这 24 小时内服务仍可正常使用。超过 24 小时后系统停止计费,模型部署进入欠费状态,底层资源将被删除,但模型部署任务仍会保留。补足欠费后,系统将重新分配资源并恢复使用(恢复后继续产生费用)。如果您不希望继续产生费用,可删除模型部署任务,删除成功后将不再计费。

当模型输入超过最长输入 Token 时,相关调用将自动切换为当前模型的按量付费模式;超出购买的 TPM 量时,按创建时选择的溢出策略处理(「自动溢出」切换为按量付费,「仅使用 PTU 容量」返回 429)。此时,推理性能可能下降,将受业务空间中当前快照模型的公共流量的管控,费用按模型调用(按量付费)标准计收。

  • 此时(仅「自动溢出」策略下),调用 API 返回 Header 将包含:x-dashscope-ptu-overflow:true
  • TPM 统计请前往:模型监控

缩容场景(降配)的具体降费退费规则请参考:降配退款规则说明

说明PTU 部署支持长输入阶梯容量系数和缓存折扣,详见预置吞吐长输入与缓存

新加坡

千问

模型名称

模型代码

最长输入Token

后付费输入

Per 10K TPM/小时

后付费输出

Per 1K TPM/小时

预付费输入

Per 10K TPM/天

预付费输出

Per 1K TPM/天

千问3.8-Max

qwen3.8-max

1M

$4.8

$1.44

$57.6

$17.28

千问3.7-Flash-2026-07-15 联系商务经理开通

qwen3.7-flash-2026-07-15

128K

$0.072

$0.031

$0.864

$0.374

千问3.7-Max-2026-05-20

qwen3.7-max-2026-05-20

256K

$1.92

$1.8

$72

$21.6

千问3.7-Plus-2026-05-26

qwen3.7-plus-2026-05-26

256K

$0.96

$0.384

$11.52

$4.608

千问3.6-Plus-2026-04-02

qwen3.6-plus-2026-04-02

128K

$1.2

$0.72

$14.4

$8.64

千问3.5-Plus-2026-04-20

qwen3.5-plus-2026-04-20

128K

$0.96

$0.576

$11.52

$6.912

DeepSeek

模型名称

模型代码

最长输入Token

后付费输入

Per 10K TPM/小时

后付费输出

Per 1K TPM/小时

预付费输入

Per 10K TPM/天

预付费输出

Per 1K TPM/天

DeepSeek-v4-Flash

deepseek-v4-flash

256K

$0.72

$0.144

$8.64

$1.728

DeepSeek-v4-Flash-0731

deepseek-v4-flash-0731

64K

$1.44

$0.288

$17.28

$3.456

DeepSeek-v4-Pro

deepseek-v4-pro

256K

$0.96

$1.728

$103.68

$20.736

千问VL

模型名称

模型代码

最长输入Token

后付费输入

Per 10K TPM/小时

后付费输出

Per 1K TPM/小时

预付费输入

Per 10K TPM/天

预付费输出

Per 1K TPM/天

千问3-VL-Plus-2025-09-23

qwen3-vl-plus-2025-09-23

128K

$0.48

$0.384

$5.76

$4.608

GLM

模型名称

模型代码

最长输入Token

后付费输入

Per 10K TPM/小时

后付费输出

Per 1K TPM/小时

预付费输入

Per 10K TPM/天

预付费输出

Per 1K TPM/天

GLM-5.2

glm-5.2

1M

$5.04

$1.584

$60.48

$19.008

华北2(北京)

千问

模型名称

模型代码

最长输入Token

后付费输入

Per 10K TPM/小时

后付费输出

Per 1K TPM/小时

预付费输入

Per 10K TPM/天

预付费输出

Per 1K TPM/天

千问3.8-Max

qwen3.8-max

1M

$3.96

$1.188

$47.53

$14.258

千问3.7-Flash-2026-07-15 联系商务经理开通

qwen3.7-flash-2026-07-15

128K

$0.066

$0.026

$0.792

$0.317

千问3.7-Max-2026-05-20

qwen3.7-max-2026-05-20

256K

$3.96

$1.188

$47.53

$14.258

千问3.7-Plus-2026-05-26

qwen3.7-plus-2026-05-26

256K

$0.66

$0.264

$7.92

$3.168

千问3.6-Plus-2026-04-02

qwen3.6-plus-2026-04-02

128K

$0.67

$0.066

$7.93

$4.753

千问3.5-Plus-2026-04-20

qwen3.5-plus-2026-04-20

128K

$0.26

$0.16

$3.17

$1.9

千问3-Max-2025-09-23

qwen3-max-2025-09-23

128K

$1.11

$0.45

$13.32

$5.4

千问-Flash-2025-07-28

qwen-flash-2025-07-28

128K

$0.06

$0.06

$0.72

$0.72

千问-Plus-2025-12-01

qwen-plus-2025-12-01

128K

$0.28

非思考:$0.07

思考:$0.28

$3.36

非思考:$0.84

思考:$3.36

DeepSeek

模型名称

模型代码

最长输入Token

后付费输入

Per 10K TPM/小时

后付费输出

Per 1K TPM/小时

预付费输入

Per 10K TPM/天

预付费输出

Per 1K TPM/天

DeepSeek-v4-Flash

deepseek-v4-flash

256K

$0.5

$0.099

$5.94

$1.188

DeepSeek-v4-Flash-0731

deepseek-v4-flash-0731

64K

$0.99

$0.198

$11.88

$2.376

DeepSeek-v4-Pro

deepseek-v4-pro

256K

$5.94

$1.188

$71.3

$14.26

DeepSeek-v3

deepseek-v3

64K

$0.99

$0.396

$11.9

$4.75

千问VL

模型名称

模型代码

最长输入Token

后付费输入

Per 10K TPM/小时

后付费输出

Per 1K TPM/小时

预付费输入

Per 10K TPM/天

预付费输出

Per 1K TPM/天

千问3-VL-Plus-2025-09-23

qwen3-vl-plus-2025-09-23

128K

$0.35

$0.35

$4.2

$4.2

GLM

模型名称

模型代码

最长输入Token

后付费输入

Per 10K TPM/小时

后付费输出

Per 1K TPM/小时

预付费输入

Per 10K TPM/天

预付费输出

Per 1K TPM/天

GLM-5.2

glm-5.2

1M

$3.96

$1.386

$47.53

$16.635

按使用时长计费(模型单元)

费用 = 使用时长(小时)× 模型单元数量 × 模型单元单价

"模型单元单价"在后付费场景下取下表"小时单价"列;预付费按月计费时,公式改为 包月数 × 模型单元数量 × 月单价

  • 预付费购买的首月,如在首月内提前退订,日单价(≈ 月单价 / 30)将按 1.2 倍计费(不满一天按一天计费)

说明模型单元-后付费方式的算力资源先买到先得。如购买不成功会全额退款。

新加坡

文本生成

模型名称

模型代码

模型单元规格

小时单价($)

最小计费:分钟

包月单价($)

最小计费:天

千问3.6-Plus-2026-04-02

qwen3.6-plus-2026-04-02

MU1 x 8

$88

$41,832

千问3.5-397B-A17B

qwen3.5-397b-a17b

MU2 x 8

$112

$52,392

千问3.5-122B-A10B

qwen3.5-122b-a10b

MU2 x 8

$112

$52,392

千问3.5-27B

qwen3.5-27b

MU1 x 2

$22

$10,458

千问3.5-9B

qwen3.5-9b

MU1 x 2

$22

$10,458

GLM-5.1

glm-5.1

MU2 x 8

$112

$52,392

MU3 x 8

$216

$102,696

DeepSeek-v4-Flash

deepseek-v4-flash

MU2 x 8

$112

$52,392

Qwen-Plus-Character-2025-11-06

qwen-plus-character-2025-11-06

MU1 x 4

$44

$20,916

多模态

模型名称

模型代码

模型单元规格

小时单价($)

最小计费:分钟

包月单价($)

最小计费:天

千问3-VL-32B-Instruct

qwen3-vl-32b-instruct

MU2 x 8

$112

$52,392

模型类型:

  • Instruct - 模型部署后以非思考模式进行推理。

华北2(北京)

文本生成

千问

模型名称

模型代码

模型单元规格

小时单价($)

最小计费:分钟

包月单价($)

最小计费:天

千问3.6-35B-A3B

qwen3.6-35b-a3b

MU1 x 8

$59.408

$28,734.256

MU2 x 8

$69.312

$33,044.72

MU3 x 8

$150.72

$72,577.152

MU8 x 1

$6.464

$3,080.477

MU9 x 1

$7.014

$3,383.024

千问3.6-27B

qwen3.6-27b

MU9 x 1

$7.014

$3,383.024

千问3.6-Flash-2026-04-16

qwen3.6-flash-2026-04-16

MU1 x 2

$14.852

$7,183.564

MU3 x 8

$150.72

$72,577.152

千问3.6-Plus-2026-04-02

qwen3.6-plus-2026-04-02

MU1 x 8

MU1 x 16(PD分离模式)

$59.408

PD分离模式:$118.816

$28,734.256

PD分离模式:$57,468.512

千问3.5-397B-A17B

qwen3.5-397b-a17b

MU3 x 8

MU3 x 16(PD分离模式)

$150.72

PD分离模式:$301.44

$72,577.152

PD分离模式:$145,154.304

MU6 x 16

$55.008

$26,599.92

千问3.5-122B-A10B

qwen3.5-122b-a10b

MU1 x 4

$29.704

$14,367.128

MU6 x 16

$55.008

$26,599.92

千问3.5-35B-A3B

qwen3.5-35b-a3b

MU1 x 2

$14.852

$7,183.564

MU2 x 8

$69.312

$33,044.72

MU3 x 8

$150.72

$72,577.152

MU9 x 1

$7.014

$3,383.024

千问3.5-27B

qwen3.5-27b

MU2 x 8

$69.312

$33,044.72

MU3 x 8

$150.72

$72,577.152

MU8 x 1

$6.464

$3,080.477

MU9 x 1

$7.014

$3,383.024

千问3.5-9B

qwen3.5-9b

MU1 x 2

$14.852

$7,183.564

MU2 x 8

$69.312

$33,044.72

千问3.5-Flash-2026-02-23

qwen3.5-flash-2026-02-23

MU1 x 2

$14.852

$7,183.564

千问3.5-Plus-2026-02-15

qwen3.5-plus-2026-02-15

MU1 x 8

MU1 x 16(PD分离模式)

$59.408

PD分离模式:$118.816

$28,734.256

PD分离模式:$57,468.512

MU2 x 8

$69.312

$33,044.72

MU3 x 8

MU3 x 16(PD分离模式)

$150.72

PD分离模式:$301.44

$72,577.152

PD分离模式:$145,154.304

千问3-235B-A22B-Instruct-2507

qwen3-235b-a22b-instruct-2507

MU1 x 4

$29.704

$14,367.128

MU2 x 8

$69.312

$33,044.72

MU3 x 8

$150.72

$72,577.152

千问3-32B

qwen3-32b

MU6 x 16

$55.008

$26,599.92

千问3-30B-A3B-Thinking-2507

qwen3-30b-a3b-thinking-2507

MU1 x 2

$14.852

$7,183.564

千问3-4B

qwen3-4b

MU1 x 2

$14.852

$7,183.564

MU5 x 1

$2.888

$1,394.329

千问3-Embedding-0.6B

qwen3-embedding-0.6b

MU5 x 1

$2.888

$1,394.329

MU6 x 1

$3.438

$1,662.495

千问3-MoE-Rerank-0.6B

qwen3-moe-rerank-0.6b

MU5 x 1

$2.888

$1,394.329

千问3-Rerank-0.6B

qwen3-rerank-0.6b

MU5 x 1

$2.888

$1,394.329

MU6 x 1

$3.438

$1,662.495

千问3-Max-2025-09-23

qwen3-max-2025-09-23

MU2 x 8

$69.312

$33,044.72

MU3 x 8

$150.72

$72,577.152

千问3-Rerank

qwen3-rerank

MU5 x 1

$2.888

$1,394.329

千问2.5-开源版-72B

qwen2.5-72b-instruct

MU1 x 8

$59.408

$28,734.256

千问2.5-开源版-14B

qwen2.5-14b-instruct

MU1 x 2

$14.852

$7,183.564

千问2.5-开源版-7B

qwen2.5-7b-instruct

MU1 x 2

$14.852

$7,183.564

MU5 x 1

$2.888

$1,394.329

千问-Plus-2025-07-28

qwen-plus-2025-07-28

MU1 x 4

MU1 x 16(PD分离模式)

$29.704

PD分离模式:$118.816

$14,367.128

PD分离模式:$57,468.512

千问-Plus-2025-12-01

qwen-plus-2025-12-01

MU1 x 4

$29.704

$14,367.128

Qwen-Plus-Character-2025-11-06

qwen-plus-character-2025-11-06

MU1 x 4

$29.704

$14,367.128

GLM

模型名称

模型代码

模型单元规格

小时单价($)

最小计费:分钟

包月单价($)

最小计费:天

GLM-5.1

glm-5.1

MU2 x 8

$69.312

$33,044.72

MU3 x 16(PD分离模式)

PD分离模式:$301.44

PD分离模式:$145,154.304

MU6 x 16

$55.008

$26,599.92

GLM-5

glm-5

MU3 x 16(PD分离模式)

PD分离模式:$301.44

PD分离模式:$145,154.304

GLM-4.7

glm-4.7

MU6 x 32(PD分离模式)

PD分离模式:$110.016

PD分离模式:$53,199.84

DeepSeek

模型名称

模型代码

模型单元规格

小时单价($)

最小计费:分钟

包月单价($)

最小计费:天

DeepSeek-v4-Flash

deepseek-v4-flash

MU1 x 8

$59.408

$28,734.256

MU3 x 8

$150.72

$72,577.152

DeepSeek-v3.2

deepseek-v3.2

MU2 x 16(PD分离模式)

PD分离模式:$138.624

PD分离模式:$66,089.44

其他模型

模型名称

模型代码

模型单元规格

小时单价($)

最小计费:分钟

包月单价($)

最小计费:天

Kimi-K2.5

kimi-k2.5

MU2 x 8

$69.312

$33,044.72

多模态

千问VL

模型名称

模型代码

模型单元规格

小时单价($)

最小计费:分钟

包月单价($)

最小计费:天

千问3-VL-235B-A22B-Thinking

qwen3-vl-235b-a22b-thinking

MU1 x 8

$59.408

$28,734.256

MU2 x 8

$69.312

$33,044.72

MU3 x 8

$150.72

$72,577.152

千问3-VL-32B-Instruct

qwen3-vl-32b-instruct

MU2 x 8

$69.312

$33,044.72

MU3 x 8

$150.72

$72,577.152

千问3-VL-8B-Instruct

qwen3-vl-8b-instruct

MU1 x 2

$14.852

$7,183.564

MU5 x 1

$2.888

$1,394.329

千问3-VL-4B-Instruct

qwen3-vl-4b-instruct

MU1 x 2

$14.852

$7,183.564

千问3-VL-2B-Instruct

qwen3-vl-2b-instruct

MU5 x 1

$2.888

$1,394.329

千问3-VL-Embedding-2B

qwen3-vl-embedding-2b

MU5 x 1

$2.888

$1,394.329

千问3-VL-Flash-2025-10-15

qwen3-vl-flash-2025-10-15

MU1 x 4

$29.704

$14,367.128

千问3-VL-Plus-2025-09-23

qwen3-vl-plus-2025-09-23

MU1 x 4

$29.704

$14,367.128

千问VL-Max-2025-08-13

qwen-vl-max-2025-08-13

MU6 x 4

$13.752

$6,649.98

千问Omni

模型名称

模型代码

模型单元规格

小时单价($)

最小计费:分钟

包月单价($)

最小计费:天

千问3.5-Omni-Flash

qwen3.5-omni-flash

MU8 x 1

$6.464

$3,080.477

MU9 x 1

$7.014

$3,383.024

模型类型:

  • Instruct - 模型部署后以非思考模式进行推理。
  • Thinking - 模型部署后以思考模式进行推理。

按模型 Token 使用量

费用 = 模型输入 Token 数 × 模型输入单价 + 模型输出 Token 数 × 模型输出单价(最小计费单位:1 token)

  • 仅当对下列基础模型完成 SFT 高效训练(即 LoRA 高效微调,API 部署时 plan 取值为 lora)并得到自定义模型后,才支持按模型 Token 使用量计费。

新加坡

基础模型

模型代码

输入

$/百万Token

输出

$/百万Token

千问3-14B

qwen3-14b

非思考模式:$0.35

思考模式:$0.35

非思考模式:$1.4

思考模式:$4.2

北京

基础模型

模型代码

输入

$/百万Token

输出

$/百万Token

千问3.5-27B

qwen3.5-27b

<128K $0.086

128K-256K $0.258

<128K $0.688

128K-256K $2.064

千问3-32B

qwen3-32b

非思考模式:$0.287

思考模式:$0.287

非思考模式:$1.147

思考模式:$2.868

千问3-14B

qwen3-14b

非思考模式:$0.144

思考模式:$0.144

非思考模式:$0.574

思考模式:$1.434

千问3-8B

qwen3-8b

非思考模式:$0.072

思考模式:$0.072

非思考模式:$0.287

思考模式:$0.717

千问3-VL-8B-Instruct

qwen3-vl-8b-instruct

$0.072

$0.287

图像生成模型-万相

经过SFT-LoRA高效微调的万相图像生成模型,部署免费,调用按微调的基础模型的标准调用价格计费。模型训练和部署流程请参见图像生成模型调优

模型名称

Lora部署调用价格

wan2.7-image-pro

$0.075/张

wan2.7-image

$0.03/张

常见问题

Q:模型部署什么时候开始计费?

A:当模型完成部署,即状态为运行中时,开始收取模型部署的费用。模型状态为部署中欠费部署失败时,均不会计费。

Q:取消模型训练会收费么?

A:会收费。主动取消训练后,已消耗的 tokens 仍会推送计费,训练费用按已消耗 tokens 估算,最终费用以账单为准。其他原因导致的训练中断,阿里云百炼不会向您收取训练费用。

Q:怎么查看已部署模型的调用统计?

A:请访问模型监控(新加坡)模型监控(弗吉尼亚)模型监控(中国香港)(中国香港仅支持普通监控,高级监控和日志不可用)或模型监控(北京)页面。

模型监控页面支持按时间范围(3小时、6小时、12小时、24小时、今天、昨天、一周、自定义)和推理类型筛选,上方汇总区展示模型总量、总调用次数、总失败次数、平均调用时长、平均首包时长,下方模型列表展示各模型的调用总量、调用失败量、失败率、平均调用时长、平均首Token延时等指标,可单击监控查看单模型详细数据。