従量課金は、サービスを使用した後に料金を支払う課金方式です。料金は、ワークスペースの AI センターに組み込まれているモデルのトークン使用量に基づいて計算されます。
AI センターは 2026 年 4 月 27 日に一般提供が開始され、課金対象となります。詳細については、「EMR Serverless Spark AI センターの一般提供開始」をご参照ください。
従量課金の詳細
機能 | 説明 |
課金ルール | 課金は、1 時間の課金サイクル内でのワークスペースにおける組み込みモデルサービスのトークン使用量に基づきます。課金ルールは、組み込みモデルごとに異なります:
モデル呼び出しのコストは、次の式で計算されます: たとえば、シンガポールで 10,000 回の 説明 トークン使用量を見積もるには、「モデル呼び出し」をご参照ください。 |
課金サイクル | 料金は 1 時間ごと (UTC+8) に計算されます。各計算の後に新しい課金サイクルが始まります。各課金サイクルの終了時に、システムは請求書を生成し、アカウントから料金を差し引きます。請求書の使用量データは遅延することがあります。詳細については、「請求書の概要」をご参照ください。 |
リージョン別の単価
qwen3.6-plus
qwen3.6-plus の場合、料金は思考モードと非思考モードで同じです。
リージョン | 入力トークン範囲 | 入力単価 (USD/100 万トークン) | 出力単価 (USD/100 万トークン) |
| 0 < Token ≤ 128K | 0.331 | 1.981 |
128K < Token ≤ 256K | 1.321 | 7.927 | |
| 0 < Token ≤ 256K | 0.6 | 3.6 |
256K < Token ≤ 1M | 2.4 | 7.2 |
qwen3.5-plus
qwen3.5-plus の場合、料金は思考モードと非思考モードで同じです。
リージョン | 入力トークン範囲 | 入力単価 (USD/100 万トークン) | 出力単価 (USD/100 万トークン) |
| 0 < Token ≤ 128K | 0.138 | 0.826 |
128K < Token ≤ 256K | 0.344 | 2.064 | |
256K < Token ≤ 1M | 0.688 | 4.128 | |
| 0 < Token ≤ 256K | 0.48 | 2.88 |
256K < Token ≤ 1M | 0.6 | 3.6 |
qwen-plus
リージョン名 | モード | リクエストあたりの入力トークン範囲 | 入力単価 (USD/100 万トークン) | 出力単価 (USD/100 万トークン) |
| 非思考モード | 0 < Token ≤ 128K | 0.138 | 0.344 |
128K < Token ≤ 256K | 0.414 | 3.442 | ||
256K < Token ≤ 1M | 0.827 | 8.257 | ||
思考モード | 0 < Token ≤ 128K | 0.138 | 1.376 | |
128K < Token ≤ 256K | 0.414 | 4.130 | ||
256K < Token ≤ 1M | 0.827 | 11.009 | ||
| 非思考モード | 0 < Token ≤ 256K | 0.48 | 1.44 |
256K < Token ≤ 1M | 1.44 | 4.32 | ||
思考モード | 0 < Token ≤ 256K | 0.48 | 4.80 | |
256K < Token ≤ 1M | 1.44 | 14.40 |
text-embedding-v4
リージョン名 | 入力単価 (USD/100 万トークン) |
| 0.086 |
| 0.084 |
tongyi-embedding-vision-plus
リージョン | 入力モダリティ | 入力単価 (USD/100 万トークン) |
| 画像、動画、テキスト | 0.09 |