すべてのプロダクト
Search
ドキュメントセンター

E-MapReduce:モデル呼び出し (従量課金)

最終更新日:May 27, 2026

従量課金は、サービスを使用した後に料金を支払う課金方式です。料金は、ワークスペースの AI センターに組み込まれているモデルのトークン使用量に基づいて計算されます。

説明

AI センターは 2026 年 4 月 27 日に一般提供が開始され、課金対象となります。詳細については、「EMR Serverless Spark AI センターの一般提供開始」をご参照ください。

従量課金の詳細

機能

説明

課金ルール

課金は、1 時間の課金サイクル内でのワークスペースにおける組み込みモデルサービスのトークン使用量に基づきます。課金ルールは、組み込みモデルごとに異なります:

  • qwen3.6-plus :入力トークンと出力トークンに基づいて課金されます。料金は思考モードと非思考モードで同じです。

  • qwen3.5-plus :入力トークンと出力トークンに基づいて課金されます。料金は思考モードと非思考モードで同じです。

  • qwen-plus :入力トークンと出力トークンに基づいて課金されます。料金は思考モードと非思考モードで異なります。

  • text-embedding-v4 :入力トークンに基づいて課金されます。出力トークンは課金されません。

  • tongyi-embedding-vision-plus :入力トークンに基づいて課金されます。出力トークンは課金されません。このモデルは、画像、動画、テキストの入力をサポートしています。

モデル呼び出しのコストは、次の式で計算されます: 入力トークン使用量 × 入力単価 + 出力トークン使用量 × 出力単価

たとえば、シンガポールで 10,000 回の ai_query() 呼び出しを行い、各呼び出しに 260 の入力トークンと 50 の出力トークン (非思考モード) が含まれる場合、合計コストは次のようになります: 0.48 × 260 × 10000 ÷ 1000000 + 1.44 × 50 × 10000 ÷ 1000000 = 0.8448 USD

説明

トークン使用量を見積もるには、「モデル呼び出し」をご参照ください。

課金サイクル

料金は 1 時間ごと (UTC+8) に計算されます。各計算の後に新しい課金サイクルが始まります。各課金サイクルの終了時に、システムは請求書を生成し、アカウントから料金を差し引きます。請求書の使用量データは遅延することがあります。詳細については、「請求書の概要」をご参照ください。

リージョン別の単価

qwen3.6-plus

説明

qwen3.6-plus の場合、料金は思考モードと非思考モードで同じです。

リージョン

入力トークン範囲

入力単価 (USD/100 万トークン)

出力単価 (USD/100 万トークン)

  • 中国 (北京)

  • 中国 (上海)

  • 中国 (杭州)

  • 中国 (深圳)

0 < Token ≤ 128K

0.331

1.981

128K < Token ≤ 256K

1.321

7.927

  • 中国 (香港)

  • シンガポール

  • ドイツ (フランクフルト)

  • 米国 (バージニア)

  • 米国 (シリコンバレー)

  • 日本 (東京)

  • インドネシア (ジャカルタ)

  • Mexico

0 < Token ≤ 256K

0.6

3.6

256K < Token ≤ 1M

2.4

7.2

qwen3.5-plus

説明

qwen3.5-plus の場合、料金は思考モードと非思考モードで同じです。

リージョン

入力トークン範囲

入力単価 (USD/100 万トークン)

出力単価 (USD/100 万トークン)

  • 中国 (北京)

  • 中国 (上海)

  • 中国 (杭州)

  • 中国 (深圳)

0 < Token ≤ 128K

0.138

0.826

128K < Token ≤ 256K

0.344

2.064

256K < Token ≤ 1M

0.688

4.128

  • 中国 (香港)

  • シンガポール

  • ドイツ (フランクフルト)

  • 米国 (バージニア)

  • 米国 (シリコンバレー)

  • 日本 (東京)

  • インドネシア (ジャカルタ)

  • Mexico

0 < Token ≤ 256K

0.48

2.88

256K < Token ≤ 1M

0.6

3.6

qwen-plus

リージョン名

モード

リクエストあたりの入力トークン範囲

入力単価 (USD/100 万トークン)

出力単価 (USD/100 万トークン)

  • 中国 (北京)

  • 中国 (上海)

  • 中国 (杭州)

  • 中国 (深圳)

非思考モード

0 < Token ≤ 128K

0.138

0.344

128K < Token ≤ 256K

0.414

3.442

256K < Token ≤ 1M

0.827

8.257

思考モード

0 < Token ≤ 128K

0.138

1.376

128K < Token ≤ 256K

0.414

4.130

256K < Token ≤ 1M

0.827

11.009

  • 中国 (香港)

  • シンガポール

  • ドイツ (フランクフルト)

  • 米国 (バージニア)

  • 米国 (シリコンバレー)

  • 日本 (東京)

  • インドネシア (ジャカルタ)

  • Mexico

非思考モード

0 < Token ≤ 256K

0.48

1.44

256K < Token ≤ 1M

1.44

4.32

思考モード

0 < Token ≤ 256K

0.48

4.80

256K < Token ≤ 1M

1.44

14.40

text-embedding-v4

リージョン名

入力単価 (USD/100 万トークン)

  • 中国 (北京)

  • 中国 (上海)

  • 中国 (杭州)

  • 中国 (深圳)

0.086

  • 中国 (香港)

  • シンガポール

  • ドイツ (フランクフルト)

  • 米国 (バージニア)

  • 米国 (シリコンバレー)

  • 日本 (東京)

  • インドネシア (ジャカルタ)

  • Mexico

0.084

tongyi-embedding-vision-plus

リージョン

入力モダリティ

入力単価 (USD/100 万トークン)

  • インドネシア (ジャカルタ)

画像、動画、テキスト

0.09