すべてのプロダクト
Search
ドキュメントセンター

OpenSearch:課金方法と課金項目

最終更新日:Sep 17, 2026

このトピックでは、AI 検索オープン プラットフォームの課金項目、課金方法、および課金ルールについて説明します。

課金項目

AI 検索オープン プラットフォームでは、次の項目に対して課金されます。

  • :ドキュメントコンテンツ解析サービス、テキスト埋め込みサービス、ソートサービスなどのモデルサービスを呼び出すための料金です。料金はトークンの使用量に基づきます。

  • :ベクトル次元削減サービスのカスタムトレーニングなど、AI 検索オープン プラットフォームが提供するモデルを独自のデータでカスタマイズするための料金です。課金は使用した計算リソースに基づきます。

  • :さまざまなソースのモデルを AI 検索オープン プラットフォームにデプロイすると、デプロイ料金と呼び出し料金が請求されます。

  • :AI 検索オープン プラットフォームは、PAI Distribution Switch (DSW) 機能を統合しています。プラットフォーム上の Notebook を使用して、サービスを開発および実行できます。

  • 検索エンジンサービス:Alibaba Cloud Elasticsearch (Elasticsearch Serverless を含む) および OpenSearch Vector Search Edition が含まれます。これらのサービスは独立した課金方法を使用します。料金の詳細については、各サービスの課金ドキュメントをご参照ください。Elasticsearch Serverless によって発生した料金は、請求書上では AI 検索オープン プラットフォームに帰属します。

説明

AI 検索オープン プラットフォームは無料で有効化できます。サービスを使用しない場合、料金は発生しません。

課金方法

検索エンジンサービスを除き、AI 検索オープン プラットフォーム上のすべてのサービスは従量課金制です。料金は、サービス呼び出し回数と、カスタムモデルトレーニングで消費されたコンピュートユニット (CU) 単位で測定される課金時間に基づいて計算されます。請求書は 1 時間ごとに生成されます。すべての時間単位の請求書は 1 つの注文にまとめられ、合計料金が Alibaba Cloud アカウントから引き落とされます。

重要

2024 年 7 月 4 日 17:00 以降、一部のサービスでは段階的価格設定が採用されます。詳細については、以降のセクションで説明する詳細な課金ルールをご参照ください。

課金ルール

モデル呼び出し

大規模言語モデル (LLM) において、トークンはモデルが処理および理解できるテキストの最小単位です。トークンは通常、単語、フレーズ、文字、記号などのテキストセグメントを表します。モデルによって独自のチャンキング方法が採用されている場合があり、文字数とトークン数が 1 対 1 で対応するとは限りません。

AI 検索オープン プラットフォームは、実際のサービス呼び出し回数に基づいて課金します。課金単位はサービスによって異なります。以下の表の [課金単位] 列を最終的なリファレンスとして使用してください。

  • USD/1,000 トークン:ドキュメントコンテンツ解析、ドキュメントチャンキング、テキスト埋め込み、一部の再ランキングサービス、大規模言語モデルなど、ほとんどのテキストサービスはトークン単位で課金されます。これらのサービスの一部は段階的価格設定を採用しており、一部は入力トークンと出力トークンで別々に課金されます。

  • USD/画像:画像コンテンツ解析、マルチモーダル埋め込み、画像認識、オブジェクト検出などのサービスは、処理された画像の数に基づいて課金されます。

  • USD/テーブル:ドキュメントコンテンツ解析サービスによって識別されたテーブルは、テーブルの数に基づいて課金されます。

  • USD/ドキュメント:ベクトル次元削減サービスと一部の再ランキングサービスは、処理されたドキュメントの数に基づいて課金されます。

  • USD/1,000 画像:ビデオスナップショットサービスは、抽出された画像の数に基づいて課金されます。

  • USD/呼び出しおよび USD/1,000 呼び出し:画像テキスト認識は呼び出し回数に基づいて課金されます。Web 検索は 1,000 呼び出しごとに段階的な定額料金で課金されます。

  • USD/時間:音声認識 (ASR) サービスは、音声の持続時間に基づいて課金されます。

説明

一部のモデルは、呼び出しによって生成されるトークン数を推定するためのトークン計算をサポートしています。

段階的価格設定の例:

ドイツ (フランクフルト) リージョンで、スパーステキスト埋め込みサービスを呼び出して 1,000,000 トークン (1,000 課金単位に相当) を生成した場合、料金は次のように計算されます:500 × 0.001 + 500 × 0.0004 = 0.7 USD。

入力と出力の課金例:

ドイツ (フランクフルト) リージョンで、大規模言語モデル qwen3-235b-a22b を呼び出して 1,000 入力トークンと 1,000 出力トークンを生成した場合、料金は次のように計算されます:

1 × 0.0007 + 1 × 0.0028 = 0.0035 USD。

中国 (上海) リージョン

モデル名

モデル ID

課金単位

価格 (0~500 ユニット)

価格 (500 ユニット超)

ドキュメントコンテンツ解析

ops-document-analyze-001

USD/1,000 トークン

0.0007

0.00085

USD/画像

0.0023

テーブルあたり USD

0.005

ドキュメントコンテンツ解析 - セマンティック理解に基づく階層構造の抽出

説明

ドキュメントコンテンツ解析サービスを呼び出す際に、パラメーターを使用してセマンティック理解に基づいてドキュメントの階層構造を抽出する機能を制御できます。この機能が有効な場合、ドキュメント解析料金に加えて、この機能に対して 0.00031 USD/1,000 トークンが課金されます。

USD/1,000 トークン

0.00031

画像テキスト認識

ops-image-analyze-ocr-001

USD/呼び出し

0.0112

0.0058

画像コンテンツ理解

ops-image-analyze-vlm-001

USD/1,000 トークン

0.0093

ドキュメントチャンキング

ops-document-split-001

USD/1,000 トークン

0.0007

0.000003

テキスト埋め込み

ops-text-embedding-001

USD/1,000 トークン

0.0007

0.000023

ops-text-embedding-002

0.0007

0.00007

ops-text-embedding-zh-001

0.0007

0.00001

ops-text-embedding-en-001

0.0007

0.000011

ops-gte-sentence-embedding-multilingual-base

0.0007

0.000025

ops-qwen3-embedding-0.6b

0.0007

0.000071

マルチモーダル埋め込み

テキストと画像の埋め込みに使用

ops-m2-encoder

テキスト埋め込み

USD/1,000 トークン

0.0007

0.000026

ops-m2-encoder

画像埋め込み

USD/画像

0.0007

0.0000162

ops-m2-encoder-large

テキスト埋め込み

USD/1,000 トークン

0.0007

0.000067

ops-m2-encoder-large

画像埋め込み

USD/画像

0.0007

0.000033

ops-gme-qwen2-vl-2b-instruct

テキスト埋め込み

USD/1,000 トークン

0.0007

0.00008

ops-gme-qwen2-vl-2b-instruct

画像ベクトル化

USD/画像

0.0007

0.000072

ops-mm-embedding-face-001

画像ベクトル化

USD/1,000 トークン

0.0041

0.00041

スパーステキスト埋め込み

ops-text-sparse-embedding-001

USD/1,000 トークン

0.00084

0.00014

ベクトル次元削減サービス

ops-embedding-dim-reduction-001

USD/ドキュメント

0.0007

0.0000071

ソートサービス

ops-bge-reranker-larger

USD/ドキュメント

0.00014

0.000013

ops-text-reranker-001

0.00014

0.000062

ops-qwen3-reranker-0.6b

0.00014

0.000015

ビデオスナップショット

ops-video-snapshot-001

USD/1,000 画像

0.016

音声認識

ops-audio-asr-001

USD/時間

0.09

検索エンジン

Alibaba Cloud Elasticsearch (Elasticsearch Serverless を含む):オープンソースの Elasticsearch をベースに構築されたフルマネージドのクラウドサービスです。オープンソースの機能と 100% 互換性があり、すぐに使える使用と従量課金制をサポートしています。Elasticsearch Serverless によって生成された API 呼び出し料金は、請求書上では AI 検索オープン プラットフォームに帰属します。詳細については、「Alibaba Cloud ES」をご参照ください。

OpenSearch-Vector Search Edition:課金の詳細については、「Vector Search Edition」をご参照ください。

LLM

qwen3-235b-a22b

USD/1,000 トークン

入力:0.00056

出力:0.0056

ops-qwen-turbo

入力:0.00006

出力:0.0001

qwen-turbo

入力:0.000042

出力:0.000084

qwen-plus

入力:0.000112

出力:0.00028

qwen-max

入力:0.000336

出力:0.001344

deepseek-r1

入力:0.00056

出力:0.00224

deepseek-r1-distill-qwen-7b

入力:0.00007

出力:0.00014

deepseek-r1-distill-qwen-14b

入力:0.00014

出力:0.00042

deepseek-v3

入力:0.00028

出力:0.00112

qwen3.6-plus

入力:0.0044

出力:0.026

qwen3-vl-plus

入力:0.0018

出力:0.0144

qwen3.5-flash

入力:0.00084

出力:0.0036

Web 検索

  • Web 検索料金は次のように計算されます:呼び出し料金 + クエリ書き換え料金

    デフォルトでは、Web 検索中のクエリ書き換えには qwen-max モデルが使用されます。
  • 使用方法:Web 検索は次の 2 つの方法で使用できます。

    • Web 検索 API を直接呼び出す。

    • LLM を使用する際に Web 検索を有効にする。

USD/呼び出し

0.00735

USD/1,000 トークン

クエリ書き換え:

入力:0.000336

出力:0.001344

クエリ分析

ops-query-analyze-001

USD/1,000 トークン

意図認識と類似クエリ拡張:

  • 入力:0.001

  • 出力:0.004

自然言語から SQL (NL2SQL) への生成:

  • 入力:0.00031

  • 出力:0.00078

オブジェクト検出

ops-object-detect-face-001

USD/画像

0.00029

評価

パフォーマンス評価モジュールは、AI 検索オープン プラットフォームが提供する RAG 開発パイプラインを包括的に評価します。この評価は、ユーザーの最初のクエリから RAG システムのコンテンツ取得、LLM の最終的な回答生成までの完全なワークフローをカバーします。

USD/1,000 トークン

入力:0.0007

出力:0.0021

モデルのカスタマイズ

モデル名

説明

価格

ベクトル次元削減モデルのカスタムトレーニング

ベクトル次元削減モデルのカスタムトレーニングでは、提供されたベクトルデータに基づいてベクトル次元削減モデルをカスタマイズできます。実際のビジネスシナリオでは、まず埋め込みモデルを使用してテキストやクエリをベクトル化し、次にベクトル次元削減モデルを使用してベクトル次元をさらに削減します。

消費された計算リソースの CU 数に基づいて課金されます。各 CU の価格は 0.5422614 USD です。

消費される CU 数は、トレーニングデータの量と次元によって異なります。たとえば、100,000 個の 1024 次元データでモデルをトレーニングする場合、約 250 CU が消費され、料金は 250 × 0.5422614 = 135.56535 USD となります。

モデルのデプロイ

課金計算式:CU 価格 × インスタンスタイプごとの CU 数 × インスタンス数

次の表に課金ルールを示します。

インスタンスタイプ

CU 価格 (USD/時間)

マシンあたりの CU

マシンあたりの価格 (USD/時間)

gpu.v100.16g.x1

0.15

30.14

4.521

gpu.t4.16g.x1

16.07

2.4105

gpu.a10.24g.x1

11.01

1.6515

たとえば、モデルサービスをデプロイするために 2 つの gpu.a10.24g.x1 インスタンスを購入した場合、料金は次のように計算されます:0.15 × 11.01 × 2 = 3.303 USD/時間。

サービス開発

インスタンスを起動すると、従量課金制で課金されます。料金は次の式で計算されます:CU 価格 × インスタンスタイプごとの CU 数 × インスタンス数。

次の表に課金ルールを示します。

インスタンスタイプ

CU 価格 (USD/時間)

マシンあたりの CU

マシンあたりの価格 (USD/時間)

gpu.t4.16g.x1

0.15

16.07

2.4105

ops.basic1.gi.large

0.61

0.0915

たとえば、ops.basic1.gi.large インスタンスを 1 つ選択した場合、料金は次のように計算されます:0.15 × 0.61 × 1 = 0.0915 USD/時間。

ドイツ (フランクフルト) リージョン

モデル名

モデル ID

課金単位

価格 (0~500 ユニット)

価格 (500 ユニット超)

ドキュメントコンテンツ解析

ops-document-analyze-001

USD/1,000 トークン

0.0009

0.000272

USD/画像

0.00073

USD/テーブル

0.00157

ドキュメントコンテンツ解析 - セマンティック理解に基づく階層構造の抽出

説明

ドキュメントコンテンツ解析サービスを呼び出す際に、パラメーターを使用してセマンティック理解に基づいてドキュメントの階層構造を抽出する機能を制御できます。この機能が有効な場合、ドキュメント解析料金に加えて、この機能に対して 0.00052 USD/1,000 トークンが課金されます。

USD/1,000 トークン

0.00052

画像テキスト認識

ops-image-analyze-ocr-001

USD/呼び出し

0.012

0.0031

画像コンテンツ理解

ops-image-analyze-vlm-001

USD/1,000 トークン

0.011

ドキュメントチャンキング

ops-document-split-001

USD/1,000 トークン

0.0009

0.000003

テキスト埋め込み

ops-text-embedding-001

USD/1,000 トークン

0.0009

0.000072

ops-text-embedding-002

0.0009

0.000054

ops-text-embedding-zh-001

0.0009

0.000022

ops-text-embedding-en-001

0.0009

0.000019

ops-gte-sentence-embedding-multilingual-base

0.0009

0.00003

ops-qwen3-embedding-0.6b

0.0009

0.000062

マルチモーダル埋め込み

テキストと画像の埋め込みに使用

ops-m2-encoder

テキスト埋め込み

USD/1,000 トークン

0.0009

0.000039

ops-m2-encoder

画像埋め込み

USD/画像

0.0009

0.000032

ops-m2-encoder-large

テキスト埋め込み

USD/1,000 トークン

0.0009

0.000065

ops-m2-encoder-large

画像ベクトル化

USD/画像

0.0009

0.000042

ops-gme-qwen2-vl-2b-instruct

テキスト埋め込み

USD/1,000 トークン

0.0009

0.000162

ops-gme-qwen2-vl-2b-instruct

画像埋め込み

USD/画像

0.0009

0.000146

ops-mm-embedding-face-001

画像ベクトル化

USD/1,000 トークン

0.007

0.0007

スパーステキスト埋め込み

ops-text-sparse-embedding-001

USD/1,000 トークン

0.001

0.0004

ベクトル次元削減サービス

ops-embedding-dim-reduction-001

USD/ドキュメント

0.0009

0.0000064

ソートサービス

ops-bge-reranker-larger

USD/ドキュメント

0.0005

0.000048

ops-text-reranker-001

0.0005

0.00016

ops-qwen3-reranker-0.6b

0.0005

0.000026

ビデオスナップショット

ops-video-snapshot-001

USD/1,000 画像

0.03

音声認識

ops-audio-asr-001

USD/時間

0.2

検索エンジン

Alibaba Cloud Elasticsearch (Elasticsearch Serverless を含む):オープンソースの Elasticsearch をベースに構築されたフルマネージドのクラウドサービスです。オープンソースの機能と 100% 互換性があり、すぐに使える使用と従量課金制をサポートしています。Elasticsearch Serverless によって生成された API 呼び出し料金は、請求書上では AI 検索オープン プラットフォームに帰属します。詳細については、「Elasticsearch」をご参照ください。

OpenSearch-Vector Search Edition:課金の詳細については、「Vector Search Edition」をご参照ください。

LLM

qwen3-235b-a22b

USD/1,000 トークン

入力:0.0007

出力:0.0028

ops-qwen-turbo

入力:0.000065

出力:0.00026

qwen-turbo

入力:0.00005

出力:0.0002

qwen-plus

入力:0.0004

出力:0.0012

qwen-max

入力:0.0016

出力:0.0064

qwen3.6-plus

入力:0.0044

出力:0.026

qwen3-vl-plus

入力:0.0018

出力:0.0144

qwen3.5-flash

入力:0.00084

出力:0.0036

クエリ分析

ops-query-analyze-001

USD/1,000 トークン

入力:0.004

出力:0.018

オブジェクト検出

ops-object-detect-face-001

USD/画像

0.00029

シンガポールリージョン

モデル名

モデル ID

課金単位

価格 (0~500 ユニット)

価格 (500 ユニット超)

ドキュメントコンテンツの解析

ops-document-analyze-002

USD/画像

0.01227243

USD/1,000 トークン

0.00157496

USD/テーブル

0.02863566

USD/1,000 トークン

0.03477187

0.00347719

ドキュメントチャンキング

ops-document-split-001

USD/1,000 トークン

0.00048

画像コンテンツの抽出

ops-image-analyze-vlm-001

USD/1,000 トークン

0.00096

テキスト埋め込み

text-embedding-v4

USD/1,000 トークン

0.000084

text-embedding-v3

USD/1,000 トークン

0.000084

qwen3.7-text-embedding

USD/1,000 トークン

0.0006

再ランキング

qwen3-rerank

USD/1,000 トークン

0.0006

音声認識

ops-audio-asr-001

USD/時間

1.1232

ビデオセグメンテーション

ops-video-segment-001

USD/1,000 トークン

0.000313

ビデオスナップショット

ops-video-snapshot-001

USD/1,000 画像

0.1512

ビデオ要約

ops-video-summarize-embodied-001

USD/1,000 トークン

出力:0.00192

入力:0.00048

ops-video-summarize-001

USD/1,000 トークン

0.0006

ops-video-annotate-embodied-001

USD/1,000 トークン

入力:0.00048

出力:0.00192

サービスの概要と体験

deepseek-v4-pro

USD/1,000 トークン

入力:0.00288

出力:0.00576

deepseek-v4-flash

USD/1,000 トークン

入力:0.00024

出力:0.00048

qwen3-vl-plus

USD/1,000 トークン

入力:0.00036

出力:0.00288

qwen-plus

USD/1,000 トークン

入力:0.00048

出力:0.00144

qwen-max

USD/1,000 トークン

出力:0.00768

入力:0.00192

qwen3-max

USD/1,000 トークン

入力:0.00144

出力:0.0072

Web 検索

  • Web 検索は 1,000 呼び出しごとに段階的な定額料金で課金されます。クエリ書き換えのトークン料金は別途請求されなくなりました。

  • 使用方法:Web 検索 API を直接呼び出すか、LLM モデルを使用する際に Web 検索を有効にします。

USD/1,000 呼び出し

  • Lite (基本検索 + 高速 Web ページ解析):1.737

  • Pro (拡張検索 + 高速 Web ページ解析):5.211

  • Max (拡張検索 + 詳細 Web ページ解析):1.447

注意事項

  • サービス名は、サービス ID および API パラメーターと 1 対 1 で対応します。詳細については、「サービスの概要」をご参照ください。

  • 請求書は、実際の使用量に基づいて 1 時間ごとに生成されます。

  • 段階的価格設定のサービスについては、各段階の使用量に基づいて料金が計算されます。

  • 1,000 トークンを課金単位として使用するサービスの場合、使用量統計に小数点が含まれることがあります。

  • サービスの停止を避けるため、Alibaba Cloud アカウントに支払い遅延がないことを確認してください。

課金例

ドイツ (フランクフルト) リージョンで、ドキュメントチャンキングサービスを 1,000 ユニット呼び出すと仮定します。料金は次のように計算されます。

  • 最初の 500 ユニット (含む) の料金:0.0009 USD × 500 = 0.45 USD

  • 500 ユニットを超える分の料金:0.000003 USD × 500 = 0.0015 USD

  • 合計料金:0.45 + 0.0015 = 0.4515 USD

参考資料

請求明細の表示