このトピックでは、AI 検索オープン プラットフォームの課金項目、課金方法、および課金ルールについて説明します。
課金項目
AI 検索オープン プラットフォームでは、次の項目に対して課金されます。
:ドキュメントコンテンツ解析サービス、テキスト埋め込みサービス、ソートサービスなどのモデルサービスを呼び出すための料金です。料金はトークンの使用量に基づきます。
:ベクトル次元削減サービスのカスタムトレーニングなど、AI 検索オープン プラットフォームが提供するモデルを独自のデータでカスタマイズするための料金です。課金は使用した計算リソースに基づきます。
:さまざまなソースのモデルを AI 検索オープン プラットフォームにデプロイすると、デプロイ料金と呼び出し料金が請求されます。
:AI 検索オープン プラットフォームは、PAI Distribution Switch (DSW) 機能を統合しています。プラットフォーム上の Notebook を使用して、サービスを開発および実行できます。
検索エンジンサービス:Alibaba Cloud Elasticsearch (Elasticsearch Serverless を含む) および OpenSearch Vector Search Edition が含まれます。これらのサービスは独立した課金方法を使用します。料金の詳細については、各サービスの課金ドキュメントをご参照ください。Elasticsearch Serverless によって発生した料金は、請求書上では AI 検索オープン プラットフォームに帰属します。
AI 検索オープン プラットフォームは無料で有効化できます。サービスを使用しない場合、料金は発生しません。
課金方法
検索エンジンサービスを除き、AI 検索オープン プラットフォーム上のすべてのサービスは従量課金制です。料金は、サービス呼び出し回数と、カスタムモデルトレーニングで消費されたコンピュートユニット (CU) 単位で測定される課金時間に基づいて計算されます。請求書は 1 時間ごとに生成されます。すべての時間単位の請求書は 1 つの注文にまとめられ、合計料金が Alibaba Cloud アカウントから引き落とされます。
2024 年 7 月 4 日 17:00 以降、一部のサービスでは段階的価格設定が採用されます。詳細については、以降のセクションで説明する詳細な課金ルールをご参照ください。
課金ルール
モデル呼び出し
大規模言語モデル (LLM) において、トークンはモデルが処理および理解できるテキストの最小単位です。トークンは通常、単語、フレーズ、文字、記号などのテキストセグメントを表します。モデルによって独自のチャンキング方法が採用されている場合があり、文字数とトークン数が 1 対 1 で対応するとは限りません。
AI 検索オープン プラットフォームは、実際のサービス呼び出し回数に基づいて課金します。課金単位はサービスによって異なります。以下の表の [課金単位] 列を最終的なリファレンスとして使用してください。
USD/1,000 トークン:ドキュメントコンテンツ解析、ドキュメントチャンキング、テキスト埋め込み、一部の再ランキングサービス、大規模言語モデルなど、ほとんどのテキストサービスはトークン単位で課金されます。これらのサービスの一部は段階的価格設定を採用しており、一部は入力トークンと出力トークンで別々に課金されます。
USD/画像:画像コンテンツ解析、マルチモーダル埋め込み、画像認識、オブジェクト検出などのサービスは、処理された画像の数に基づいて課金されます。
USD/テーブル:ドキュメントコンテンツ解析サービスによって識別されたテーブルは、テーブルの数に基づいて課金されます。
USD/ドキュメント:ベクトル次元削減サービスと一部の再ランキングサービスは、処理されたドキュメントの数に基づいて課金されます。
USD/1,000 画像:ビデオスナップショットサービスは、抽出された画像の数に基づいて課金されます。
USD/呼び出しおよび USD/1,000 呼び出し:画像テキスト認識は呼び出し回数に基づいて課金されます。Web 検索は 1,000 呼び出しごとに段階的な定額料金で課金されます。
USD/時間:音声認識 (ASR) サービスは、音声の持続時間に基づいて課金されます。
一部のモデルは、呼び出しによって生成されるトークン数を推定するためのトークン計算をサポートしています。
段階的価格設定の例:
ドイツ (フランクフルト) リージョンで、スパーステキスト埋め込みサービスを呼び出して 1,000,000 トークン (1,000 課金単位に相当) を生成した場合、料金は次のように計算されます:500 × 0.001 + 500 × 0.0004 = 0.7 USD。
入力と出力の課金例:
ドイツ (フランクフルト) リージョンで、大規模言語モデル qwen3-235b-a22b を呼び出して 1,000 入力トークンと 1,000 出力トークンを生成した場合、料金は次のように計算されます:
1 × 0.0007 + 1 × 0.0028 = 0.0035 USD。
中国 (上海) リージョン
モデル名 | モデル ID | 課金単位 | 価格 (0~500 ユニット) | 価格 (500 ユニット超) |
ops-document-analyze-001 | USD/1,000 トークン | 0.0007 | 0.00085 | |
USD/画像 | 0.0023 | |||
テーブルあたり USD | 0.005 | |||
ドキュメントコンテンツ解析 - セマンティック理解に基づく階層構造の抽出 説明 ドキュメントコンテンツ解析サービスを呼び出す際に、パラメーターを使用してセマンティック理解に基づいてドキュメントの階層構造を抽出する機能を制御できます。この機能が有効な場合、ドキュメント解析料金に加えて、この機能に対して 0.00031 USD/1,000 トークンが課金されます。 | USD/1,000 トークン | 0.00031 | ||
ops-image-analyze-ocr-001 | USD/呼び出し | 0.0112 | 0.0058 | |
ops-image-analyze-vlm-001 | USD/1,000 トークン | 0.0093 | ||
ops-document-split-001 | USD/1,000 トークン | 0.0007 | 0.000003 | |
ops-text-embedding-001 | USD/1,000 トークン | 0.0007 | 0.000023 | |
ops-text-embedding-002 | 0.0007 | 0.00007 | ||
ops-text-embedding-zh-001 | 0.0007 | 0.00001 | ||
ops-text-embedding-en-001 | 0.0007 | 0.000011 | ||
ops-gte-sentence-embedding-multilingual-base | 0.0007 | 0.000025 | ||
ops-qwen3-embedding-0.6b | 0.0007 | 0.000071 | ||
テキストと画像の埋め込みに使用 | ops-m2-encoder テキスト埋め込み | USD/1,000 トークン | 0.0007 | 0.000026 |
ops-m2-encoder 画像埋め込み | USD/画像 | 0.0007 | 0.0000162 | |
ops-m2-encoder-large テキスト埋め込み | USD/1,000 トークン | 0.0007 | 0.000067 | |
ops-m2-encoder-large 画像埋め込み | USD/画像 | 0.0007 | 0.000033 | |
ops-gme-qwen2-vl-2b-instruct テキスト埋め込み | USD/1,000 トークン | 0.0007 | 0.00008 | |
ops-gme-qwen2-vl-2b-instruct 画像ベクトル化 | USD/画像 | 0.0007 | 0.000072 | |
画像ベクトル化 | USD/1,000 トークン | 0.0041 | 0.00041 | |
ops-text-sparse-embedding-001 | USD/1,000 トークン | 0.00084 | 0.00014 | |
ops-embedding-dim-reduction-001 | USD/ドキュメント | 0.0007 | 0.0000071 | |
ops-bge-reranker-larger | USD/ドキュメント | 0.00014 | 0.000013 | |
ops-text-reranker-001 | 0.00014 | 0.000062 | ||
ops-qwen3-reranker-0.6b | 0.00014 | 0.000015 | ||
ops-video-snapshot-001 | USD/1,000 画像 | 0.016 | ||
ops-audio-asr-001 | USD/時間 | 0.09 | ||
検索エンジン | Alibaba Cloud Elasticsearch (Elasticsearch Serverless を含む):オープンソースの Elasticsearch をベースに構築されたフルマネージドのクラウドサービスです。オープンソースの機能と 100% 互換性があり、すぐに使える使用と従量課金制をサポートしています。Elasticsearch Serverless によって生成された API 呼び出し料金は、請求書上では AI 検索オープン プラットフォームに帰属します。詳細については、「Alibaba Cloud ES」をご参照ください。 | |||
OpenSearch-Vector Search Edition:課金の詳細については、「Vector Search Edition」をご参照ください。 | ||||
qwen3-235b-a22b | USD/1,000 トークン | 入力:0.00056 出力:0.0056 | ||
ops-qwen-turbo | 入力:0.00006 出力:0.0001 | |||
qwen-turbo | 入力:0.000042 出力:0.000084 | |||
qwen-plus | 入力:0.000112 出力:0.00028 | |||
qwen-max | 入力:0.000336 出力:0.001344 | |||
deepseek-r1 | 入力:0.00056 出力:0.00224 | |||
deepseek-r1-distill-qwen-7b | 入力:0.00007 出力:0.00014 | |||
deepseek-r1-distill-qwen-14b | 入力:0.00014 出力:0.00042 | |||
deepseek-v3 | 入力:0.00028 出力:0.00112 | |||
qwen3.6-plus | 入力:0.0044 出力:0.026 | |||
qwen3-vl-plus | 入力:0.0018 出力:0.0144 | |||
qwen3.5-flash | 入力:0.00084 出力:0.0036 | |||
| USD/呼び出し | 0.00735 | ||
USD/1,000 トークン | クエリ書き換え: 入力:0.000336 出力:0.001344 | |||
ops-query-analyze-001 | USD/1,000 トークン | 意図認識と類似クエリ拡張:
| ||
自然言語から SQL (NL2SQL) への生成:
| ||||
| USD/画像 | 0.00029 | ||
パフォーマンス評価モジュールは、AI 検索オープン プラットフォームが提供する RAG 開発パイプラインを包括的に評価します。この評価は、ユーザーの最初のクエリから RAG システムのコンテンツ取得、LLM の最終的な回答生成までの完全なワークフローをカバーします。 | USD/1,000 トークン | 入力:0.0007 出力:0.0021 | ||
モデルのカスタマイズ
モデル名 | 説明 | 価格 |
ベクトル次元削減モデルのカスタムトレーニングでは、提供されたベクトルデータに基づいてベクトル次元削減モデルをカスタマイズできます。実際のビジネスシナリオでは、まず埋め込みモデルを使用してテキストやクエリをベクトル化し、次にベクトル次元削減モデルを使用してベクトル次元をさらに削減します。 | 消費された計算リソースの CU 数に基づいて課金されます。各 CU の価格は 0.5422614 USD です。 消費される CU 数は、トレーニングデータの量と次元によって異なります。たとえば、100,000 個の 1024 次元データでモデルをトレーニングする場合、約 250 CU が消費され、料金は 250 × 0.5422614 = 135.56535 USD となります。 |
モデルのデプロイ
課金計算式:CU 価格 × インスタンスタイプごとの CU 数 × インスタンス数
次の表に課金ルールを示します。
インスタンスタイプ | CU 価格 (USD/時間) | マシンあたりの CU | マシンあたりの価格 (USD/時間) |
gpu.v100.16g.x1 | 0.15 | 30.14 | 4.521 |
gpu.t4.16g.x1 | 16.07 | 2.4105 | |
gpu.a10.24g.x1 | 11.01 | 1.6515 |
たとえば、モデルサービスをデプロイするために 2 つの gpu.a10.24g.x1 インスタンスを購入した場合、料金は次のように計算されます:0.15 × 11.01 × 2 = 3.303 USD/時間。
サービス開発
インスタンスを起動すると、従量課金制で課金されます。料金は次の式で計算されます:CU 価格 × インスタンスタイプごとの CU 数 × インスタンス数。
次の表に課金ルールを示します。
インスタンスタイプ | CU 価格 (USD/時間) | マシンあたりの CU | マシンあたりの価格 (USD/時間) |
gpu.t4.16g.x1 | 0.15 | 16.07 | 2.4105 |
ops.basic1.gi.large | 0.61 | 0.0915 |
たとえば、ops.basic1.gi.large インスタンスを 1 つ選択した場合、料金は次のように計算されます:0.15 × 0.61 × 1 = 0.0915 USD/時間。
ドイツ (フランクフルト) リージョン
モデル名 | モデル ID | 課金単位 | 価格 (0~500 ユニット) | 価格 (500 ユニット超) |
ops-document-analyze-001 | USD/1,000 トークン | 0.0009 | 0.000272 | |
USD/画像 | 0.00073 | |||
USD/テーブル | 0.00157 | |||
ドキュメントコンテンツ解析 - セマンティック理解に基づく階層構造の抽出 説明 ドキュメントコンテンツ解析サービスを呼び出す際に、パラメーターを使用してセマンティック理解に基づいてドキュメントの階層構造を抽出する機能を制御できます。この機能が有効な場合、ドキュメント解析料金に加えて、この機能に対して 0.00052 USD/1,000 トークンが課金されます。 | USD/1,000 トークン | 0.00052 | ||
ops-image-analyze-ocr-001 | USD/呼び出し | 0.012 | 0.0031 | |
ops-image-analyze-vlm-001 | USD/1,000 トークン | 0.011 | ||
ops-document-split-001 | USD/1,000 トークン | 0.0009 | 0.000003 | |
ops-text-embedding-001 | USD/1,000 トークン | 0.0009 | 0.000072 | |
ops-text-embedding-002 | 0.0009 | 0.000054 | ||
ops-text-embedding-zh-001 | 0.0009 | 0.000022 | ||
ops-text-embedding-en-001 | 0.0009 | 0.000019 | ||
ops-gte-sentence-embedding-multilingual-base | 0.0009 | 0.00003 | ||
ops-qwen3-embedding-0.6b | 0.0009 | 0.000062 | ||
テキストと画像の埋め込みに使用 | ops-m2-encoder テキスト埋め込み | USD/1,000 トークン | 0.0009 | 0.000039 |
ops-m2-encoder 画像埋め込み | USD/画像 | 0.0009 | 0.000032 | |
ops-m2-encoder-large テキスト埋め込み | USD/1,000 トークン | 0.0009 | 0.000065 | |
ops-m2-encoder-large 画像ベクトル化 | USD/画像 | 0.0009 | 0.000042 | |
ops-gme-qwen2-vl-2b-instruct テキスト埋め込み | USD/1,000 トークン | 0.0009 | 0.000162 | |
ops-gme-qwen2-vl-2b-instruct 画像埋め込み | USD/画像 | 0.0009 | 0.000146 | |
画像ベクトル化 | USD/1,000 トークン | 0.007 | 0.0007 | |
ops-text-sparse-embedding-001 | USD/1,000 トークン | 0.001 | 0.0004 | |
ops-embedding-dim-reduction-001 | USD/ドキュメント | 0.0009 | 0.0000064 | |
ops-bge-reranker-larger | USD/ドキュメント | 0.0005 | 0.000048 | |
ops-text-reranker-001 | 0.0005 | 0.00016 | ||
ops-qwen3-reranker-0.6b | 0.0005 | 0.000026 | ||
ops-video-snapshot-001 | USD/1,000 画像 | 0.03 | ||
ops-audio-asr-001 | USD/時間 | 0.2 | ||
検索エンジン | Alibaba Cloud Elasticsearch (Elasticsearch Serverless を含む):オープンソースの Elasticsearch をベースに構築されたフルマネージドのクラウドサービスです。オープンソースの機能と 100% 互換性があり、すぐに使える使用と従量課金制をサポートしています。Elasticsearch Serverless によって生成された API 呼び出し料金は、請求書上では AI 検索オープン プラットフォームに帰属します。詳細については、「Elasticsearch」をご参照ください。 | |||
OpenSearch-Vector Search Edition:課金の詳細については、「Vector Search Edition」をご参照ください。 | ||||
qwen3-235b-a22b | USD/1,000 トークン | 入力:0.0007 出力:0.0028 | ||
ops-qwen-turbo | 入力:0.000065 出力:0.00026 | |||
qwen-turbo | 入力:0.00005 出力:0.0002 | |||
qwen-plus | 入力:0.0004 出力:0.0012 | |||
qwen-max | 入力:0.0016 出力:0.0064 | |||
qwen3.6-plus | 入力:0.0044 出力:0.026 | |||
qwen3-vl-plus | 入力:0.0018 出力:0.0144 | |||
qwen3.5-flash | 入力:0.00084 出力:0.0036 | |||
ops-query-analyze-001 | USD/1,000 トークン | 入力:0.004 出力:0.018 | ||
| USD/画像 | 0.00029 | ||
シンガポールリージョン
モデル名 | モデル ID | 課金単位 | 価格 (0~500 ユニット) | 価格 (500 ユニット超) |
ops-document-analyze-002 | USD/画像 | 0.01227243 | ||
USD/1,000 トークン | 0.00157496 | |||
USD/テーブル | 0.02863566 | |||
USD/1,000 トークン | 0.03477187 | 0.00347719 | ||
ops-document-split-001 | USD/1,000 トークン | 0.00048 | ||
ops-image-analyze-vlm-001 | USD/1,000 トークン | 0.00096 | ||
text-embedding-v4 | USD/1,000 トークン | 0.000084 | ||
text-embedding-v3 | USD/1,000 トークン | 0.000084 | ||
qwen3.7-text-embedding | USD/1,000 トークン | 0.0006 | ||
qwen3-rerank | USD/1,000 トークン | 0.0006 | ||
ops-audio-asr-001 | USD/時間 | 1.1232 | ||
ビデオセグメンテーション | ops-video-segment-001 | USD/1,000 トークン | 0.000313 | |
ops-video-snapshot-001 | USD/1,000 画像 | 0.1512 | ||
ビデオ要約 | ops-video-summarize-embodied-001 | USD/1,000 トークン | 出力:0.00192 入力:0.00048 | |
ops-video-summarize-001 | USD/1,000 トークン | 0.0006 | ||
ops-video-annotate-embodied-001 | USD/1,000 トークン | 入力:0.00048 出力:0.00192 | ||
deepseek-v4-pro | USD/1,000 トークン | 入力:0.00288 出力:0.00576 | ||
deepseek-v4-flash | USD/1,000 トークン | 入力:0.00024 出力:0.00048 | ||
qwen3-vl-plus | USD/1,000 トークン | 入力:0.00036 出力:0.00288 | ||
qwen-plus | USD/1,000 トークン | 入力:0.00048 出力:0.00144 | ||
qwen-max | USD/1,000 トークン | 出力:0.00768 入力:0.00192 | ||
qwen3-max | USD/1,000 トークン | 入力:0.00144 出力:0.0072 | ||
| USD/1,000 呼び出し |
| ||
注意事項
サービス名は、サービス ID および API パラメーターと 1 対 1 で対応します。詳細については、「サービスの概要」をご参照ください。
請求書は、実際の使用量に基づいて 1 時間ごとに生成されます。
段階的価格設定のサービスについては、各段階の使用量に基づいて料金が計算されます。
1,000 トークンを課金単位として使用するサービスの場合、使用量統計に小数点が含まれることがあります。
サービスの停止を避けるため、Alibaba Cloud アカウントに支払い遅延がないことを確認してください。
課金例
ドイツ (フランクフルト) リージョンで、ドキュメントチャンキングサービスを 1,000 ユニット呼び出すと仮定します。料金は次のように計算されます。
最初の 500 ユニット (含む) の料金:0.0009 USD × 500 = 0.45 USD
500 ユニットを超える分の料金:0.000003 USD × 500 = 0.0015 USD
合計料金:0.45 + 0.0015 = 0.4515 USD