すべてのプロダクト
Search
ドキュメントセンター

Dataphin:コンピューティング設定

最終更新日:Jun 06, 2026

データ開発用のプロジェクトスペースを作成する前に、Dataphin インスタンスのコンピューティングエンジンを設定する必要があります。コンピューティングエンジンの設定後、対応するコンピューティングソースをプロジェクトスペースに追加して、コンピューティングリソースとストレージリソースを提供できます。このトピックでは、Dataphin で利用可能なコンピューティングエンジンについて説明します。

権限

スーパー管理者またはシステム管理者のみがコンピューティングエンジンを設定できます。

課金

リアルタイムコンピューティングエンジンを設定するには、まずリアルタイム開発モジュールを購入して有効化する必要があります。

Agile R&D Edition はリアルタイムコンピューティングエンジンをサポートしていません。

制限事項

  • ビジネステナントのコンピューティングエンジンを設定した後、メタストアコンピューティングエンジンのタイプを再設定すると、そのテナントのメタデータ処理が正しく行われなくなる可能性があります。メタストアコンピューティングエンジンのタイプを変更する前に、Dataphin 運用チームに連絡して確認することを推奨します。

  • オフラインコンピューティングエンジンの設定を変更すると、システムは自動的にコンピューティングソースの設定を更新します。効率を確保するため、このプロセス中にシステムはコンピューティングソースの接続性を検証しません。タスクの失敗を防ぐために、設定が正確であることを確認してください。変更完了後、手動でコンピューティングソースの接続性をテストすることを推奨します。

  • コンピューティング設定を変更すると、新しい設定は30 秒以内にコンピューティングソースに反映されます。同期が完了する前にコンピューティングソースの設定を表示すると、不整合が生じることがあり、SQL の実行では以前の設定が使用される場合があります。

サポート対象のコンピューティングエンジン

シングルエンジンモードでは、クラスターアドレスを指定して Dataphin インスタンスのコンピューティングエンジンを設定する必要があります。設定後、このクラスターに基づいてコンピューティングソースを作成できます。シングルテナントマルチエンジンモードでは、クラスターに関連付けることによってのみコンピューティングエンジンを使用できます。詳細については、「シングルテナントマルチエンジンモードでのクラスターの作成」をご参照ください。Dataphin は、以下のコンピューティングエンジンをサポートしています:

説明

オフラインコンピューティングソースが存在しない場合、コンピューティングエンジンのタイプとその設定の両方を変更できます。既に存在する場合は、設定のみ変更可能で、エンジンタイプは変更できません。

テナントのメタストアコンピューティングエンジンが既に初期化されている場合、そのメタストアがサポートするコンピューティングエンジンのみを選択できます。

コンピューティングエンジン

説明

リファレンス

オフラインコンピューティングエンジン

MaxCompute

膨大なデータセットに対して高効率で安定したストレージとコンピューティングを提供する、Alibaba Cloud ネイティブのビッグデータコンピューティングプラットフォーム。

Dataphin インスタンスのコンピューティングエンジンとして MaxCompute を設定

AnalyticDB for

PostgreSQL

オンライン分析処理 (OLAP) のための、クラウドホスト型でペタバイト規模、高同時実行性のリアルタイムデータウェアハウス。膨大なデータ処理のためのシームレスなスケーリングが特徴です。

Dataphin インスタンスのコンピューティングエンジンとして AnalyticDB for PostgreSQL を設定

E-MapReduce 3.x

Hadoop and E-MapReduce 5.x Hadoop

ECS インスタンス上で実行される、Alibaba Cloud E-MapReduce (EMR) ベースの Hadoop クラスター。

Dataphin インスタンスのコンピューティングエンジンとして Hadoop を設定

CDH 5.x

Hadoop

CDH 6.x

Hadoop

広く使用されている分散システムフレームワーク。そのコアコンポーネントである HDFS と MapReduce は、大量のデータストレージとコンピューティングを提供します。

広く使用されている分散システムフレームワーク。そのコアコンポーネントである HDFS と MapReduce は、大量のデータストレージとコンピューティングを提供します。

Cloudera Data Platform 7.x

Cloudera Data Platform (CDP) は、Cloudera の CDH と Hortonworks の HDP の長所を組み合わせたもので、両社の合併後に作成されました。

Huawei FusionInsight 8.x

Hadoop

オープンソースの Apache ソフトウェアをベースに機能強化された、データストレージ、クエリ、分析のための Huawei 製エンタープライズグレードのビッグデータプラットフォーム。

AsiaInfo DP 5.3

Hadoop

オープンソースエコシステムとキャリアグレードのテクノロジーを基盤に構築された、ビッグデータの生産と運用のための統合プラットフォーム。

Transwarp ArgoDB

Transwarp ArgoDB は、Transwarp 社の分散分析データベースです。

説明

Transwarp ArgoDB は Agile R&D Edition ではサポートされていません。

Dataphin インスタンスのコンピューティングエンジンとして TDH または ArgoDB を設定

Transwarp Data Hub (TDH) 6.x

Transwarp Data Hub (TDH) は、Transwarp 社のビッグデータプラットフォームです。

StarRocks

StarRocks は、高性能な分析データウェアハウスです。ベクトル化、超並列処理 (MPP) アーキテクチャ、コストベースオプティマイザー (CBO) 、スマートマテリアライズドビュー、リアルタイム更新可能なカラムナストレージエンジンなどのテクノロジーを使用して、多次元、リアルタイム、高同時実行性のデータ分析を可能にします。

初期化のために StarRocks をメタストアコンピューティングエンジンとして使用

Lindorm (コンピューティングエンジン)

Lindorm は、Alibaba Cloud ネイティブのマルチモデルデータベースです。そのコンピューティングエンジンモードは、オフラインのビッグデータアプリケーションをサポートします。

Dataphin インスタンスのコンピューティングエンジンとして Lindorm (コンピューティングエンジン) を設定

GaussDB (DWS)

GaussDB (DWS) は、Huawei が開発した分散リレーショナルデータベースです。PostgreSQL をベースにしており、Oracle、MySQLTeradata の構文と互換性があります。

Dataphin インスタンスのコンピューティングエンジンとして GaussDB (DWS) を設定

Databricks

Databricks は、Apache Spark をベースにした統合データ分析プラットフォームです。マネージド Spark クラスター、インタラクティブなノートブック環境、クラウドストレージとのシームレスな統合を提供し、効率的なデータ処理と大規模な分析を実現します。

Dataphin インスタンスのコンピューティングエンジンとして Databricks を設定

Amazon EMR

Amazon EMR は、Hive や Spark などのビッグデータフレームワークを実行するためのマネージドクラスタープラットフォームです。

Dataphin インスタンスのコンピューティングエンジンとして Amazon EMR を設定

SelectDB

SelectDB Enterprise は、SelectDB が提供する Apache Doris の商用ディストリビューションです。

Dataphin インスタンスのコンピューティングエンジンとして SelectDB または Doris を設定

Doris

Apache Doris は、MPP アーキテクチャをベースにした高性能なリアルタイム分析データベースです。

EMR Serverless Spark

EMR Serverless Spark は、データと AI のための高性能なレイクハウス製品です。

Dataphin インスタンスのコンピューティングエンジンとして EMR Serverless Spark を設定

OushuDB

OushuDB は、Oushu Technology が開発したクラウドネイティブの分散分析データベースです。

重要

OushuDB コンピューティングエンジンは、マルチエンジンモードのクラスター経由でのみ使用できます。

シングルテナントマルチエンジンモードでのクラスターの作成

リアルタイムコンピューティングエンジン

Realtime Compute for Apache Flink

Apache Flink をベースにした Alibaba Cloud のサービスです。高いスループットと低レイテンシーで、リアルタイム処理とオフラインバッチ処理の両方をサポートします。

テナントでリアルタイム開発モジュールを有効にすると、選択したオフラインコンピューティングエンジンに基づいてシステムが設定を推奨します。この設定は必要に応じて変更できます。リアルタイム開発を有効にするには、「テナント設定」をご参照ください。

Apache Flink

Apache Flink は、無界および有界データストリームに対するステートフルな計算のための分散処理エンジンです。

FusionInsight Flink

FusionInsight Flink は、高速なデータストリームをリアルタイムで分析するための、Apache Flink をベースにしたストリーム処理エンジンです。

Blink 専用

Blink は Alibaba Cloud のリアルタイムコンピューティングエンジンです。

重要

このバージョンはパブリッククラウドでは販売終了しています。注意してご使用ください。

シングルテナントマルチエンジン

Dataphin V6.1 以降で作成したテナントでは、デフォルトでシングルテナントマルチエンジンモードを使用します。ここではテナントのコンピューティングエンジンを設定できません。代わりに、[Plan] > [Cluster Management] に移動して、さまざまなエンジンタイプのクラスターを作成してください。詳細については、「シングルテナントマルチエンジンモードでのクラスターの作成」をご参照ください。