Dataphin 分析プラットフォームは、効率的な SQL クエリと豊富なデータ可視化機能を提供します。このトピックでは、プラットフォームで SQL クエリを作成する方法について説明します。
操作手順
Dataphin コンソールで、トップナビゲーションバーで [Analyze] > [SQL Query] の順に選択します。
[SQL Query] ページで、
アイコンをクリックします。[New SQL Query] ダイアログボックスで、次のパラメーターを設定します。
パラメーター
説明
[SQL クエリ名]
名前は 256 文字以内で指定できます。縦棒 (|)、スラッシュ (/)、バックスラッシュ (\)、コロン (:)、疑問符 (?)、山括弧 (<>)、アスタリスク (*)、二重引用符 (") は使用できません。
[ディレクトリ]
クエリを保存するディレクトリを選択します。
ディレクトリが作成されていない場合は、[SQL Query] ページで
アイコンをクリックして新しいフォルダーを作成します。[New Folder] ダイアログボックスでフォルダーの [Name] を入力し、[Location] を選択してから [OK] をクリックします。Query Data
プロジェクトデータまたはデータソースを選択します。
プロジェクトデータ:現在のプロジェクトのコンピューティングソースからデータをクエリします。
データソース:データソースからデータをクエリします。サポートされているデータソースタイプについては、「分析プラットフォームでサポートされているデータソース」をご参照ください。このオプションを選択した場合は、次のパラメーターも設定する必要があります。
データソース:外部データソースを含むデータソースを選択します。データソースがない場合は、[+ New Data Source] をクリックして作成できます。詳細については、「データソース管理」をご参照ください。
カタログ:Presto および Trino データソースの場合は、カタログを選択する必要があります。
データベース/スキーマ:MySQL、PostgreSQL、Hologres、AnalyticDB for PostgreSQL、OceanBase (Oracle テナントモード)、Lindorm、Oracle、ClickHouse、DM、openGauss、StarRocks、Doris、SelectDB、Presto、GaussDB (DWS)、Trino、PolarDB-X 2.0、OushuDB、TDSQL for MySQL、TDSQL for PostgreSQL などのデータソースの場合は、対応するデータベースまたはスキーマを選択する必要があります。
[OK] をクリックして SQL クエリを作成します。デフォルトで SQL クエリのコードエディタータブが開きます。
エディターで SQL コードを記述できます。
(オプション) クエリアクセラレーションを有効に設定できます。有効にした場合は、高速化方式を選択する必要があります。
アクセラレーションソース:アクセラレーションソースを使用してクエリを高速化します。この方式を選択した場合は、アクセラレーションソースとリソースグループも選択する必要があります。
アクセラレーションソース:現在のプロジェクトのコンピューティングソースに紐づけられているアクセラレーションソースを選択できます。利用可能なアクセラレーションソースがない場合は、[New Acceleration Source] をクリックして作成ページに移動し、必要に応じて作成します。
リソースグループ (オプション):選択したアクセラレーションソース配下で設定済みのリソースグループを選択できます。
説明アクセラレーションソースを高速化方式として選択した場合、ジョブは選択したソースタイプの構文 (たとえば、StarRocks ソースの場合は StarRocks 構文) を使用して実行されます。
MCQA:MaxCompute クエリアクセラレーション (MCQA)。MCQA には、ジョブと同時実行数にテナントごとの制限があり、高速化の失敗や実行エラーが発生する可能性があります。詳細については、「クエリアクセラレーション (MCQA)」をご参照ください。[管理センター] > [システム設定] > [開発プラットフォーム] > [クエリアクセラレーション] で MCQA を無効にできます。
サポートされる高速化方式は、コンピューティングエンジンとシナリオによって異なります。
現在のテナントが MaxCompute コンピューティングエンジンを使用している場合:
データクエリの高速化を購入しておらず、開発プラットフォームでクエリアクセラレーションを有効にしている場合、高速化方式は MCQA です。
データクエリの高速化を購入し、開発プラットフォームでクエリアクセラレーションを有効にしており、現在のプロジェクトのコンピューティングソースがアクセラレーションソースに紐づけられていない場合、高速化方式は MCQA です。
データクエリの高速化を購入し、プロジェクトのコンピューティングソースがアクセラレーションソースに紐づけられている場合、高速化方式としてアクセラレーションソースまたは MCQA のいずれかを選択できます。
現在のテナントが Hadoop コンピューティングエンジンを使用している場合:クエリの高速化を購入し、プロジェクトのコンピューティングソースクラスターがアクセラレーションソースに紐づけられている場合、高速化方式はアクセラレーションソースです。
[Run] をクリックします。システムがコードを解析し、参照されるオブジェクトに必要な権限があるかを確認します。権限チェックが失敗した場合、権限が不足しているオブジェクトを一覧表示するダイアログボックスが表示されます。
説明SQL クエリジョブは、プロジェクトのデフォルトリソースグループではなく、選択したデータソースのデフォルトリソースグループを使用します。
権限チェック失敗のダイアログボックスには、オブジェクト名、オブジェクトタイプ、権限の種類、および利用可能な操作が表示されます。
オブジェクト名:権限が不足しているオブジェクトの名前。
オブジェクトタイプ:テーブルとグローバル変数。
権限の種類:スクリプトの実行に必要な権限の種類。例として、テーブルのクエリ権限やデータソースの実行権限などが挙げられます。
操作:権限チェックが失敗した場合、1 つ以上のオブジェクトの権限をリクエストできます。
単一オブジェクトの権限をリクエスト:対象オブジェクトの [操作] 列で
アイコンをクリックし、そのオブジェクトの個人権限をリクエストします。デフォルトの有効期間は 30 日間です。権限の一括リクエスト:複数のオブジェクトを選択するか、[Select All Tables] を選択してから [権限をリクエスト] をクリックします。
権限のリクエスト方法の詳細については、「権限をリクエスト」をご参照ください。権限が付与されたら、クエリを再実行できます。
説明MySQL および Oracle データソースのみがテーブルレベルの権限制御をサポートしています。
単一テナントのマルチエンジン
マルチエンジンモードでは、[Project Data] をクエリする場合、クラスターとプロジェクトを選択して、[実行プロジェクト]を指定する必要もあります。その他のパラメーターは、前述のセクションで説明したように設定します。
クラスター:現在のテナント配下のすべてのクラスターと [クラスターレスプロジェクト] がオプションに含まれます。クエリ作成後にクラスターを変更することはできません。
プロジェクト:選択したクラスター配下のプロジェクトと、そのクラスター専用の分析プロジェクトがオプションに含まれます。クラスターの専用分析プロジェクトの名前は
{Cluster Name} Analysis Projectに固定されています。クラスターレスプロジェクトの専用分析プロジェクトの名前はClusterless Independent Analysis Projectです。
実行プロジェクトを選択すると、選択したクラスターに基づいて、対応するエンジンタイプの SQL クエリが作成されます。対応関係は次のとおりです。
エンジンタイプ | SQL タイプ |
MaxCompute | MaxCompute SQL |
Hadoop | Hive SQL |
Databricks | Databricks SQL |
AnalyticDB for PostgreSQL | AnalyticDB for PostgreSQL SQL |
StarRocks | StarRocks SQL |
Doris | Doris SQL |
SelectDB | SelectDB SQL |
Lindorm (コンピューティングエンジン) | Spark SQL |
ArgoDB | ArgoDB SQL |
GaussDB (DWS) | GaussDB SQL |
TDH 6.x および TDH 9.3.x | Inceptor SQL |
OushuDB | OushuDB SQL |
Hive と Spark の両方が有効になっている Hadoop クラスターを選択した場合、クエリで Hive SQL と Spark SQL を切り替えることができます。