Dataphin は、オフラインコンピューティングタスクを処理するためのオフラインコンピューティングエンジンとして StarRocks の使用をサポートしています。このトピックでは、StarRocks コンピューティングソースを作成する方法について説明します。
背景情報
StarRocks は、リアルタイム、多次元、高並行性のデータ分析に対応した高性能分析データベースです。StarRocks は高い拡張性、可用性を備え、保守が容易です。リアルタイム分析、アドホッククエリ、データレイク分析など、幅広い OLAP ユースケースに対応しています。詳細については、「StarRocks 公式ウェブサイト」をご参照ください。
権限
Tag Businessperson と Business Member を除くすべてのシステムロール、および [Cluster-View] 権限を持つカスタムグローバルロールは、クラスターの詳細を表示できます。
最高管理者、システム管理者、および [Cluster-Manage] 権限を持つカスタムグローバルロールは、StarRocks クラスターを作成および管理できます。また、StarRocks コンピューティングソースを作成する際にクラスターを参照できるユーザーを指定し、クラスター管理者を割り当てることができます。
クラスター管理者 は、割り当てられたクラスターを管理できます。
最高管理者、システム管理者、および [Compute Source Management-Create] 権限を持つカスタムグローバルロールのユーザーは、StarRocks コンピューティングソースを作成できます。また、使用権限を持つ任意の StarRocks クラスターを参照できます。
手順
Dataphin ホームページのトップナビゲーションバーで、[プラン] > [コンピューティングソース] を選択します。
[コンピューティングソース] ページで、[コンピューティングソースの追加] をクリックし、[StarRocks コンピューティングソース] を選択します。
[StarRocks コンピュートソースの作成] ページで、次のパラメーターを設定します。
特定のクラスターを参照
パラメータ
説明
[基本情報]
[コンピューティングタイプ]
[StarRocks] を選択します。
[コンピューティングソース名]
コンピューティングソース名には、中国語の文字、英字、数字、アンダースコア (_)、ハイフン (-) を使用できます。
[設定方法]
[特定のクラスターを参照] を選択し、ドロップダウンリストから使用が許可されているクラスターを選択します。[表示] をクリックすると、[StarRocks の表示] ページに移動してクラスターの詳細を表示できます。必要なクラスターが利用できない場合は、[クラスターの設定] をクリックして [StarRocks クラスターの作成] ページに移動し、新しいクラスターを作成します。
説明クラスター情報の変更は、このコンピューティングソース に自動的に同期されます。
[コンピューティングソースの説明]
コンピューティングソースの簡単な説明を入力します。説明は最大 128 文字まで入力できます。
[設定]
[JDBC URL]
JDBC URL は、選択した StarRocks クラスターに設定されたものがデフォルトとなり、変更できません。
[カタログ]
[デフォルトカタログ] または [外部カタログ] を選択できます。
[デフォルトカタログ]:StarRocks の内部データを管理します。
[外部カタログ]:クラスター内のすべての外部カタログから選択するか、カタログ名を手動で入力できます。
[データベース]
選択したカタログ内の既存のデータベースを選択するか、新しいデータベース名を入力できます。
[認証]
[クラスターと同じ] または [カスタム] を選択できます。 デフォルトは[クラスターと同じ]です。 [カスタム] を選択した場合は、認証用に [ユーザー名] と [パスワード] を入力する必要があります。 タスクを正常に実行するには、ユーザーに必要なデータ権限があることを確認してください。
[タスクリソースグループ]
[リソース隔離を有効化]
StarRocks は、リソースグループとクラシファイアを使用して、タスクを特定のグループにルーティングすることでリソースを隔離します。Dataphin では、優先度に基づいてタスクのリソースグループ名を指定できます。
[クラスターのデフォルト設定を使用]:選択したクラスターのデフォルトのリソースグループ設定を使用します。
[タスクの優先度によるリソースの分離]: [リソースグループ] や [コンピュートグループ] などの [リソース分離方法] を選択します。 また、[最高優先度]、[高優先度]、[中優先度]、[低優先度]、[最低優先度] の各優先度について、リソースグループ名またはコンピュートグループ名を指定する必要もあります。
説明コンピューティンググループは、ストレージとコンピューティングが分離された EMR Serverless StarRocks v3.3 以降のバージョンでのみサポートされます。
スタンドアロン構成
パラメータ
説明
[基本情報]
[コンピューティングタイプ]
[StarRocks] を選択します。
[コンピューティングソース名]
コンピューティングソース名には、中国語の文字、英字、数字、アンダースコア (_)、ハイフン (-) を使用できます。
[設定方法]
[スタンドアロン構成]を選択します。
[コンピューティングソースの説明]
コンピューティングソースの簡単な説明を入力します。説明は最大 128 文字まで入力できます。
[設定]
[JDBC URL]
次のいずれかの形式で JDBC URL を入力します:
jdbc:mysql:loadbalance://{fe1-host}:{port},{fe2-host}:{port},{fe3-host}:{port}/{database}jdbc:mysql://{host}:{port}/database?key1=value1&key2=value2
[カタログ]
[デフォルトカタログ] のみがサポートされています。外部カタログからコンピューティングソースを作成するには、[特定のクラスターを参照] 設定方法を使用します。
[FE ノード URL]
FE ノードの接続アドレスをカンマ区切りで指定します。例:
fe_host1:http_port01,fe_host02:http_port02。[ユーザー名]
StarRocks データベースにログオンするためのユーザー名とパスワードを入力します。タスクを正常に実行できるよう、ユーザーに必要なデータ権限があることを確認してください。
[パスワード]
[タスクリソースグループ]
StarRocks は、リソースグループとクラシファイアを使用して、タスクを特定のグループにルーティングすることでリソースを隔離します。Dataphin では、優先度に基づいてタスクのリソースグループ名を指定できます。
[リソースグループマッピングを使用しない]:タスクの優先度に基づいたリソースグループへのマッピングは行わず、上記で設定したユーザーのデフォルト設定でタスクを実行します。
[カスタム]: [最高優先度]、[高優先度]、[中優先度]、[低優先度]、および[最低優先度]の各優先度に対してリソースグループを指定する必要があります。
[接続テスト] をクリックして、コンピューティングソースの接続を検証します。
接続テストが成功した場合、[送信] をクリックします。
作成後、StarRocks コンピューティングソースをプロジェクトに割り当てることができます。詳細については、「プロジェクトスペースの権限とコンピューティングソースの管理」をご参照ください。
次のステップ
コンピューティングソースをプロジェクトに割り当てて、オフラインコンピューティングタスクに使用します。詳細については、「汎用プロジェクトの作成」をご参照ください。