DataWorks に E-MapReduce (EMR) クラスターを登録した後、その Kyuubi 接続情報をカスタマイズできます。これにより、カスタムのユーザー名とパスワードを使用して Kyuubi にアクセスし、タスクを実行できます。
背景情報
Apache Kyuubi は、Spark、Flink、Trino などのデータレイククエリエンジンに SQL などのクエリサービスを提供する分散マルチテナントゲートウェイです。詳細については、Kyuubi をご参照ください。
前提条件
-
Kyuubi サービスが EMR クラスターで有効化されていること。
-
EMR クラスターが DataWorks のコンピューティングリソースとしてバインドされていること。詳細については、「データ開発 (新バージョン):EMR コンピューティングリソースのバインド」をご参照ください。
説明EMR コンピューティングリソースをバインドする際に、リソースグループの初期化を完了する必要があります。完了していない場合、Kyuubi の設定ページを見つけられません。
Kyuubi 接続情報の設定
-
Kyuubi 設定ページに移動します。
[Management Center] ページに移動します。
DataWorks コンソールにログインします。 左側のナビゲーションウィンドウで、[Management Center] をクリックします。 表示されるページで、ドロップダウンリストから目的のワークスペースを選択し、[管理センターに移動] をクリックします。
-
左側ナビゲーションペインで、計算リソース をクリックします。
-
対象の EMR クラスターを見つけ、 をクリックします。
-
Kyuubi 接続情報を設定します。
必要に応じて接続モードを選択します:
-
EMR クラスターの接続情報: EMR クラスターを登録したときに設定した デフォルトアクセス主体 を使用して Kyuubi に直接ログインします。このモードはデフォルトで選択されています。
-
[カスタム接続情報]: カスタムのユーザー名とパスワードを使用して Kyuubi にログインする必要がある場合は、このモードを選択できます。形式は
jdbc:hive2://host:port/;user=<username>;password=<password>です。説明-
初めて カスタム接続情報 を選択すると、EMR クラスターの登録情報に基づいてプラットフォームが自動的に JDBC URL を入力します。その後、必要に応じてこの URL を変更できます。
-
クラスターの登録時にプロキシユーザー情報を渡すように選択した場合、DataWorks は EMR タスクの実行時に
hive.server2.proxy.user設定を JDBC URL に追加します。 ルールは以下のとおりです。-
カスタム接続情報 の JDBC URL にプレースホルダー
DATAWORKS_PROXY_USERが含まれていない場合、タスクの実行時に、プラットフォームはデフォルトでhive.server2.proxy.user設定情報を JDBC URL の末尾に追加します。 -
カスタム接続情報 の JDBC URL にプレースホルダー
DATAWORKS_PROXY_USERが含まれている場合、プラットフォームはタスクを実行するときに、プレースホルダーをhive.server2.proxy.user設定の値で動的に置換します。
-
-
-
次のステップ
DataWorks でデータ開発用のコンポーネントを設定するには、データ開発プロセスガイドに従ってください。