このトピックでは、Spark SQL ジョブの設定方法について説明します。
前提条件
プロジェクトが作成済みである必要があります。詳細については、「project management」をご参照ください。手順
-
Data Platform の [Projects] ページに移動します。
-
Alibaba Cloud アカウントで E-MapReduce コンソール にログインします。
-
上部ナビゲーションバーでリージョンとリソースグループを選択します。
-
Data Development タブをクリックします。
-
-
編集するプロジェクトの行で、[ジョブの編集] をクリックします。
- Spark SQL ジョブを作成します。
- ページ左側で、対象のフォルダを右クリックし、[Create Job] を選択します。
- [Create Job] ダイアログボックスで、ジョブ名 と [Description] を入力します。ジョブタイプ ドロップダウンリストから [Spark SQL] を選択します。
説明 デフォルトでは、プラットフォームは yarn-client モードで Spark SQL ジョブを送信します。プラットフォームは、次のコマンドでこのタイプのジョブを送信します:
spark-sql [options] [cli options] {SQL_CONTENT}パラメーターを次の表で説明します:パラメーター 説明 options Advanced Settings パネルの [詳細設定] タブで、Environment Variable 行の
アイコンをクリックして、SPARK_CLI_PARAMS 環境変数を追加します。例: SPARK_CLI_PARAMS="--executor-memory 1g --executor-cores 2"cli options 例: -e <quoted-query-string>:引用符で囲まれた SQL クエリ文字列を実行します。-f <filename>:指定されたファイル内の SQL ステートメントを実行します。
SQL_CONTENT 入力する SQL ステートメントです。 - [OK] をクリックします。
- ジョブの内容を編集します。
- [Content] フィールドに、Spark SQL ステートメントを入力します。
例:
-- SQL ステートメントの例 -- SQL ステートメントは 64 KB を超えることはできません。 show databases; show tables; -- システムは SELECT ステートメントに自動的に 'limit 2000' を追加します。 select * from test1; - [Save] をクリックします。
- [Content] フィールドに、Spark SQL ステートメントを入力します。