Apache Zeppelin は、インタラクティブなデータ分析のための Web ベースのノートブックです。Zeppelin を使用すると、Scala、Python、SparkSQL、Hive など、あらかじめ組み込まれたさまざまな言語バックエンド (またはインタープリター) を使用して、インタラクティブで共同作業が可能なドキュメントを作成できます。Hologres は PostgreSQL と互換性があり、データ分析のために Apache Zeppelin からの直接接続をサポートしています。このトピックでは、Apache Zeppelin を Hologres に接続し、データ可視化を実行する方法について説明します。
制限事項
Apache Zeppelin の最新バージョンでは、PostgreSQL インタープリターは非推奨となり、JDBC インタープリターにマージされました。JDBC インタープリターを使用して Hologres に接続してください。
Apache Zeppelin から Hologres への接続
-
Apache Zeppelin のインストール
Apache Zeppelin のインストールについては、Apache Zeppelin 公式ドキュメントをご参照ください。
-
インタープリターの設定
-
Apache Zeppelin にログインします。右上隅で、ご自身のユーザー名をクリックし、ドロップダウンメニューから [Interpreter] を選択します。
-
ページの右上隅にある [+Create] をクリックして、インタープリターを追加します。[Interpreter Name] と [Interpreter group] パラメーターを設定します。
-
[Interpreter Name] には、任意の名前を設定します。
-
[Interpreter group] には、JDBC を設定します。
-
-
[Interpreter group] を JDBC に設定した後、[Properties] テーブルで、default.url、default.user、default.password のパラメーターを設定します。
パラメーター
説明
default.url
JDBC 接続 URL。フォーマットは
jdbc:postgresql://{host}:{port}/{database}を使用します。-
host: Hologres インスタンスのネットワークアドレス。Hologres コンソール のインスタンス詳細ページにある Network Information セクションで確認できます。
-
port: Hologres インスタンスのポート。Hologres コンソール のインスタンス詳細ページにある Network Information セクションで確認できます。
-
database: Hologres で作成したデータベースの名前。
default.user
ご利用の Alibaba Cloud アカウントの AccessKey ID。AccessKey の取得方法については、「AccessKey の作成」をご参照ください。
default.password
ご利用の Alibaba Cloud アカウントの AccessKey Secret。AccessKey の取得方法については、「AccessKey の作成」をご参照ください。
ビジネス要件に基づいて他のパラメーターを設定することもできます。パラメーターの詳細については、Apache Zeppelin 公式ドキュメントをご参照ください。
-
-
ページ下部の [保存] をクリックします。
-
-
データ分析用ノートブックの作成
SQL ステートメントの前に、
%hologresのように設定したインタープリター名を付けます。これにより、Zeppelin は正しいインタープリターを使用するようになります。たとえば、%hologresインタープリターを使用してselect * from lineitem limit 10のようなクエリを実行できます。クエリのステータスが FINISHED に変わったら、可視化ボタンからグラフの種類を選択します。ピボットグラフを設定するには、フィールドを「keys」エリア (例:l_shipmode) と「values」エリア (例:l_quantity SUM) にドラッグして、データをグループ化および集計します。