SelectDB データソースを作成すると、Dataphin は SelectDB からデータを読み取ったり、SelectDB にデータを書き込んだりできるようになります。
背景情報
SelectDB は、リアルタイムレポート、アドホック多次元分析、ログの取得と分析、データフェデレーション、クエリアクセラレーションに広く使用されているデータウェアハウスです。高性能で使いやすいデータ分析サービスを提供します。
権限
[Super Admin]、[Data Source Admin]、[Section Architect]、または [Project Admin] のシステムロール、あるいは [Create Data Source] 権限を持つカスタムグローバルロールが付与されたユーザーのみが、データソースを作成できます。
手順
-
Dataphin のホームページで、上部メニューの [Admin Center] > [Data Source Management] をクリックします。
-
[Data Sources] ページで、[+ Add Data Source] をクリックします。
-
[Add Data Source] ページで、[Big Data Storage] セクションの [SelectDB] を選択します。
最近 SelectDB を使用した場合は、[Recently Used] セクションで選択することもできます。または、検索ボックスに「SelectDB」と入力して検索することもできます。
-
[Create SelectDB Data Source] ページで、データソースの接続パラメーターを設定します。
-
基本情報の設定
パラメーター
説明
[データソース名]
命名規則は次のとおりです:
-
中国語、英字 (大文字と小文字)、数字、アンダースコア (_)、ハイフン (-) を使用できます。
-
長さは 64 文字以内です。
[データソースコード]
データソースコードを設定すると、Flink SQL タスクで
Data Source Code.tableまたはData Source Code.schema.tableの形式でテーブルを参照できます。Dataphin が現在の環境のデータソースに自動的にアクセスできるようにするには、${Data Source Code}.tableまたは${Data Source Code}.schema.tableの形式を使用します。詳細については、「Flink SQLタスクの開発」をご参照ください。重要データソースコードは、一度構成すると変更できません。
データソースコードが構成された後でのみ、アセットディレクトリおよびアセットチェックリストのオブジェクト詳細ページでデータをプレビューできます。
Flink SQL では、現在、MySQL、Hologres、MaxCompute、Oracle、StarRocks、Hive、SelectDB、および GaussDB データウェアハウスサービス (DWS) のデータソースのみがサポートされています。
[カーネルバージョン]
[Cloud Core v3.0.x (based on Apache Doris v2.1.x)] または [Cloud Core v4.0.x (based on Apache Doris v3.0.x)] を選択できます。
[データソースの説明]
データソースの簡単な説明を 128 文字以内で入力します。
[データソースの設定]
使用するデータソース設定を選択します。
-
本番環境と開発環境で別々のデータソースを使用する場合は、[本番 + 開発データソース] を選択します。
-
両方に単一のデータソースを使用する場合は、[本番データソース] を選択します。
[タグ]
タグを使用して、データソースを分類およびラベル付けできます。タグの作成方法については、「データソースタグの管理」をご参照ください。
-
-
接続パラメーターの設定
[Data Source Configuration] を [本番 + 開発データソース] に設定した場合は、本番環境と開発環境の両方の接続情報を設定する必要があります。[本番データソース] を選択した場合は、本番環境のパラメーターのみを設定する必要があります。
説明通常、環境分離を実現し、開発環境が本番環境に与える影響を軽減するために、本番環境と開発環境には異なるデータソースを使用する必要があります。ただし、Dataphin は両方に同じデータソースを使用することもサポートしており、その場合はパラメーター値が同一になります。
パラメーター
説明
JDBC URL
SelectDB の JDBC URL を入力します。形式は
jdbc:mysql://host:port/dbnameです。ユーザー名とパスワード
データベースへの接続に使用するユーザー名とパスワードを入力します。
[Arrow Flight SQLポート] (任意)
Arrow Flight SQL プロトコルを使用して高速かつ大規模なデータ同期を行うための SelectDB FE 上のポートです。デフォルトは 8070 です。
FEノードURL
SelectDB Front End (FE) ノードのホスト名と HTTP ポートを入力します。形式は
fe_host:http_port,fe_host:http_portです。FE ノードが複数ある場合は、カンマ (,) で区切ります。SelectDB のデフォルトの HTTP ポートは 8030 です。 -
詳細設定
パラメーター
説明
[connectTimeout]
データベース接続のタイムアウト時間 (ミリ秒、ms)。デフォルトは 900000 ms (15 分) です。
説明-
JDBC URL に connectTimeout パラメーターを含める場合、URL で指定された値が優先されます。
-
V3.11 より前の Dataphin バージョンで作成されたデータソースの場合、connectTimeout のデフォルト値は
-1で、タイムアウトがないことを意味します。
[socketTimeout]
データベースソケットのタイムアウト時間 (ミリ秒、ms)。デフォルトは 1800000 ms (30 分) です。
説明-
JDBC URL に socketTimeout パラメーターを含める場合、URL で指定された値が優先されます。
-
V3.11 より前の Dataphin バージョンで作成されたデータソースの場合、socketTimeout のデフォルト値は
-1で、タイムアウトがないことを意味します。
[接続リトライ]
接続試行がタイムアウトした場合、Dataphin は指定された回数まで接続をリトライします。すべてのリトライが失敗した場合、接続は失敗したと見なされます。
説明-
デフォルトのリトライ回数は 1 です。この値は 0 から 10 までの整数に設定できます。
-
接続リトライ設定は、デフォルトで バッチ統合タスクと [Global Quality] (アセット品質モジュールの有効化が必要です) に適用されます。バッチ統合タスクについては、タスクレベルでリトライ回数を設定することもできます。
-
-
-
[デフォルトリソースグループ]を選択します。このリソースグループは、データベース SQL の実行、データベース全体の一括移行、データプレビューなど、データソースに関連するタスクを実行します。
-
[接続テスト] をクリックして接続を検証するか、[OK] をクリックしてデータソースを保存して作成します。
[接続テスト] をクリックすると、システムはデータソースが Dataphin に接続できるかどうかをテストします。[OK] をクリックすると、システムは選択したすべてのクラスターへの接続を自動的にテストします。ただし、選択したすべてのクラスターへの接続に失敗した場合でも、データソースは正常に作成できます。