このトピックでは、TDSQL for PostgreSQL データソースを作成する方法について説明します。これにより、Dataphin は TDSQL for PostgreSQL からのデータの読み取り、または TDSQL for PostgreSQL へのデータの書き込みが可能になります。
制限事項
データソースを作成できるのは、[Create Data Source] 権限を持つカスタムグローバルロール、および次のシステムロールを持つユーザーのみです: [Super Admin]、[Data Source Administrator]、[Business Segment Architect]、および [Project Administrator]。
手順
Dataphin のホームページで、上部メニューから [Management Center] > [Data Source Management] を選択します。
[Data Source] ページで、[+ New Data Source] をクリックします。
[New Data Source] ページの [Relational Database] セクションで、[TDSQL for PostgreSQL] を選択します。
最近 TDSQL for PostgreSQL を使用したことがある場合は、[Recently Used] セクションで [TDSQL for PostgreSQL] を選択することもできます。また、検索ボックスに TDSQL for PostgreSQL のキーワードを入力して、すばやく検索することもできます。
[Create TDSQL for PostgreSQL Data Source] ページで、接続パラメーターを設定します。
データソースの基本情報を設定します。
パラメーター
説明
[データソース名]
命名規則は次のとおりです:
使用できるのは、中国語文字、大文字と小文字の英字、数字、アンダースコア (_)、ハイフン (-) のみです。
長さは 64 文字以内にする必要があります。
[データソースコード]
データソースコードを設定すると、Flink SQL タスクで
data_source_code.table_nameまたはdata_source_code.schema.table_nameの形式でこのデータソースのテーブルを参照できます。現在の環境に対応するデータソースに自動的にアクセスするには、変数形式${data_source_code}.tableまたは${data_source_code}.schema.tableを使用します。詳細については、「Dataphin データソーステーブルを開発する」および「」をご参照ください。重要データソースコードは、一度構成すると変更できません。
データソースコードが構成された後でのみ、アセットディレクトリおよびアセットチェックリストのオブジェクト詳細ページでデータをプレビューできます。
Flink SQL では、現在、MySQL、Hologres、MaxCompute、Oracle、StarRocks、Hive、SelectDB、および GaussDB データウェアハウスサービス (DWS) のデータソースのみがサポートされています。
[データソースの説明]
データソースの説明です。最大 128 文字まで入力できます。
[タイムゾーン]
統合タスクの日付と時刻のデータは、選択されたタイムゾーンに基づいて処理されます。デフォルトのタイムゾーンは [Asia/Shanghai] です。 [Modify] をクリックして別のタイムゾーンを選択します。選択肢は次のとおりです:
[GMT]: [GMT-12:00]、[GMT-11:00]、[GMT-10:00]、[GMT-09:30]、[GMT-09:00]、[GMT-08:00]、[GMT-07:00]、[GMT-06:00]、[GMT-05:00]、[GMT-04:00]、[GMT-03:00]、[GMT-03:00]、[GMT-02:30]、[GMT-02:00]、[GMT-01:00]、[GMT+00:00]、[GMT+01:00]、[GMT+02:00]、[GMT+03:00]、[GMT+03:30]、[GMT+04:00]、[GMT+04:30]、[GMT+05:00]、[GMT+05:30]、[GMT+05:45]、[GMT+06:00]、[GMT+06:30]、[GMT+07:00]、[GMT+08:00]、[GMT+08:45]、[GMT+09:00]、[GMT+09:30]、[GMT+10:00]、[GMT+10:30]、[GMT+11:00]、[GMT+12:00]、[GMT+12:45]、[GMT+13:00]、[GMT+14:00]。
[夏時間]: [Africa/Cairo]、[America/Chicago]、[America/Denver]、[America/Los_Angeles]、[America/New_York]、[America/Sao_Paulo]、[Asia/Bangkok]、[Asia/Dubai]、[Asia/Kolkata]、[Asia/Shanghai]、[Asia/Tokyo]、[Atlantic/Azores]、[Australia/Sydney]、[Europe/Berlin]、[Europe/London]、[Europe/Moscow]、[Europe/Paris]、[Pacific/Auckland]、[Pacific/Honolulu]。
[データソース設定]
環境設定に一致する設定を選択します:
本番環境と開発環境を分けて使用する場合は、[Production + Development Data Source] を選択します。
それ以外の場合は、[Production Data Source] を選択します。
[タグ]
タグを使用すると、データソースを分類し、ラベル付けできます。タグの作成方法の詳細については、「データソースタグの管理」をご参照ください。
データソースの接続パラメーターを設定します。
[Production + Development Data Source] を選択した場合は、本番環境と開発環境の両方の接続情報を設定する必要があります。[Production Data Source] を選択した場合は、[Production Data Source] のみを設定する必要があります。
説明環境の分離を確保し、開発アクティビティが本番環境に影響を与えるのを防ぐために、本番データソースと開発データソースには異なるインスタンスを使用することを推奨します。
[Configuration Method] では、 [JDBC URL] (デフォルト) または [Host] のいずれかを選択します。
JDBC URL
パラメーター
説明
[JDBC URL]
接続 URL の形式は
jdbc:postgresql://host:port/dbnameです。[スキーマ]
ユーザー名に関連付けられているスキーマを入力します。
[ユーザー名]と[パスワード]
データベース認証用のユーザー名とパスワードを入力します。タスクが正しく実行されるように、アカウントに必要なデータ権限があることを確認してください。
Host
ホスト情報
パラメーター
説明
[サーバーアドレス]
サーバーの IP アドレスとポート番号を入力します。
[+ Add] をクリックして、複数の IP アドレスとポート番号のペアを追加します。
アイコンをクリックして、余分なペアを削除します。少なくとも 1 つのペアが必要です。[dbname]
データベース名を入力します。
パラメーター設定
パラメーター
説明
パラメーター
パラメーター名:既存のパラメーター名を選択するか、カスタム名を入力します。
カスタムパラメーター名には、大文字と小文字の英字、数字、ピリオド (.)、アンダースコア (_)、ハイフン (-) のみを使用できます。
パラメーター値:パラメーター名が選択されている場合、このフィールドは必須です。値には、大文字と小文字の英字、数字、ピリオド (.)、アンダースコア (_)、ハイフン (-) のみを使用でき、長さは 256 文字以内にする必要があります。
説明[+ Add Parameter] をクリックしてパラメーターを追加します (最大 30 個)。
アイコンをクリックしてパラメーターを削除します。[スキーマ]
ユーザー名に関連付けられているスキーマを入力します。
[ユーザー名]と[パスワード]
データベース認証用のユーザー名とパスワードを入力します。タスクが正しく実行されるように、アカウントに必要なデータ権限があることを確認してください。
説明設定方法として [Host] を選択し、データソース作成後に [JDBC URL] 方式に切り替えた場合、システムはサーバーの IP アドレスとポート番号を組み合わせて [JDBC URL] フィールドに自動的に入力します。
データソースの詳細設定を行います。
パラメーター
説明
[connectTimeout]
接続タイムアウト (秒)。デフォルトは 900 秒 (15 分) です。
説明JDBC URL に
connectTimeout設定が含まれている場合、その値が優先されます。[socketTimeout]
ソケットタイムアウト (秒)。デフォルトは 1800 秒 (30 分) です。
説明JDBC URL に
socketTimeout設定が含まれている場合、その値が優先されます。[接続の再試行]
接続がタイムアウトした場合、システムは指定された回数まで自動的に再試行します。すべての再試行が失敗した場合、接続は失敗と見なされます。
説明デフォルトの再試行回数は 1 です。この値は 0 ~ 10 の整数に設定できます。
接続の再試行回数は、デフォルトで オフライン統合タスクと [Global Quality] (Asset Quality 機能の有効化が必要) に適用されます。個々のオフライン統合タスクに対して、タスクレベルの再試行を設定できます。
説明パラメーターが複数の場所で定義されている場合、その値は次の優先順位に従って決定されます:
パラメーターが [JDBC URL]、[Advanced settings]、および [Host] 設定で定義されている場合、[JDBC URL] の値が使用されます。
パラメーターが [JDBC URL] と [Advanced settings] の両方で定義されている場合、[JDBC URL] の値が使用されます。
パラメーターが [Advanced settings] と [Host] 設定の両方で定義されている場合、[Advanced settings] の値が使用されます。
[Default resource group] を選択します。このリソースグループは、データベース SQL、オフラインのデータベース全体の移行、データプレビューなど、現在のデータソースに関連するタスクを実行するために使用されます。
[Test Connection] をクリックして接続をテストするか、[OK] をクリックして設定を保存し、TDSQL for PostgreSQL データソースを作成します。
[Test Connection] をクリックすると、Dataphin への接続が検証されます。[OK] を直接クリックすると、システムは選択されたすべてのクラスターに対して自動的に接続をテストします。すべての接続テストが失敗した場合でも、データソースは作成されます。
接続テスト は、デフォルトクラスター または Dataphin に登録済みかつ正常に稼働中の 登録済みスケジューリングクラスター に対して実行されます。デフォルトクラスター がデフォルトで選択され、解除することはできません。登録済みスケジューリングクラスターにリソースグループが未作成の場合、接続テストはサポートされません。接続テストを実行するには、まずリソースグループを作成してください。
選択されたクラスターは、現在のデータソースとのネットワーク接続性をテストする目的でのみ使用され、今後の関連タスク実行には使用されません。
接続テストは通常 2 分以内に完了します。タイムアウトした場合は、
アイコンをクリックして具体的な原因を確認し、再試行できます。テスト結果が 接続失敗、接続成功、または 警告あり接続成功 のいずれであっても、最終結果の生成時刻が記録されます。
説明デフォルトクラスター のテスト結果のみが、警告あり接続成功、接続成功、接続失敗 の 3 種類のステータスを含みます。登録済みスケジューリングクラスター のテスト結果は、接続成功 および 接続失敗 の 2 種類のみです。
テスト結果が 接続失敗 の場合、
アイコンをクリックして具体的な失敗原因を確認できます。テスト結果が 警告あり接続成功 の場合、アプリケーションクラスターへの接続は成功しましたが、スケジューリングクラスターへの接続に失敗しています。この状態では、現在のデータソースをデータ開発および統合に使用できません。
アイコンをクリックしてログ情報を確認できます。