すべてのプロダクト
Search
ドキュメントセンター

DataWorks:MaxCompute へのデータ同期

最終更新日:Jul 18, 2026

DataWorks 同期ノードを使用して、単一の Hologres テーブルから MaxCompute へデータを移行し、効率的なビッグデータストレージとパフォーマンス専有型処理を実現します。

前提条件

制限事項

同期ノードの設定

同期ノードの構成タブで、以下の設定項目を構成します。

Hologres ソースの選択

Hologres ソーステーブルを選択して構成します。

パラメーター

説明

ソースオブジェクトタイプ

デフォルト値は Hologres Table です。

データソース

データを同期する Hologres コンピューティングリソースを選択します。

インスタンス

このフィールドには、Hologres インスタンスの ID が自動的に入力されます。

データベース

同期する Hologres データベースを選択します。

スキーマ

同期するスキーマを選択します。

テーブル

同期するテーブル名を選択します。

フィルター条件

パーティションテーブルに基づいてフィルター条件が自動生成されます。必要に応じて条件を変更できます。フィルター条件を満たすデータが保持されます。

説明

フィルター条件とは、SQL ステートメントの WHERE 句以降の部分です。

MaxCompute 送信先の設定

MaxCompute 送信先テーブルを構成します。

パラメーター

説明

データソース

送信先の MaxCompute コンピューティングリソースを選択します。

プロジェクト

データソースに対応する MaxCompute プロジェクトです。この値はシステムによって自動入力されます。

スキーマ

データを格納するスキーマを選択します。このパラメーターは、3 レイヤーモデルが有効化された MaxCompute プロジェクトでのみ使用可能です。

テーブル

MaxCompute 内部テーブルの名前を指定します。

ライフサイクル

テーブルのライフサイクルを設定します。指定された期間内にデータが変更されない場合、MaxCompute はそのテーブルを回収します。

フィールド

フィールドの同期

同期するフィールドを選択し、送信先の MaxCompute テーブルにおける各フィールドのデータ型を設定します。

パーティション設定

MaxCompute の内部テーブルのパーティション列を指定します。パーティションデータは以下のいずれかのソースから取得できます。

  • 指定した holo フィールド: Hologres テーブルの特定のフィールドをパーティション列データのソースとして選択します。

  • 設定済みの スケジューリング変数:タスクのスケジューリング変数を使用してパーティション列を定義します。

データ同期の構成

データ同期設定セクションで、インポート方法および Hologres インスタンスへのアクセス権限を構成します。

パラメーター

説明

インポート方式

以下のいずれかのインポート方法を選択します。

  • 上書き:既存のデータを削除し、新しいデータを送信先テーブルに書き込みます。

  • 追記:既存のデータを保持したまま、新しいデータを送信先テーブルに追加します。

Hologres へのアクセス権限

Hologres インスタンスへのアクセス方法として、以下のいずれかを選択します。

  • 二重署名アクセス:現在の ID を使用して Hologres の権限チェックを通過します。

    MaxCompute プロジェクト内で、MaxCompute テーブルに対する読み取り権限および対応する Hologres ソーステーブルに対する権限が必要です。MaxCompute 権限の詳細については、「Data Lakehouse 2.0 ユーザーガイド」をご参照ください。Hologres 権限の詳細については、「権限管理の概要」をご参照ください。

  • RAM ロールアクセス:指定した RAM ロールを使用して本人確認を行います。

    RAM ロールに AliyunSTSAssumeRoleAccess ポリシーを付与する必要があります。詳細については、「RAM ロール権限付与モード」をご参照ください。権限付与が完了したら、Ramロール フィールドに指定した RAM ロールを構成します。

場所

同期中に、システムは Hologres 外部ストレージパスに基づいて MaxCompute テーブルを自動作成します。システムが生成したデフォルトのストレージパスを使用するか、カスタムパスを指定できます。

同期ノードのデバッグ

ノードを実行する前に、デバッグ設定を構成します。

  1. デバッグ実行のプロパティを構成します。

    ノード構成タブの右側にある デバッグの構成 ペインで、計算リソース および リソースグループ を構成します。以下の表にパラメーターの説明を示します。

    パラメーター

    説明

    計算リソース

    バインド済みの MaxCompute コンピューティングリソースを選択します。

    コンピューティングクォータ

    MaxCompute プロジェクト作成時に生成されたコンピューティングクォータを選択するか、ドロップダウンリストの下部にある コンピューティングクォータの作成 をクリックして新規作成します。詳細については、「コンピューティングリソース - クォータ管理」をご参照ください。

    リソースグループ

    MaxCompute コンピューティングリソースをバインドする際に接続性テストに合格したリソースグループを選択します。

    スケジューリング CU

    このノードではデフォルトのスケジューリング CU 値が使用されます。変更する必要はありません。

    パラメーター

    フィルター条件に ${Parameter name} 形式の変数を使用する場合は、スクリプトパラメーター セクションの パラメーター名 および パラメーター値 でその値を定義する必要があります。ランタイムに、システムはこれらの変数を構成済みの値に動的に置き換えます。詳細については、「ノードスケジューリング構成」をご参照ください。

  2. ノードタスクをデバッグして実行するには、保存 をクリックした後、実行 をクリックします。

次のステップ

  • ノードを定期的に実行するには、右側の スケジューリング設定 ペインでスケジューリングプロパティを構成します。スケジューリングポリシー および関連するスケジューリングプロパティを設定します。「ノードスケジューリング構成」をご参照ください。

  • 本番環境でタスクを実行するには、image アイコンをクリックしてデプロイメントプロセスを開始します。プロジェクト内のノードは、本番環境にデプロイされた後にのみスケジュールに従って実行されます。「ノードデプロイメント」をご参照ください。

よくある質問

  • フィールドの型不一致:同期タスクがデータ型の不一致により失敗した場合は、MaxCompute テーブル内のフィールドデータ型が正しく構成されているか確認してください。

  • 同期された単一パーティション内のデータ不整合:ソースのフィルター条件が正しく構成されているか確認してください。