すべてのプロダクト
Search
ドキュメントセンター

Dataphin:統合およびコンピューティングタスクインスタンスの管理

最終更新日:Aug 01, 2026

定期的な統合およびコンピューティングタスクは、スケジュールされたランタイムにインスタンスを生成します。これらのインスタンスは、実行ログの表示、再実行、現在または下流インスタンスの強制再実行、ノードコードの表示などによって管理できます。このトピックでは、統合およびコンピューティングタスクインスタンスの表示および管理方法について説明します。

前提条件

ガントチャートを表示するには、インテリジェント O&M 付加価値サービスを購入し、現在のテナントでインテリジェント O&M モジュールを有効にする必要があります。

統合およびコンピューティングインスタンスへのアクセス

  1. Dataphin ホームページの上部のナビゲーションバーで、[開発] > [タスク O&M] を選択します。

  2. 左側のナビゲーションウィンドウで、[インスタンス O&M] > [定期インスタンス] を選択します。

  3. 上部のナビゲーションバーで、本番環境または開発環境を選択します。

  4. [定期インスタンス] ページで、[統合とコンピューティング] タブをクリックします。

インスタンスリストでの操作

定期的な統合およびコンピューティングタスクがインスタンスを生成すると、そのインスタンスは [定期インスタンス] > [統合とコンピューティング] タブのリストに表示されます。リストには、インスタンスオブジェクト、インスタンス ID、ディレクトリ、ステータス、スケジューリング周期、ビジネス日付、スケジュール時刻、開始時刻、終了時刻、持続時間、再試行/自動再試行、優先度、所有者、プロジェクト、関連ベースラインインスタンス、HTTP パス、スケジューリングリソースグループ、タグ、および利用可能な操作など、各インスタンスの情報が表示されます。

  • [インスタンスオブジェクト]:定期タスクが実行されるたびにインスタンスオブジェクトが生成されます。この列には、インスタンスオブジェクトの名前と ID が表示され、タスクのスケジューリングメソッドが示されます。列名の横にある image.png アイコンをクリックすると、オブジェクトを名前の昇順または降順でソートできます。詳細については、「定期インスタンスのアイコンの説明」をご参照ください。

  • [ディレクトリ]:インスタンスが生成されたときのタスクディレクトリのスナップショットです。タスクディレクトリが変更されても、この情報は更新されません。ディレクトリ情報は、Dataphin V6.2 へのアップグレード後に生成されたインスタンスに対してのみ表示されます。権限のないディレクトリ内のインスタンスを操作しようとすると、システムはエラーを報告します。

  • [ステータス]:インスタンスの実行ステータスです。取りうるステータスには、成功、失敗、実行中、スケジュール時刻待ち、スロットリング中、スケジューリングリソース待ち、未実行があります。各ステータスの詳細については、「定期インスタンスの実行ステータスの説明」をご参照ください。

  • [開始時刻]:インスタンスが実行を開始した時刻です。列名の横にある image.png アイコンをクリックすると、開始時刻の昇順または降順でソートできます。

    説明

    論理テーブルノードの場合、開始時刻はインスタンスオブジェクトの最も早い内部実体化ノードが実行を開始した時刻です。

  • [終了時刻]:インスタンスが終了した時刻です。列名の横にある image.png アイコンをクリックすると、終了時刻の昇順または降順でソートできます。

    説明

    論理テーブルノードの場合、終了時刻はインスタンスオブジェクトの最も遅い内部実体化ノードが実行を終了した時刻です。

  • [再試行/自動再試行]:インスタンスの手動および自動再実行の回数です。ここで、再試行 = 実行回数 - 1 です。

  • [持続時間]:開始から終了までの経過時間です。列名の横にある image.png アイコンをクリックすると、持続時間の昇順または降順でソートできます。

    説明

    論理テーブルノードの場合、持続時間は最も早い内部実体化ノードの開始時刻と最も遅いノードの終了時刻の差です。

  • [優先度]:インスタンスの優先度レベルです。

    説明

    ベースライン機能が有効になっている場合、タスクの優先度は関連するベースラインの最高優先度に設定され、設定された優先度を上書きします。

  • [プロジェクト]:タスクが属するプロジェクトで、ProjectEnglishName(ProjectChineseName) のフォーマットで表示されます。

  • [関連ベースラインインスタンス]:インスタンスをエンドポイントノードとして保証するベースライン、および保証範囲内でインスタンスを上流ノードとして含む関連ベースラインです。

    説明

    ベースライン機能が有効になっていない場合、このフィールドは表示されません。

  • [HTTP パス]:選択された環境に基づいて、Databricks SQL インスタンスの本番環境または開発環境の HTTP パスを表示します。

    説明

    このフィールドは Databricks SQL インスタンスに対してのみ表示されます。他のタスクタイプでは - と表示されます。

  • [スケジューリングリソースグループ]:インスタンスが実行に使用するスケジューリングリソースグループの名前です。

    タスクに指定されたカスタムリソースグループが利用できない場合、プロジェクトのデフォルトリソースグループが使用されます。プロジェクトのデフォルトリソースグループも利用できない場合、テナントのデフォルトリソースグループが使用されます。優先順位は次のとおりです:カスタムリソースグループ > プロジェクトのデフォルトリソースグループ > テナントのデフォルトリソースグループ

    説明

    プロジェクトのデフォルトリソースグループを変更した後、更新された情報が表示されるまでに遅延が生じることがあります。ただし、タスクの実行には新しく指定されたリソースグループが使用されます。

    テナントのデフォルトリソースグループ:このリソースグループはどのプロジェクトにも属しません。各テナントにはデフォルトリソースグループが 1 つだけあります。タスクがカスタムリソースグループを指定せず、プロジェクトにデフォルトのリソースグループがない場合、テナントのデフォルトリソースグループがスケジューリングに使用されます。これは、SQL や仮想タスクなどの専用リソースタスクにのみ適用されます

次の表に、統合およびコンピューティングタスクインスタンスで利用可能な操作を示します。

操作

説明

DAG

image アイコンをクリックして、定期インスタンスの DAG を表示します。詳細については、「定期インスタンスの DAG」をご参照ください。

[実行ログの表示]

image アイコンをクリックして、定期インスタンスの実行ログを表示します。実行ログの内容はインスタンスタイプによって異なります。

[再実行]

image アイコンをクリックして、定期インスタンスを再実行します。[成功] または [失敗] ステータスの統合およびコンピューティングタスクインスタンスのみ再実行できます。インスタンスを再実行すると、システムはすべての上流ノードのステータスが [成功] であるかを確認します。このチェックに失敗した場合、インスタンスのステータスは即座に [未実行] に設定されます。

ビジネスシナリオでこのチェックに関わらず再実行が必要な場合は、強制再実行を実行できます。

[ガントチャートの表示]

image アイコンをクリックし、[ガントチャートの表示] を選択して [ガントチャートの表示] ダイアログボックスを開き、次のパラメーターを設定します。

  • [選択したノードを次として設定]:現在のノードを [開始ノード] または [終了ノード] として設定できます。[開始ノード] を選択すると、現在のノードが自動的に開始ノードとして設定され、変更できなくなります。[終了ノード] を選択した場合も同様です。

  • [開始ノード]:ガントチャートの開始ノードを選択します。キーワードでノードを検索できます。選択可能なノードは {ノード名}({ノード ID}, {インスタンスのスケジュールされたランタイム}) のフォーマットでリストされます。選択したノードを終了ノードとして設定した場合、開始ノードはデフォルトでテナントのルートノードになります。

    説明

    時間単位および分単位のタスクには複数のノードがあり、各インスタンスに 1 つずつあります。これらはスケジュールされたランタイムによって区別されます。

  • [終了ノード]:ガントチャートの終了ノードを選択します。キーワードでノードを検索できます。選択可能なノードは {ノード名}({ノード ID}, {インスタンスのスケジュールされたランタイム}) のフォーマットでリストされます。

    説明

    論理テーブルを終了ノードとして選択する場合、論理テーブルは単一のユニットとして扱われるため、特定のフィールドを選択することはできません。

ガントチャートの詳細については、「クリティカルパスのガントチャートの表示」をご参照ください。

[上流および下流ノードのダウンロード]

現在のノードの上流および下流ノードのリストをダウンロードします。リストには、現在 UI に表示されていない列もすべて含まれます。

[上流および下流ノードのダウンロード] をクリックします。[上流および下流ノードのダウンロード] ダイアログボックスで、上流および下流ノードのレベルを選択します。[レベル 1] から [レベル 10] または [すべてのレベル] を選択できます。両方のデフォルトはレベル 1 です。レベルを選択した後、[OK] をクリックして Excel ファイルのダウンロードを開始します。ファイル名は {task_name}_Upstream_and_Downstream_Nodes_{timestamp}.xlsx です。

[ノードコードの表示]

image アイコンをクリックし、[ノードコードの表示] を選択して現在のインスタンスのコードを表示します。Flink_SQL 統合およびコンピューティングタスクインスタンスの場合、論理コードと物理コードを切り替えることができます。

[論理コード]:作成したタスクコードです。

[物理コード]:Flink エンジンで実行するためにコンパイルされたコードです。

定期タスク

image アイコンをクリックし、[定期タスク] を選択して、現在のインスタンスが属する定期タスクを表示します。

[開発ノードの編集]

image アイコンをクリックし、[開発ノードの編集] を選択して、インスタンスの開発ページに移動して変更を加えます。

説明

この操作は、Dev-Prod モードを使用するプロジェクトの統合およびコンピューティングタスクインスタンスでのみ利用できます。

[本番ノードの表示]

image アイコンをクリックし、[本番ノードの編集] を選択して、インスタンスの本番ページに移動します。

説明

この操作は、Dev-Prod モードを使用するプロジェクトの統合およびコンピューティングタスクインスタンスでのみ利用できます。

[ノードの編集]

image アイコンをクリックし、[ノードの編集] を選択して、インスタンスを生成した統合およびコンピューティングタスクを編集します。このタスクには、Basic モードプロジェクトのインスタンスリストまたは DAG からアクセスできます。

説明

この操作は、Basic モードを使用するプロジェクトの統合およびコンピューティングタスクインスタンスでのみ利用できます。

下流の再実行

image アイコンをクリックし、[下流の再実行] を選択して、インスタンスの下流ノードを再実行します。[成功] または [失敗] ステータスの統合およびコンピューティングタスクインスタンスの下流ノードのみ再実行できます。[待機中 (スケジュール時刻待ち、スケジューリングリソース待ち)] または [実行中] ステータスの下流インスタンスは再実行できません。詳細については、「下流インスタンスの再実行」をご参照ください。

パイプライン全体を再実行するには、下流インスタンスの強制再実行を使用することを推奨します。詳細については、「下流インスタンスの強制再実行」をご参照ください。

[下流の再実行] 操作は、主に次のようなシナリオで使用されます:

  • 現在のインスタンスノードのデータが更新された後、下流ノードのデータを更新する必要がある場合。

  • 下流ノードが失敗した後、それらを再実行する必要がある場合。

[成功に設定してスケジューリングを続行]

image アイコンをクリックし、[成功に設定してスケジューリングを続行] を選択して、[失敗] または [未実行] の統合およびコンピューティングタスクインスタンスノードを手動で成功に設定し、スケジューリングを再開できるようにします。[成功に設定してスケジューリングを続行] をクリックし、[成功に設定してスケジューリングを続行] プロンプトダイアログボックスで [OK] をクリックして設定を完了します。

終了

image アイコンをクリックし、[終了] を選択して、現在実行中のインスタンスを終了します。そのステータスは [失敗] に変わります。インスタンスが終了すると、その下流ノードは実行されません。

説明

[成功][失敗]、または [未実行] の状態にあるインスタンスは終了できません。他の状態のインスタンスは終了できます。

[終了] 操作は、主に次のようなシナリオで使用されます:

  • Dataphin のエラーまたは操作ミスにより、統合およびコンピューティングタスクインスタンスを停止する必要がある場合。

  • 統合およびコンピューティングタスクインスタンスが実行中と表示されているが、データが生成されていない場合。手動で実行を終了し、ログを確認して問題をトラブルシューティングできます。

[強制再実行]

image アイコンをクリックし、[強制再実行] を選択し、[現在のインスタンスを強制再実行] または [下流インスタンスを強制再実行] のいずれかを選択します。

  • [現在のインスタンスを強制再実行]:上流ノードのステータスを確認せずにインスタンスを強制的に再実行します。上流ノードがすべて正常に実行されていない場合、現在のインスタンスの再実行が失敗したり、不正確なデータが生成されたりする可能性があります。注意して実行してください。現在のインスタンスを強制再実行すると、そのデータが更新されます。

  • [下流インスタンスを強制再実行]:この操作を実行すると、選択されたすべてのインスタンスが最初に [未実行] に設定され、上流ノードが再実行中に下流ノードが実行されることによるデータ競合を防ぎます。開始ノードのみが上流の依存関係とスケジュールされたランタイムのチェックをバイパスします。下流ノードは、引き続きその依存関係と起動条件に従います。詳細については、「下流インスタンスの強制再実行」をご参照ください。

重要

強制再実行では、すべての上流ノードが正常に実行されたか、またはインスタンスのスケジュールされたランタイムに達したかはチェックされません。これにより、実行の失敗やデータ品質の問題が発生する可能性があります。続行する前に、下流データに影響がないことを確認してください。

[上流依存関係の削除]

image アイコンをクリックし、[上流依存関係の削除] を選択して、実行ステータスに関係なく、統合およびコンピューティングタスクインスタンスから上流の依存関係を削除します。

重要

少なくとも 1 つの上流インスタンスを保持する必要があります。

[一時停止]

image アイコンをクリックし、[一時停止] を選択して、現在実行中のインスタンスを一時停止します。統合およびコンピューティングタスクインスタンスを一時停止しても、同じタスクの他のインスタンスには影響しません。インスタンスが一時停止されると、そのインスタンスとその下流の依存インスタンスはスケジュールされません。

説明
  • [未実行][スケジュール時刻待ち]、または [スロットリング中] の状態にあるインスタンスのみ一時停止できます。

  • [一時停止] 操作は、優先度の低いインスタンスを一時停止してリソースを解放し、優先度の高いタスクが先に実行されるようにするためによく使用されます。

再開

image アイコンをクリックし、[再開] を選択して、[一時停止中] の統合およびコンピューティングタスクインスタンスを再開します。再開後、インスタンスとその下流インスタンスは通常どおりスケジュールされます。

HTTP パスの変更

対応するタスクの本番 HTTP パスを変更します。本番プロジェクトに関連付けられたクラスター用に設定された任意の HTTP パスを選択できます。

説明

この操作は、本番環境で Databricks SQL タスクを選択した場合にのみサポートされます。

[スケジューリングリソースグループの変更]

image アイコンをクリックし、[スケジューリングリソースグループの変更] を選択して、インスタンスの実行に使用されるスケジューリングリソースグループを変更します。

説明
  • 複数のプロジェクトからタスクを選択した場合、ターゲットのスケジューリングリソースグループリストには、選択されたすべてのプロジェクトで共有され、承認されているリソースグループのみが表示されます。この一括操作を実行する前に、単一のプロジェクトでフィルターをかけることを推奨します。

  • この変更は現在のインスタンスにのみ影響し、同じタスクの他のインスタンスには影響しません。

[優先度の変更]

image アイコンをクリックし、[優先度の変更] を選択します。[優先度の変更] ダイアログボックスで、現在のタスクの優先度を変更します。[最高][高][中][低]、または [最低] を選択できます。

DAG ノードの操作

DAG は、インスタンスノードの上流および下流の依存関係を明確に可視化します。また、システムでは上流および下流のインスタンスノードを管理することもできます。デフォルトでは、DAG はメインノード (選択されたノード) とその第 1 レベルの上流および下流ノードを表示します。統合およびコンピューティングタスクインスタンスノードを選択して、関連する O&M 操作を実行できます。

Dataphin は、異なるプロジェクト間での O&M をサポートしています。別のプロジェクトの統合およびコンピューティングタスクノードで O&M を実行するには、インスタンスが配置されているプロジェクトの表示および操作権限が必要です。

  • DAG ビューでの操作

    操作

    説明

    親ノードを展開

    DAG 内のメインノードの異なるレベルの依存ノードを展開します。

    [子ノードの展開]

    タスクの表示

    現在のインスタンスノードを生成したタスクの DAG に移動します。ここでは、タスクノードの詳細、上流および下流の情報を表示し、O&M を実行できます。詳細については、「定期タスク」をご参照ください。

    [操作ログの表示]

    このインスタンスで実行された操作のログを表示します。

  • DAG ノードの操作

    DAG ノードにカーソルを合わせると、その名前、タイプ、スケジューリング周期、所有者、および説明が表示されます。統合およびコンピューティングタスクインスタンスの DAG ノードで利用可能な操作は、インスタンスリストの操作と同じです。詳細については、「インスタンスリストでの操作」をご参照ください。

バッチ操作

次の表に、定期的な統合およびコンピューティングタスクでサポートされているバッチ操作を示します。

操作

説明

[再実行]

  • この操作は、[成功] または [失敗] ステータスのインスタンスでのみサポートされます。

  • 選択したインスタンスのいずれも [成功] または [失敗] ステータスでない場合、バッチ再実行操作は利用できません。選択範囲に [成功] または [失敗] ステータスのインスタンスと他のステータスのインスタンスが含まれている場合、システムは [成功] または [失敗] ステータスのインスタンスのみを再実行します。

終了

  • [成功][失敗]、または [未実行] ステータスのインスタンスは終了できません。他のステータスのインスタンスは終了できます。

  • 選択したすべてのインスタンスが [成功][失敗]、または [未実行] ステータスの場合、バッチ終了操作は利用できません。選択範囲にこれらのステータスのインスタンスと他のステータスのインスタンスが含まれている場合、システムは [成功][失敗]、または [未実行] ステータスのインスタンスを終了しません。

[成功に設定してスケジューリングを続行]

複数のインスタンスを選択した後、統合およびコンピューティングタスクインスタンスのステータスを [失敗] または [未実行] から [成功] に手動で設定し、スケジューリングを続行できるようにします。

[一時停止]

  • この操作は、[未実行][スケジュール時刻待ち]、または [スロットリング中] ステータスのインスタンスでのみサポートされます。

  • 選択したインスタンスのいずれも [未実行][スケジュール時刻待ち]、または [スロットリング中] ステータスでない場合、バッチ一時停止操作は利用できません。選択範囲にこれらのステータスのインスタンスと他のステータスのインスタンスが含まれている場合、システムは [未実行][スケジュール時刻待ち]、または [スロットリング中] ステータスのインスタンスのみを一時停止します。

[再開]

[一時停止中] ステータスの複数の定期インスタンスを再開します。

[HTTP パスの変更]

複数の Databricks SQL インスタンスの本番 HTTP パスを変更します。選択したインスタンスが異なる Databricks クラスターに属している場合、各クラスターに異なる HTTP パスを指定できます。対応するクラスター用に設定された任意の HTTP パスを選択できます。

説明

この操作は、本番環境で Databricks SQL インスタンスを選択した場合にのみサポートされます。

スケジューリングリソースグループの変更

インスタンスの実行に使用されるスケジューリングリソースグループを変更します。

説明
  • 本番環境プロジェクトのインスタンスのスケジューリングリソースグループのみ変更できます。

  • この変更は現在のインスタンスにのみ影響し、同じタスクの他のインスタンスには影響しません。

[優先度の変更]

選択したインスタンスの優先度を変更します。[最高][高][中][低]、または [最低] を選択できます。

[すべてダウンロード]

これをクリックするとダウンロードタスクが送信され、システムはバックグラウンドで非同期にファイルを生成します。生成されると、ファイルは自動的にローカルマシンにダウンロードされます。ファイルは .xlsx 形式で、名前は Dataphin_periodic_instances_{timestamp}.xlsx です。

ファイルには次の情報が含まれます:インスタンスオブジェクト、インスタンス ID、ステータス、スケジューリング周期、ビジネス日付、優先度、所有者、プロジェクト (複数のプロジェクトを持つサマリー論理テーブルの場合、プロジェクト名はカンマで区切られます)、スケジュール時刻、開始時刻、終了時刻、持続時間、再試行/自動再試行、関連ベースラインインスタンス (インスタンスに関連付けられたベースラインの名前、カンマで区切られます)、およびスケジューリングリソースグループ (このフィールドはモデリングタスクインスタンスでは空です)。

下流インスタンスの再実行

  1. [下流の再実行] ダイアログボックスで、パラメーターを設定します。

    説明

    [待機中] または [実行中] ステータスの下流インスタンスは再実行できません。パイプライン全体を再実行するには、下流インスタンスの強制再実行を使用することを推奨します。詳細については、「下流インスタンスの強制再実行」をご参照ください。

    パラメーター

    説明

    [開始ノードの実行モード]

    開始ノードの実行方法を定義します。[ドライラン] または [通常実行] を選択できます。

    • [ドライラン]:インスタンスのステータスが [成功] に設定され、通常のスケジューリングが続行されますが、実行ログは空で、持続時間はなく、データは処理されません。

    • [通常実行]:インスタンスは通常どおりスケジュールされ、実行されます。

    下流の再実行範囲

    再実行する下流ノードの範囲を選択します。

    • すべての失敗したインスタンス:システムは、特定のリストを表示することなく、失敗したすべての下流インスタンスを自動的に選択して再実行します。

    • [カスタム]:再実行する下流インスタンスを指定する必要がある場合は、このオプションを選択します。ノード名または ID で検索し、ステータス、所有者、またはプロジェクトでフィルターできます。

  2. [OK] をクリックします。

  3. 下流インスタンスが再実行されると、そのデータが更新されます。

下流インスタンスの強制再実行

  1. [下流の強制再実行] ダイアログボックスで、パラメーターを設定します。

    パラメーター

    説明

    [開始ノードの実行モード]

    開始ノードの実行方法を定義します。[ドライラン] または [通常実行] を選択できます。

    • [ドライラン]:インスタンスのステータスが [成功] に設定され、通常のスケジューリングが続行されますが、実行ログは空で、持続時間はなく、データは処理されません。

    • [通常実行]:インスタンスは通常どおりスケジュールされ、実行されます。

    下流強制再実行の範囲

    強制再実行する下流ノードの範囲を選択します。

    • [すべてのインスタンス]:開始ノードのすべての下流インスタンスを選択します。

    • [カスタム]:再実行する下流インスタンスを指定する必要がある場合は、このオプションを選択します。ノード名または ID で検索し、ステータス、所有者、またはプロジェクトでフィルターできます。

  2. [OK] をクリックして設定を完了します。