すべてのプロダクト
Search
ドキュメントセンター

DataWorks:O&M ダッシュボード

最終更新日:Aug 23, 2026

運用保守ダッシュボードは、自動トリガーノードの安定性評価、主要メトリクス、およびリソース使用量の概要を提供します。また、手動トリガーノードと Data Integration の同期タスクの運用詳細も表示します。ワークスペース内のすべてのタスクを俯瞰できるこの概要により、問題を迅速に特定・解決し、運用保守効率を向上できます。

使用上の注意

O&M ダッシュボードでは、ワークスペース内の自動トリガーされたノード手動でトリガーされたノード、およびData Integration タスクの運用状況を、次の観点から確認できます。

  • 指定したワークスペース:選択したワークスペースの O&M 概要を表示します。このビューでは、ワークスペース全体の O&M サマリーと、Data Integration の同期タスクの O&M 詳細を個別に確認できます。

  • すべてのワークスペース:現在のアカウント配下にあるすべてのワークスペースの O&M 概要を表示します。このビューでは、[Data Integration] の同期タスクの O&M 詳細を個別に確認することはできません。

制限

  • O&M ダッシュボードは、標準モードのワークスペースの開発環境では使用できません。

    説明

    オペレーションセンターのトップメニューバーで、本番 環境と 開発者 環境を切り替えることができます。

  • [自動トリガーノード] タブ: 自動トリガーノードとそのインスタンスの O&M データのみを表示します。その他のタイプのタスクとインスタンスのデータは表示されません。

  • [手動トリガーノード] タブ: 手動トリガーワークフローとその内部ノードインスタンスの O&M データのみを表示します。

  • [Data Integration] タブ: Data Integration のバッチ同期およびリアルタイム同期タスクの O&M データのみを表示します。

O&M ダッシュボードへのアクセス

DataWorks コンソールにログインします。 左側のナビゲーションウィンドウで、[データモデリングと開発] > [オペレーションセンター] を選択します。 表示されるページで、ドロップダウンリストから目的のワークスペースを選択し、[オペレーションセンターに移動] をクリックします。

自動トリガーノードの運用保守

定期タスク タブには、安定性評価、主要な問題、インスタンスステータス分布、インスタンス完了ステータス、スケジューリングリソースグループのリソース使用量など、運用保守の概要が表示されます。

運用保守の安定性評価

システムは、タスクの全体的な実行ステータスに基づいて、ワークスペースの運用安定性を評価します。

ワークスペース

[単一のワークスペース]

[すべてのマイワークスペース]

安定性チャート

image

すべてのワークスペースの名前、安定性評価レベル、自動トリガーインスタンス数、自動トリガーインスタンス完了率、およびワークスペースの健全性を一覧表示します。このリストはページ分割に対応しています。ワークスペースの右側にある 詳細を表示 をクリックすると、その単一ワークスペースの運用保守の詳細が開きます。

説明

安定性は「優秀」、「良好」、「普通」、「不良」として評価されます。「高リスク」などのリスクラベルは、健全性が低い状態を示しており、迅速な対応と最適化が必要です。

  • ページ上部で [すべてのマイワークスペース] ビューに切り替えると、参加しているすべてのワークスペースの運用保守の安定性、自動トリガーインスタンス数、およびインスタンス完了ステータスを表示できます。

  • また、特定のワークスペースの 操作 列にある 詳細を表示 をクリックして、その運用保守の安定性の詳細を表示することもできます。

主要な問題

このセクションでは、スマートベースラインと例外統計に基づき、ワークスペース全体および個人の両方の観点から、自動トリガーノードの運用上の例外に焦点を当てています。ワークスペース内の全体的な問題、または自身が所有するタスクに関連する問題のみを表示できます。これにより、問題を迅速に特定して解決し、ビジネスへの影響を防ぐことができます。

問題の種類

説明

関連ドキュメント

図解

時間超過のベースラインインスタンス

本日時間超過しているベースラインインスタンスの数です。

インスタンスの推定完了時間がベースラインのコミット時間を超えると、時間超過となり、アラートがトリガーされます。

ベースラインインスタンス

時間超過のベースラインインスタンスアラート状態のベースラインインスタンスエラーイベント低速化イベントの数 (それぞれ前日比および前週比の変化付き) と、孤立ノード凍結ノード期限切れノード本日変更されたノードの数という 8 つの主要メトリクスをカードとして表示します。[すべて] ビューと マイページ ビューを切り替えることができます。

アラート状態のベースラインインスタンス

本日アラート状態にあるベースラインインスタンスの数です。

アラートマージンは、複雑な依存関係のシナリオで重要なデータが時間通りに生成されることを保証するのに役立ちます。アラートマージンを超えると、ノードが時間通りに完了できず、例外が発生する可能性があります。

ベースラインのコミット時間とアラートマージン

エラーイベント

本日発生したエラーイベントの数です。

タスクがベースラインによって監視されている場合、実行の失敗はエラーイベントを生成します。失敗したタスクは下流の依存関係をブロックする可能性があるため、正常な運用を保証するために迅速に解決する必要があります。

イベント管理

低速化イベント

本日発生した低速化イベントの数です。

低速化イベントは、ベースラインで監視されているタスクの実行時間が過去の平均と比較して大幅に増加した場合に発生します。

孤立ノード

上流の依存関係がない自動トリガーノードの数です。

上流の依存関係がない自動トリガーノードは孤立ノードとなり、自動的に実行されなくなります。

孤立ノード

凍結ノード

凍結 (一時停止) 状態にある自動トリガーノードの数です。

自動トリガーノードが凍結されると、そのインスタンスも凍結されます。凍結されたインスタンスは実行されず、下流の依存関係をブロックします。

タスクの凍結と凍結解除

期限切れノード

スケジューリング有効期間が終了した自動トリガーノードの数です。

ノードは、スケジューリング有効期間内に自動トリガーインスタンスを自動的に生成して実行します。この期間外では、インスタンスは生成もスケジューリングもされません。

なし

本日変更されたノード

本日変更された自動トリガーノードの数です。

  • 変更操作:コード、スケジューリング設定、ノードステータス、ノード所有者の変更が含まれます。

  • 範囲:DataStudio で行われ、本番環境にデプロイされた変更、および本番環境の自動トリガーノードへの直接の変更が含まれます。

説明

マイページ ビューに切り替えると、このメトリクスは自分が所有する変更されたノードの数をカウントします。

なし

自動トリガーインスタンスとノードの概要

次の表では、自動トリガーインスタンスとノードの運用保守の概要について説明します。

メトリクス

説明

図解

[定期インスタンスの実行状態別分布]

  • 範囲:現在のワークスペースまたは自分が所有するインスタンスについて、特定のデータタイムスタンプにおける自動トリガーインスタンスのステータス分布を表示します。データはページリクエスト時の状態を反映します。

  • 表示方法:円グラフのセグメントをクリックすると、その状態のインスタンスの数と割合が表示されます。

  • 注意すべきインスタンスの状態

    • 失敗:失敗したインスタンスは、下流の依存タスクをブロックする可能性があります。

    • 凍結:凍結されたインスタンスは実行されず、下流の依存関係をブロックします。

    • 低速実行:実行中のインスタンスの実行時間が過去 10 日間の平均実行時間を 15 分以上超えた場合、低速実行と見なされます。過去のインスタンスが 4 つ未満の場合、実行時間が 30 分を超えると低速実行と見なされます。

説明

このメトリクスには 通常のタスク のみが含まれ、ドライランタスクと凍結タスクは除外されます。

实例运行状态分布

[定期インスタンスの完了状況]

  • 範囲:現在のワークスペースにおける、当日のうち 00:00 から 23:00 までの自動トリガーインスタンスの完了ステータス (成功または未実行のインスタンス数) を、前日および過去の平均と比較して表示します。

  • 表示:折れ線グラフは、今日、昨日、および過去の平均の完了トレンドを示します。線と線の間に大きな乖離がある場合は、さらなる調査が必要な異常を示している可能性があります。

  • ノードタイプ:ノードタイプで結果をフィルターできます。

  • 過去の平均:これは過去 10 日間の平均完了ステータスです。

周期实例完成情况

[定期インスタンスと定期タスクの傾向]

範囲:選択したデータタイムスタンプの範囲における、本番環境の自動トリガーノードとインスタンス数の傾向を表示します。最大で過去 1 年間のデータを表示できます。

周期实例与周期任务趋势

[タスクの分布状況]

  • 範囲:ノードタイプやスケジューリング周期などのディメンションごとに分類した、自動トリガーノードの数と割合を表示します。データはページリクエスト時の状態を反映します。

  • 表示:円グラフで表示できるカテゴリ数には制限があります。タイプ数が制限を超えた場合、それらはまとめてグループ化されます。

説明

[すべてのマイワークスペース] ビューでは、ワークスペースごとの自動トリガーノードの分布を確認できます。

任务分布情况

スケジューリングリソースグループの使用状況

このセクションでは、選択したスケジューリングリソースグループの使用率 (グループ上で実行されているインスタンスが使用するリソースの割合) と、指定した期間におけるグループ上で実行されているインスタンス数の傾向を表示します。

説明
  • 最大 7 日間のデータを表示できます。

  • リソース使用量が 80% を超える場合は、リソース不足がタスク実行に影響を与えるのを防ぐために、リソースグループをスケールアウトすることを推奨します。

  • リソース使用量と実行中のインスタンス数は、リソースグループレベルで測定されます。たとえば、複数のワークスペースで共有されている専用スケジューリングリソースグループを使用する場合、このチャートには、それらすべてのワークスペースにわたる合計リソース使用量とインスタンス数の傾向が表示されます。

调度资源组使用情况

自動トリガーインスタンスのランキング

  • [昨日の定期インスタンスランキング]

    このセクションでは、前日の自動トリガーインスタンスの Top 30 を、実行時間、リソース待機時間、および低速実行時間でランク付けします。このランキングを使用して、時間のかかるタスクをすばやく見つけることができます。[インスタンス ID] をクリックすると、インスタンス詳細ページに移動し、その実行診断を表示できます。

    説明

    低速実行時間:これは、インスタンスの昨日の実行時間と過去の平均との差です。インスタンスはこの差の降順でソートされます。

  • [過去 1 か月でエラー率が最も高かった自動トリガーインスタンスのランキング]

    このセクションでは、過去 1 か月間のエラー率によって自動トリガーインスタンスをランク付けし、Top 30 のタスクを表示します。これを使用して、エラー率の高いタスクをすばやく特定し、その詳細を表示してエラーの原因を見つけることができます。

手動トリガーノード

ワンタイムタスク タブには、手動トリガーワークフローとその内部タスクインスタンスの実行ステータスが表示されます。

手動タスクの概要

このセクションには、指定した日付から実行を開始した、手動トリガーワークフローと内部タスクインスタンスの合計数、およびそれらの成功率が表示されます。

image

ワークフローインスタンスの実行ステータス

メトリクス

説明

[業務フローインスタンスのステータス別分布]

円グラフには、指定した実行日における、手動トリガーワークフローインスタンスの実行ステータス別の分布が表示されます。

  • セグメントをクリックすると、その状態のタスクの詳細ページに移動し、問題を確認して対処できます。 [実行失敗] のタスクには特に注意してください。

  • 最大 7 日間のデータを表示できます。

  • マイページ ビューに切り替えると、このグラフには自身が所有する、手動トリガーワークフローインスタンスのステータス分布が表示されます。

image

[ビジネスフローランキング]

指定した実行日における、実行時間と失敗数でワークフローをランキングします。

  • このランキングを使用して、低速または失敗率の高いワークフローを迅速に見つけることができます。 タスク ID をクリックすると、 手動トリガーワークフローインスタンス 詳細ページが開きます。そこで、ワークフローの [DAG グラフ] 内の特定のインスタンスの 実行診断 を表示して、その実行ステータスを確認できます。

  • 上位 30 件のワークフローのみが表示されます。

手動トリガーワークフローのランキングが、順位、ワークフロー名、作成者、実行時間などのフィールドとともに一覧表示されます。ソートディメンションを [実行時間][失敗数] の間で切り替えたり、実行日でフィルターしたりできます。

内部タスクインスタンスの実行ステータス

メトリクス

説明

[内部タスク分布]

円グラフには、オペレーションセンター内の内部タスクインスタンスのリアルタイム分布が、ノードタイプ所有者 別に表示されます。

image

[内部タスクランキング]

指定した実行日における、実行時間と失敗数で内部タスクインスタンスをランキングします。

  • このランキングを使用して、低速または失敗率の高い内部タスクインスタンスを迅速に見つけることができます。 タスク ID をクリックすると、 手動トリガーワークフローインスタンス 詳細ページに移動します。詳細ページでは、ワークフローの [DAG グラフ] 内の特定のインスタンスの 実行診断 を表示して、その実行ステータスを確認できます。

  • 上位 30 件の内部タスクのみが表示されます。

内部タスクのランキングが、順位、ノード ID、ノード名、ワークフロー、ノードタイプ、作成者、実行時間などのフィールドとともに一覧表示されます。ソートディメンションを [実行時間][失敗数] の間で切り替えることができます。

Data Integration タスク

Data Integration タブには、昨日 または 今日 の Data Integration 同期タスクとリソースグループの使用状況の概要が表示されます。

Data Integration リソースグループの使用状況

このセクションには、現在のワークスペース内のすべての Data Integration タスクのリソース詳細が表示されます。これには、実行中のタスク数リソース使用率有効期限 が含まれます。リソース使用率とタスク量を使用して、最適な割り当てのためにリソースをスケールアップまたはスケールダウンするかどうかを判断できます。また、リソースグループ名、ステータス、キューに入っているタスク数、仕様、リージョンなどの情報も表示され、[表示][更新][リソースグループの作成] のエントリポイントが用意されています。

説明

Data Integration 同期タスクの実行ステータス分布

円グラフには、現在のワークスペース内の同期タスクの実行ステータス別の分布が表示されます。セグメントをクリックすると、その状態のタスクの詳細ページに移動し、問題を確認して対応できます。異常 および 実行失敗 のタスクには特に注意してください。これらは下流タスクの実行をブロックすることがよくあります。运行状态分布

バッチ同期タスクの実行ステータス

次の表は、バッチ同期タスクの実行ステータスについて説明しています。

メトリクス

説明

表示例

[データ同期の進捗]

選択したデータタイムスタンプにおけるバッチ同期に使用されたデータの合計量と合計トラフィックを表示します。

3 つのバッチ同期進行状況メトリクスがカードとして表示されます:[合計データ量][パブリックネットワークトラフィック合計][合計レコード数]

[同期データ量の統計]

選択したデータタイムスタンプにおける、データソースタイプ別のデータ読み取りおよび書き込み曲線を表示します。これにより、大量のデータを処理するエンジンタスクを迅速に特定し、より多くのリソースが必要かどうかを判断できます。

离线数据同步任务数据统计量

[最新ランキング Top10]

最新の 最新の失敗したインスタンス最新の成功インスタンス の上位 10 件を表示し、最新の同期タスクステータスの全体像を把握できます。エラーメッセージを使用して、失敗の原因を迅速に特定して解決できます。

[最近の失敗インスタンス][最近の成功インスタンス] が、ノード名、ノード ID、開始時刻、終了時刻、エラーメッセージなどのフィールドとともに一覧表示されます。

[同期タスクの実行詳細]

コミット日時タスクステータスタスク名 などの条件でフィルタリングして、タスクインスタンスを迅速に検索し、その実行詳細を表示できます。

同期タスクの実行詳細が、インスタンス ID、ノード名、開始時刻、終了時刻、実行時間、ソースおよび宛先データソース、同期データ量、同期レコード数、同期速度などのフィールドとともに一覧表示されます。実行日、ノードステータス、ノード名でフィルタリングできます。

リアルタイム同期タスクの実行ステータス

次の表は、リアルタイム同期タスクの実行ステータスについて説明しています。

メトリクス

説明

表示例

データ同期[概要]

現在のワークスペース内のすべてのリアルタイム同期タスクの合計データ速度とレコード速度を表示します。

2 つのリアルタイム同期概要メトリクスがカードとして表示されます:[データ速度 (BPS)][レコード速度 (RPS)]

[レイテンシーが最も高い上位 10 タスク]

レイテンシーが最も高いリアルタイム同期タスクの上位 10 件を表示し、迅速に特定して最適化できるようにします。

レイテンシーが最も高いリアルタイム同期タスクが、ノード名、ビジネスレイテンシー、リソースグループ情報とともに一覧表示されます。

[アラーム情報]

リアルタイム同期タスクからの最近のアラート情報を表示し、例外を迅速に検出して解決できるようにします。

アラートレコードが、発生時刻、ノード ID、ノード名、受信者、アラートタイプ (CRITICAL または WARNING)、トリガー条件、しきい値、アラート時刻、通知方法などのフィールドとともに一覧表示されます。

[フェイルオーバー情報]

指定した期間内のリアルタイム同期タスクの フェイルオーバー メッセージを表示し、タスクの フェイルオーバー ステータスの概要を把握できます。フェイルオーバー の詳細については、「リアルタイム同期タスクの実行と管理」をご参照ください。

指定した期間内の フェイルオーバー レコードが、時刻、インスタンス ID、ノード名、フェイルオーバーイベント、アクションなどのフィールドとともに一覧表示されます。