すべてのプロダクト
Search
ドキュメントセンター

Managed Service for Prometheus:Flink のメトリック

最終更新日:Aug 25, 2026

Managed Service for Prometheus は、Alibaba Cloud Realtime Compute for Apache Flink から収集される一連の Flink メトリックをサポートしています。各メトリックは基本メトリックまたはカスタムメトリックのいずれかであり、その分類によってメトリックのレポートに料金が発生するかどうかが決まります。

メトリックのタイプと課金

Managed Service for Prometheus は、書き込まれたデータ量またはレポートされたデータポイントの数に基づいて課金されます。メトリックは 2 つのカテゴリに分類されます。

  • 基本メトリック — Alibaba Cloud Realtime Compute for Apache Flink から収集された基本メトリックは、Managed Service for Prometheus にレポートまたは書き込まれる際に無料です。この特典は、セルフマネージド Flink などの他の Flink サービスには適用されません。

  • カスタムメトリック — 基本メトリック以外のメトリックはカスタムメトリックです。カスタムメトリックは 2020 年 1 月 6 日から課金対象となっています。

    本トピックの各テーブルの Type 列には、メトリックが属するカテゴリが記載されています。基本メトリックは、JobManager と TaskManager の JVM およびシステムリソースのセクションに集中しています。残りのセクションのメトリックはカスタムメトリックであるため、ジョブのヘルス状態、レイテンシー、スループット、チェックポイント、ステート、ウィンドウ、および CDC コネクタのデータはレポート時に課金されます。2 つの JVM セクション内では、隣接するメトリックが基本メトリックであっても、8 つの G1 ガベージコレクターメトリックはカスタムメトリックです。

メトリックテーブルの読み方

本トピックのすべてのメトリックテーブルでは、同じ 5 つの列が使用されています。

  • メトリック — Managed Service for Prometheus にレポートされるメトリック名。

  • 説明 — メトリックが測定する内容。

  • 詳細 — 値の解釈方法、または値が異常に見える場合に確認すべきこと。

  • 単位 — メトリック値の単位。本トピックで使用される値は、CountCount/sBytesBytes/sms、および ns です。

  • タイプ — メトリックのカテゴリ:Basic または Custom

    N/A は、本トピックがそのセルに対して値を提供しないことを意味します。Unit 列の N/A は、そのメトリックに単位が文書化されていないことを意味します。

一部のメトリック名には、メトリックがレポートされるときに置き換えられる可変セグメントが含まれているため、テーブル内の名前は時系列の実際の名ではありません。state_name はメトリックが適用されるステートの名前を表し、cdcns_schema_table は監視対象テーブルの CDC 名前空間、スキーマ名、およびテーブル名を表します。クエリやアラートルールでメトリック名を使用する前に、これらのセグメントを実際の値に置き換えてください。

ジョブのヘルス状態

メトリック説明詳細単位タイプ
flink_jobmanager_job_numRestartsエラーによるジョブの再起動回数ジョブエラーによる再起動回数。JobManager のフェールオーバーはカウントされません。CountCustom
flink_jobmanager_job_uptimeジョブの実行時間N/AmsCustom
flink_jobmanager_numRunningJobs実行中のジョブの数N/AN/ACustom
flink_jobmanager_taskSlotsAvailable利用可能なタスクスロットの数N/AN/ACustom
flink_jobmanager_taskSlotsTotalタスクスロットの総数N/AN/ACustom
flink_jobmanager_numRegisteredTaskManagers登録されている TaskManager の数N/AN/ACustom

レイテンシー

メトリック説明詳細単位タイプ
flink_taskmanager_job_task_operator_currentEmitEventTimeLagオペレーターが発行するレコードのイベントタイムラグ値が大きい場合、ジョブのデータプルまたは処理で遅延が発生している可能性があります。msCustom
flink_taskmanager_job_task_operator_currentFetchEventTimeLagオペレーターがプルするレコードのイベントタイムラグ値が大きい場合、ジョブのデータプルで遅延が発生している可能性があります。msCustom
flink_taskmanager_job_task_currentInputWatermark各タスクが受信した最新のウォーターマークの時刻タスクが受信するデータのレイテンシーを示します。N/ACustom
flink_taskmanager_job_task_operator_watermarkLagオペレーターのウォーターマークラグサブタスクレベルでのジョブのレイテンシーを示します。msCustom

スループット

レコードスループット

メトリック説明詳細単位タイプ
flink_taskmanager_job_task_numRecordsInタスクが受信したレコードの総数タスクの numRecordsIn の値が長時間増加しない場合、上流でデータがドロップされ、渡されなかった可能性があります。この場合は、上流のデータを確認してください。CountCustom
flink_taskmanager_job_task_numRecordsOutタスクが出力したレコードの総数タスクの numRecordsOut の値が長時間増加しない場合、ジョブコードの論理エラーによってデータがドロップされ、渡されなかった可能性があります。この場合は、ジョブコードのロジックを確認してください。CountCustom
flink_taskmanager_job_task_operator_numRecordsInオペレーターが受信したレコードの総数オペレーターの numRecordsIn の値が長時間増加しない場合、上流でデータがドロップされ、渡されなかった可能性があります。この場合は、上流のデータを確認してください。CountCustom
flink_taskmanager_job_task_operator_numRecordsOutオペレーターが出力したレコードの総数オペレーターの numRecordsOut の値が長時間増加しない場合、ジョブコードの論理エラーによってデータがドロップされ、渡されなかった可能性があります。この場合は、ジョブコードのロジックを確認してください。CountCustom
flink_taskmanager_job_task_operator_source_numRecordsInソースオペレーターのみの入力レコード上流のデータ入力を確認してください。CountCustom
flink_taskmanager_job_task_operator_sink_numRecordsOutシンクによって出力されたレコードの総数下流のデータ出力を確認してください。CountCustom
flink_taskmanager_job_task_numRecordsInPerSecondタスクが 1 秒あたりに受信するレコード数タスクの処理速度を監視する必要があるシナリオで使用します。例えば、タスクの処理速度が期待レベルに達しているか、異なる入力負荷の下でパフォーマンスがどのように変化するかを確認できます。Count/sCustom
flink_taskmanager_job_task_numRecordsOutPerSecondタスクが 1 秒あたりに出力するレコード数タスクの出力速度を監視する必要があるシナリオで使用します。例えば、タスクの出力速度が期待レベルに達しているか、異なる出力負荷の下でパフォーマンスがどのように変化するかを確認できます。Count/sCustom
flink_taskmanager_job_task_operator_numRecordsInPerSecondオペレーターが 1 秒あたりに受信するレコード数オペレーターの処理速度を監視する必要があるシナリオで使用します。例えば、オペレーターの処理速度が期待レベルに達しているか、異なる入力負荷の下でパフォーマンスがどのように変化するかを確認できます。Count/sCustom
flink_taskmanager_job_task_operator_numRecordsOutPerSecondオペレーターが 1 秒あたりに出力するレコード数オペレーターの出力速度を監視する必要があるシナリオで使用します。例えば、オペレーターの出力速度が期待レベルに達しているか、異なる出力負荷の下でパフォーマンスがどのように変化するかを確認できます。Count/sCustom
flink_taskmanager_job_task_operator_source_numRecordsInPerSecondソースが 1 秒あたりに入力するレコード数各データソースの生成レートを把握し、各データソースが 1 秒あたりに生成するレコード数を測定する必要があるシナリオで使用します。データストリーム内の異なるデータソースは異なる数のレコードを生成する可能性があるため、このメトリックはデータストリームのパフォーマンス向上のためのチューニングに役立ちます。このメトリックはモニタリングとアラートにも使用されます。値が 0 の場合は、上流でデータがドロップされた可能性があります。上流のデータが消費されていないために出力がブロックされているかどうかを確認してください。Count/sCustom
flink_taskmanager_job_task_operator_sink_numRecordsOutPerSecondシンクが 1 秒あたりに出力するレコード数各シンクの出力速度を把握し、各シンクが 1 秒あたりに出力するレコード数を測定する必要があるシナリオで使用します。データストリーム内の異なるシンクは異なる数のレコードを出力する可能性があるため、このメトリックはデータストリームのパフォーマンス向上のためのチューニングに役立ちます。このメトリックはモニタリングとアラートにも使用されます。値が 0 の場合は、すべてのデータをフィルタリングしてしまうジョブコードの論理エラーを示している可能性があります。この場合は、ジョブコードのロジックを確認してください。Count/sCustom

バイトスループット

メトリック説明詳細単位タイプ
flink_taskmanager_job_task_operator_numBytesInオペレーターが受信したバイトの総数ジョブのトラフィックを監視するために、上流のスループット入力を確認します。BytesCustom
flink_taskmanager_job_task_operator_numBytesOutオペレーターが出力したバイトの総数ジョブのトラフィックを監視するために、下流のスループット出力を確認します。BytesCustom
flink_taskmanager_job_task_operator_numBytesInPerSecondオペレーターが 1 秒あたりに受信するバイト数N/ABytes/sCustom
flink_taskmanager_job_task_operator_numBytesOutPerSecondオペレーターが 1 秒あたりに出力するバイト数ジョブのトラフィックを監視するために、下流のスループット出力を確認します。Bytes/sCustom
flink_taskmanager_job_task_numBytesInLocalPerSecondタスクがローカルソースから 1 秒あたりに読み取るバイト数ジョブのトラフィックを監視するために、上流の入力レートを確認します。Bytes/sCustom
flink_taskmanager_job_task_numBytesInRemotePerSecondタスクがリモートソースから 1 秒あたりに読み取るバイト数N/ABytes/sCustom
flink_taskmanager_job_task_numBytesOutPerSecondタスクが 1 秒あたりに出力するバイト数N/ABytes/sCustom

ネットワークバッファー

メトリック説明詳細単位タイプ
flink_taskmanager_job_task_numBuffersInLocalPerSecond1 秒あたりに消費されるローカルデータバッファーの数値が高い場合は、タスク間のローカル通信、つまり同じノード上での通信が頻繁に行われていることを示します。Count/sCustom
flink_taskmanager_job_task_numBuffersInRemotePerSecondリモートの TaskManager から 1 秒あたりに受信するバッファーの数TaskManager 間の通信の頻度を反映します。Count/sCustom
flink_taskmanager_job_task_numBuffersOutPerSecond他のタスクに 1 秒あたりに送信されるバッファーの数タスクの出力負荷とネットワーク帯域幅の使用状況を示します。Count/sCustom

ソースとシンク

メトリック説明詳細単位タイプ
flink_taskmanager_job_task_operator_pendingRecordsソースでまだ読み取られていないレコードの数外部システム内で、ソースによってまだプルされていないレコードの数。CountCustom
flink_taskmanager_job_task_operator_sourceIdleTimeソースがデータを処理していない時間ソースがアイドル状態かどうかを示します。値が大きい場合は、外部システムでのデータ生成レートが低いことを示します。msCustom
flink_taskmanager_job_task_operator_currentSendTime最新のレコードを送信するのにかかった時間N/AmsCustom

チェックポイント

メトリック説明詳細単位タイプ
flink_jobmanager_job_totalNumberOfCheckpointsチェックポイントの総数N/ACountCustom
flink_jobmanager_job_numberOfFailedCheckpoints失敗したチェックポイントの数N/ACountCustom
flink_jobmanager_job_numberOfCompletedCheckpoints完了したチェックポイントの数N/ACountCustom
flink_jobmanager_job_numberOfInProgressCheckpoints進行中のチェックポイントの数N/ACountCustom
flink_jobmanager_job_lastCheckpointDuration最新のチェックポイントの所要時間チェックポイントに時間がかかりすぎる、またはタイムアウトする場合、原因はステートが大きすぎる、一時的なネットワークの問題、barrier の不整合、またはデータのバックプレッシャーである可能性があります。msCustom
flink_jobmanager_job_lastCheckpointSize最新のチェックポイントのサイズ実際に最後にアップロードされたチェックポイントのサイズ。チェックポイントがボトルネックになっている場合に、チェックポイントのパフォーマンスを分析するためにこのメトリックを使用します。BytesCustom

ステート

ステートメトリックは、ステートタイプごとにグループ化された単一のステート操作の最大レイテンシーと、GeminiDB が保存するステートデータのサイズをレポートします。ステートのレイテンシーメトリック名では、state_name を監視したいステートの名前に置き換えてください。各レイテンシーメトリックは、その名前が示すステート操作のパフォーマンスを示すため、これらのメトリックの Details 列は N/A です。

全般

メトリック説明詳細単位タイプ
flink_taskmanager_job_task_operator_state_name_stateClearLatency単一のステートクリア操作の最大レイテンシーN/AnsCustom

値ステート

メトリック説明詳細単位タイプ
flink_taskmanager_job_task_operator_state_name_valueStateGetLatency単一の値ステートアクセスの最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_valueStateUpdateLatency単一の値ステート更新の最大レイテンシーN/AnsCustom

集約ステート

メトリック説明詳細単位タイプ
flink_taskmanager_job_task_operator_state_name_aggregatingStateGetLatency単一の集約ステートアクセスの最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_aggregatingStateAddLatency単一の集約ステート追加操作の最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_aggregatingStateMergeNamespacesLatency単一の集約ステート名前空間マージ操作の最大レイテンシーN/AnsCustom

削減ステート

メトリック説明詳細単位タイプ
flink_taskmanager_job_task_operator_state_name_reducingStateGetLatency単一の削減ステートアクセスの最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_reducingStateAddLatency単一の削減ステート追加操作の最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_reducingStateMergeNamespacesLatency単一の削減ステート名前空間マージ操作の最大レイテンシーN/AnsCustom

マップステート

メトリック説明詳細単位タイプ
flink_taskmanager_job_task_operator_state_name_mapStateGetLatency単一のマップステートアクセスの最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStatePutLatency単一のマップステート put 操作の最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStatePutAllLatency単一のマップステート put all 操作の最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateRemoveLatency単一のマップステート remove 操作の最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateContainsLatency単一マップ状態の contains 操作の最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateEntriesInitLatency単一のマップステート entries init 操作の最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateKeysInitLatency単一のマップステート keys init 操作の最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateValuesInitLatency単一のマップステート values init 操作の最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateIteratorInitLatency単一のマップステート iterator init 操作の最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateIsEmptyLatency単一のマップステート空チェックの最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateIteratorHasNextLatency単一のマップステートイテレータ hasNext 操作の最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateIteratorNextLatency単一のマップステートイテレータ next 操作の最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateIteratorRemoveLatency単一のマップステートイテレータ remove 操作の最大レイテンシーN/AnsCustom

リストステート

メトリック説明詳細単位タイプ
flink_taskmanager_job_task_operator_state_name_listStateGetLatency単一のリストステートアクセスの最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_listStateAddLatency単一のリストステート追加操作の最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_listStateAddAllLatency単一のリストステート add all 操作の最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_listStateUpdateLatency単一のリストステート更新の最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_listStateMergeNamespacesLatency単一のリストステート名前空間マージ操作の最大レイテンシーN/AnsCustom

ソート済みマップステート

メトリック説明詳細単位タイプ
flink_taskmanager_job_task_operator_state_name_sortedMapStateFirstEntryLatencyソート済みマップステートの最初のエントリへの単一アクセスの最大レイテンシーN/AnsCustom
flink_taskmanager_job_task_operator_state_name_sortedMapStateLastEntryLatencyソート済みマップステートの最後のエントリへの単一アクセスの最大レイテンシーN/AnsCustom

GeminiDB ステートストレージ

メトリック説明詳細単位タイプ
flink_taskmanager_job_task_operator_geminiDB_total_sizeステートデータのサイズこのメトリックを監視することで、ステートのボトルネックが発生する可能性のあるノードを直接または事前に特定し、TTL が有効かどうかを判断できます。BytesCustom
flink_taskmanager_job_task_operator_geminiDB_total_filesizeステートデータファイルのサイズこのメトリックを監視することで、ステートが占有するローカルディスク領域を確認し、使用量が高い場合に事前に対策を講じたり、ローカルディスク領域の不足が過大なステートデータによって引き起こされているかどうかを判断したりできます。BytesCustom

ウィンドウメトリック

メトリック説明詳細単位タイプ
flink_taskmanager_job_task_operator_numLateRecordsDroppedウィンドウのレイテンシーのためにドロップされたレコードの総数N/ACountCustom
flink_taskmanager_job_task_operator_lateRecordsDroppedRateウィンドウのレイテンシーのためにレコードがドロップされるレートN/AN/ACustom

CDC コネクタメトリック

変更データキャプチャ (CDC) コネクタメトリックは、完全データが処理されるスナップショットフェーズと、増分データが処理されるバイナリロギング (binlog) フェーズを追跡します。以下のテーブルは、ジョブが現在どのフェーズにあるか、スナップショットフェーズの進捗、読み取られたデータ量、および増分フェーズで処理される DML および DDL 文によってこれらのメトリックをグループ化しています。

メトリック名では、cdcns_schema_table を監視したいテーブルの CDC 名前空間、スキーマ名、およびテーブル名に置き換えてください。このセグメントを含むメトリック名は単一テーブルの値をレポートします。このセグメントを省略したメトリック名はジョブ全体に対する値をレポートします。

フェーズインジケーター

メトリック説明詳細単位タイプ
flink_jobmanager_job_operator_coordinator_enumerator_isSnapshottingジョブが完全データを処理するフェーズにあるかどうかジョブがまだスナップショットフェーズにあるかどうかを判断します。N/ACustom
flink_jobmanager_job_operator_coordinator_enumerator_isBinlogReadingジョブが増分データを処理するフェーズにあるかどうかジョブが binlog フェーズに入ったかどうかを判断します。N/ACustom

スナップショットの進捗

メトリック説明詳細単位タイプ
flink_jobmanager_job_operator_coordinator_enumerator_numTablesRemainingスナップショットフェーズでまだ処理されていないテーブルの数まだ処理を待っているテーブルの数を表示します。CountCustom
flink_jobmanager_job_operator_coordinator_enumerator_numTablesSnapshottedスナップショットが完了したテーブルの数処理済みのテーブルの数を表示します。CountCustom
flink_jobmanager_job_operator_coordinator_enumerator_numSnapshotSplitsProcessedジョブ全体のスナップショットフェーズで処理されたシャードの数すべてのテーブルにわたる処理済みシャードの数を表示します。CountCustom
flink_jobmanager_job_operator_coordinator_enumerator_cdcns_schema_table_numSnapshotSplitsProcessed単一テーブルのスナップショットフェーズで処理されたシャードの数指定されたテーブルの処理済みシャードの数を表示します。CountCustom
flink_jobmanager_job_operator_coordinator_enumerator_numSnapshotSplitsRemainingジョブ全体のスナップショットフェーズで処理を待っているシャードの数すべてのテーブルにわたる未処理シャードの数を表示します。CountCustom
flink_jobmanager_job_operator_coordinator_enumerator_cdcns_schema_table_numSnapshotSplitsRemaining単一テーブルのスナップショットフェーズで処理を待っているシャードの数指定されたテーブルの未処理シャードの数を表示します。CountCustom

データ量

メトリック説明詳細単位タイプ
flink_taskmanager_job_task_operator_currentReadTimestampMs読み取られた最新のデータレコードのタイムスタンプ最新の binlog データのタイムスタンプを表示します。msCustom
flink_taskmanager_job_task_operator_numSnapshotRecordsスナップショットフェーズで処理されたレコードの数スナップショットフェーズで処理されたデータ量を表示します。CountCustom
flink_taskmanager_job_task_operator_cdcns_schema_table_numRecordsIn各テーブルで読み取られたレコードの数各テーブルで処理された総データ量を表示します。CountCustom
flink_taskmanager_job_task_operator_cdcns_schema_table_numSnapshotRecordsスナップショットフェーズで各テーブルについて処理されたレコードの数スナップショットフェーズで各テーブルについて処理されたデータ量を表示します。CountCustom

増分フェーズの DML と DDL

メトリック説明詳細単位タイプ
flink_taskmanager_job_task_operator_cdcns_schema_table_numInsertDMLRecords増分フェーズで各テーブルについて処理された INSERT DML 文の数各テーブルの INSERT 文のデータ量を表示します。CountCustom
flink_taskmanager_job_task_operator_cdcns_schema_table_numUpdateDMLRecords増分フェーズで各テーブルについて処理された UPDATE DML 文の数各テーブルの UPDATE 文のデータ量を表示します。CountCustom
flink_taskmanager_job_task_operator_cdcns_schema_table_numDeleteDMLRecords増分フェーズで各テーブルについて処理された DELETE DML 文の数各テーブルの DELETE 文のデータ量を表示します。CountCustom
flink_taskmanager_job_task_operator_cdcns_schema_table_numDDLRecords増分フェーズで各テーブルについて処理された DDL 文の数各テーブルの DDL 文のデータ量を表示します。CountCustom
flink_taskmanager_job_task_operator_numInsertDMLRecords増分フェーズで処理された INSERT DML 文の数INSERT 文のデータ量を表示します。CountCustom
flink_taskmanager_job_task_operator_numUpdateDMLRecords増分フェーズで処理された UPDATE DML 文の数UPDATE 文のデータ量を表示します。CountCustom
flink_taskmanager_job_task_operator_numDeleteDMLRecords増分フェーズで処理された DELETE DML 文の数DELETE 文のデータ量を表示します。CountCustom
flink_taskmanager_job_task_operator_numDDLRecords増分フェーズで処理された DDL 文の数DDL 文のデータ量を表示します。CountCustom

JobManager の JVM とシステムリソース

CPU

メトリック説明詳細単位タイプ
flink_jobmanager_Status_JVM_CPU_Load単一の JobManager CPU の負荷この値が長時間 100% を超え続ける場合、CPU はビジー状態で負荷が高いことを示します。これはシステムのパフォーマンスに影響を与え、システムの遅延や応答時間の大幅な増加を引き起こす可能性があります。N/ABasic
flink_jobmanager_Status_ProcessTree_CPU_Usage単一の JobManager CPU の CPU 使用率この値は Flink がどれだけの CPU 時間を占有しているかを反映します。1 つの CPU コアが完全に利用されると値は 100% になり、4 つの CPU コアが完全に利用されると 400% になります。この値が長時間 100% を超え続ける場合、CPU は非常にビジーです。負荷が高いにもかかわらず CPU 使用率が低い場合、頻繁な読み書き操作により、割り込み不可能なスリープ状態のプロセスが多すぎる可能性があります。N/ABasic

メモリ

メトリック説明詳細単位タイプ
flink_jobmanager_Status_JVM_Memory_Heap_UsedJobManager のヒープメモリN/ABytesBasic
flink_jobmanager_Status_JVM_Memory_Heap_CommittedJobManager によってコミットされたヒープメモリN/ABytesBasic
flink_jobmanager_Status_JVM_Memory_Heap_MaxJobManager の最大ヒープメモリN/ABytesBasic
flink_jobmanager_Status_JVM_Memory_NonHeap_UsedJobManager の非ヒープメモリN/ABytesBasic
flink_jobmanager_Status_JVM_Memory_NonHeap_CommittedJobManager によってコミットされた非ヒープメモリN/ABytesBasic
flink_jobmanager_Status_JVM_Memory_NonHeap_MaxJobManager の最大非ヒープメモリN/ABytesBasic

スレッド

メトリック説明詳細単位タイプ
flink_jobmanager_Status_JVM_Threads_CountJobManager のスレッド数JobManager のスレッドが多すぎると、過剰なメモリ領域を占有し、ジョブの安定性が低下します。CountBasic

ガベージコレクション

次のテーブルの G1 ガベージコレクターメトリックはカスタムメトリックです。その他の JobManager ガベージコレクションメトリックは基本メトリックです。

メトリック説明詳細単位タイプ
flink_jobmanager_Status_JVM_GarbageCollector_ParNew_CountJobManager の GC 回数GC が多すぎると、過剰なメモリ領域を占有し、ジョブのパフォーマンスに影響します。このメトリックは、ジョブの診断とジョブレベルの障害のトラブルシューティングに役立ちます。CountBasic
flink_jobmanager_Status_JVM_GarbageCollector_G1_Young_Generation_CountJobManager の Young 領域 GC 回数 (G1 ガベージコレクター)N/ACountCustom
flink_jobmanager_Status_JVM_GarbageCollector_G1_Old_Generation_CountJobManager の Old 領域 GC 回数 (G1 ガベージコレクター)N/ACountCustom
flink_jobmanager_Status_JVM_GarbageCollector_G1_Young_Generation_TimeJobManager の Young 領域 GC 時間 (G1 ガベージコレクター)N/AmsCustom
flink_jobmanager_Status_JVM_GarbageCollector_G1_Old_Generation_TimeJobManager の Old 領域 GC 時間 (G1 ガベージコレクター)N/AmsCustom
flink_jobmanager_Status_JVM_GarbageCollector_ConcurrentMarkSweep_CountJobManager の CMS ガベージコレクターによって実行されたコレクションの回数N/ACountBasic
flink_jobmanager_Status_JVM_GarbageCollector_ParNew_Time各 JobManager GC の所要時間GC が長いと、過剰なメモリ領域を占有し、ジョブのパフォーマンスに影響します。このメトリックは、ジョブの診断とジョブレベルの障害のトラブルシューティングに役立ちます。msBasic
flink_jobmanager_Status_JVM_GarbageCollector_ConcurrentMarkSweep_TimeJobManager の CMS ガベージコレクターによって実行されたコレクションに費やされた時間N/AmsBasic

クラスローディング

メトリック説明詳細単位タイプ
flink_jobmanager_Status_JVM_ClassLoader_ClassesLoadedJobManager をホストする JVM が作成された後にロードされたクラスの総数JobManager をホストする JVM が作成された後にロードされたクラスの総数が多すぎると、過剰なメモリ領域が占有され、ジョブのパフォーマンスに影響します。N/ABasic
flink_jobmanager_Status_JVM_ClassLoader_ClassesUnloadedJobManager をホストする JVM が作成された後にアンロードされたクラスの総数JobManager をホストする JVM が作成された後にアンロードされたクラスの総数が多すぎると、過剰なメモリ領域が占有され、ジョブのパフォーマンスに影響します。N/ABasic

TaskManager の JVM とシステムリソース

CPU

メトリック説明詳細単位タイプ
flink_taskmanager_Status_JVM_CPU_Load単一の TaskManager CPU の負荷一定期間に CPU が処理しているプロセスと CPU を待っているプロセスの合計で、一般的には CPU がどれだけビジーであるかを意味します。CPU のビジー度は CPU コア数に依存します。Flink では、CPU 負荷の値は CPU 使用率 / CPU コア数 です。flink_taskmanager_Status_JVM_CPU_Load が CPU 負荷の値より大きい場合、CPU 処理がブロックされている可能性があります。N/ABasic
flink_taskmanager_Status_ProcessTree_CPU_Usage単一の TaskManager CPU の CPU 使用率この値は Flink がどれだけの CPU 時間を占有しているかを反映します。1 つの CPU コアが完全に利用されると値は 100% になり、4 つの CPU コアが完全に利用されると 400% になります。この値が長時間 100% を超え続ける場合、CPU は非常にビジーです。負荷が高いにもかかわらず CPU 使用率が低い場合、頻繁な読み書き操作により、割り込み不可能なスリープ状態のプロセスが多すぎる可能性があります。N/ABasic

メモリ

メトリック説明詳細単位タイプ
flink_taskmanager_Status_JVM_Memory_Heap_UsedTaskManager のヒープメモリN/ABytesBasic
flink_taskmanager_Status_JVM_Memory_Heap_CommittedTaskManager のコミット済みヒープメモリN/ABytesBasic
flink_taskmanager_Status_JVM_Memory_Heap_MaxTaskManager の最大ヒープメモリN/ABytesBasic
flink_taskmanager_Status_JVM_Memory_NonHeap_UsedTaskManager の非ヒープメモリN/ABytesBasic
flink_taskmanager_Status_JVM_Memory_NonHeap_CommittedTaskManager のコミット済み非ヒープメモリN/ABytesBasic
flink_taskmanager_Status_JVM_Memory_NonHeap_MaxTaskManager の最大非ヒープメモリN/ABytesBasic
flink_taskmanager_Status_ProcessTree_Memory_RSSLinux を通じて取得されたプロセス全体のメモリプロセスメモリの変更を表示します。BytesBasic

スレッド

メトリック説明詳細単位タイプ
flink_taskmanager_Status_JVM_Threads_CountTaskManager のスレッド数TaskManager のスレッドが多すぎると、過剰なメモリを占有し、ジョブの安定性が低下します。CountBasic

ガベージコレクション

次のテーブルの G1 ガベージコレクターメトリックはカスタムメトリックです。その他の TaskManager ガベージコレクションメトリックは基本メトリックです。

メトリック説明詳細単位タイプ
flink_taskmanager_Status_JVM_GarbageCollector_ParNew_CountTaskManager の GC 回数GC が多すぎると、過剰なメモリ領域を占有し、ジョブのパフォーマンスに影響します。このメトリックは、ジョブの診断とタスクレベルの障害のトラブルシューティングに役立ちます。CountBasic
flink_taskmanager_Status_JVM_GarbageCollector_G1_Young_Generation_CountTaskManager の Young 領域 GC 回数 (G1 ガベージコレクター)N/ACountCustom
flink_taskmanager_Status_JVM_GarbageCollector_G1_Old_Generation_CountTaskManager の Old 領域 GC 回数 (G1 ガベージコレクター)N/ACountCustom
flink_taskmanager_Status_JVM_GarbageCollector_G1_Young_Generation_TimeTaskManager の Young 領域 GC 時間 (G1 ガベージコレクター)N/AmsCustom
flink_taskmanager_Status_JVM_GarbageCollector_G1_Old_Generation_TimeTaskManager の Old 領域 GC 時間 (G1 ガベージコレクター)N/AmsCustom
flink_taskmanager_Status_JVM_GarbageCollector_ConcurrentMarkSweep_CountTaskManager の CMS ガベージコレクターによって実行されたコレクションの回数N/ACountBasic
flink_taskmanager_Status_JVM_GarbageCollector_ParNew_Time各 TaskManager GC の所要時間GC が長いと、過剰なメモリ領域を占有し、ジョブのパフォーマンスに影響します。このメトリックは、ジョブの診断とタスクレベルの障害のトラブルシューティングに役立ちます。msBasic
flink_taskmanager_Status_JVM_GarbageCollector_ConcurrentMarkSweep_TimeTaskManager の CMS ガベージコレクターによって実行されたコレクションに費やされた時間N/AmsBasic

クラスローディング

メトリック説明詳細単位タイプ
flink_taskmanager_Status_JVM_ClassLoader_ClassesLoadedTaskManager をホストする JVM が作成された後にロードされたクラスの総数TaskManager をホストする JVM が作成された後にロードされたクラスの総数が多すぎると、過剰なメモリ領域が占有され、ジョブのパフォーマンスに影響します。N/ABasic
flink_taskmanager_Status_JVM_ClassLoader_ClassesUnloadedTaskManager をホストする JVM が作成された後にアンロードされたクラスの総数TaskManager をホストする JVM が作成された後にアンロードされたクラスの総数が多すぎると、過剰なメモリ領域が占有され、ジョブのパフォーマンスに影響します。N/ABasic

共通のメトリックラベル

Flink メトリックには、一般的に以下のラベルが付与されます。これらを使用して、プロジェクト、デプロイメント、またはジョブごとにメトリックデータをフィルタリングおよび集約します。

ラベル説明
vvpNamespaceプロジェクトの名前空間。
deploymentNameデプロイメントの名前。
deploymentIdデプロイメントの ID。
jobIdジョブの ID。

リファレンス

以下のトピックでは、関連するメトリックセットとメトリック管理オプションについて説明します。