All Products
Search
Document Center

Managed Service for Prometheus:Metrik Flink

Last Updated:Aug 25, 2026

Managed Service for Prometheus mendukung serangkaian metrik Flink yang dikumpulkan dari Alibaba Cloud Realtime Compute for Apache Flink. Setiap metrik diklasifikasikan sebagai metrik dasar atau metrik kustom, dan klasifikasi ini menentukan apakah pelaporan metrik tersebut dikenai biaya.

Jenis metrik dan penagihan

Managed Service for Prometheus ditagih berdasarkan volume data yang ditulis atau jumlah titik data yang dilaporkan. Metrik dibagi menjadi dua kategori:

  • Metrik dasar — Metrik dasar yang dikumpulkan dari Alibaba Cloud Realtime Compute for Apache Flink tidak dikenai biaya saat dilaporkan ke atau ditulis ke Managed Service for Prometheus. Manfaat ini tidak berlaku untuk layanan Flink lainnya, seperti Flink yang dikelola sendiri.

  • Metrik kustom — Metrik selain metrik dasar dikategorikan sebagai metrik kustom dan telah dikenai biaya sejak 6 Januari 2020.

    Kolom Type pada setiap tabel dalam topik ini menunjukkan kategori metrik tersebut. Metrik dasar terkonsentrasi pada bagian JVM dan sumber daya sistem JobManager serta TaskManager. Metrik pada bagian lainnya merupakan metrik kustom, sehingga data mengenai kesehatan pekerjaan, latensi, throughput, checkpoint, state, window, dan konektor CDC akan dikenai biaya saat dilaporkan. Di dalam dua bagian JVM tersebut, delapan metrik garbage collector G1 diklasifikasikan sebagai metrik kustom meskipun metrik di sekitarnya merupakan metrik dasar.

Cara membaca tabel metrik

Setiap tabel metrik dalam topik ini menggunakan lima kolom yang sama:

  • Metric — Nama metrik sebagaimana dilaporkan ke Managed Service for Prometheus.

  • Description — Apa yang diukur oleh metrik tersebut.

  • Details — Cara menginterpretasikan nilai tersebut atau hal yang perlu diperiksa jika nilainya tampak tidak normal.

  • Unit — Satuan nilai metrik. Nilai yang digunakan dalam topik ini adalah Count, Count/s, Bytes, Bytes/s, ms, dan ns.

  • Type — Kategori metrik: Basic atau Custom.

    N/A dalam sebuah sel berarti topik ini tidak menyediakan nilai untuk sel tersebut. Pada kolom Unit, N/A berarti tidak ada satuan yang didokumentasikan untuk metrik tersebut.

Beberapa nama metrik memuat segmen variabel yang diganti saat metrik dilaporkan, sehingga nama dalam tabel bukanlah nama literal dari deret waktu. state_name mewakili nama state yang diterapkan oleh metrik tersebut, dan cdcns_schema_table mewakili namespace CDC, nama skema, dan nama tabel dari tabel yang dipantau. Ganti segmen-segmen ini dengan nilai aktual sebelum menggunakan nama metrik dalam kueri atau aturan peringatan.

Kesehatan pekerjaan

MetricDescriptionDetailsUnitType
flink_jobmanager_job_numRestartsJumlah restart pekerjaan yang disebabkan oleh errorJumlah restart yang disebabkan oleh error pekerjaan. Failover JobManager tidak dihitung.CountCustom
flink_jobmanager_job_uptimeWaktu eksekusi pekerjaanN/AmsCustom
flink_jobmanager_numRunningJobsJumlah pekerjaan yang sedang berjalanN/AN/ACustom
flink_jobmanager_taskSlotsAvailableJumlah slot tugas yang tersediaN/AN/ACustom
flink_jobmanager_taskSlotsTotalJumlah total slot tugasN/AN/ACustom
flink_jobmanager_numRegisteredTaskManagersJumlah TaskManager yang terdaftarN/AN/ACustom

Latensi

MetricDescriptionDetailsUnitType
flink_taskmanager_job_task_operator_currentEmitEventTimeLagEvent-time lag dari record yang dikeluarkan oleh operatorNilai besar menunjukkan bahwa pekerjaan mungkin mengalami latensi saat menarik atau memproses data.msCustom
flink_taskmanager_job_task_operator_currentFetchEventTimeLagEvent-time lag dari record yang ditarik oleh operatorNilai besar menunjukkan bahwa pekerjaan mungkin mengalami latensi saat menarik data.msCustom
flink_taskmanager_job_task_currentInputWatermarkWaktu watermark terbaru yang diterima oleh setiap tugasMenunjukkan latensi data yang diterima oleh tugas.N/ACustom
flink_taskmanager_job_task_operator_watermarkLagWatermark lag dari operatorMenunjukkan latensi pekerjaan di tingkat subtask.msCustom

Throughput

Throughput record

MetricDescriptionDetailsUnitType
flink_taskmanager_job_task_numRecordsInJumlah total record yang diterima oleh tugasJika nilai numRecordsIn suatu tugas tidak meningkat dalam waktu lama, data upstream mungkin telah dibuang dan gagal diteruskan. Dalam kasus ini, periksa data upstream.CountCustom
flink_taskmanager_job_task_numRecordsOutJumlah total record yang dikeluarkan oleh tugasJika nilai numRecordsOut suatu tugas tidak meningkat dalam waktu lama, kemungkinan terdapat error logika pada kode pekerjaan yang menyebabkan data dibuang sehingga tidak diteruskan. Dalam kasus ini, periksa logika kode pekerjaan.CountCustom
flink_taskmanager_job_task_operator_numRecordsInJumlah total record yang diterima oleh operatorJika nilai numRecordsIn suatu operator tidak meningkat dalam waktu lama, data upstream mungkin telah dibuang dan gagal diteruskan. Dalam kasus ini, periksa data upstream.CountCustom
flink_taskmanager_job_task_operator_numRecordsOutJumlah total record yang dikeluarkan oleh operatorJika nilai numRecordsOut suatu operator tidak meningkat dalam waktu lama, kemungkinan terdapat error logika pada kode pekerjaan yang menyebabkan data dibuang sehingga tidak diteruskan. Dalam kasus ini, periksa logika kode pekerjaan.CountCustom
flink_taskmanager_job_task_operator_source_numRecordsInRecord input hanya untuk operator sourcePeriksa input data upstream.CountCustom
flink_taskmanager_job_task_operator_sink_numRecordsOutJumlah total record yang dikeluarkan oleh sinkPeriksa output data downstream.CountCustom
flink_taskmanager_job_task_numRecordsInPerSecondJumlah record yang diterima oleh tugas per detikBerlaku untuk skenario di mana Anda perlu memantau kecepatan pemrosesan tugas. Misalnya, Anda dapat memeriksa apakah kecepatan pemrosesan tugas mencapai tingkat yang diharapkan dan bagaimana kinerja berubah di bawah beban input yang berbeda.Count/sCustom
flink_taskmanager_job_task_numRecordsOutPerSecondJumlah record yang dikeluarkan oleh tugas per detikBerlaku untuk skenario di mana Anda perlu memantau kecepatan output tugas. Misalnya, Anda dapat memeriksa apakah kecepatan output tugas mencapai tingkat yang diharapkan dan bagaimana kinerja berubah di bawah beban output yang berbeda.Count/sCustom
flink_taskmanager_job_task_operator_numRecordsInPerSecondJumlah record yang diterima oleh operator per detikBerlaku untuk skenario di mana Anda perlu memantau kecepatan pemrosesan operator. Misalnya, Anda dapat memeriksa apakah kecepatan pemrosesan operator mencapai tingkat yang diharapkan dan bagaimana kinerja berubah di bawah beban input yang berbeda.Count/sCustom
flink_taskmanager_job_task_operator_numRecordsOutPerSecondJumlah record yang dikeluarkan oleh operator per detikBerlaku untuk skenario di mana Anda perlu memantau kecepatan output operator. Misalnya, Anda dapat memeriksa apakah kecepatan output operator mencapai tingkat yang diharapkan dan bagaimana kinerja berubah di bawah beban output yang berbeda.Count/sCustom
flink_taskmanager_job_task_operator_source_numRecordsInPerSecondJumlah record yang diinput per detik oleh sourceBerlaku untuk skenario di mana Anda perlu memahami laju pembangkitan setiap sumber data dan mengukur jumlah record yang dihasilkan per detik oleh setiap sumber data. Sumber data yang berbeda dalam aliran data mungkin menghasilkan jumlah record yang berbeda, sehingga metrik ini membantu Anda menyetel aliran data untuk kinerja yang lebih baik. Metrik ini juga digunakan untuk pemantauan dan peringatan. Nilai 0 mungkin menunjukkan bahwa data upstream telah dibuang. Periksa apakah output diblokir karena data upstream belum dikonsumsi.Count/sCustom
flink_taskmanager_job_task_operator_sink_numRecordsOutPerSecondJumlah record yang dioutput per detik oleh sinkBerlaku untuk skenario di mana Anda perlu memahami kecepatan output setiap sink dan mengukur jumlah record yang dioutput per detik oleh setiap sink. Sink yang berbeda dalam aliran data mungkin mengoutput jumlah record yang berbeda, sehingga metrik ini membantu Anda menyetel aliran data untuk kinerja yang lebih baik. Metrik ini juga digunakan untuk pemantauan dan peringatan. Nilai 0 mungkin menunjukkan adanya error logika pada kode pekerjaan yang menyaring semua data. Dalam kasus ini, periksa logika kode pekerjaan.Count/sCustom

Throughput byte

MetricDescriptionDetailsUnitType
flink_taskmanager_job_task_operator_numBytesInJumlah total byte yang diterima oleh operatorPeriksa input throughput upstream untuk mengamati trafik pekerjaan.BytesCustom
flink_taskmanager_job_task_operator_numBytesOutJumlah total byte yang dikeluarkan oleh operatorPeriksa output throughput downstream untuk mengamati trafik pekerjaan.BytesCustom
flink_taskmanager_job_task_operator_numBytesInPerSecondJumlah byte yang diterima oleh operator per detikN/ABytes/sCustom
flink_taskmanager_job_task_operator_numBytesOutPerSecondJumlah byte yang dikeluarkan oleh operator per detikPeriksa output throughput downstream untuk mengamati trafik pekerjaan.Bytes/sCustom
flink_taskmanager_job_task_numBytesInLocalPerSecondJumlah byte yang dibaca oleh tugas per detik dari sumber lokalPeriksa laju input upstream untuk mengamati trafik pekerjaan.Bytes/sCustom
flink_taskmanager_job_task_numBytesInRemotePerSecondJumlah byte yang dibaca oleh tugas per detik dari sumber remoteN/ABytes/sCustom
flink_taskmanager_job_task_numBytesOutPerSecondJumlah byte yang dikeluarkan oleh tugas per detikN/ABytes/sCustom

Buffer jaringan

MetricDescriptionDetailsUnitType
flink_taskmanager_job_task_numBuffersInLocalPerSecondJumlah buffer data lokal yang dikonsumsi per detikNilai tinggi menunjukkan komunikasi lokal yang sering antar tugas, yaitu komunikasi pada node yang sama.Count/sCustom
flink_taskmanager_job_task_numBuffersInRemotePerSecondJumlah buffer yang diterima per detik dari TaskManager remoteMencerminkan frekuensi komunikasi lintas-TaskManager.Count/sCustom
flink_taskmanager_job_task_numBuffersOutPerSecondJumlah buffer yang dikirim per detik ke tugas lainMenunjukkan tekanan output tugas dan penggunaan lebar pita jaringan.Count/sCustom

Source dan sink

MetricDescriptionDetailsUnitType
flink_taskmanager_job_task_operator_pendingRecordsJumlah record yang belum dibaca di sourceJumlah record di sistem eksternal yang belum ditarik oleh source.CountCustom
flink_taskmanager_job_task_operator_sourceIdleTimeWaktu selama source tidak memproses dataMenunjukkan apakah source sedang idle. Nilai besar menunjukkan bahwa laju pembangkitan data di sistem eksternal rendah.msCustom
flink_taskmanager_job_task_operator_currentSendTimeWaktu yang dibutuhkan untuk mengirim record terbaruN/AmsCustom

Checkpoint

MetricDescriptionDetailsUnitType
flink_jobmanager_job_totalNumberOfCheckpointsJumlah total checkpointN/ACountCustom
flink_jobmanager_job_numberOfFailedCheckpointsJumlah checkpoint yang gagalN/ACountCustom
flink_jobmanager_job_numberOfCompletedCheckpointsJumlah checkpoint yang selesaiN/ACountCustom
flink_jobmanager_job_numberOfInProgressCheckpointsJumlah checkpoint yang sedang berlangsungN/ACountCustom
flink_jobmanager_job_lastCheckpointDurationDurasi checkpoint terbaruJika checkpoint memakan waktu terlalu lama atau timeout, penyebabnya mungkin state yang terlalu besar, masalah jaringan sementara, barrier yang tidak sejajar, atau tekanan balik data.msCustom
flink_jobmanager_job_lastCheckpointSizeUkuran checkpoint terbaruUkuran checkpoint yang paling baru diunggah. Gunakan metrik ini untuk menganalisis kinerja checkpoint saat checkpoint menjadi bottleneck.BytesCustom

State

Metrik state melaporkan latensi maksimum operasi state tunggal, dikelompokkan berdasarkan jenis state, dan ukuran data state yang disimpan oleh GeminiDB. Dalam nama metrik latensi state, ganti state_name dengan nama state yang ingin Anda pantau. Setiap metrik latensi menunjukkan kinerja operasi state yang diidentifikasi oleh namanya, sehingga kolom Details bernilai N/A untuk metrik-metrik ini.

Umum

MetricDescriptionDetailsUnitType
flink_taskmanager_job_task_operator_state_name_stateClearLatencyLatensi maksimum operasi clear state tunggalN/AnsCustom

Value state

MetricDescriptionDetailsUnitType
flink_taskmanager_job_task_operator_state_name_valueStateGetLatencyLatensi maksimum akses value state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_valueStateUpdateLatencyLatensi maksimum pembaruan status nilai tunggalN/AnsCustom

Aggregating state

MetricDescriptionDetailsUnitType
flink_taskmanager_job_task_operator_state_name_aggregatingStateGetLatencyLatensi maksimum akses aggregating state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_aggregatingStateAddLatencyLatensi maksimum operasi add aggregating state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_aggregatingStateMergeNamespacesLatencyLatensi maksimum operasi merge-namespaces aggregating state tunggalN/AnsCustom

Reducing state

MetricDescriptionDetailsUnitType
flink_taskmanager_job_task_operator_state_name_reducingStateGetLatencyLatensi maksimum akses reducing state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_reducingStateAddLatencyLatensi maksimum operasi add reducing state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_reducingStateMergeNamespacesLatencyLatensi maksimum operasi merge-namespaces reducing state tunggalN/AnsCustom

Map state

MetricDescriptionDetailsUnitType
flink_taskmanager_job_task_operator_state_name_mapStateGetLatencyLatensi maksimum akses map state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStatePutLatencyLatensi maksimum operasi put map state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStatePutAllLatencyLatensi maksimum operasi put all pada status peta tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateRemoveLatencyLatensi maksimum operasi remove map state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateContainsLatencyLatensi maksimum operasi contains map state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateEntriesInitLatencyLatensi maksimum operasi init entries map state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateKeysInitLatencyLatensi maksimum operasi init keys map state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateValuesInitLatencyLatensi maksimum operasi init values map state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateIteratorInitLatencyLatensi maksimum operasi init iterator map state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateIsEmptyLatencyLatensi maksimum pemeriksaan kosong map state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateIteratorHasNextLatencyLatensi maksimum operasi hasNext iterator map state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateIteratorNextLatencyLatensi maksimum operasi next iterator map state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_mapStateIteratorRemoveLatencyLatensi maksimum operasi remove iterator map state tunggalN/AnsCustom

List state

MetricDescriptionDetailsUnitType
flink_taskmanager_job_task_operator_state_name_listStateGetLatencyLatensi maksimum akses list state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_listStateAddLatencyLatensi maksimum operasi add list state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_listStateAddAllLatencyLatensi maksimum operasi add all list state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_listStateUpdateLatencyLatensi maksimum pembaruan status daftar tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_listStateMergeNamespacesLatencyLatensi maksimum operasi merge-namespaces list state tunggalN/AnsCustom

Sorted map state

MetricDescriptionDetailsUnitType
flink_taskmanager_job_task_operator_state_name_sortedMapStateFirstEntryLatencyLatensi maksimum akses entri pertama sorted map state tunggalN/AnsCustom
flink_taskmanager_job_task_operator_state_name_sortedMapStateLastEntryLatencyLatensi maksimum akses entri terakhir sorted map state tunggalN/AnsCustom

Penyimpanan state GeminiDB

MetricDescriptionDetailsUnitType
flink_taskmanager_job_task_operator_geminiDB_total_sizeUkuran data stateDengan memantau metrik ini, Anda dapat menemukan node tempat bottleneck state mungkin terjadi, baik secara langsung maupun lebih awal, serta menentukan apakah TTL berlaku.BytesCustom
flink_taskmanager_job_task_operator_geminiDB_total_filesizeUkuran file data stateDengan memantau metrik ini, Anda dapat memeriksa berapa banyak ruang disk lokal yang ditempati oleh state sehingga Anda dapat mengambil tindakan lebih awal saat penggunaannya tinggi, serta menentukan apakah ruang disk lokal yang tidak mencukupi disebabkan oleh data state yang terlalu besar.BytesCustom

Metrik window

MetricDescriptionDetailsUnitType
flink_taskmanager_job_task_operator_numLateRecordsDroppedJumlah total record yang dibuang karena latensi windowN/ACountCustom
flink_taskmanager_job_task_operator_lateRecordsDroppedRateLaju pembuangan record karena latensi windowN/AN/ACustom

Metrik konektor CDC

Metrik konektor Change data capture (CDC) melacak fase snapshot, di mana data penuh diproses, dan fase binary logging (binlog), di mana data inkremental diproses. Tabel-tabel berikut mengelompokkan metrik ini berdasarkan fase tempat pekerjaan berada, progres fase snapshot, volume data yang telah dibaca, serta pernyataan DML dan DDL yang diproses dalam fase inkremental.

Dalam nama metrik, ganti cdcns_schema_table dengan namespace CDC, nama skema, dan nama tabel dari tabel yang ingin Anda pantau. Metrik yang namanya memuat segmen ini melaporkan nilai untuk satu tabel. Metrik yang namanya tidak memuatnya melaporkan nilai untuk seluruh pekerjaan.

Indikator fase

MetricDescriptionDetailsUnitType
flink_jobmanager_job_operator_coordinator_enumerator_isSnapshottingApakah pekerjaan berada dalam fase pemrosesan data penuhTentukan apakah pekerjaan masih dalam fase snapshot.N/ACustom
flink_jobmanager_job_operator_coordinator_enumerator_isBinlogReadingApakah pekerjaan berada dalam fase pemrosesan data inkrementalTentukan apakah pekerjaan telah memasuki fase binlog.N/ACustom

Progres snapshot

MetricDescriptionDetailsUnitType
flink_jobmanager_job_operator_coordinator_enumerator_numTablesRemainingJumlah tabel yang belum diproses dalam fase snapshotLihat jumlah tabel yang masih menunggu untuk diproses.CountCustom
flink_jobmanager_job_operator_coordinator_enumerator_numTablesSnapshottedJumlah tabel yang telah selesai di-snapshotLihat jumlah tabel yang telah diproses.CountCustom
flink_jobmanager_job_operator_coordinator_enumerator_numSnapshotSplitsProcessedJumlah shard yang telah diproses dalam fase snapshot, untuk seluruh pekerjaanLihat jumlah shard yang telah diproses di semua tabel.CountCustom
flink_jobmanager_job_operator_coordinator_enumerator_cdcns_schema_table_numSnapshotSplitsProcessedJumlah shard yang telah diproses dalam fase snapshot, untuk satu tabelLihat jumlah shard yang telah diproses untuk tabel tertentu.CountCustom
flink_jobmanager_job_operator_coordinator_enumerator_numSnapshotSplitsRemainingJumlah shard yang menunggu untuk diproses dalam fase snapshot, untuk seluruh pekerjaanLihat jumlah shard yang belum diproses di semua tabel.CountCustom
flink_jobmanager_job_operator_coordinator_enumerator_cdcns_schema_table_numSnapshotSplitsRemainingJumlah shard yang menunggu untuk diproses dalam fase snapshot, untuk satu tabelLihat jumlah shard yang belum diproses untuk tabel tertentu.CountCustom

Volume data

MetricDescriptionDetailsUnitType
flink_taskmanager_job_task_operator_currentReadTimestampMsTimestamp record data terbaru yang telah dibacaLihat timestamp data binlog terbaru.msCustom
flink_taskmanager_job_task_operator_numSnapshotRecordsJumlah record yang telah diproses dalam fase snapshotLihat volume data yang telah diproses dalam fase snapshot.CountCustom
flink_taskmanager_job_task_operator_cdcns_schema_table_numRecordsInJumlah record yang telah dibaca untuk setiap tabelLihat total volume data yang telah diproses untuk setiap tabel.CountCustom
flink_taskmanager_job_task_operator_cdcns_schema_table_numSnapshotRecordsJumlah record yang telah diproses untuk setiap tabel dalam fase snapshotLihat volume data yang telah diproses untuk setiap tabel dalam fase snapshot.CountCustom

DML dan DDL fase inkremental

MetricDescriptionDetailsUnitType
flink_taskmanager_job_task_operator_cdcns_schema_table_numInsertDMLRecordsJumlah pernyataan INSERT DML yang diproses untuk setiap tabel dalam fase inkrementalLihat volume data pernyataan INSERT untuk setiap tabel.CountCustom
flink_taskmanager_job_task_operator_cdcns_schema_table_numUpdateDMLRecordsJumlah pernyataan UPDATE DML yang diproses untuk setiap tabel dalam fase inkrementalLihat volume data pernyataan UPDATE untuk setiap tabel.CountCustom
flink_taskmanager_job_task_operator_cdcns_schema_table_numDeleteDMLRecordsJumlah pernyataan DELETE DML yang diproses untuk setiap tabel dalam fase inkrementalLihat volume data pernyataan DELETE untuk setiap tabel.CountCustom
flink_taskmanager_job_task_operator_cdcns_schema_table_numDDLRecordsJumlah pernyataan DDL yang diproses untuk setiap tabel dalam fase inkrementalLihat volume data pernyataan DDL untuk setiap tabel.CountCustom
flink_taskmanager_job_task_operator_numInsertDMLRecordsJumlah pernyataan INSERT DML yang diproses dalam fase inkrementalLihat volume data pernyataan INSERT.CountCustom
flink_taskmanager_job_task_operator_numUpdateDMLRecordsJumlah pernyataan UPDATE DML yang diproses dalam fase inkrementalLihat volume data pernyataan UPDATE.CountCustom
flink_taskmanager_job_task_operator_numDeleteDMLRecordsJumlah pernyataan DELETE DML yang diproses dalam fase inkrementalLihat volume data pernyataan DELETE.CountCustom
flink_taskmanager_job_task_operator_numDDLRecordsJumlah pernyataan DDL yang diproses dalam fase inkrementalLihat volume data pernyataan DDL.CountCustom

Sumber daya JVM dan sistem JobManager

CPU

MetricDescriptionDetailsUnitType
flink_jobmanager_Status_JVM_CPU_LoadBeban CPU JobManager tunggalJika nilai ini tetap di atas 100% dalam waktu lama, CPU sedang sibuk dan bebannya tinggi. Hal ini dapat memengaruhi kinerja sistem dan menyebabkan sistem tersendat atau waktu respons menjadi terlalu lama.N/ABasic
flink_jobmanager_Status_ProcessTree_CPU_UsageUtilisasi CPU JobManager tunggalNilai ini mencerminkan berapa banyak waktu CPU yang digunakan oleh Flink. Nilainya 100% ketika 1 core CPU digunakan sepenuhnya dan 400% ketika 4 core CPU digunakan sepenuhnya. Jika nilai ini tetap di atas 100% dalam waktu lama, CPU sangat sibuk. Jika beban tinggi tetapi utilisasi CPU rendah, operasi baca dan tulis yang sering mungkin menyebabkan terlalu banyak proses dalam keadaan sleep yang tidak dapat diinterupsi.N/ABasic

Memori

MetricDescriptionDetailsUnitType
flink_jobmanager_Status_JVM_Memory_Heap_UsedMemori heap JobManagerN/ABytesBasic
flink_jobmanager_Status_JVM_Memory_Heap_CommittedMemori heap yang dialokasikan oleh JobManagerN/ABytesBasic
flink_jobmanager_Status_JVM_Memory_Heap_MaxMemori heap maksimum JobManagerN/ABytesBasic
flink_jobmanager_Status_JVM_Memory_NonHeap_UsedMemori non-heap JobManagerN/ABytesBasic
flink_jobmanager_Status_JVM_Memory_NonHeap_CommittedMemori non-heap yang dialokasikan oleh JobManagerN/ABytesBasic
flink_jobmanager_Status_JVM_Memory_NonHeap_MaxMemori non-heap maksimum JobManagerN/ABytesBasic

Utas

MetricDescriptionDetailsUnitType
flink_jobmanager_Status_JVM_Threads_CountJumlah thread JobManagerTerlalu banyak thread JobManager menempati ruang memori berlebihan dan mengurangi stabilitas pekerjaan.CountBasic

Pengumpulan sampah

Metrik garbage collector G1 dalam tabel berikut merupakan metrik kustom. Metrik pengumpulan sampah JobManager lainnya merupakan metrik dasar.

MetricDescriptionDetailsUnitType
flink_jobmanager_Status_JVM_GarbageCollector_ParNew_CountJumlah GC JobManagerTerlalu banyak GC menempati ruang memori berlebihan dan memengaruhi kinerja pekerjaan. Metrik ini membantu Anda mendiagnosis pekerjaan dan mengatasi kegagalan tingkat pekerjaan.CountBasic
flink_jobmanager_Status_JVM_GarbageCollector_G1_Young_Generation_CountJumlah GC generasi muda JobManager (garbage collector G1)N/ACountCustom
flink_jobmanager_Status_JVM_GarbageCollector_G1_Old_Generation_CountJumlah GC generasi tua JobManager (garbage collector G1)N/ACountCustom
flink_jobmanager_Status_JVM_GarbageCollector_G1_Young_Generation_TimeWaktu GC generasi muda JobManager (garbage collector G1)N/AmsCustom
flink_jobmanager_Status_JVM_GarbageCollector_G1_Old_Generation_TimeWaktu GC generasi tua JobManager (garbage collector G1)N/AmsCustom
flink_jobmanager_Status_JVM_GarbageCollector_ConcurrentMarkSweep_CountJumlah koleksi yang dilakukan oleh garbage collector CMS JobManagerN/ACountBasic
flink_jobmanager_Status_JVM_GarbageCollector_ParNew_TimeDurasi setiap GC JobManagerGC yang lama menempati ruang memori berlebihan dan memengaruhi kinerja pekerjaan. Metrik ini membantu Anda mendiagnosis pekerjaan dan mengatasi kegagalan tingkat pekerjaan.msBasic
flink_jobmanager_Status_JVM_GarbageCollector_ConcurrentMarkSweep_TimeWaktu yang dikonsumsi oleh koleksi yang dilakukan oleh garbage collector CMS JobManagerN/AmsBasic

Pemuatan kelas

MetricDescriptionDetailsUnitType
flink_jobmanager_Status_JVM_ClassLoader_ClassesLoadedJumlah total kelas yang dimuat setelah JVM yang menjalankan JobManager dibuatJika jumlah total kelas yang dimuat setelah JVM yang menjalankan JobManager dibuat terlalu besar, ruang memori berlebihan ditempati dan kinerja pekerjaan terpengaruh.N/ABasic
flink_jobmanager_Status_JVM_ClassLoader_ClassesUnloadedJumlah total kelas yang dilepas setelah JVM yang menjalankan JobManager dibuatJika jumlah total kelas yang dilepas setelah JVM yang menjalankan JobManager dibuat terlalu besar, ruang memori berlebihan ditempati dan kinerja pekerjaan terpengaruh.N/ABasic

Sumber daya JVM dan sistem TaskManager

CPU

MetricDescriptionDetailsUnitType
flink_taskmanager_Status_JVM_CPU_LoadBeban CPU TaskManager tunggalJumlah proses yang ditangani CPU dan proses yang menunggu CPU dalam periode waktu tertentu, yang umumnya dipahami sebagai seberapa sibuk CPU tersebut. Seberapa sibuk CPU tergantung pada jumlah core CPU. Di Flink, nilai beban CPU adalah CPU Usage / Jumlah core CPU. Jika flink_taskmanager_Status_JVM_CPU_Load lebih besar dari nilai beban CPU, pemrosesan CPU mungkin terblokir.N/ABasic
flink_taskmanager_Status_ProcessTree_CPU_UsageUtilisasi CPU TaskManager tunggalNilai ini mencerminkan berapa banyak waktu CPU yang digunakan oleh Flink. Nilainya 100% ketika 1 core CPU digunakan sepenuhnya dan 400% ketika 4 core CPU digunakan sepenuhnya. Jika nilai ini tetap di atas 100% dalam waktu lama, CPU sangat sibuk. Jika beban tinggi tetapi utilisasi CPU rendah, operasi baca dan tulis yang sering mungkin menyebabkan terlalu banyak proses dalam keadaan sleep yang tidak dapat diinterupsi.N/ABasic

Memori

MetricDescriptionDetailsUnitType
flink_taskmanager_Status_JVM_Memory_Heap_UsedMemori heap TaskManagerN/ABytesBasic
flink_taskmanager_Status_JVM_Memory_Heap_CommittedMemori heap yang dialokasikan oleh TaskManagerN/ABytesBasic
flink_taskmanager_Status_JVM_Memory_Heap_MaxMemori heap maksimum TaskManagerN/ABytesBasic
flink_taskmanager_Status_JVM_Memory_NonHeap_UsedMemori non-heap TaskManagerN/ABytesBasic
flink_taskmanager_Status_JVM_Memory_NonHeap_CommittedMemori non-heap yang dialokasikan oleh TaskManagerN/ABytesBasic
flink_taskmanager_Status_JVM_Memory_NonHeap_MaxMemori non-heap maksimum TaskManagerN/ABytesBasic
flink_taskmanager_Status_ProcessTree_Memory_RSSMemori seluruh proses yang diperoleh melalui LinuxLihat perubahan memori proses.BytesBasic

Thread

MetricDescriptionDetailsUnitType
flink_taskmanager_Status_JVM_Threads_CountJumlah thread TaskManagerTerlalu banyak thread TaskManager menempati memori berlebihan dan mengurangi stabilitas pekerjaan.CountBasic

Pengumpulan sampah

Metrik garbage collector G1 dalam tabel berikut merupakan metrik kustom. Metrik pengumpulan sampah TaskManager lainnya merupakan metrik dasar.

MetricDescriptionDetailsUnitType
flink_taskmanager_Status_JVM_GarbageCollector_ParNew_CountJumlah GC TaskManagerTerlalu banyak GC menempati ruang memori berlebihan dan memengaruhi kinerja pekerjaan. Metrik ini membantu Anda mendiagnosis pekerjaan dan mengatasi kegagalan tingkat tugas.CountBasic
flink_taskmanager_Status_JVM_GarbageCollector_G1_Young_Generation_CountJumlah GC generasi muda TaskManager (garbage collector G1)N/ACountCustom
flink_taskmanager_Status_JVM_GarbageCollector_G1_Old_Generation_CountJumlah GC generasi tua TaskManager (garbage collector G1)N/ACountCustom
flink_taskmanager_Status_JVM_GarbageCollector_G1_Young_Generation_TimeWaktu GC generasi muda TaskManager (garbage collector G1)N/AmsCustom
flink_taskmanager_Status_JVM_GarbageCollector_G1_Old_Generation_TimeWaktu GC generasi tua TaskManager (garbage collector G1)N/AmsCustom
flink_taskmanager_Status_JVM_GarbageCollector_ConcurrentMarkSweep_CountJumlah koleksi yang dilakukan oleh garbage collector CMS TaskManagerN/ACountBasic
flink_taskmanager_Status_JVM_GarbageCollector_ParNew_TimeDurasi setiap GC TaskManagerGC yang lama menempati ruang memori berlebihan dan memengaruhi kinerja pekerjaan. Metrik ini membantu Anda mendiagnosis pekerjaan dan mengatasi kegagalan tingkat tugas.msBasic
flink_taskmanager_Status_JVM_GarbageCollector_ConcurrentMarkSweep_TimeWaktu yang dikonsumsi oleh koleksi yang dilakukan oleh garbage collector CMS TaskManagerN/AmsBasic

Pemuatan kelas

MetricDescriptionDetailsUnitType
flink_taskmanager_Status_JVM_ClassLoader_ClassesLoadedJumlah total kelas yang dimuat setelah JVM yang menjalankan TaskManager dibuatJika jumlah total kelas yang dimuat setelah JVM yang menjalankan TaskManager dibuat terlalu besar, ruang memori berlebihan ditempati dan kinerja pekerjaan terpengaruh.N/ABasic
flink_taskmanager_Status_JVM_ClassLoader_ClassesUnloadedJumlah total kelas yang dilepas setelah JVM yang menjalankan TaskManager dibuatJika jumlah total kelas yang dilepas setelah JVM yang menjalankan TaskManager dibuat terlalu besar, ruang memori berlebihan ditempati dan kinerja pekerjaan terpengaruh.N/ABasic

Label metrik umum

Metrik Flink umumnya membawa label berikut. Gunakan label ini untuk memfilter dan mengagregasi data metrik berdasarkan proyek, penerapan, atau pekerjaan.

LabelDescription
vvpNamespaceNamespace proyek.
deploymentNameNama penerapan.
deploymentIdID penerapan.
jobIdID pekerjaan.

Referensi

Topik-topik berikut mencakup kumpulan metrik terkait dan opsi manajemen metrik.