Topik ini menjelaskan cara mengintegrasikan pemantauan event kontainer dengan Managed Service for Prometheus, serta cara melihat dasbor dan mengatur aturan peringatan. Pemantauan event merupakan metode pemantauan di Kubernetes yang melengkapi pemantauan resource dengan mengatasi keterbatasannya dalam hal ketepatan waktu, akurasi, dan cakupan skenario. Anda dapat memantau anomali dan masalah kluster secara real time menggunakan NPD (node-problem-detector) bersama pusat event Kubernetes dari SLS, mengonfigurasi pemeriksaan kluster NPD dan fitur offline event abnormal, serta memanfaatkan DingTalk, event Kubernetes offline SLS, dan event Kubernetes offline EventBridge.
Prasyarat
-
Anda telah mengaktifkan Managed Service for Prometheus. Untuk informasi selengkapnya, lihat Penagihan instans Prometheus.
-
Anda telah membuat Kubernetes cluster. Untuk informasi selengkapnya, lihat Buat kluster ACK yang dikelola.
-
Anda telah mengaktifkan Resource Center. Untuk informasi selengkapnya, lihat Aktifkan Resource Center.
Langkah 1: Integrasikan pemantauan event kontainer
-
Masuk ke atau Prometheus console. Di panel navigasi kiri, klik Integration Center.
-
Klik kartu Kubernetes Event, pilih ACK cluster yang akan diintegrasikan, lalu ikuti petunjuk di layar untuk menyelesaikan integrasi komponen.
CatatanSetelah integrasi, ingesti data lengkap memerlukan waktu sekitar satu hingga dua menit. Dasbor tidak akan menampilkan data hingga proses ingesti selesai.
Langkah 2: Lihat dasbor
Managed Service for Prometheus menyediakan berbagai dasbor bawaan untuk pemantauan kontainer, mencakup ringkasan kluster, komponen inti, node, dan Pod. Anda dapat mengakses dasbor tersebut dari Konsol Container Service for Kubernetes (ACK), ARMS console, dan Prometheus console.
-
Masuk ke atau Prometheus console. Di panel navigasi sebelah kiri, klik Integration Management.
-
Di halaman Integration Management, klik tab Query Dashboards. Dari daftar drop-down Select Environment, pilih lingkungan kontainer target, misalnya
mengtu-test-api. Anda dapat memfilter dasbor menggunakan daftar drop-down Scenario dan Source Component, serta filter label seperti api-server, etcd, kubernetes, node, dan storage. Daftar akan diperbarui untuk menampilkan dasbor yang tersedia sesuai kriteria Anda.
Langkah 3: Atur peringatan
-
Masuk ke atau Prometheus console. Di panel navigasi sebelah kiri, klik Integration Management.
-
Di halaman Integration Management, klik tab Integrated Environments. Pilih Container Service, lalu klik nama lingkungan target untuk membuka halaman detailnya.
-
Klik tab Component Management. Di daftar tipe komponen di sebelah kiri, pilih Kubernetes Event. Kemudian, di sebelah kanan, klik tab Alert Rule untuk melihat aturan peringatan bawaan.
-
Aturan peringatan bawaan menghasilkan event peringatan, tetapi tidak mengirimkan notifikasi peringatan. Jika Anda ingin mengirimkan notifikasi peringatan ke alamat email atau platform lain, klik Edit untuk mengonfigurasi kebijakan notifikasi.
Di halaman konfigurasi peringatan, Anda juga dapat menyesuaikan ambang batas peringatan, durasi, dan kontennya. Untuk informasi selengkapnya tentang konfigurasi peringatan, lihat Buat aturan peringatan Prometheus.
Di bagian Alert Notification, pilih Normal Mode. Dari daftar drop-down Quickly specify notification policy, pilih kebijakan notifikasi atau klik Create notification policy. Buka Advanced Settings dan atur Alert check cycle menjadi
1menit.
Metrik yang dikumpulkan
|
Metric |
Type |
Description |
|
eventer_events_error_total |
COUNTER |
Jumlah total event error. |
|
eventer_events_normal_total |
COUNTER |
Jumlah total event normal. |
|
eventer_events_warning_total |
COUNTER |
Jumlah total event peringatan. |
|
eventer_exporter_duration_milliseconds |
SUMMARY |
Waktu dalam milidetik yang dihabiskan untuk mengekspor event. |
|
eventer_manager_last_time_seconds |
GAUGE |
Timestamp Unix dalam detik dari tugas housekeeping eventer terakhir. |
|
eventer_scraper_duration_milliseconds |
SUMMARY |
Waktu dalam milidetik yang dihabiskan untuk mengambil event. |
|
eventer_scraper_events_total_number |
COUNTER |
Jumlah total event yang diambil. |
|
eventer_scraper_last_time_seconds |
GAUGE |
Timestamp Unix dalam detik dari event terakhir yang diambil. |