ApsaraDB for ClickHouse mendukung penyiapan peringatan untuk metrik kluster utama. Ketika nilai suatu metrik melebihi ambang batas yang dikonfigurasi, sistem akan mengirimkan notifikasi peringatan kepada kontak dalam kelompok peringatan guna membantu Anda mengidentifikasi masalah secara cepat. Topik ini menjelaskan cara menyiapkan aturan peringatan untuk kluster ApsaraDB for ClickHouse.
Prasyarat
-
Kluster merupakan kluster Edisi Komunitas atau Edisi Perusahaan.
-
Fitur peringatan untuk ApsaraDB for ClickHouse bergantung pada Application Real-Time Monitoring Service (ARMS). Jika Anda adalah Pengguna RAM, Anda harus memiliki izin AliyunARMSFullAccess untuk mengelola ARMS. Untuk informasi lebih lanjut tentang cara memberikan izin ini, lihat Mengelola izin untuk Pengguna RAM.
Catatan penggunaan
Anda tidak dapat melihat informasi pemantauan untuk kluster Edisi Perusahaan di Konsol CloudMonitor.
Prosedur
Konsol ApsaraDB for ClickHouse
Jika kluster Anda memenuhi kedua kondisi berikut, lihat Prosedur untuk konsol lama.
-
Kluster dibuat sebelum 1 Desember 2021.
-
Kluster berada di wilayah Tiongkok (Qingdao) atau Tiongkok (Hohhot).
-
Masuk ke Konsol ApsaraDB for ClickHouse.
-
Di pojok kiri atas halaman, pilih wilayah tempat kluster target berada.
-
Pada halaman Clusters, pilih Clusters of Community-compatible Edition atau Enterprise Edition Clusters, lalu klik ID kluster target.
-
Di panel navigasi sebelah kiri, klik Monitoring and Alerting.
-
Pada halaman Monitoring Details, klik tab Cluster Alerting.
-
Klik tombol untuk membuat aturan peringatan kluster.
CatatanUntuk kluster Edisi Komunitas, tombolnya adalah Create ClickHouse Alert Rule.
Untuk kluster Edisi Perusahaan, tombolnya adalah Create Enterprise Edition ClickHouse Alert Rule.
-
Pada halaman Create ClickHouse Alert Rule atau Create Enterprise Edition ClickHouse Alert Rule, konfigurasikan parameter berikut.
CatatanApsaraDB for ClickHouse menyediakan dua jenis pemeriksaan untuk aturan peringatan: ambang batas statis dan PromQL kustom. Parameter yang tersedia bervariasi tergantung pada jenis pemeriksaan yang dipilih.
-
Jenis pemeriksaan ambang batas statis memungkinkan Anda membuat aturan peringatan dengan cepat dengan memilih dari metrik yang telah ditentukan sebelumnya.
-
Jenis pemeriksaan PromQL kustom digunakan untuk membuat aturan peringatan untuk metrik yang tidak disediakan oleh sistem secara default.
Ambang batas statis
Parameter
Deskripsi
Contoh
Alert Name
Nama aturan peringatan.
CPU utilization alert
Check Type
Pilih Static Threshold.
Static Threshold
Cluster
Kluster target untuk aturan peringatan.
cc-bp1lxbo89u95****
Alert group
Pilih kelompok peringatan.
Kelompok peringatan yang tersedia bervariasi berdasarkan tipe instans Prometheus.
ClickHouse Open Source Edition
Alert Metric
Metrik yang akan dipantau. Metrik yang tersedia bergantung pada Alert group yang dipilih.
CPU utilization
Alert Condition
Konfigurasikan kondisi pemicu untuk metrik yang dipilih.
Peringatan dipicu ketika CPU utilization
greater than80%.Filter Conditions
Tidak ada filter
None
Preview Data
Bagian Preview Data menampilkan pernyataan PromQL yang sesuai dengan kondisi peringatan dan memplot nilai metrik pemantauan yang dikonfigurasi untuk aturan peringatan saat ini sebagai kurva deret waktu.
-
Secara default, hanya nilai real-time dari satu resource yang ditampilkan.
-
Anda dapat memilih resource target dan rentang waktu untuk melihat nilai dari resource berbeda dalam periode berbeda.
Catatan-
Ambang batas peringatan ditampilkan sebagai garis horizontal merah pada grafik. Data deret waktu yang memenuhi ambang batas ditampilkan dalam warna merah tua, sedangkan data yang tidak memenuhi ambang batas ditampilkan dalam warna biru.
-
Arahkan kursor ke grafik deret waktu untuk melihat detail resource pada titik waktu tertentu.
-
Pada grafik deret waktu, pilih rentang waktu untuk melihat deret waktu selama periode yang ditentukan.
None
Duration
-
Peringatan dipicu segera ketika kondisi terpenuhi: Peringatan dipicu jika ada titik data yang mencapai ambang batas.
-
Peringatan dipicu hanya jika kondisi bertahan selama N menit.
1
Alert Level
Tingkat keparahan peringatan. Tingkat default adalah Default. Tingkat keparahan, dari terendah ke tertinggi, adalah Default, P4, P3, P2, dan P1.
P2
Alert Content
Isi pemberitahuan peringatan. Anda dapat menggunakan sintaks templat Go untuk menyertakan variabel.
Node: {{$labels.pod_name}} CPU utilization {{$labels.metrics_params_opt_label_value}} {{$labels.metrics_params_value}}%, current value {{ printf "%.2f" $value }}%
Alert Notification
Simple mode
Alert Contact: objek yang akan diberi tahu ketika peringatan dipicu.
Notification period: periode waktu selama pemberitahuan peringatan dikirim. Peringatan yang dipicu di luar periode ini akan diabaikan.
Repetition policy: kebijakan untuk mengirim pemberitahuan berulang ketika peringatan dipicu.
-
Alert Contact: Pilih kontak dan tentukan metode notifikasi (Email, Phone, SMS, atau Group @). Klik + Create Notification Object untuk menambahkan kontak baru.
-
Notification Period: Tetapkan waktu mulai dan akhir (misalnya, 00:00~23:59). Konfigurasi lintas hari dalam 24 jam didukung.
-
Whether to Resend Notifications: Pilih No escalation policy required. Send only once when the alert is not recovered, atau pilih When the alert is not recovered, send repeated notifications at specified intervals.
Standard Mode
Tentukan kebijakan menggunakan Quickly Specify Notification Policy.
PentingOpsi Quickly Specify Notification Policy memastikan bahwa event dari aturan peringatan saat ini dicocokkan oleh kebijakan notifikasi yang dipilih. Namun, event tersebut juga mungkin dicocokkan oleh kebijakan notifikasi lain yang menggunakan pencocokan kabur. Hubungan antara event aturan peringatan dan kebijakan notifikasi bersifat banyak-ke-banyak.
-
Jangan tentukan aturan notifikasi.
-
Pilih kebijakan notifikasi yang sudah ada.
CatatanAnda dapat mengklik Create Notification Policy untuk membuat kebijakan notifikasi. Untuk informasi lebih lanjut, lihat Notification policies.
Do not specify a notification policy
Advanced Settings
Alert check period
Frekuensi pemeriksaan kondisi peringatan. Nilai minimum dan default adalah 1 menit.
1 minute
Data complete check
Tunggu hingga data dikumpulkan, ditransmisikan, dan disimpan sebelum pemeriksaan peringatan dilakukan. Nilai default adalah Yes. Dalam kebanyakan kasus, Anda tidak perlu mengubah nilai ini.
Yes
Tag
Tetapkan tag untuk aturan peringatan. Tag tersebut dapat digunakan sebagai kondisi pencocokan dalam kebijakan notifikasi.
None
Comment
Tambahkan anotasi untuk aturan peringatan.
None
PromQL kustom
Parameter
Deskripsi
Contoh
Alert Name
Nama aturan peringatan.
Pod CPU utilization is greater than 8%
Check Type
Atur ke custom PromQL.
custom PromQL
Cluster
Kluster target untuk aturan peringatan.
cc-bp1lxbo89u95****
Reference Alert Contact Group
Pilih kelompok peringatan.
Kelompok peringatan yang tersedia bervariasi berdasarkan tipe instans Prometheus.
ClickHouse Open Source Edition
Reference Metrics
Opsional. Menyediakan templat PromQL untuk metrik umum. Anda dapat memilih templat lalu memodifikasinya.
Opsi Reference alert metric yang tersedia secara otomatis difilter berdasarkan tipe instans Prometheus yang dipilih.
Number of HTTP connections
Custom PromQL statement
Ekspresi PromQL yang mendefinisikan kondisi peringatan.
clickhouse_http_conn_usage_count{} > 1000Preview Data
Duration
-
Peringatan dipicu segera ketika kondisi terpenuhi: Peringatan dipicu jika ada titik data yang mencapai ambang batas.
-
Peringatan dipicu hanya jika kondisi bertahan selama N menit.
1
Alert Level
Tingkat keparahan peringatan. Tingkat default adalah Default. Tingkat keparahan, dari terendah ke tertinggi, adalah Default, P4, P3, P2, dan P1.
Default
Alert Content
Isi pemberitahuan peringatan. Anda dapat menggunakan sintaks templat Go untuk menyertakan variabel.
Namespace: {{$labels.namespace}}/Pod: {{$labels.pod_name}}/Disk device: {{$labels.device}} utilization exceeds 90%, current value {{ printf "%.2f" $value }}%
Alert Notification
Simple mode
Alert Contact: objek yang akan diberi tahu ketika peringatan dipicu.
Notification period: periode waktu selama pemberitahuan peringatan dikirim. Peringatan yang dipicu di luar periode ini akan diabaikan.
Whether to Resend Notifications: kebijakan untuk mengirim pemberitahuan berulang ketika peringatan dipicu.
Standard Mode
Tentukan kebijakan menggunakan Quickly Specify Notification Policy.
PentingOpsi Quickly Specify Notification Policy memastikan bahwa event dari aturan peringatan saat ini dicocokkan oleh kebijakan notifikasi yang dipilih. Namun, event tersebut juga mungkin dicocokkan oleh kebijakan notifikasi lain yang menggunakan pencocokan kabur. Hubungan antara event aturan peringatan dan kebijakan notifikasi bersifat banyak-ke-banyak.
-
Jangan tentukan aturan notifikasi.
-
Pilih kebijakan notifikasi yang sudah ada.
CatatanAnda dapat mengklik Create Notification Policy untuk membuat kebijakan notifikasi. Untuk informasi lebih lanjut, lihat Notification policies.
Do not specify a notification policy
Advanced Settings
Alert check period
Frekuensi pemeriksaan kondisi peringatan. Nilai minimum dan default adalah 1 menit.
1 minute
Check When Data Is Complete
Tunggu hingga data dikumpulkan, ditransmisikan, dan disimpan sebelum pemeriksaan peringatan dilakukan. Nilai default adalah Yes. Dalam kebanyakan kasus, Anda tidak perlu mengubah nilai ini.
Yes
Tag
Tetapkan tag untuk aturan peringatan. Tag tersebut dapat digunakan sebagai kondisi pencocokan dalam kebijakan notifikasi.
None
Comment
Tambahkan anotasi untuk aturan peringatan.
None
-
-
Setelah mengonfigurasi parameter, klik Completed.
Konsol CloudMonitor
-
Masuk ke Konsol CloudMonitor.
-
Di panel navigasi sebelah kiri, pilih .
-
Pada halaman Alert Rules, klik Create Alert Rule.
-
Pada panel Create Alert Rule, konfigurasikan parameter berikut.
Parameter
Deskripsi
Products
Pilih tipe kluster untuk ApsaraDB for ClickHouse. Nilai yang valid:
-
ApsaraDB for ClickHouse: Kluster Edisi Komunitas yang dibeli sebelum 1 Desember 2021.
-
ApsaraDB for ClickHouse Community Edition: Kluster Edisi Komunitas yang dibeli pada atau setelah 1 Desember 2021.
Resource Range
Cakupan resource tempat aturan peringatan berlaku. Nilai yang valid:
-
All Resources: Aturan peringatan berlaku untuk semua resource layanan cloud yang ditentukan, termasuk resource yang baru ditambahkan.
-
Application Group: Aturan peringatan berlaku untuk semua resource dalam kelompok aplikasi tertentu dari layanan cloud, termasuk resource yang baru ditambahkan.
-
Instance: Aturan peringatan berlaku untuk resource spesifik dari layanan cloud.
Description
Menentukan kondisi pemicu untuk peringatan. Untuk mengonfigurasi deskripsi aturan, ikuti langkah-langkah berikut:
-
Klik Add Rule.
-
Di panel Set Rule Description , masukkan Rule Name lalu atur kondisi aturan.
-
Single Metric: Pilih metrik lalu atur ambang batas dan tingkat peringatan.
-
Multiple Metrics: Pilih tingkat peringatan lalu atur kondisi peringatan untuk dua metrik atau lebih.
-
Dynamic Threshold: Untuk informasi lebih lanjut tentang ambang batas cerdas, lihat Overview dan Create an alert rule for an intelligent threshold.
CatatanFitur ambang batas cerdas sedang dalam pengujian beta. Anda harus membuat tiket untuk mengajukan akses.
-
-
Klik OK.
CatatanUntuk informasi tentang cara menetapkan kondisi peringatan kompleks, lihat Expressions for alert rules.
Mute Period
Penundaan sebelum CloudMonitor mengirim ulang notifikasi untuk peringatan yang belum terselesaikan. Nilai yang valid: 5 menit, 15 menit, 30 menit, 60 menit, 3 jam, 6 jam, 12 jam, dan 24 jam.
Ketika metrik yang dipantau mencapai ambang batasnya, peringatan dikirim. Jika metrik tersebut terus melebihi ambang batas selama periode bisu, tidak ada peringatan baru yang dikirim. Jika metrik masih dalam status peringatan setelah periode bisu, CloudMonitor akan mengirim notifikasi peringatan lain.
Misalnya, jika Anda mengatur Mute Period menjadi 12 Hours, CloudMonitor akan mengirim ulang notifikasi setelah 12 jam jika peringatan belum terselesaikan.
Effective Time
Periode waktu saat aturan peringatan aktif. Notifikasi hanya dikirim untuk peringatan yang dipicu selama periode ini.
CatatanJika peringatan dipicu di luar periode efektif, tidak ada notifikasi yang dikirim, tetapi peringatan tersebut tetap dicatat dalam daftar Alert History.
Alert Contact Group
Kelompok kontak tempat notifikasi peringatan dikirim.
Notifikasi peringatan untuk kelompok aplikasi dikirim ke kontak dalam kelompok kontak yang ditentukan. Kelompok kontak dapat berisi satu atau lebih kontak.
Untuk informasi tentang cara membuat kontak dan kelompok kontak, lihat Create an alert contact or a contact group.
Tag
Tag untuk aturan peringatan, yang terdiri dari kunci tag dan nilai tag.
CatatanAnda dapat menambahkan hingga enam tag.
Advanced Settings
Alert Callback
URL yang dapat diakses publik yang menerima informasi peringatan dari CloudMonitor melalui permintaan POST. Hanya protokol HTTP yang didukung. Untuk informasi tentang cara mengonfigurasi panggilan balik peringatan, lihat Use a webhook to send threshold-triggered alerts.
Untuk menguji konektivitas URL panggilan balik peringatan, lakukan langkah-langkah berikut:
-
Klik Test di samping URL panggilan balik.
Di panel Webhook Test, Anda dapat memeriksa kode status webhook dan detail hasil pengujian untuk mendiagnosis masalah konektivitas.
CatatanAnda juga dapat mengatur Callback Template Type dan Language untuk webhook, lalu klik Test lagi untuk melihat hasil pengujian yang sesuai.
-
Klik Disable.
Auto Scaling
Jika Anda mengaktifkan Auto Scaling, aturan penskalaan yang sesuai akan dipicu ketika terjadi peringatan. Anda harus mengonfigurasi Region, ESS Group, dan ESS Rule untuk Auto Scaling.
-
Untuk informasi tentang cara membuat grup penskalaan, lihat Manage scaling groups.
-
Untuk informasi tentang cara membuat aturan penskalaan, lihat Manage scaling rules.
Log Service
Jika Anda mengaktifkan Log Service, informasi peringatan akan dikirim ke Logstore di Log Service ketika terjadi peringatan. Anda harus mengonfigurasi Region, ProjectName, dan Logstore untuk Log Service.
Untuk informasi tentang cara membuat Project dan Logstore, lihat Use iLogtail to collect and analyze text logs from ECS instances.
Simple Message Queue (formerly MNS) - Topic
Jika Anda mengaktifkan Message Service MNS-Topic, informasi peringatan akan dikirim ke topik di Message Service (MNS) ketika terjadi peringatan.
Untuk mengaktifkan fitur ini, Anda harus mengonfigurasi wilayah dan topik untuk Message Service (MNS). Untuk informasi tentang cara membuat topik, lihat Create a topic.
Function Compute
Jika Anda mengaktifkan Function Compute, notifikasi peringatan akan dikirim ke Function Compute untuk diformat ketika terjadi peringatan. Anda harus mengonfigurasi wilayah, layanan, dan fungsi untuk Function Compute.
Untuk informasi tentang cara membuat layanan dan fungsi, lihat Create a function.
NoDataPolicy
Metode penanganan peringatan ketika tidak tersedia data pemantauan. Nilai yang valid:
-
Do not do anything (Default)
-
Send alert notifications
-
Treat as recovered
-
(Opsional) Konsol lama
Langkah selanjutnya
Untuk mengelola aturan peringatan yang dibuat di Konsol ApsaraDB for ClickHouse, lihat Manage alert rules.
Dokumen terkait
Jika Anda baru mengenal CloudMonitor, lihat What is CloudMonitor?.