Aturan peringatan memantau penggunaan sumber daya di berbagai layanan Alibaba Cloud. Ketika suatu metrik memenuhi kondisi peringatan, Cloud Monitor secara otomatis mengirimkan notifikasi untuk membantu Anda mendeteksi anomali dan merespons dengan cepat.
Prosedur
-
Masuk ke Konsol Cloud Monitor.
-
Di panel navigasi sebelah kiri, pilih .
-
Pada halaman Alert Rules, klik Create Alert Rule.
-
Pada panel Create Alert Rule, konfigurasikan parameter aturan peringatan.
Contoh: Buat aturan peringatan yang memberi notifikasi kepada semua kontak dalam Alert Contact Group ketika utilisasi CPU maksimum dari instans Elastic Compute Service (ECS) mana pun mencapai 85% atau lebih tinggi selama tiga periode berturut-turut(Metode notifikasi: Email + WebHook).
-
Pilih Product sebagai Elastic Compute Service (ECS). Pilih Resource Range sebagai All Resources.
-
Konfigurasikan kondisi aturan.
-
Klik Add Rule dan pilih jenis metrik.
-
Pada panel Configure Rule Description, masukkan Alert Rule. Untuk Metric Type, pilih Simple Metric. Untuk Metric, pilih . Pada bagian Critical, atur kondisi pemicu menjadi tiga periode berturut-turut (satu periode sama dengan satu menit) dan atur nilai maksimum agar lebih besar dari atau sama dengan 85%.
-
Klik OK.
-
Metrik pemantauan CPU ECS
Saat Anda mengonfigurasi metrik pemantauan, daftar drop-down Metric berisi dua metrik terkait CPU: (ECS) CPU Utilization dan (Agent) cpu.total. Keduanya berbeda dalam sumber data dan kasus penggunaan. Pilih metrik sesuai kebutuhan Anda:
Attribute
(ECS) CPU Utilization
(Agent) cpu.total
Metric name
CPUUtilizationcpu_totalMonitoring type
Basic Monitoring
OS Monitoring (Agent)
Data source
Collected directly from the host
Collected by the Cloud Monitor agent
Plug-in required
No
Yes
Collection interval
60/300/3600 seconds
15/60/900 seconds
Scenario
Quick setup of general CPU alerts
Precise CPU monitoring and troubleshooting
(ECS) CPU Utilization dikumpulkan langsung dari host dan tidak memerlukan plug-in, sehingga cocok untuk penyiapan cepat peringatan CPU umum. (Agent) cpu.total dikumpulkan oleh agen Cloud Monitor, yang harus diinstal pada instans ECS, sehingga cocok untuk skenario yang memerlukan data penggunaan CPU yang akurat atau troubleshooting anomali CPU.
Tabel 1. Deskripsi parameter untuk aturan peringatan
Parameter
Description
Product
Layanan Alibaba Cloud yang dipantau oleh Cloud Monitor. Contoh: ApsaraDB RDS.
Resource Range
Cakupan sumber daya untuk aturan peringatan ini. Nilai yang valid:
-
All Resources: Berlaku untuk semua sumber daya produk yang ditentukan, termasuk sumber daya yang ditambahkan kemudian.
-
Application Groups: Berlaku untuk semua sumber daya dalam kelompok aplikasi yang ditentukan dari produk yang dipilih, termasuk sumber daya yang ditambahkan kemudian.
-
Instances: Hanya berlaku untuk sumber daya tertentu dari produk yang dipilih.
Beberapa aturan peringatan dengan cakupan sumber daya berbeda dapat mencakup instans yang sama secara bersamaan. Misalnya, sebuah instans dapat berada dalam cakupan All Resources sekaligus dalam kelompok aplikasi. Setiap aturan peringatan dievaluasi dan dipicu secara independen. Aturan peringatan tidak saling memengaruhi, dan tumpang tindih cakupan sumber daya tidak menyebabkan penggantian prioritas atau konflik.
Rule Description
Menentukan kapan Cloud Monitor memicu peringatan. Untuk mengonfigurasi:
-
Klik Add Rule dan pilih jenis metrik.
-
Pada panel Configure Rule Description, masukkan Alert Rule, lalu definisikan kondisi aturan tersebut.
-
Simple Metric: Pilih metrik, lalu atur ambang batas dan level peringatannya.
Level peringatan menggunakan model eskalasi. Saat ambang batas mencapai level tertentu, hanya level tersebut yang dipicu; level lain tidak dipicu secara bersamaan. Misalnya, jika ambang batas langsung mencapai Critical, hanya peringatan Critical yang dipicu, sedangkan peringatan Info dan Warning tidak dipicu secara bersamaan.
-
Combined Metrics: Pilih level peringatan, lalu definisikan kondisi peringatan menggunakan dua metrik atau lebih.
CatatanAturan peringatan multi-metrik mengharuskan sumber daya target melaporkan data untuk setiap metrik yang disertakan. Misalnya, jika aturan mencakup metrik jaringan publik tetapi instans ECS tidak memiliki alamat IP publik, peringatan tidak akan dipicu.
-
Expression: Pilih level peringatan, lalu definisikan ekspresi peringatan.
-
Dynamic Threshold: Rincian ambang batas cerdas: Ikhtisar | Buat aturan pemberitahuan ambang batas cerdas.
-
CatatanEkspresi peringatan kompleks: Alert rule expression reference.
Mute Period
Interval antara notifikasi peringatan berulang saat peringatan tetap aktif dan belum diakui. Nilai yang valid: 5 menit, 15 menit, 30 menit, 60 menit, 3 jam, 6 jam, 12 jam, dan 24 jam.
Ketika suatu metrik melewati ambang batas peringatannya, Cloud Monitor mengirimkan peringatan. Tidak ada peringatan tambahan yang dikirim selama periode bisu. Setelah periode bisu berakhir, jika metrik masih melebihi ambang batas, Cloud Monitor mengirimkan peringatan lain.
Misalnya, jika Anda mengatur Mute Period menjadi 12 jam dan peringatan tetap aktif, Cloud Monitor mengirimkan peringatan lain 12 jam kemudian.
Effective Period
Rentang waktu selama aturan peringatan aktif. Peringatan hanya dikirim selama periode ini.
CatatanDi luar periode efektif, peringatan tidak dikirim, tetapi catatan riwayat peringatan tetap muncul dalam daftar riwayat peringatan.
Alert Contact Group
Kelompok kontak yang menerima notifikasi peringatan.
Kelompok kontak peringatan berisi satu atau beberapa kontak peringatan. Notifikasi untuk kelompok aplikasi dikirimkan ke semua kontak dalam kelompok ini.
Untuk membuat kontak atau kelompok, lihat Create an alert contact or alert contact group.
Tag
Tag untuk aturan peringatan. Setiap tag memiliki nama dan nilai.
CatatanAnda dapat menambahkan hingga enam tag.
Alert Callback
URL yang dapat diakses publik yang menerima data peringatan dari Cloud Monitor melalui permintaan HTTP POST. Hanya HTTP yang didukung. Use threshold-based alert callbacks.
Untuk menguji konektivitas ke URL callback:
-
Klik Test, yang terletak tepat di sebelah kanan URL callback.
Pada panel WebHook Test, periksa kode status HTTP dan detail hasil pengujian untuk memverifikasi konektivitas.
CatatanAnda juga dapat mengatur Test Template Type: dan Language:. Lalu klik Test lagi untuk melihat hasil pengujian terbaru.
-
Klik Close.
CatatanKlik Advanced Settings untuk mengonfigurasi parameter ini.
Ketika peringatan dipicu, aturan peringatan hanya dapat mengirimkan notifikasi melalui saluran seperti pesan teks, email, WebHook, dan chatbot DingTalk, atau mengintegrasikannya dengan layanan Alibaba Cloud lainnya, seperti Auto Scaling, Function Compute, dan Simple Log Service. Aturan peringatan tidak dapat secara otomatis melakukan tindakan isolasi atau pemblokiran, seperti mengubah izin Object Storage Service (OSS) atau mengambil instans ECS offline. Untuk menerapkan pemblokiran otomatis, Anda dapat menggunakan callback WebHook bersama CloudOps Orchestration Service (OOS) atau fungsi Function Compute kustom.
Auto Scaling
Jika Anda mengaktifkan Auto Scaling, Cloud Monitor memicu aturan penskalaan terkait saat peringatan terjadi. Anda harus menentukan Region, ESS Group, dan ESS Rule.
CatatanKlik Advanced Settings untuk mengonfigurasi parameter ini.
Simple Log Service
Jika Anda mengaktifkan Simple Log Service, Cloud Monitor mengirimkan data peringatan ke penyimpanan log di Simple Log Service (SLS) saat peringatan terjadi. Anda harus menentukan Region, ProjectName, dan Logstore.
Collect and analyze ECS text logs using LoongCollector.
CatatanKlik Advanced Settings untuk mengonfigurasi parameter ini.
Simple Message Queue (formerly MNS) - Topic
Jika Anda mengaktifkan Simple Message Queue (formerly MNS) - Topic, Cloud Monitor mengirimkan data peringatan ke topik Message Service (MNS) saat peringatan terjadi. Anda harus menentukan wilayah dan topik.
CatatanKlik Advanced Settings untuk mengonfigurasi parameter ini.
Function Compute
Jika Anda mengaktifkan Function Compute, Cloud Monitor mengirimkan notifikasi peringatan ke Function Compute (FC) untuk pemformatan kustom saat peringatan terjadi. Anda harus menentukan wilayah, layanan, dan fungsi.
CatatanKlik Advanced Settings untuk mengonfigurasi parameter ini.
Method to handle alerts when no monitoring data is found
Cara Cloud Monitor menangani peringatan saat data pemantauan tidak tersedia. Nilai yang valid:
-
Do not do anything (default)
-
Send alert notifications
-
Treated as normal
Untuk beberapa metrik layanan Alibaba Cloud, seperti metrik pembatasan kecepatan ApsaraMQ for RocketMQ, Cloud Monitor tidak melaporkan data pemantauan saat nilai metrik adalah 0. Jika suatu metrik memiliki data tetapi tidak mencapai ambang batas peringatan, status aturan peringatan adalah Normal. Jika nilai metrik adalah 0 dan Cloud Monitor tidak melaporkan data pemantauan, status aturan peringatan adalah No data bukan Normal. Untuk memastikan apakah data dilaporkan untuk suatu metrik, lihat data aktual dimensi instans pada halaman pemantauan dan peringatan instans.
Ketika aturan peringatan memicu peringatan tanpa data, Cloud Monitor mengirimkan notifikasi pada level peringatan tertinggi yang dikonfigurasi dalam aturan tersebut. Misalnya, jika aturan dikonfigurasi dengan level Critical, Warn, dan Info, peringatan tanpa data dikirim pada level Critical. Jika aturan hanya dikonfigurasi dengan level Info, peringatan tanpa data dikirim pada level Info.
CatatanKlik Advanced Settings untuk mengonfigurasi parameter ini.
Setelah Anda menghapus sumber daya yang dipantau, aturan peringatan yang terkait dengan sumber daya tersebut akan dihapus secara otomatis. Misalnya, jika Resource Range dari aturan peringatan adalah instans ECS tertentu, aturan peringatan yang terkait dengan instans tersebut akan dihapus segera setelah instans dihapus, dan tidak ada catatan riwayat peringatan baru yang dihasilkan.
Untuk mengelola aturan peringatan yang terkait dengan sumber daya yang kedaluwarsa, lihat Alert rules associated with expired resources.
-
-
Klik Confirm.