當您需要監控應用分組中各雲產品資源的使用方式時,可以建立警示規則。如果資源的監控指標達到警示條件,CloudMonitor自動發送警示通知,協助您及時得知異常監控資料,並快速處理。
操作步驟
在左側導覽列,選擇。
在應用分組頁簽,單擊目標應用分組名稱連結。
在目標應用分組的左側導覽列,單擊警示規則。
單擊建立警示規則。
在建立警示規則面板,設定警示規則相關參數。
參數
說明
產品
CloudMonitor可管理的雲產品名稱。例如:雲資料庫RDS版。
資源範圍
警示規則作用的資源範圍。取值:
-
全部資源:警示規則作用於指定雲產品的全部資源上,對於新加入的資源生效。
-
應用分組:警示規則作用於指定雲產品的指定應用分組內的全部資源上,對於新加入的資源生效。
-
執行個體:警示規則作用於指定雲產品的指定資源上。
規則描述
警示規則的主體。當監控資料滿足警示條件時,觸發警示規則。規則描述的設定方法如下:
-
單擊添加規則,在下滑菜單中選擇合適的指標類型。
-
在添加規則描述面板,先輸入規則名稱,再設定規則條件。
-
簡單指標:先選擇監控指標,再為其設定閾值和警示層級。
-
組合指標:先選擇警示層級,再配置多指標警示描述為兩個或兩個以上的監控指標設定警示條件。
說明如果設定了多個指標警示規則,則目標資源必須在每個指標上均有資料,只有在滿足條件後才能夠正常觸發警示。例如:在多指標警示規則中,如果包含公網的監控指標,而ECS主機資源並未配置公網IP,則將無法正常觸發警示。
-
表達式:先選擇警示層級,再配置警示運算式。
-
智能閾值:關於智能閾值的更多資訊,請參見概覽和建立智能閾值警示規則。
-
警示層級決定了警示發生時的通知方式。僅緊急層級支援電話通知。警告和普通層級不支援電話通知。不同警示層級支援的通知方式如下:
警示層級
通知方式
緊急(緊急)
郵件+WebHook
警告(警告)
郵件+WebHook
普通(普通)
郵件+WebHook
說明關於如何設定複雜的運算式警示條件,請參見警示規則運算式說明。
通道沉默周期
警示發生後未恢複正常,間隔多久重複發送一次警示通知。取值:5分鐘、15分鐘、30分鐘、60分鐘、3小時、6小時、12小時和24小時。
某監控指標達到警示閾值時發送警示,如果監控指標在通道沉默周期內持續超過警示閾值,在通道沉默周期內不會重複發送警示通知;如果監控指標在通道沉默周期後仍未恢複正常,則CloudMonitor再次發送警示通知。
例如:當通道沉默周期選擇12小時,如果警示未恢複正常,則間隔12小時後,CloudMonitor會再次發送警示通知。
生效時間
警示規則的生效時間。警示規則僅在生效期內才會發送警示通知。
說明當警示規則不在生效期時,不會發送警示通知,但是警示記錄仍然會顯示在警示歷史列表中。
報警聯繫人組
發送警示的連絡人群組。
應用分組的警示通知會發送給該警示連絡人群組中的警示連絡人。警示連絡人群組是一組警示連絡人,可以包含一個或多個警示連絡人。
關於如何建立警示連絡人和警示連絡人群組,請參見建立警示連絡人或警示連絡人群組。
標籤
警示規則的標籤。包括標籤名稱和標籤值。
說明您最多可設定6組標籤。
警示回調
公網可訪問的URL,用於接收CloudMonitor通過POST請求推送的警示資訊。目前僅支援HTTP協議。關於如何設定警示回調,請參見使用閾值警示回調。
當您需要測試警示回調地址的連通性時,可以執行以下操作。
-
單擊回調地址正後方的測試。
在WebHook測試面板,您可以通過Webhook返回的狀態代碼和測試結果詳情對警示回調地址的連通性進行判斷和排查。
說明您還可以設定Webhook的回調模版類型:和語言:,再次單擊測試,擷取對應的測試結果詳情。
-
單擊關閉。
說明單擊進階設定,可設定該參數。
Auto Scaling
如果您開啟Auto Scaling開關,當警示發生時,會觸發相應的伸縮規則。您需要設定Auto Scaling的地區、Auto Scaling組和Auto Scaling規則。
說明單擊進階設定,可設定該參數。
Log Service
如果您開啟Log Service開關,當警示發生時,會將警示資訊發送至Log Service的日誌庫。您需要設定Log Service的地區、ProjectName/和Logstore。
關於如何建立Project和LogStore,請參見使用LoongCollector採集並分析ECS文本日誌。
說明單擊進階設定,可設定該參數。
輕量訊息佇列(原 MNS)— topic
如果您開啟輕量訊息佇列(原 MNS)— topic開關,當警示發生時,會將警示資訊發送至Message Service的主題。您需要設定Message Service的地區和主題。
關於如何建立主題,請參見建立主題。
說明單擊進階設定,可設定該參數。
函數計算
如果您開啟函數計算開關,當警示發生時,會將警示通知發送至Function Compute進行格式處理。您需要設定Function Compute的地區、服務和函數。
關於如何建立服務和函數,請參見快速建立函數。
說明單擊進階設定,可設定該參數。
無數據警示處理方法
無監控資料時警示的處理方式。取值:
-
不做任何處理(預設值)
-
發送無數據警示
-
視為正常
說明單擊進階設定,可設定該參數。
-
單擊確認。
常見問題
如何配置緊急電話警示或磁碟空間不足預警?
電話警示配置
建立警示規則時,在規則描述中將警示層級設定為緊急(Critical),系統會自動通過電話方式通知警示連絡人群組中的成員。
磁碟剩餘空間預警
支援配置當磁碟剩餘空間不足特定值(如 5 GB)時觸發簡訊預警。在規則描述中,選擇對應的磁碟剩餘空間指標,並將閾值設定為目標值(單位:位元組)。
電話和簡訊通知的前提是已正確建立警示連絡人群組並關聯到警示規則。如何建立警示連絡人和警示連絡人群組,請參見建立警示連絡人或警示連絡人群組。
為什麼 CLB 建立警示規則時無法選擇執行個體層級指標?
若在舊版控制台遇到 CLB(傳統型負載平衡)無法選擇執行個體級指標的情況,請通過新版CloudMonitor控制台地址建立:
https://cloudmonitor.console.alibabacloud.com/productListNav/acs_slb_dashboard/slb/all
通過新版控制台入口,即可正常選擇執行個體層級指標並配置警示規則。
未收到警示通知或警示未觸發怎麼辦?
出現此問題時,請按以下步驟自查:
檢查規則是否建立:確認已在CloudMonitor控制台為目標資源(如 ECS)建立了有效警示規則。未配置規則不會發送任何通知。
核對監控指標:檢查實際配置的指標是否與預期一致。例如,是否誤配了「inode 使用率」而非「磁碟空間使用率」。建議在作業系統內執行
df -i等命令驗證實際指標值。驗證閾值邏輯:確認閾值單位(位元組/百分比)與所選指標匹配,並理解連續周期平均值的觸發邏輯。即使當前瞬時值已恢複正常,若過去連續周期的平均值仍滿足閾值條件,依然會觸發警示;反之,若連續周期平均值尚未達到閾值,即便瞬時值超出也不會觸發警示。