Crie regras de alerta para monitorar seus aplicativos e serviços. Quando as condições forem atendidas, o Cloud Monitor notifica você por meio de contatos, chatbots, webhooks ou integrações de ação.
Pré-requisitos
Você ativou os serviços de monitoramento de observabilidade necessários, como Prometheus, Application Monitoring e Log Service.
Você criou um notification contact.
Criar uma regra de alerta
Faça login no console do Cloud Monitor 2.0. No painel de navegação à esquerda, escolha All Features > Alert Center.
Na página Alert Center, escolha Alert Management > Alert Rule.
Clique em Create alert rules.
-
No painel Create alert rules, configure os seguintes parâmetros.
Rule name: nome para identificar a regra de alerta.
-
Monitoring type: objeto ao qual a regra de alerta se aplica. Em seguida, configure os parâmetros do objeto selecionado. A tabela a seguir descreve os parâmetros.
Parâmetro
Descrição
Detection conditions
Defina as condições que disparam um alerta.
Duration: defina a duração do período de detecção do alerta.
Indicators
Comparison
Alert threshold:
Critical: para problemas graves que afetam a disponibilidade do negócio principal e têm grande impacto.
Warning: para problemas que podem causar erros de negócio ou impacto no service.
Info: para cenários que exigem notificação, mas têm baixa prioridade.
Label
Pares de chave-valor personalizados usados para categorizar e filtrar regras de alerta. Por exemplo,
env: productioneteam: sre.Annotation
Informações estendidas para a regra de alerta. Use anotações para armazenar descrições longas ou links para runbooks. Por exemplo,
description: High CPU utilizationerunbook_url: https://wiki.xxx.com/runbook\. -
Notification Cofiguration
-
Notification recipient: destinatários a serem notificados quando um alerta for disparado.
Contact: contatos individuais a serem notificados.
Contact group: grupo de contatos a serem notificados.
DingTalk: envia alertas para um chatbot de grupo do DingTalk.
WeCom: envia alertas para um chatbot do WeCom.
Lark: envia alertas para um chatbot do Lark.
Slack: envia alertas pelo Slack.
Custom webhook: envia alertas por meio de um webhook personalizado.
-
Integrate with ARMS alert management: integra com o Application Real-Time Monitoring Service (ARMS) para gerencie ciclos de vida de alertas.
NotaPor padrão, os eventos de alerta são enviados ao centro de O&M de alertas do ARMS. Configure as notificações nesse local.
Action integration: service a ser acionado para resposta automatizada a incidentes, como Log Service, filas de mensagens leves, Function Compute e serviços de terceiros como PagerDuty e webhooks.
-
Notification silence period: tempo de espera antes de reenviar uma notificação para um alerta não resolvido. Valores válidos: 1, 5, 10, 15, 30 e 50 minutos, e 1, 3, 6, 12 e 24 horas.
NotaExemplo: com Notification silence period defina como 12 hours, o Cloud Monitor reenvia a notificação após 12 horas se o alerta persistir.
-
Effective period: janela de tempo durante a qual a regra de alerta está ativa. As notificações são enviadas apenas nesse período.
NotaAlertas disparados fora do período vigente são registrados no histórico, mas não geram notificações.
O período de notificação pode ser defina dentro de um intervalo de 24 horas e pode abranger dias diferentes — por exemplo, das 23:00 às 01:00 do dia seguinte.
-
Gerenciar regras de alerta
-
A página Alert Rules lista todas as regras de alerta com as seguintes informações.
Parâmetro
Descrição
Alert status
O status atual da regra. Valores válidos:
- Ok: nenhuma condição de alerta disparada.
- Alarm: condição de alerta disparada, alerta ativo.
- NoData: nenhum dado de monitoramento disponível.
Rule name/ID
O nome de exibição e o identificador único (UUID) da regra de alerta.
Enabled status
Indica se a regra está ativa. Regras ativas são avaliadas no intervalo configurado; regras desativadas não são avaliadas.
Service source
O service ao qual a regra se aplica.
-
Pesquise regras de alerta usando os seguintes parâmetros:
Monitoring type
Rule name/ID
Alert status
Enabled status
More filters: pesquise por tag ou notification contact.
Se o escopo de recursos de uma regra de alerta padrão do sistema estiver defina como todos os recursos, não é possível modifique diretamente o escopo para excluir instâncias específicas após a criação da regra.
Para excluir recursos específicos, siga estas etapas:
Na página Alert rules, localize a regra padrão do sistema de destino e clique em More > Duplicate na coluna Actions.
Na caixa de diálogo Create alert rule, selecione a aba Prometheus instance ou Aggregate view no seletor de fonte de dados e escolha os recursos específicos que deseja monitorar.
Clique em OK para salve a nova regra.
-
Na coluna Actions da regra padrão do sistema original, clique em More > Delete para exclua-la, ou desative o switch Enabled status na linha da regra para desabilitá-la.
NotaSe você não exclua nem desative a regra original, o mesmo recurso disparará dois alertas quando o limiar for atingido.
Ao edite uma regra de alerta migrada do Cloud Monitor 1.0, as notificações de alerta oferecem suporte apenas a contact groups legados. Não é possível selecione um Notification Recipient criado no Cloud Monitor 2.0. O Cloud Monitor 1.0 utiliza grupos de contatos de alerta, enquanto o Cloud Monitor 2.0 usa destinatários de notificação e políticas de notificação. Os dois sistemas são independentes e não são interoperáveis. Para usar um Notification Recipient, crie uma nova regra de alerta no console do Cloud Monitor 2.0.
Edit: para edite uma regra de alerta, selecione-a, clique em edite na coluna actions, modifique a regra e clique em OK.
Enable/Disable: alterne o switch na coluna enabled status.
-
Delete: clique em exclua
na coluna actions.AvisoEssa ação não pode ser desfeita. Prossiga com cautela.