Todos os produtos
Search
Central de documentação

Serverless App Engine:Alert Management

Última atualização: Jun 28, 2026

O Gerenciamento de Alertas do Application Real-Time Monitoring Service (ARMS) oferece convergência de alertas, notificações e escalonamento automático para detectar e resolver rapidamente alertas de negócios.

Informações básicas

O Serverless App Engine (SAE) integra o Gerenciamento de Alertas do ARMS. A nova versão desse recurso está disponível apenas para contas Alibaba Cloud que ativaram o SAE após as 00:00 de 30 de abril de 2021.

Arquitetura

O Gerenciamento de Alertas consiste em cinco módulos principais: gerenciamento de integrações, gerenciamento de eventos de alerta, gerenciamento de políticas de notificação, tratamento colaborativo de alertas e análise de tratamento de alertas.

image

Gerenciamento de integrações

O Gerenciamento de Alertas suporta dois tipos de integração: integração de alertas padrão e integração de serviços de terceiros.

Integração de alertas padrão

Integrações padrão estão disponíveis para alertas de diversos serviços do ARMS, como Application Monitoring, monitoramento de navegador, Managed Service for Prometheus e monitoramento sintético. Essas integrações usam tarefas periódicas para verificar anomalias nos dados de monitoramento. Ao detectar uma anomalia, o sistema envia um evento de alerta ao centro de gerenciamento de eventos por meio de um canal padrão.

Integração de produtos de terceiros

Configure integrações para receber alertas de qualquer source de terceiros. Isso permite centralizar o gerenciamento de alertas no ARMS, oferecendo um local único para tratar alertas de todos os sistemas, sejam on-premises ou na nuvem. O Gerenciamento de Alertas processa qualquer alerta recebido como um evento de alerta. Um evento de alerta possui a seguinte estrutura e restrições:

Estrutura de dados de um evento de alerta

A estrutura de dados de um evento de alerta do ARMS baseia-se no formato open-source AlertManager e inclui os seguintes campos:

  • Labels: conjunto de pares chave-valor que representam os metadados do alerta. Um conjunto exclusivo de labels identifica um único evento de alerta. Eventos com o mesmo conjunto de labels são mesclados. Exemplo: "alertname: High CPU Utilization".

  • Annotations: conjunto de pares chave-valor que fornecem informações adicionais e não identificadoras sobre o alerta. Exemplo: "message: Alert content".

  • StartsAt: horário em que o evento de alerta começou.

  • EndsAt: horário em que o evento de alerta terminou.

  • GeneratorUrl: URL que vincula à source do evento de alerta.

Diferenças entre labels e annotations

  • O conjunto de labels define exclusivamente um evento de alerta. Se qualquer valor de label mudar, o sistema gera um novo evento de alerta.

    Exemplo:

    O conjunto de labels {"hostname":"prod-host-01", "alertname":"High CPU Utilization", "ip":"192.168.0.3"} representa um alerta específico (alta utilização de CPU no host 192.168.0.3). Se a label ip mudar, como em {"hostname":"prod-host-01", "alertname":"High CPU Utilization", "ip":"192.168.0.4"}, isso cria um alerta novo e distinto (alta utilização de CPU no host 192.168.0.4).

  • Alterações nas annotations não criam um novo evento de alerta. Múltiplos eventos com as mesmas labels, mas annotations diferentes, são considerados atualizações do mesmo alerta.

    Exemplo:

    Se um alerta com a annotation {"value":"85", "message":"Host 192.168.0.3 CPU utilization is 85%, which exceeds the 80% threshold."} for enviado novamente com uma nova annotation, como {"value":"86", "message":"Host 192.168.0.3 CPU utilization is 86%, which exceeds the 80% threshold."}, ele não gera um novo alerta. Ambos os eventos são tratados como atualizações do mesmo alerta em andamento.

Nota

Configure deduplication fields para uma integração. Quando especificados, apenas esses campos são usados como labels para identificar exclusivamente um evento de alerta dessa integração. Caso você não configure campos de deduplicação, todas as labels serão usadas para identificar um evento de alerta exclusivo.

Gerenciamento de eventos de alerta

O módulo de gerenciamento de eventos de alerta oferece duas formas de processar eventos provenientes de sources de alerta:

  • Use um fluxo de processamento de eventos para criar pipelines simples de processamento. Isso permite reprocessar eventos de alerta de qualquer source para atender a diferentes requisitos de manipulação de dados.

  • Use recursos de gerenciamento de eventos para executar deduplicação, compressão, remoção de ruído e silenciamento em eventos de alerta. Essa abordagem ajuda a consolidar alertas e reduzir tempestades de alertas.

Compressão de eventos

Por padrão, o módulo de gerenciamento de eventos de alerta comprime eventos de duas maneiras: por label e por tempo. As seções a seguir descrevem o funcionamento de cada método.

Compressão baseada em labels

Quando um evento de alerta aciona uma notificação, o sistema o comprime com base na política de agrupamento definida na política de notificação. Se vários eventos correspondentes à política compartilharem os mesmos valores para as labels de agrupamento especificadas, o sistema os comprime automaticamente em uma única notificação. A figura a seguir ilustra como três eventos diferentes são comprimidos usando duas labels de agrupamento distintas:

image

Compressão baseada em tempo

Cada evento de alerta possui um horário de início e um horário de término. Se eventos de alerta com as mesmas labels tiverem intervalos de tempo sobrepostos, o sistema os mescla em um único evento. Os horários de início e término do evento mesclado tornam-se a união dos intervalos de tempo dos eventos originais.

image

Gerenciamento de políticas de notificação

Uma política de notificação funciona essencialmente como uma regra de assinatura. Configure regras de correspondência e, quando um evento de alerta atender às condições, o ARMS enviará notificações conforme a política.

A figura a seguir mostra a relação entre fluxos de processamento de eventos, gerenciamento de eventos e políticas de notificação.

image

Tratamento colaborativo de alertas

Trate alertas no Alibaba Cloud Management Console ou por meio do DingTalk, WeCom e Lark. O Gerenciamento de Alertas também suporta sincronização de mensagens em grupo, agendamento de plantão e políticas de escalonamento para o tratamento colaborativo de alertas. A figura a seguir ilustra o processo de tratamento de alertas. Para mais informações, consulte Tratar alertas em um grupo de notificação de alertas.告警协同处理

Benefícios

Ao implantar serviços na Alibaba Cloud e usar o ARMS para monitoramento, o Gerenciamento de Alertas ajuda a melhorar a eficiência operacional das seguintes maneiras:

  • Operações globalizadas

    • Modelos globais permitem gerenciar regras de alerta para todas as regiões a partir de um único local.

    • Configure contatos e políticas de notificação uma única vez e aplique-os globalmente.

  • Gerenciamento centralizado e eficiente

    • O Gerenciamento de Alertas oferece integrações com um clique para ferramentas comuns de monitoramento da Alibaba Cloud e suporta integração manual para outras ferramentas, facilitando a centralização da manutenção.

    • O módulo de ingestão de eventos é estável e fornece processamento ininterrupto de eventos 24 horas por dia, 7 dias por semana.

    • O sistema garante baixa latência ao processar grandes volumes de dados de eventos.

  • Notificações precisas e oportunas

    • Configure regras de notificação para mesclar eventos antes de enviar notificações, ajudando a reduzir a fadiga de alertas da equipe de operações.

    • Escolha diferentes métodos de notificação, como e-mail, SMS, telefone ou DingTalk, com base na urgência do alerta para notificar os contatos adequados.

    • Use uma política de escalonamento para enviar lembretes repetidos de alertas que permanecem sem tratamento após um período especificado, garantindo a resolução oportuna.

  • Gerenciamento de alertas rápido e conveniente

    • Os contatos podem tratar alertas a qualquer momento pelo DingTalk.

    • Um formato de alerta comum permite que os contatos analisem alertas com mais eficácia.

    • Vários contatos podem trabalhar juntos para resolver alertas por meio do DingTalk.

  • Estatísticas em tempo real e análises de status ajudam a melhorar continuamente a eficiência na resolução de alertas.