Todos os produtos
Search
Central de documentação

Application Real-Time Monitoring Service:Gerenciamento de alertas

Última atualização: Jun 27, 2026

O Alert Management do ARMS oferece recursos robustos para agregação de alertas, notificação e escalonamento automático. Esse recurso ajuda a detectar e resolver problemas em aplicações e serviços com rapidez. Este tópico descreve a arquitetura, os conceitos principais e os benefícios do Alert Management.

Arquitetura

O Alert Management é composto por cinco módulos principais: gerenciamento de integrações, gerenciamento de eventos de alerta, gerenciamento de políticas de notificação, tratamento colaborativo de alertas e análise de tratamento de alertas.

image

Gerenciamento de integrações

O Alert Management suporta dois tipos de integração: integração de alertas padrão e integração de serviços de terceiros.

Integração de alertas padrão

As integrações padrão estão disponíveis para alertas de diversos serviços do ARMS, como Application Monitoring, monitoramento de navegador, Managed Service for Prometheus e monitoramento sintético. Essas integrações usam tarefas periódicas para verificar anomalias nos dados de monitoramento. Ao detectar uma anomalia, o sistema envia um evento de alerta para o centro de gerenciamento de eventos por meio de um canal padrão.

Para obter mais informações sobre como criar regras de alerta para cada serviço do ARMS, consulte os seguintes tópicos:

Integração de serviços de terceiros

Configure integrações para receber alertas de qualquer fonte de terceiros. Isso permite centralizar o gerenciamento de alertas no ARMS, oferecendo um local único para tratar alertas de todos os sistemas, sejam eles on-premises ou na nuvem. O Alert Management processa qualquer alerta recebido como um evento de alerta. Um evento de alerta possui a seguinte estrutura e restrições:

Estrutura de dados de um evento de alerta

A estrutura de dados de um evento de alerta do ARMS baseia-se no formato open-source AlertManager e inclui os seguintes campos:

  • Labels: conjunto de pares chave-valor que representam os metadados do alerta. Um conjunto exclusivo de labels identifica um único evento de alerta. Eventos com o mesmo conjunto de labels são mesclados. Exemplo: "alertname: High CPU Utilization".

  • Annotations: conjunto de pares chave-valor que fornecem informações adicionais e não identificadoras sobre o alerta. Exemplo: "message: Alert content".

  • StartsAt: horário em que o evento de alerta começou.

  • EndsAt: horário em que o evento de alerta terminou.

  • GeneratorUrl: URL que vincula à origem do evento de alerta.

Diferença entre labels e annotations

  • O conjunto de labels define exclusivamente um evento de alerta. Se qualquer valor de label for alterado, o sistema gera um novo evento de alerta.

    Exemplo:

    O conjunto de labels {"hostname":"prod-host-01", "alertname":"High CPU Utilization", "ip":"192.168.0.3"} representa um alerta específico (alta utilização de CPU no host 192.168.0.3). Se a label ip mudar, como em {"hostname":"prod-host-01", "alertname":"High CPU Utilization", "ip":"192.168.0.4"}, isso cria um alerta novo e distinto (alta utilização de CPU no host 192.168.0.4).

  • Alterações nas annotations não criam um novo evento de alerta. Vários eventos com as mesmas labels, mas annotations diferentes, são considerados atualizações do mesmo alerta.

    Exemplo:

    Se um alerta com a annotation {"value":"85", "message":"Host 192.168.0.3 CPU utilization is 85%, which exceeds the 80% threshold."} for enviado novamente com uma nova annotation, como {"value":"86", "message":"Host 192.168.0.3 CPU utilization is 86%, which exceeds the 80% threshold."}, ele não gera um novo alerta. Ambos os eventos são tratados como atualizações do mesmo alerta em andamento.

Nota

Configure deduplication fields para uma integração. Quando especificados, apenas esses campos são usados como labels para identificar exclusivamente um evento de alerta dessa integração. Se você não configurar campos de deduplicação, todas as labels serão usadas para identificar um evento de alerta exclusivo.

Gerenciamento de eventos de alerta

O módulo de gerenciamento de eventos de alerta oferece duas formas de processar eventos provenientes de fontes de alerta:

  • Use um fluxo de processamento de eventos para construir pipelines simples de processamento. Isso permite reprocessar eventos de alerta de qualquer source para atender a diferentes requisitos de manipulação de dados.

  • Use os recursos de gerenciamento de eventos para executar deduplicação, compressão, redução de ruído e silenciamento em eventos de alerta. Essa abordagem ajuda a consolidar alertas e reduzir tempestades de alertas.

Compressão de eventos

Por padrão, o módulo de gerenciamento de eventos de alerta comprime os eventos de duas maneiras: por label e por tempo. As seções a seguir descrevem o funcionamento de cada método.

Compressão baseada em labels

Quando um evento de alerta aciona uma notificação, o sistema o comprime com base na política de agrupamento definida na política de notificação. Se vários eventos correspondentes à política compartilharem os mesmos valores para as labels de agrupamento especificadas, o sistema os comprime automaticamente em uma única notificação. A figura a seguir mostra como três eventos diferentes são comprimidos usando duas labels de agrupamento distintas:

image

Compressão baseada em tempo

Cada evento de alerta possui um horário de início e um horário de término. Se eventos de alerta com as mesmas labels tiverem intervalos de tempo sobrepostos, o sistema os mescla em um único evento. Os horários de início e término do evento mesclado tornam-se a união dos intervalos de tempo dos eventos originais.

image

Gerenciamento de políticas de notificação

Uma política de notificação funciona essencialmente como uma regra de assinatura. Configure regras de correspondência e, quando um evento de alerta atender às condições, o ARMS enviará notificações de acordo com a política.

A figura a seguir ilustra a relação entre fluxos de processamento de eventos, gerenciamento de eventos e políticas de notificação.

image

Tratamento colaborativo de alertas

O módulo de tratamento colaborativo de alertas permite configurar várias políticas de colaboração. Trate alertas diretamente no console do Alibaba Cloud ou em ferramentas como DingTalk, WeCom e Lark. O módulo também suporta recursos como sincronização de mensagens em grupo, agendamento de plantão e políticas de escalonamento para ambientes de equipe colaborativa. A figura a seguir mostra o processo de tratamento de alertas. Para obter mais informações, consulte Tratar alertas em chats de grupo.

image

Benefícios

Ao implantar serviços no Alibaba Cloud e usar o ARMS para monitoramento, o Alert Management ajuda a melhorar a eficiência operacional das seguintes maneiras:

  • Operações globalizadas

    • Modelos globais permitem gerenciar regras de alerta para todas as regiões a partir de um único local.

    • Configure contatos e políticas de notificação uma única vez e aplique-os globalmente.

  • Gerenciamento centralizado e eficiente

    • O Alert Management oferece integrações com um clique para ferramentas comuns de monitoramento do Alibaba Cloud e suporta integração manual para outras ferramentas, facilitando a centralização da manutenção.

    • O módulo de ingestão de eventos é estável e fornece processamento ininterrupto de eventos 24 horas por dia, 7 dias por semana.

    • O sistema garante baixa latência ao processar grandes volumes de dados de eventos.

  • Notificações precisas e oportunas

    • Configure regras de notificação para mesclar eventos antes de enviar notificações, o que ajuda a reduzir a fadiga de alertas da equipe de operações.

    • Escolha diferentes métodos de notificação, como e-mail, SMS, telefone ou DingTalk, com base na urgência do alerta para notificar os contatos adequados.

    • Use uma política de escalonamento para enviar lembretes repetidos de alertas que permanecem sem tratamento após um período especificado, garantindo a resolução oportuna.

  • Gerenciamento de alertas rápido e conveniente

    • Os contatos podem tratar alertas a qualquer momento pelo DingTalk.

    • Um formato de alerta comum permite que os contatos analisem os alertas com mais eficácia.

    • Vários contatos podem trabalhar juntos para resolver alertas pelo DingTalk.

  • Estatísticas em tempo real e análises de status ajudam a melhorar continuamente a eficiência na resolução de alertas.