Todos os produtos
Search
Central de documentação

Simple Log Service:Configurar avaliação por grupo

Última atualização: Jul 03, 2026

A avaliação por grupo é um parâmetro em uma regra de alerta. Quando o sistema de alertas calcula os resultados de uma consulta e análise, você pode agrupar os resultados por um campo específico. O sistema de alertas avalia cada grupo em relação à condição de disparo de forma independente, gerando um alerta separado. Isso permite usar uma única regra de alerta para monitorar vários alvos e gerenciar alertas e eventos de forma independente para cada grupo.

Importante
  • Após configurar a avaliação por grupo, uma única avaliação pode gerar até 100 grupos de alerta. Se mais de 100 grupos forem gerados, o sistema selecionará aleatoriamente 100 deles e os enviará para a política de alerta.

  • Ao selecionar um campo para avaliação por grupo, escolha um que identifique exclusivamente a entidade monitorada e tenha um número limitado de valores possíveis. Não selecione campos que não distinguem as entidades entre si. O uso desses campos pode criar muitos grupos, cada um disparando um alerta separado. Isso pode causar uma tempestade de alertas, fazendo com que você perca notificações críticas.

    Por exemplo, para logs do Nginx, use campos como host e method. Para logs de acesso do OSS, use o campo bucket. Não use campos como request_time ou body_size dos logs do Nginx, nem o campo err_cnt dos logs de erro.

Exemplo 1: Monitoramento por grupo para dados de séries temporais

Por exemplo, você armazena dados de métricas de vários servidores em um único banco de dados de séries temporais. Você deseja que o Log Service envie um alerta separado para cada servidor quando sua utilização de CPU (cpu_util) ultrapassar 95%. Para isso, configure a avaliação por grupo ao criar uma regra de alerta.时序数据

A configuração é a seguinte:

  • Query and statistics: * | select promql_query_range('cpu_util') from metrics limit 1000

    Essa consulta calcula a utilização de CPU.

  • Group evaluation: Auto label

    O Log Service agrupa automaticamente os resultados da consulta e análise para dados de séries temporais.

  • Trigger Condition: Data Matching, value > 95, Severity: High

    O sistema dispara um alerta de alta severidade quando o value nos resultados da consulta e análise ultrapassa 95.

  • Add Annotation: Configure anotações como o título e a descrição do alerta. Você pode referenciar variáveis de campo, como ${host}, nas anotações. Para mais informações, consulte Adicionar rótulos e anotações.

Defina o title como CPU utilization for host ${host} has spiked e o desc como CPU utilization for host ${host} has reached ${value}.

Exemplo 2: Monitoramento por grupo para logs

Por exemplo, ao monitorar logs de acesso do OSS, você deseja receber um alerta separado para cada bucket que apresentar mais de 1.000 erros HTTP 500 por minuto. Para isso, configure a avaliação por grupo ao criar uma regra de alerta.

A configuração é a seguinte:

  • Query and statistics: http_status=500 | select bucket,count(1) as pv group by bucket having pv >1000 order by pv desc

    Essa consulta encontra buckets com mais de 1.000 erros HTTP 500.

  • Group evaluation: Custom label, bucket

    O sistema agrupa os resultados da consulta e análise por bucket.

  • Trigger Condition:

    • Condição 1: Data Matching, pv > 3000, Severity: High

      O sistema dispara um alerta de alta severidade quando o valor de pv nos resultados da consulta e análise ultrapassa 3.000.

    • Condição 2: Data Exists, Severity: Medium

      O sistema dispara um alerta de severidade média se a consulta e análise retornar qualquer resultado.

  • Add Annotation: Configure anotações como o título e a descrição do alerta. Você pode referenciar variáveis de campo, como ${pv}, nas anotações. Para mais informações, consulte Adicionar rótulos e anotações.

Defina o title como ${bucket} bucket is experiencing 500 errors e o desc como Error count: ${pv}.