Todos os produtos
Search
Central de documentação

ApsaraMQ for RocketMQ:Configurar alertas de monitoramento de mensagens

Última atualização: Jun 27, 2026

Integre o ApsaraMQ for RocketMQ ao Cloud Monitor para configurar regras de alerta. Essa integração permite monitorar o status em tempo real das instâncias e as principais métricas de negócios, receber notificações rápidas sobre anomalias e gerencie proativamente os riscos no ambiente de produção.

Informações básicas

O ApsaraMQ for RocketMQ oferece um serviço de mensagens totalmente gerenciado. Cada especificação de instância inclui uma garantia de SLA clara. Isso assegura que, após a compra da instância, métricas como TPS de mensagens e armazenamento atendam às especificações contratadas.

Embora não seja necessário gerenciar o desempenho da instância, monitore se a carga de trabalho do seu negócio está se aproximando dos limites de especificação. O ApsaraMQ for RocketMQ integra-se ao Cloud Monitor para fornecer um serviço gratuito de monitoramento e alerta pronto para uso. Esse recurso ajuda a resolver os seguintes problemas:

  • Alertas proativos para marcas d'água de especificação da instância

    Se o uso real exceder os limites de especificação da instância, o ApsaraMQ for RocketMQ aplica limitação rigorosa (throttling). Configure alertas para as marcas d'água de especificação com antecedência para identificar o risco de ultrapassar esses limites e atualizar a instância rapidamente, evitando interrupções nos negócios causadas pela limitação.

  • Alertas proativos para erros de lógica de negócios

    Erros podem ocorrer durante o envio ou recebimento de mensagens. Configure alertas para erros de chamada para detectar anomalias antes que os usuários as reportem. Isso possibilita identificar e corrigir rapidamente a origem dos erros.

  • Alertas proativos para métricas de desempenho de negócios

    Caso seu middleware orientado a mensagens tenha requisitos específicos de desempenho, como tempo de resposta (RT) ou latência de mensagens, configure alertas para essas métricas para gerencie proativamente os riscos do negócio.

Princípios de configuração de alertas

O ApsaraMQ for RocketMQ oferece um conjunto abrangente de métricas e itens de monitoramento para alertas. Esses itens classificam-se em três tipos de alertas: marcas d'água operacionais, desempenho de envio/recebimento e eventos de erro.

Com base em vasta experiência em produção, recomendamos configurar os alertas seguindo os princípios abaixo:

Nota

Os principais itens de monitoramento listados a seguir são recomendações de linha de base. O ApsaraMQ for RocketMQ fornece um conjunto completo de métricas de monitoramento, permitindo configurar alertas mais granulares e abrangentes conforme as necessidades do seu negócio. Para mais informações, consulte Monitoramento e Alertas.

Categoria

Alerta principal

Recomendação

Função

Marca d'água operacional da instância e métricas de consumo

Frequência de chamadas de API da instância

  • Quando: Imediatamente após crie a instância.

  • Por quê: Monitore a marca d'água geral para evitar ultrapassar os limites da instância, pois esse consumo independe de tópicos ou grupos específicos.

Equipe de operações

Métricas de desempenho de envio/recebimento de mensagens

  • TPS de envio para um tópico específico

  • TPS de consumo para um grupo específico

  • Acúmulo de mensagens para um grupo

  • Latência de consumo para um grupo

  • Quando: Logo após a aplicação de negócios entrar em produção.

  • Por quê: Após cada lançamento, defina alertas para a tolerância de desempenho de mensagens do seu negócio.

  • Equipe de operações

  • Desenvolvedores de aplicações

Eventos de erro no envio/recebimento de mensagens

  • Geração de mensagens dead-letter

  • Número de solicitações limitadas (throttled)

  • Quando: Assim que implantar a aplicação de negócios em produção.

  • Por quê: Após cada lançamento, configure alertas para falhas a fim de facilitar a análise de problemas em produção.

  • Equipe de operações

  • Desenvolvedores de aplicações

Acessar a configuração de regras de alerta

  1. Faça login no console do ApsaraMQ for RocketMQ. No painel de navegação à esquerda, clique em Instances.

  2. Na barra de navegação superior, selecione uma região, como China (Hangzhou). Na página Instances, clique em no nome da instância que deseja gerencie.

  3. No painel de navegação à esquerda, clique em Monitoring and Alerts e, em seguida, clique em Create Alert Rule.

Melhores práticas

Configurar um alerta para frequência de chamadas de API da instância

  • Contexto: Cada instância do ApsaraMQ for RocketMQ possui um limite definido de TPS para chamadas de API de envio e recebimento de mensagens. Por exemplo, uma instância Standard Edition suporta 5.000 chamadas de API por segundo. Se a frequência de chamadas exceder esse limite, a instância sofrerá limitação (throttling).

  • Risco se não configurado: Sem este alerta, você não receberá avisos antes que o limite de chamadas de API da instância seja excedido. Isso causará falhas em algumas solicitações de mensagens devido à limitação.

  • Momento ideal para configuração: Recomendamos configurar este alerta imediatamente após crie a instância.

Defina o Rule Name como Instance API call frequency alert. Para Metric Type, selecione Basic Metrics e, para Metric, escolha Instance / Instance API call frequency(Instance). Configure três níveis de alerta: Critical (notifica por telefone, SMS, e-mail e webhook), Warn (notifica por SMS, e-mail e webhook) e Info (notifica por e-mail e webhook). Para cada nível, defina a condição para disparar após 3 períodos consecutivos (1 período = 1 minuto) se Sum >= Threshold (unidade: contagem/s). Para o nível Critical, insira o limiar desejado.

  • Limiar recomendado: Sugerimos definir o limiar em 70% do pico de TPS da instância. Por exemplo, se sua instância tem um pico de TPS de 10.000, defina o limiar de alerta para 7.000. Encontre o pico de TPS da instância na página Instance Details no console.

  • Tratamento do alerta: Caso receba um alerta de frequência de chamadas de API da instância, siga estas etapas:

    1. Na página Instance Details, clique em na aba Dashboard.

    2. Na seção Instance Message Volume Overview, verifique a curva TPS Max value em Instance Request Count Metrics (Production + Consumption) para determinar o padrão temporal em que o limiar de alerta foi atingido.

    3. Na seção Message Business Metrics Overview, revise as métricas Top 20 Topics by Message Production Rate (messages/minute) e Top 20 GroupIDs by Message Consumption Rate (messages/minute). Com base no padrão temporal em que o limiar foi atingido, identifique o tópico e o grupo com dados anormais e analise suas curvas para determinar se a mudança de tráfego é esperada.

    4. Se a alteração nos negócios for anormal, entre em contato com a equipe de negócios para analisar melhor a causa da anomalia.

    5. Caso o aumento de tráfego seja esperado, isso indica que a especificação da instância é insuficiente. Atualize a instância imediatamente. Para obter instruções, consulte Atualizar ou rebaixar uma instância.

Configurar alertas para taxas de produção e consumo de mensagens

  • Contexto: O ApsaraMQ for RocketMQ suporta o monitoramento do TPS de envio e recebimento de mensagens nos níveis de tópico e grupo. Isso permite configurar alertas para o TPS de aplicações de negócios específicas, ajudando a compreender a escala do seu negócio em tempo hábil.

  • Risco se não configurado: Sem esse alerta, quedas ou picos de tráfego podem ocorrer sem aviso prévio, levando a riscos inesperados para os negócios.

  • Momento ideal para configuração: Recomendamos configurar este alerta após a entrada em produção do seu negócio e quando o tráfego estiver estabilizado.

Taxa de envio do Producer

Na caixa de diálogo de configurações da regra, defina o Rule Name como Producer messages sent per minute alert. Para Metric Type, selecione a aba Basic Metrics e, para Metric, escolha Producer / Number of messages sent per minute(Topic). Configure três níveis de alerta: Critical (notifica por telefone, SMS, e-mail e webhook), Warn (notifica por SMS, e-mail e webhook) e Info (notifica por e-mail e webhook). Defina a condição para cada nível disparar após 3 períodos consecutivos (1 período = 1 minuto) se Sum >= Threshold (unidade: contagem/m) e insira o limiar apropriado com base nas necessidades do seu negócio. Para Dimension, selecione topic.

  • Limiar recomendado: Após a entrada em produção do seu negócio, estime o limiar de alerta com base no volume de tráfego estável.

  • Tratamento do alerta: Se receber um alerta de TPS de envio e recebimento de mensagens, siga estas etapas:

    1. Na página Topics, clique em no nome do tópico especificado na regra de alerta.

    2. Na página Topic Details, clique em na aba Dashboard.

    3. No gráfico Message Volume (messages/minute), verifique a curva Production. Com base no seu modelo de negócios, determine se as alterações na curva são razoáveis e analise se há anomalias.

Taxa de recebimento do Consumer

Na caixa de diálogo Set Rule Description, defina o Rule Name como Consumer messages received per minute alert. Para Metric Type, selecione Basic Metrics e, para Metric, escolha Consumer / Number of messages received per minute(Group). Configure três níveis de alerta: Critical, Warn e Info. Selecione Sum como método de agregação. Defina a condição para disparar após 3 períodos consecutivos (1 período = 1 minuto) se o valor for maior ou igual ao limiar e insira o limiar apropriado. Para Dimension, selecione groupId e especifique o grupo de consumidores alvo.

  • Limiar recomendado: Após a entrada em produção do seu negócio, estime o limiar de alerta com base no volume de tráfego estável.

  • Tratamento do alerta: Se receber um alerta de TPS de envio e recebimento de mensagens, siga estas etapas:

    1. Na página Groups, clique em no Group ID especificado na regra de alerta.

    2. Na página Group Details, clique em na aba Dashboard.

    3. No gráfico Trend of Message Production and Consumption Rate (messages/minute), verifique a curva Consumption. Com base no seu modelo de negócios, determine se as alterações na curva são razoáveis e analise se há anomalias.

Configurar um alerta para acúmulo de mensagens

Nota

As estatísticas de acúmulo de mensagens podem ser voláteis e propensas a erros. Não recomendamos definir um limiar de monitoramento para um acúmulo de apenas algumas dezenas de mensagens. Se o seu negócio for altamente sensível até mesmo a pequenos acúmulos, sugerimos usar o limiar de latência de consumo para monitoramento.

  • Contexto: O ApsaraMQ for RocketMQ suporta o monitoramento do acúmulo de mensagens no nível do grupo de consumidores. Use esse recurso para alertar sobre problemas de backlog de consumo downstream.

  • O alerta para acúmulo de mensagens é uma capacidade essencial do ApsaraMQ for RocketMQ. No entanto, para cenários que exigem processamento de mensagens em tempo real, monitore e controle o número de mensagens não processadas para evitar impactos nos negócios causados por backlogs de consumo.

  • Momento ideal para configuração: Recomendamos configurar este alerta após a entrada em produção do seu negócio e quando o tráfego estiver estabilizado.

Na caixa de diálogo Set Rule Description, defina o Rule Name como Message accumulation alert. Para Metric Type, selecione Basic Metrics e, para Metric, escolha Consumer / Number of accumulated messages(Group). Configure três níveis de alerta: Critical (notifica por telefone, SMS, e-mail e webhook), Warn (notifica por SMS, e-mail e webhook) e Info (notifica por e-mail e webhook). Para cada nível, defina a condição para disparar após 3 períodos consecutivos (1 período = 1 minuto) se Sum >= Threshold e o método estatístico for contagem. Para Dimension, selecione groupId e especifique o grupo de consumidores correspondente.

  • Limiar recomendado: Após a entrada em produção do seu negócio, estime o limiar de alerta com base nos níveis de tolerância aceitáveis.

  • Tratamento do alerta: Se receber um alerta de acúmulo de mensagens, siga estas etapas:

    1. Na página Groups, clique em no Group ID especificado na regra de alerta.

    2. Na página Group Details, clique em na aba Dashboard.

    3. No gráfico Accumulation-related Metrics (messages), verifique a curva Accumulated Messages. Analise a tendência do acúmulo e descubra quando ele começou.

    4. Com base nas alterações de negócios e nos logs da aplicação, analise os fatores no momento inicial do acúmulo para encontrar a causa raiz. Para mais informações sobre as causas do acúmulo de mensagens, consulte Como lidar com o acúmulo de mensagens.

    5. Com base na causa raiz, decida se deve escalar horizontalmente a aplicação consumidora ou corrigir defeitos na lógica de consumo.

Configurar um alerta para latência de consumo

Nota

Essa métrica é cumulativa (calculada a partir da mensagem não consumida mais antiga no grupo de consumidores) e altamente sensível. Se você receber um alerta de latência de consumo, determine primeiro se o impacto nos negócios se deve a algumas mensagens travadas ou a um atraso global no consumo.

  • Contexto: O ApsaraMQ for RocketMQ suporta o monitoramento da latência de consumo no nível do grupo de consumidores. Essa métrica é mais específica para analisar cenários de acúmulo de mensagens.

  • O alerta para acúmulo de mensagens é uma capacidade essencial do ApsaraMQ for RocketMQ. No entanto, para cenários que exigem processamento de mensagens em tempo real, monitore e controle a latência das mensagens acumuladas para evitar impactos nos negócios causados por atrasos no consumo.

  • Momento ideal para configuração: Recomendamos configurar este alerta após a entrada em produção do seu negócio e quando o tráfego estiver estabilizado.

Na caixa de diálogo de configurações da regra, defina o Rule Name como Message processing latency alert. Para Metric Type, selecione Basic Metrics e, para Metric, escolha Consumer / Message processing latency(GroupId). Configure três níveis de alerta: Critical (notifica por telefone, SMS, e-mail e webhook), Warn (notifica por SMS, e-mail e webhook) e Info (notifica por e-mail e webhook). Para cada nível, defina a condição para disparar após 3 períodos consecutivos (1 período = 1 minuto) se Maximum >= Threshold (unidade: ms) e insira os limiares apropriados para cada nível com base nas necessidades do seu negócio. Para Dimension, selecione o groupId correspondente.

  • Limiar recomendado: Após a entrada em produção do seu negócio, estime o limiar de alerta com base nos níveis de tolerância aceitáveis.

  • Tratamento do alerta: Se receber um alerta de latência de consumo, siga estas etapas:

    1. Na página Groups, clique em no Group ID especificado na regra de alerta.

    2. Na página Group Details, clique em na aba Dashboard.

    3. No gráfico Accumulation-related Metrics (messages), verifique a curva Accumulated Messages. Analise a tendência do acúmulo e descubra quando ele começou.

    4. Com base nas alterações de negócios e nos logs da aplicação, analise os fatores no momento inicial do acúmulo para encontrar a causa raiz. Para mais informações sobre as causas do acúmulo de mensagens, consulte Como lidar com o acúmulo de mensagens.

    5. Com base na causa raiz, decida se deve escalar horizontalmente a aplicação consumidora ou corrigir defeitos na lógica de consumo.

Configurar um alerta para mensagens dead-letter

  • Contexto: O ApsaraMQ for RocketMQ suporta mensagens dead-letter. Mensagens que falham no consumo e excedem o número máximo de tentativas são entregues a uma fila dead-letter para tratamento manual. Monitorar o número de mensagens que entram na fila dead-letter ajuda a detectar prontamente problemas inesperados e indeterminados no seu negócio.

  • Risco se não configurado: Ignorar mensagens dead-letter pode levar a um processamento incompleto dos negócios.

  • Momento ideal para configuração: Recomendamos configurar este alerta após a entrada em produção do seu negócio e quando o tráfego estiver estabilizado.

Na caixa de diálogo Set Rule Description, defina o Rule Name como Dead-letter message alert. Para Metric Type, selecione Basic Metrics e, para Metric, escolha Consumer / Number of dead-letter messages generated per minute(Group). Em Thresholds and Alert Levels, configure três níveis: Critical (notifica por telefone, SMS, e-mail e webhook), Warn (notifica por SMS, e-mail e webhook) e Info (notifica por e-mail e webhook). Para cada nível, defina a condição para disparar após 3 períodos consecutivos (1 período = 1 minuto), o método de agregação como Sum e a condição como Value >= Threshold (unidade: contagem/m). Para Dimension, selecione groupId e defina seu valor como o grupo de consumidores correspondente.

  • Limiar recomendado: Sugerimos estimar o limiar de alerta com base nos níveis de tolerância aceitáveis após a entrada em produção e estabilização do seu negócio.

  • Tratamento do alerta: Se receber um alerta sobre o número de mensagens dead-letter, siga estas etapas:

    1. Consulte as mensagens dead-letter e analise a lista de mensagens originais. Para obter instruções, consulte Fila dead-letter.

    2. Com base no Topic e Message ID da mensagem original, consulte o rastro da mensagem para analisar a causa da falha no consumo. Para obter instruções, consulte Consultar um rastro de mensagem.

    3. Com base na causa da falha no consumo da mensagem, determine as medidas corretivas apropriadas.

Configurar um alerta para contagem de limitação (throttling)

  • Contexto: O ApsaraMQ for RocketMQ permite usar eventos de limitação em uma instância especificada como item de monitoramento. Ao monitorar a contagem de limitações, você entende a extensão do impacto no seu negócio.

  • Risco se não configurado: Uma contagem maior de limitações indica uma violação mais grave das especificações da instância. Atualize a especificação da instância em tempo hábil.

  • Momento ideal para configuração: Após a entrada em produção do seu negócio e quando o tráfego estiver estabilizado.

    • Contagem de limitação no nível da instância: Recomendamos configurar este alerta após crie a instância.

    • Contagem de limitação nos níveis de tópico e grupo: Recomendamos configurar este alerta após a entrada em produção do seu negócio e quando o tráfego estiver estabilizado.

Na caixa de diálogo Set Rule Description, defina o Rule Name como Throttling count alert. Para Metric Type, selecione Basic Metrics e, para Metric, escolha Producer / Throttled messages per minute(Instance). Na seção Thresholds and Alert Levels, defina a condição para cada nível disparar após 3 períodos consecutivos (1 período = 1 minuto), o método de agregação como Sum e a condição como Value >= Threshold (unidade: contagem/m). Os métodos de notificação são: Critical (telefone, SMS, e-mail e webhook), Warn (SMS, e-mail e webhook) e Info (e-mail e webhook).

  • Limiar recomendado: Após a entrada em produção do seu negócio, estime o limiar de alerta com base nos níveis de tolerância aceitáveis.

  • Tratamento do alerta: Se receber um alerta de contagem de limitação, siga estas etapas:

    1. Na página Instance Details, clique em na aba Dashboard.

    2. Na seção Instance Message Volume Overview, verifique a curva Number of Throttled Requests para analisar o momento e o padrão dos eventos de limitação.

    3. Na seção Message Business Metrics Overview, revise a métrica Top 20 Topics by Message Production Rate (messages/minute). Com base no momento e no padrão da limitação, identifique o tópico com dados anormais e verifique sua curva para determinar se o aumento de tráfego está alinhado com as expectativas do negócio.

    4. Com base nessa análise, se o aumento de tráfego for esperado, atualize a especificação da instância. Se não for esperado, investigue a origem do tráfego anormal.