Quando há picos de throughput de mensagens, atraso no consumo ou limitação de requisições, é essencial ter visibilidade completa do que ocorre nas suas instâncias do RocketMQ. O ApsaraMQ for RocketMQ integra-se ao CloudMonitor para coletar métricas em intervalos de 1 minuto, exibi-las em gráficos de séries temporais e enviar notificações de alerta sempre que os limiares forem ultrapassados.
O monitoramento e os alertas são gratuitos.
Para mais informações sobre o CloudMonitor, consulte Monitoramento de serviços em nuvem.
Pré-requisitos
Antes de começar, verifique se a seguinte função vinculada ao serviço existe na sua conta:
Nome da função: AliyunServiceRoleForOns
Política da função: AliyunServiceRolePolicyForOns
Essa função concede ao ApsaraMQ for RocketMQ acesso ao CloudMonitor e ao Application Real-Time Monitoring Service (ARMS) para habilitar recursos de monitoramento, alertas e painéis.
Para mais informações, consulte Funções vinculadas ao serviço.
Métricas de monitoramento
As tabelas a seguir listam as métricas disponíveis por categoria. Todas as métricas são agregadas em intervalos de 1 minuto.
Para definições de Ready messages e Ready message queue time, consulte Termos.
Métricas de instância
As métricas no nível da instância acompanham o throughput geral e a limitação de uma única instância do RocketMQ. Utilize-as para monitorar taxas de chamadas de API, volumes de mensagens e eventos de limitação.
|
Métrica |
Nome da métrica |
Unidade |
Dimensões |
|
Transações por segundo (TPS) na instância |
InstanceApiCallTps |
count/s |
userId, instanceId |
|
Mensagens enviadas por produtores por minuto |
SendMessageCountPerInstance |
count/m |
userId, instanceId |
|
Mensagens recebidas por consumidores por minuto |
ReceiveMessageCountPerInstance |
count/m |
userId, instanceId |
|
Requisições de envio de mensagens limitadas por minuto |
ThrottledSendRequestsPerInstance |
count/m |
userId, instanceId |
|
Requisições de recebimento de mensagens limitadas por minuto |
ThrottledReceiveRequestsPerInstance |
count/m |
userId, instanceId |
Métricas de grupo
As métricas no nível de grupo medem o desempenho do consumidor para um grupo de consumidores específico. Elas ajudam a detectar atrasos no consumo, identificar consumidores lentos e acompanhar a geração de mensagens dead-letter.
|
Métrica |
Nome da métrica |
Unidade |
Dimensões |
|
Mensagens acumuladas |
ConsumerLag |
count |
userId, instanceId, groupId |
|
Latência de processamento de mensagens |
ConsumerLagLatencyPerGid |
ms |
userId, instanceId, groupId |
|
Ready messages |
ReadyMessages |
count |
userId, instanceId, groupId |
|
Ready message queue time |
ReadyMessageQueueTime |
ms |
userId, instanceId, groupId |
|
Mensagens recebidas por consumidores por minuto |
ReceiveMessageCountPerGid |
count/m |
userId, instanceId, groupId |
|
Requisições de recebimento de mensagens limitadas por minuto |
ThrottledReceiveRequestsPerGid |
count/m |
userId, instanceId, groupId |
|
Mensagens dead-letter geradas por minuto |
SendDLQMessageCountPerGid |
count/m |
userId, instanceId, groupId |
Métricas de tópico
As métricas no nível de tópico rastreiam o throughput do produtor e a limitação para um tópico específico.
|
Métrica |
Nome da métrica |
Unidade |
Dimensões |
|
Mensagens enviadas por produtores por minuto |
SendMessageCountPerTopic |
count/m |
userId, instanceId, topic |
|
Requisições de envio de mensagens limitadas por minuto |
ThrottledSendRequestsPerTopic |
count/m |
userId, instanceId, topic |
Métricas de grupo e tópico
Essas métricas combinam um grupo de consumidores específico com um tópico específico, oferecendo a visualização mais granular possível. Use-as para identificar problemas de consumo no nível do tópico dentro de um grupo.
|
Métrica |
Nome da métrica |
Unidade |
Dimensões |
|
Mensagens acumuladas |
ConsumerLagPerGidTopic |
count |
userId, instanceId, groupId, topic |
|
Latência de processamento de mensagens |
ConsumerLagLatencyPerGidTopic |
ms |
userId, instanceId, topic, groupId |
|
Ready messages |
ReadyMessagesPerGidTopic |
count |
userId, instanceId, groupId, topic |
|
Ready message queue time |
ReadyMessageQueueTimePerGidTopic |
ms |
userId, instanceId, groupId, topic |
|
Mensagens recebidas por consumidores por minuto |
ReceiveMessageCountPerGidTopic |
count/m |
userId, instanceId, topic, groupId |
|
Requisições de recebimento de mensagens limitadas por minuto |
ThrottledReceiveRequestsPerGidTopic |
count/m |
userId, instanceId, topic, groupId |
|
Mensagens dead-letter geradas por minuto |
SendDLQMessageCountPerGidTopic |
count/m |
userId, instanceId, groupId, topic |
Visualizar métricas
Faça login no console do ApsaraMQ for RocketMQ. No painel de navegação à esquerda, clique em Instances.
Na barra de navegação superior, selecione uma região, como China (Hangzhou). Na página Instances, clique no nome da instância a ser gerenciada.
No painel de navegação à esquerda, clique em Monitoring and Alerts.
Na página Monitoring and Alerts, selecione um tipo de recurso na lista suspensa Group Name e escolha o intervalo de tempo da consulta. A página exibirá automaticamente os gráficos de métricas correspondentes ao tipo de recurso selecionado.
Criar uma regra de alerta
Na página Instances, clique no nome da instância a ser gerenciada.
No painel de navegação à esquerda, clique em Monitoring and Alerts.
No canto superior direito da página Monitoring and Alerts, clique em Create Alert Rule. O painel Create Alert Rule será aberto no console do CloudMonitor.
Configure a regra de alerta e as configurações de notificação e clique em OK. Para descrições dos parâmetros, consulte Criar uma regra de alerta.
Veja também
Configurar o recurso de monitoramento e alertas para aviso de risco: Saiba como configurar regras de alerta para métricas principais e métricas de negócios.