ApsaraMQ for RocketMQ utiliza os recursos de armazenamento de métricas e visualização do Managed Service for Prometheus e do Managed Service for Grafana, ambos do Application Real-Time Monitoring Service (ARMS), para oferecer um painel de estatísticas em tempo real. Esse recurso permite coletar e monitorar métricas para compreender rapidamente o estado operacional do seu negócio. Este tópico descreve os casos de uso, faturamento, métricas disponíveis e como utilizar o painel.
Casos de uso
Receba alertas imediatos sobre anomalias no consumo de mensagens para localizar e resolver problemas rapidamente, garantindo o processamento oportuno das mensagens.
Solucione problemas com pedidos específicos, como status anormal, revisando o rastreamento de mensagens para verifique a transmissão correta ao longo do fluxo de trabalho.
Analise tendências de tráfego, padrões de distribuição e volume total de mensagens para prever tendências de negócios e planejar recursos.
Visualize e analise a topologia de dependências da sua aplicação para entender as relações upstream e downstream, simplificando o planejamento de atualizações, otimizações e refatorações arquiteturais.
Pré-requisitos
-
Crie uma função vinculada ao service.
Nome da função: AliyunServiceRoleForOns
Nome da política da função: AliyunServiceRolePolicyForOns
Descrição da permissão: Permite que o Message Queue for RocketMQ assuma a função e acesse o CloudMonitor e o ARMS para funcionalidades de monitoramento, alerta e painel.
Para mais detalhes, consulte Service-linked roles.
Faturamento
As métricas do painel do ApsaraMQ for RocketMQ são métricas básicas no Managed Service for Prometheus. Como essas métricas são gratuitas, o recurso de painel também não gera custos.
Para mais informações, consulte Metrics e Pay-as-you-go.
Conceitos principais
Antes de visualizar as métricas do painel, compreenda os seguintes conceitos relacionados ao atraso do consumidor.

A figura anterior ilustra o estado das mensagens em uma fila para um tópico específico. O Message Queue for RocketMQ coleta estatísticas sobre a quantidade e o tempo de processamento das mensagens em diferentes estágios. Essas métricas refletem diretamente a taxa de processamento e o atraso do consumidor. Monitorá-las ajuda a identificar rapidamente possíveis anomalias no consumo de mensagens.
Categoria | Métrica | Descrição | Fórmula de cálculo |
Métricas de contagem de mensagens | inflight messages | Mensagens que os clientes consumidores estão processando, mas ainda não confirmaram. | offset da última mensagem puxada - offset da última mensagem confirmada |
ready messages | Mensagens no servidor do Message Queue for RocketMQ prontas para consumo. | Offset máximo da mensagem - offset da última mensagem puxada | |
consumer lag | Número total de mensagens não processadas. | Número de inflight messages + Número de ready messages | |
Métricas de latência de mensagens | ready time |
| Não aplicável |
ready message queue time | Diferença entre a hora atual e o ready time da mensagem pronta mais antiga. Esta métrica indica a velocidade com que os consumidores puxam mensagens. | Hora atual - Ready time da mensagem pronta mais antiga | |
consumer lag time | Diferença entre a hora atual e o ready time da mensagem não confirmada mais antiga. Esta métrica indica a velocidade com que os consumidores processam mensagens. | Hora atual - Ready time da mensagem não confirmada mais antiga |
Métricas
O painel do Message Queue for Apache RocketMQ fornece as seguintes métricas:
Producer: Visualize métricas de um tópico, como número de mensagens enviadas, taxa de sucesso de envio e tempo de resposta de envio.
Consumer: Consulte métricas relacionadas à assinatura de um grupo em um tópico específico, incluindo mensagens recebidas, taxa de sucesso de consumo e atraso do consumidor.
Instance top 20 overview: Veja os 20 principais valores para métricas específicas dentro de uma instância, juntamente com o tópico ou grupo correspondente.
Billing metric overview: Acompanhe métricas de uma instância específica, como TPS de envio e recebimento, número de chamadas de API e tamanho médio da mensagem. Esses dados auxiliam na estimativa de custos de faturamento.
Todas as métricas são coletadas em intervalos de 1 minuto. É possível consultar dados dos últimos 15 dias no Message Queue for Apache RocketMQ. O intervalo de tempo máximo para uma única consulta é de 24 horas.
Produtor
Métrica | Descrição |
Taxa de envio de mensagens | Taxa de mensagens enviadas e chamadas de API feitas para um tópico. Unidades:
|
Taxa máxima de envio de mensagens | Maior taxa de envio de mensagens registrada. Unidade: mensagens/segundo. |
Total de mensagens enviadas | Quantidade total de mensagens enviadas na instância especificada. Unidade: mensagens. |
Taxa de sucesso de chamadas de API de envio | Percentual de chamadas de API bem-sucedidas para envio de mensagens a um tópico. |
Tempo de resposta de envio de mensagens | Tempo necessário para enviar uma mensagem a um tópico. Unidade: ms. |
Consumidor
Métrica | Descrição |
Taxa média de sucesso de consumo | Percentual de mensagens consumidas com sucesso por um grupo. |
Atraso do consumidor (prontas + em trânsito) | Total de mensagens acumuladas para um grupo. Unidade: mensagens. |
Mensagens em trânsito | Quantidade de mensagens entregues aos clientes consumidores, mas ainda não confirmadas. Unidade: mensagens. |
Mensagens prontas | Número de mensagens no servidor do Message Queue for Apache RocketMQ disponíveis para consumo. Indica o volume de mensagens que os consumidores ainda não começaram a processar. Unidade: mensagens. |
Tempo de fila de mensagens prontas | Tempo decorrido desde que a mensagem pronta mais antiga ficou disponível para consumo. Indicador essencial de atrasos no processamento, sendo crítico para aplicações sensíveis ao tempo. O valor geral mostra a média de tempo de fila para a instância, enquanto o gráfico exibe o tempo para um grupo específico assinando um tópico específico. Unidade: ms. |
Taxa de recebimento de mensagens | Velocidade com que um grupo consome mensagens. Unidade: mensagens/segundo |
Taxa máxima de recebimento de mensagens | Pico da taxa de consumo de mensagens. Unidade: mensagens/segundo |
Total de mensagens recebidas | Soma total de mensagens consumidas por um grupo. Unidade: mensagens. |
Atraso do consumidor | Quantidade de mensagens acumuladas para um grupo, incluindo tanto mensagens prontas quanto em trânsito. Unidade: mensagens. |
Tempo de processamento de mensagens | Duração do processamento de uma mensagem pelo grupo, do início ao fim do consumo. Unidade: ms. |
Tempo de espera no lado do consumidor | Intervalo entre a chegada da mensagem ao cliente consumidor e o início do consumo. Unidade: ms. |
Taxa de sucesso de consumo | Percentual de êxito no consumo de mensagens. |
Proporção de protocolo do cliente consumidor | Distribuição das mensagens consumidas por cada protocolo de cliente. |
Top 20 da instância
|
Métrica |
Descrição |
|
Top 20 tópicos por taxa de envio |
Os 20 tópicos com maior taxa de envio de mensagens. Unidade: mensagens/segundo. |
|
Top 20 grupos por taxa de recebimento |
Os 20 grupos com maior taxa de consumo de mensagens. Unidade: mensagens/segundo. |
|
Top 20 grupos por mensagens prontas |
Os 20 grupos com maior quantidade de mensagens prontas. Unidade: mensagens. |
|
Top 20 grupos por tempo de fila de mensagens prontas |
Os 20 grupos com maior tempo de fila para mensagens prontas. Unidade: ms. |
|
Top 20 grupos por atraso do consumidor (prontas + em trânsito) |
Os 20 grupos com maior atraso acumulado. Unidade: mensagens. |
Métricas de faturamento
As métricas de faturamento abaixo consideram multiplicadores para mensagens grandes e recursos avançados.
Multiplicador de mensagem grande: Uma chamada de API é contabilizada a cada 4 KB de tamanho de mensagem. Por exemplo, enviar uma mensagem de 16 KB conta como quatro chamadas de API (16 KB / 4 KB = 4).
Multiplicador de recurso avançado: Chamadas de API para recursos avançados, como mensagens ordenadas, agendadas/atrasadas e transacionais, são contabilizadas com peso cinco vezes maior que as mensagens normais.
|
Métrica |
Descrição |
|
TPS máximo de envio |
Pico de transações por segundo (TPS) para produção de mensagens. Auxilia na estimativa da especificação de TPS necessária para sua instância. Unidade: TPS. |
|
TPS máximo de recebimento |
Maior TPS registrado para consumo de mensagens. Útil para dimensionar a capacidade de pico da instância. Unidade: TPS. |
|
TPS máximo |
Soma máxima de TPS para produção e consumo combinados. Fundamental para definir a especificação de pico da instância. Unidade: TPS. |
|
Total de chamadas de API |
Quantidade acumulada de chamadas de API. Base para estimativa de uso e custos de faturamento. Unidade: chamadas. |
|
Tamanho médio da mensagem |
Média do tamanho de todas as mensagens produzidas. Unidade: bytes. |
|
TPS de envio e recebimento |
Taxa combinada de transações para produção e consumo de mensagens. Unidade: TPS. |
|
Total diário de chamadas de API |
Soma diária de chamadas de API para produção e consumo. Unidade: chamadas. |
Métricas
Todas as métricas de throughput de mensagens (TPS), requisições e contagem utilizam uma mensagem normal de 4 KB como base. O valor final é multiplicado por fatores baseados no tamanho real da mensagem e no tipo avançado.
A tabela a seguir detalha os campos presentes nas métricas.
Campo | Valor |
Tipo de métrica | Gauge: Métrica que pode aumentar ou diminuir. Representa uma medição instantânea, como o TPS de chamadas de API. |
Rótulo |
|
Métricas do lado do servidor
Tipo de métrica | Nome da métrica | Unidade | Descrição | Rótulo |
Gauge | rocketmq_instance_requests_threshold | count/s | Limiar de limitação de taxa para a instância. |
|
Gauge | rocketmq_instance_requests_max | count/s | Transações máximas por segundo (TPS) da instância, excluindo requisições limitadas. Representa o pico de TPS registrado em um intervalo de um minuto. |
|
Métricas do produtor
Tipo de métrica | Nome da métrica | Unidade | Descrição | Rótulo |
Gauge | rocketmq_producer_requests (Métrica faturável) | count | Número de chamadas de API faturáveis para envio de mensagens. |
|
Gauge | rocketmq_producer_messages | message | Quantidade de mensagens enviadas. |
|
Gauge | rocketmq_producer_message_size_bytes | byte | Tamanho total das mensagens enviadas. |
|
Gauge | rocketmq_producer_send_success_rate | % | Taxa de sucesso no envio de mensagens. |
|
Gauge | rocketmq_producer_failure_api_calls | count | Número de chamadas de API com falha para envio de mensagens. |
|
Gauge | rocketmq_producer_send_rt_milliseconds_avg | ms | Tempo médio de resposta para envio de mensagens. |
|
Gauge | rocketmq_producer_send_rt_milliseconds_min | ms | Menor tempo de resposta registrado no envio de mensagens. |
|
Gauge | rocketmq_producer_send_rt_milliseconds_max | ms | Maior tempo de resposta registrado no envio de mensagens. |
|
Gauge | rocketmq_producer_send_rt_milliseconds_p95 | ms | Percentil 95 do tempo de resposta para envio de mensagens. |
|
Gauge | rocketmq_producer_send_rt_milliseconds_p99 | ms | Percentil 99 do tempo de resposta para envio de mensagens. |
|
Métricas do consumidor
Tipo de métrica | Nome da métrica | Unidade | Descrição | Rótulo |
Gauge | rocketmq_consumer_requests | count | Quantidade de chamadas de API para consumo de mensagens. |
|
Gauge | rocketmq_consumer_send_back_requests | count | Chamadas de API para devolver mensagens após falha no consumo. |
|
Gauge | rocketmq_consumer_send_back_messages | message | Mensagens devolvidas devido a falhas no consumo. |
|
Gauge | rocketmq_consumer_messages | message | Volume de mensagens consumidas. |
|
Gauge | rocketmq_consumer_message_size_bytes | byte | Soma do tamanho das mensagens consumidas. |
|
Gauge | rocketmq_consumer_ready_and_inflight_messages | message | Atraso total do consumidor, calculado pela soma de mensagens prontas e em trânsito. |
|
Gauge | rocketmq_consumer_ready_messages | message | Mensagens na fila aguardando serem puxadas pelos consumidores. Calculado como: |
|
Gauge | rocketmq_consumer_inflight_messages | message | Mensagens puxadas pelos consumidores, mas ainda não confirmadas. Calculado como: |
|
Gauge | rocketmq_consumer_queue_time_milliseconds | ms | Tempo de permanência da mensagem na fila. |
|
Gauge | rocketmq_consumer_message_await_time_milliseconds_avg | ms | Tempo médio que a mensagem aguarda no buffer do cliente consumidor antes do processamento. |
|
Gauge | rocketmq_consumer_message_await_time_milliseconds_min | ms | Menor tempo de espera da mensagem no buffer do cliente consumidor antes do processamento. |
|
Gauge | rocketmq_consumer_message_await_time_milliseconds_max | ms | Maior tempo de espera da mensagem no buffer do cliente consumidor antes do processamento. |
|
Gauge | rocketmq_consumer_message_await_time_milliseconds_p95 | ms | Percentil 95 do tempo de espera da mensagem no buffer do cliente consumidor antes do processamento. |
|
Gauge | rocketmq_consumer_message_await_time_milliseconds_p99 | ms | Percentil 99 do tempo de espera da mensagem no buffer do cliente consumidor antes do processamento. |
|
Gauge | rocketmq_consumer_message_process_time_milliseconds_avg | ms | Tempo médio gasto pelo consumidor para processar uma mensagem. |
|
Gauge | rocketmq_consumer_message_process_time_milliseconds_min | ms | Menor tempo gasto pelo consumidor para processar uma mensagem. |
|
Gauge | rocketmq_consumer_message_process_time_milliseconds_max | ms | Maior tempo gasto pelo consumidor para processar uma mensagem. |
|
Gauge | rocketmq_consumer_message_process_time_milliseconds_p95 | ms | Percentil 95 do tempo de processamento de mensagens. |
|
Gauge | rocketmq_consumer_message_process_time_milliseconds_p99 | ms | Percentil 99 do tempo de processamento de mensagens. |
|
Gauge | rocketmq_consumer_consume_success_rate | % | Taxa de sucesso no consumo de mensagens. |
|
Gauge | rocketmq_consumer_failure_api_calls | count | Chamadas de API com falha durante o consumo de mensagens. |
|
Gauge | rocketmq_consumer_to_dlq_messages | message | Mensagens encaminhadas para a fila de mensagens mortas. |
|
Painel
Faça login no console do Message Queue for Apache RocketMQ. No painel de navegação à esquerda, clique em Instances.
Na barra de menu superior, selecione uma região, como China (Hangzhou). Em seguida, na lista de instâncias, clique na instância desejada.
-
Acesse o painel de uma das seguintes formas:
Página Instance Details: Na página Instance Details, clique na aba Dashboard.
Aba Dashboard: No painel de navegação à esquerda, clique em Dashboard.
Página Topic Details: No painel de navegação à esquerda, clique em Topics. Na lista, selecione o tópico alvo. Na página Topic Details, clique na aba Topic Overview.
Página Group Details: No painel de navegação à esquerda, clique em Groups. Selecione o grupo desejado na lista. Na página Group Details, clique na aba Group Overview.
Perguntas frequentes sobre o painel
Acessar dados de métricas do painel
Utilize sua conta raiz para fazer login no console do ARMS.
No painel de navegação à esquerda, clique em Access Center.
Na página Access Center, insira
RocketMQna caixa de pesquisa e clique no ícone de busca.Nos resultados, selecione o service cloud que deseja integrar, como Alibaba Cloud Message Queue for RocketMQ. Para detalhes sobre o procedimento de integração, consulte Step 1: Integrate monitoring data from a cloud service.
Após a integração bem-sucedida, clique em Integration Management no painel de navegação à esquerda.
Na lista Cloud Service Environment, clique no nome do ambiente alvo para abrir sua página de detalhes.
Na aba Component Management, dentro da seção Basic Information, clique na região do service cloud ao lado de Prometheus instance.
Esta página oferece diferentes métodos para acessar os dados.{key, select, RAM {RAM} Overview {Overview} Identities {Identities} Users {Users} Groups {Groups} Roles {Roles} Settings {Settings} Permissions {Permissions} Grants {Grants} Troubleshoot {Troubleshooting} Policies {Policies} Integrations {Integrations} Providers {SSO} Applications {OAuth (Preview)} CloudSSO {CloudSSO} AccessAnalyzing {Access Analysis} Analyzers {Analyzers} Findings {Findings} Beta {Beta} Governance {Cloud Governance} other {{key}} }
Importar dados para um Grafana autogerenciado
Todos os dados de métricas do Alibaba Cloud Message Queue for RocketMQ ficam armazenados no seu Alibaba Cloud Prometheus Service. Siga os passos em How do I get dashboard metric data? para integrar o service cloud e obter o nome do ambiente e o endpoint da API HTTP. Depois, utilize a API para importar esses dados para o seu Grafana autogerenciado. Para mais informações, consulte Use an HTTP API endpoint to connect to Grafana or a self-managed application to access Prometheus data.
TPS médio e máximo
TPS médio = Total de requisições em um período de 1 minuto / 60 segundos
TPS máximo: O sistema amostra o valor de TPS uma vez por segundo durante um minuto. O TPS máximo corresponde ao maior valor entre as 60 amostras.
Por exemplo:
Considere uma instância que produz 60 mensagens em um minuto (todas mensagens normais de 4 KB cada).
TPS médio da instância = 60 requisições / 60 segundos = 1 requisição/segundo
O TPS máximo da instância é calculado da seguinte forma:
-
Se todas as 60 mensagens forem enviadas no primeiro segundo, o TPS de cada segundo desse minuto será 60, 0, 0, ..., 0.
O TPS máximo da instância será de 60 requisições/segundo.
-
Se 40 mensagens forem enviadas no primeiro segundo e 20 no segundo seguinte, o TPS de cada segundo desse minuto será 40, 20, 0, 0, ..., 0.
Neste caso, o TPS máximo da instância será de 40 requisições/segundo.