O CloudMonitor envia alertas aos contatos designados quando métricas essenciais de desempenho — como utilização de CPU ou uso de memória — ultrapassam limiares críticos, ou quando ocorrem eventos na instância, como failovers entre primário e réplica. Configure regras de alerta para identificar problemas antes que afetem sua aplicação.
Pré-requisitos
Antes de começar, verifique se você tem:
Uma instância Tair (compatível com Redis OSS)
Um contato de alerta e um grupo de contatos de alerta no CloudMonitor. Consulte Crie um contato de alerta ou grupo de contatos de alerta
Configure regras de alerta
Faça login no console e acesse a página Instances.
Na barra de navegação superior, selecione a região onde a instância está localizada.
Localize a instância e clique em ID dela.
No painel de navegação à esquerda, clique em Alert Settings.
Na página Alarm Settings, revise as métricas atuais da instância.
-
Clique em Alert Settings no canto superior direito para abrir o console do CloudMonitor. Em seguida, adicione ou gerencie regras de alerta usando um dos métodos abaixo:
Crie uma regra de alerta: Envia um alerta quando o valor de uma métrica excede um limiar definido. Por exemplo, dispare um alerta quando a utilização de CPU ultrapassar 90%.
Subscribe to event notifications: Envia um alerta quando ocorre um evento na instância, como failover entre primário e réplica, falha da instância ou tarefa proativa de O&M, como migração de instância. Os alertas são disparados por eventos como InstanceMaintenance (O&M proativo) e exceções de instância.
NotaAo criar uma regra de alerta, selecione o tipo de service correspondente à arquitetura da instância. Selecionar o tipo incorreto impede a aplicação das regras de alerta às métricas adequadas.
Tipo de instância
Tipos de service
Instâncias Tair baseadas em DRAM e instâncias Redis Open-Source Edition
Redis/Tair DRAM(Standard), Redis/Tair DRAM(Cluster), Redis/Tair DRAM(Read/Write Splitting)
Instâncias Tair otimizadas para memória persistente
Tair Persistent Memory(Standard), Tair Persistent Memory(Cluster), Tair Persistent Memory(Read/Write Splitting)
Instâncias Tair baseadas em ESSD/SSD
Limiares de alerta recomendados
As métricas a seguir são as mais sensíveis à degradação de desempenho. Configure regras de alerta para essas métricas como linha de base.
|
Métrica |
Limiar recomendado |
Importância |
|
Utilização de CPU |
Maior que 60% |
O uso elevado e contínuo de CPU indica dificuldade do servidor Redis em processar requisições, aumentando a latência e podendo causar timeouts. |
|
Uso de memória |
Maior que 80% |
Com a memória quase cheia, o Redis pode começar a evictar chaves ou rejeitar escritas, dependendo da política de evicção configurada. |
|
Uso de largura de banda de entrada |
Maior que 80% |
A saturação da largura de banda atrasa a entrega de dados aos clientes, provocando timeouts nas requisições. |
|
Uso de largura de banda de saída |
Maior que 80% |
A saturação da largura de banda retarda a transmissão de dados para os clientes, resultando em timeouts de requisição. |
Para obter a lista completa de métricas disponíveis, consulte Appendix 1: Metrics.
Perguntas frequentes
O que significa a métrica Blocked Clients?
A métrica Node/Blocked Clients contabiliza o número de conexões de clientes bloqueadas aguardando resposta de um comando de bloqueio. Comandos de bloqueio incluem BRPOP, BLPOP, BZPOPMIN, BZPOPMAX e XREAD. Um aumento sustentado nessa métrica indica acúmulo de clientes devido a operações de bloqueio de longa duração, o que pode degradar a responsividade geral da instância.