Diagnosticar problemas de desempenho em uma instância Redis gerenciada exige visibilidade sobre métricas, logs e padrões de acesso a chaves. O Tair (compatível com Redis OSS) oferece ferramentas nativas de observabilidade — métricas, logs e análises — que vão além dos recursos do Redis open-source. Assim, você monitora a integridade da instância, investiga lentidão e identifica chaves problemáticas sem precisar de ferramentas externas.
Visão geral dos recursos
A observabilidade se baseia em três tipos de dados:
Métricas: medições numéricas coletadas ao longo do tempo que mostram o estado e as tendências de um sistema.
Logs: registros de eventos discretos ocorridos durante a execução, incluindo erros, consultas lentas e operações.
Traces: registros de ponta a ponta do ciclo de vida de uma solicitação.
A análise de traces geralmente exige middleware ou alterações no código do lado do cliente.
A tabela a seguir compara os recursos de observabilidade entre as edições.
| Observabilidade | Redis | Redis Open-Source Edition | Tair (Enterprise Edition) | |
|---|---|---|---|---|
| Métricas | Métricas de desempenho | Suportado | Suportado (detalhado) | Suportado (detalhado) |
| Logs | Logs ativos | Suportado | Suportado | Suportado |
| Logs de consultas lentas | Suportado | Suportado | Suportado | |
| Logs de auditoria | Não suportado | Suportado | Suportado | |
| Análise de latência | Não suportado | Suportado | Suportado | |
| Traces | ➖ | ➖ | ➖ | ➖ |
| Análises | Análise em tempo real de hotkeys | Não suportado | Suportado | Suportado |
| Análise em tempo real de large keys | Não suportado | Suportado | Suportado | |
| Análise offline de chaves | Não suportado | Suportado | Suportado | |
| Diagnóstico de instância | Não suportado | Suportado | Suportado | |
Métricas
O Tair (compatível com Redis OSS) inclui todas as métricas padrão do Redis — distribuição de memória, uso de memória, taxa de fragmentação de memória, contagem de conexões e comandos, tráfego de rede, status de sincronização, utilização de CPU e informações do keyspace — além de consultas de leitura por segundo (QPS) e QPS de escrita detalhadas.
As métricas detalhadas habilitam três capacidades adicionais de monitoramento:
Monitoramento de desempenho em tempo real: exibe métricas de desempenho conforme são atualizadas.
Gerenciamento de sessões: mostra sessões ativas entre uma instância e seus clientes.
Tendências de desempenho: apresenta como as métricas variam em uma janela de tempo selecionada.
Para obter a lista completa de métricas disponíveis, consulte Visualize dados de monitoramento de desempenho.
Logs
O Tair (compatível com Redis OSS) fornece quatro tipos de log para monitoramento e solução de problemas de instâncias.
Logs ativos
Os logs ativos registram operações de persistência, eventos de replicação síncrona, atividades de depuração e mensagens de erro em tempo de execução. Cada entrada aparece como uma linha no log.
Para visualizar os logs ativos, acesse a página de detalhes da instância e escolha Logs > Active Logs no painel de navegação à esquerda. Para mais informações, consulte Consultar logs ativos.
Logs de consultas lentas
Os logs de consultas lentas capturam solicitações que ultrapassam limites específicos de execução. O tempo de execução considera apenas o período gasto processando o comando, excluindo o tempo em fila ou em transmissão de rede.
Cada entrada de log de consulta lenta inclui:
|
Campo |
Descrição |
|
Timestamp de execução |
Momento em que o comando foi processado |
|
Duração da execução |
Tempo necessário para executar o comando |
|
Comando e parâmetros |
Comando executado |
|
Informações do cliente |
Cliente que emitiu o comando |
Utilize os logs de consultas lentas para identificar comandos que demoram mais do que o esperado e otimize-os para evitar congestionamento do serviço.
Para visualizar os logs de consultas lentas, acesse a página de detalhes da instância e escolha Logs > Slow Logs no painel de navegação à esquerda. Para mais informações, consulte Consultar logs lentos.
Logs de auditoria
Os logs de auditoria são baseados no Simple Log Service (SLS) e capturam todos os logs de operações online, incluindo operações sensíveis como FLUSHALL, FLUSHDB e DEL.
Cada entrada de log de auditoria inclui:
|
Campo |
Descrição |
|
Tipo de log |
Categoria do evento registrado |
|
Duração da execução |
Tempo gasto para executar a operação |
|
Número do banco de dados |
Banco de dados alvo da operação |
|
Endereço IP do cliente |
Endereço IP do cliente que emitiu o comando |
|
Nome da conta |
Conta que realizou a operação |
|
Detalhes do comando |
Comando completo executado |
|
Informações de extensão |
Contexto adicional sobre a operação |
Os logs de auditoria permitem pesquisar e analisar operações online, consultas lentas e logs ativos, além de exportar os resultados.
Para visualizar os logs de auditoria, acesse a página de detalhes da instância e escolha Logs > Audit Logs no painel de navegação à esquerda. Para mais informações, consulte Ative o recurso de log de auditoria.
Análise de latência
A análise de latência registra tempos de execução de até 27 eventos em todos os comandos e retém os dados dos últimos três dias.
Para visualizar dados de latência, acesse a página de detalhes da instância e escolha CloudDBA > Latency Insights no painel de navegação à esquerda. Para mais informações, consulte Usar o recurso de análise de latência.
Análises
O Tair (compatível com Redis OSS) integra métricas de desempenho, traces e logs para fornecer ferramentas analíticas de diagnóstico de problemas na instância.
Análise de hotkeys e large keys
Uma hotkey recebe significativamente mais solicitações do que outras chaves. Se não tratadas, as hotkeys causam distribuição desigual de solicitações e podem levar a falhas de cache. Uma large key contém muitos membros ou ocupa uma grande quantidade de memória. Sem o devido tratamento, as large keys tornam lentos os comandos que as acessam e podem gerar erros de falta de memória (OOM).
O recurso Real-time Key Statistics identifica hotkeys e large keys assim que surgem e retém dados dos últimos quatro dias. Ele mostra o consumo de memória e a frequência de solicitações de cada chave com alta precisão e impacto mínimo no desempenho.
Para visualizar estatísticas de hotkeys e large keys, acesse a página de detalhes da instância e escolha CloudDBA > Real-time Key Statistics no painel de navegação à esquerda. Para mais informações, consulte Usar o recurso de estatísticas de chaves em tempo real.
Análise offline de chaves
A Offline Key Analysis processa arquivos de snapshot do Redis Database (RDB) sem afetar as instâncias em execução. Ela suporta todas as estruturas de dados, arquiteturas de instância e versões do Redis compatíveis com o Tair (compatível com Redis OSS).
Características de desempenho:
|
Cenário |
Desempenho |
|
Mix de 10% de large keys e 90% de small keys |
4 vezes mais rápido que redis-rdb-tool |
|
Medium e large keys |
20 vezes mais rápido que redis-rdb-tool |
|
Uso de memória durante a análise |
Abaixo de 1 GB (evita erros OOM) |
Este recurso também permite pesquisar o subelemento mais longo dentro de uma chave para identificar a origem de problemas com large keys.
Para executar uma análise offline de chaves, acesse a página de detalhes da instância e escolha CloudDBA > Offline Key Analysis no painel de navegação à esquerda. Para mais informações, consulte Usar o recurso de análise offline de chaves.
Diagnóstico de instância
O diagnóstico de instância combina métricas de desempenho, logs de consultas lentas e análise de chaves em uma verificação de integridade completa. Cada relatório de diagnóstico avalia a instância com base em critérios como níveis de desempenho, distorção na distribuição de solicitações e padrões de consultas lentas, fornecendo sugestões práticas.
Para gerar um relatório de diagnóstico, acesse a página de detalhes da instância e escolha CloudDBA > Diagnostic Reports no painel de navegação à esquerda. Para mais informações, consulte Crie um relatório de diagnóstico.