O CoreDNS é o plugin padrão de descoberta de serviço DNS em clusters ACK. Este tópico explica como visualizar o painel do componente CoreDNS, interpretar anomalias comuns de métricas e consultar a lista de métricas do CoreDNS.
Pré-requisitos
O Application Real-Time Monitoring Service (ARMS) está ativado.
O componente ack-arms-prometheus está instalado. Consulte Gerenciar componentes.
Visualizar o painel do CoreDNS
Faça login no ACK console. No painel de navegação à esquerda, escolha Clusters.
Na página Clusters, clique em nome do cluster desejado. No painel de navegação à esquerda, escolha Operations > Prometheus Monitoring.
-
Na página Prometheus Monitoring, selecione a aba Network Monitoring e, em seguida, a aba CoreDNS.

Métricas do painel
O painel do CoreDNS usa consultas PromQL para exibir throughput de requisições, comportamento de resposta e desempenho de cache em três categorias.
Métricas de requisição
|
Métrica |
Unidade |
Descrição |
|
Requests (total) |
Requisições/s |
Quantidade de requisições DNS recebidas pelo CoreDNS por segundo. |
|
Requests (success rate) |
% |
Percentual de requisições com retorno NOERROR ou NXDOMAIN (ambos contam como sucesso). |
|
Requests (by zone) |
Requisições/s |
Taxa de requisições por zona DNS. |
|
Requests (by qtype) |
Requisições/s |
Taxa de requisições por tipo de consulta DNS (por exemplo, A, AAAA, MX). |
|
Requests (DO bit) |
Requisições/s |
Taxa de requisições com o bit DNSSEC OK (DO) ativado. |
|
Requests (size, udp) |
Bytes |
Tamanho de cada pacote de requisição udp recebido pelo CoreDNS. |
|
Requests (size, tcp) |
Bytes |
Tamanho de cada pacote de requisição tcp recebido pelo CoreDNS. |
Métricas de resposta
|
Métrica |
Unidade |
Descrição |
|
Responses (by rcode) |
Requisições/s |
Taxa de respostas por código de resposta DNS (por exemplo, NOERROR, NXDOMAIN, SERVFAIL). |
|
Responses (duration) |
Segundos |
Latência de resposta nos percentis 99, 90 e 50. |
|
Responses (size, udp) |
Bytes |
Tamanho do pacote de resposta udp nos percentis 99 e 50. |
|
Responses (size, tcp) |
Bytes |
Tamanho do pacote de resposta tcp nos percentis 99 e 50. |
Métricas de cache
|
Métrica |
Unidade |
Descrição |
|
Cache (size) |
N/A |
Entradas no cache do CoreDNS. |
|
Cache (hitrate) |
% |
Taxa de acertos do cache. |
Anomalias comuns
Anomalias frequentes do CoreDNS organizadas por gravidade, causas prováveis e ações recomendadas.
|
Gravidade |
Anomalia |
Onde verificar |
Causas prováveis |
Ação recomendada |
|
Crítica |
Alta taxa de respostas SERVFAIL |
Responses (by rcode) |
Servidor DNS upstream inacessível |
Identifique nos logs do CoreDNS os nomes de domínio que geram respostas SERVFAIL e corrija a conectividade com o DNS upstream. Consulte Coletar e analisar logs do CoreDNS. |
|
Crítica |
Alta latência de resposta |
Responses (duration) |
Grande volume de aplicações resolvendo nomes de domínio externos |
Verifique a latência do percentil 99 no gráfico Responses (duration) para identificar a origem. |
|
Aviso |
Aumento abrupto na taxa de requisições |
Requests (total) |
Pico de tráfego da aplicação; aplicação mal configurada gerando consultas DNS excessivas |
Analise os logs do CoreDNS para verificar se os domínios mais consultados justificam o pico. Se for um comportamento esperado, adicione pods do CoreDNS (Garantir a alta disponibilidade do CoreDNS) e ative o NodeLocal DNSCache para descarregar o tráfego DNS. Consulte Coletar e analisar logs do CoreDNS. |
Métricas para Prometheus autogerenciado
Sem o ARMS, monitore o CoreDNS com uma instância de Prometheus autogerenciada. A tabela lista as métricas do CoreDNS 1.9.3; consulte a documentação de métricas do CoreDNS para obter a lista completa.
|
Métrica |
Tipo de dado |
Rótulos |
Descrição |
|
|
Contador |
server, zone, proto, family, type |
Total de consultas DNS. |
|
|
Histograma |
server, zone |
Latência da consulta DNS. |
|
|
Histograma |
server, zone, proto |
Tamanho do pacote de consulta DNS. Limiares de bucket do histograma (bytes): 0, 100, 200, 300, 400, 511, 1023, 2047, 4095, 8291, 16000, 32000, 48000, 64000. |
|
|
Contador |
server, zone |
Total de consultas com o bit DO. |
|
|
Histograma |
server, zone, proto |
Tamanho do pacote de resposta DNS. Limiares de bucket do histograma (bytes): 0, 100, 200, 300, 400, 511, 1023, 2047, 4095, 8291, 16000, 32000, 48000, 64000. |
|
|
Contador |
server, zone, rcode, plugin |
Total de respostas DNS. |
|
|
Contador |
— |
Contagem de panics do CoreDNS. |
|
|
Medidor |
server, zone, name |
Indica se um plugin está habilitado. |
|
|
Contador |
server, status |
Total de consultas DoH. |