CoreDNS est le plugin de découverte de service DNS par défaut dans les clusters ACK. Cette rubrique explique comment consulter le tableau de bord du composant CoreDNS, interpréter les anomalies courantes des métriques et examiner la liste des métriques CoreDNS.
Prérequis
Le Application Real-Time Monitoring Service (ARMS) est activé.
Le composant ack-arms-prometheus est installé. Consultez la rubrique Gérer les composants.
Consulter le tableau de bord CoreDNS
Connectez-vous à la console ACK. Dans le volet de navigation de gauche, choisissez Clusters.
Sur la page Clusters, cliquez sur le nom du cluster cible. Dans le volet de navigation de gauche, choisissez Operations > Prometheus Monitoring.
-
Sur la page Prometheus Monitoring, sélectionnez l'onglet Network Monitoring, puis l'onglet CoreDNS.

Métriques du tableau de bord
Le tableau de bord CoreDNS utilise des requêtes PromQL pour afficher le débit des requêtes, le comportement des réponses et les performances du cache, répartis en trois catégories.
Métriques de requête
| Metric | Unit | Description |
|---|---|---|
| Requests (total) | Requests/s | Nombre de requêtes DNS reçues par CoreDNS par seconde. |
| Requests (success rate) | % | Pourcentage de requêtes renvoyant NOERROR ou NXDOMAIN (les deux sont considérés comme des succès). |
| Requests (by zone) | Requests/s | Taux de requêtes par zone DNS. |
| Requests (by qtype) | Requests/s | Taux de requêtes par type de requête DNS (par exemple, A, AAAA, MX). |
| Requests (DO bit) | Requests/s | Taux de requêtes avec le bit DNSSEC OK (DO). |
| Requests (size, udp) | Bytes | Taille de chaque paquet de requête UDP reçu par CoreDNS. |
| Requests (size, tcp) | Bytes | Taille de chaque paquet de requête TCP reçu par CoreDNS. |
Métriques de réponse
| Metric | Unit | Description |
|---|---|---|
| Responses (by rcode) | Requests/s | Taux de réponses par code de réponse DNS (par exemple, NOERROR, NXDOMAIN, SERVFAIL). |
| Responses (duration) | Seconds | Latence de réponse aux 99e, 90e et 50e percentiles. |
| Responses (size, udp) | Bytes | Taille des paquets de réponse UDP aux 99e et 50e percentiles. |
| Responses (size, tcp) | Bytes | Taille des paquets de réponse TCP aux 99e et 50e percentiles. |
Métriques de cache
| Metric | Unit | Description |
|---|---|---|
| Cache (size) | N/A | Nombre d'entrées dans le cache CoreDNS. |
| Cache (hitrate) | % | Taux de succès du cache. |
Anomalies courantes
Présentation des anomalies courantes de CoreDNS classées par gravité, avec leurs causes probables et les actions recommandées.
| Severity | Anomaly | Where to look | Likely causes | What to do |
|---|---|---|---|---|
| Critical | High SERVFAIL response rate | Responses (by rcode) | Serveur DNS amont inaccessible | Dans les journaux CoreDNS, identifiez les noms de domaine qui déclenchent des réponses SERVFAIL, puis corrigez la connectivité DNS amont. Consultez la rubrique Collecter et analyser les journaux CoreDNS. |
| Critical | High response latency | Responses (duration) | Grand nombre d'applications résolvant des noms de domaine externes | Vérifiez la latence au 99e percentile dans le graphique Responses (duration) pour identifier la source. |
| Warning | Sharp increase in request rate | Requests (total) | Pic de trafic applicatif ; application mal configurée effectuant un nombre excessif de requêtes DNS | Dans les journaux CoreDNS, vérifiez si les noms de domaine fréquemment interrogés expliquent ce pic. Si cela est attendu, ajoutez des pods CoreDNS (consultez la rubrique Garantir la haute disponibilité de CoreDNS) et activez NodeLocal DNSCache pour décharger le trafic DNS. Consultez la rubrique Collecter et analyser les journaux CoreDNS. |
Métriques pour Prometheus autogéré
Sans ARMS, surveillez CoreDNS à l'aide d'une instance Prometheus autogérée. Le tableau ci-dessous répertorie les métriques de CoreDNS 1.9.3 ; consultez la documentation des métriques CoreDNS pour obtenir la liste complète.
| Metric | Data type | Labels | Description |
|---|---|---|---|
requests_total |
Counter | server, zone, proto, family, type | Nombre total de requêtes DNS. |
request_duration_seconds |
Histogram | server, zone | Latence des requêtes DNS. |
request_size_bytes |
Histogram | server, zone, proto | Taille des paquets de requête DNS. Seuils des compartiments de l'histogramme (en octets) : 0, 100, 200, 300, 400, 511, 1023, 2047, 4095, 8291, 16000, 32000, 48000, 64000. |
do_requests_total |
Counter | server, zone | Nombre total de requêtes avec le bit DO. |
response_size_bytes |
Histogram | server, zone, proto | Taille des paquets de réponse DNS. Seuils des compartiments de l'histogramme (en octets) : 0, 100, 200, 300, 400, 511, 1023, 2047, 4095, 8291, 16000, 32000, 48000, 64000. |
responses_total |
Counter | server, zone, rcode, plugin | Nombre total de réponses DNS. |
panics_total |
Counter | — | Nombre de paniques CoreDNS. |
plugin_enabled |
Gauge | server, zone, name | Indique si un plugin est activé. |
https_responses_total |
Counter | server, status | Nombre total de requêtes DoH. |