Metric
Description
container_cpu_usage_seconds_total
Temps CPU total consommé par le conteneur, en secondes.
container_fs_usage_bytes
Espace de système de fichiers utilisé par le conteneur, en octets.
container_memory_cache
Mémoire cache utilisée par le conteneur, en octets.
container_memory_usage_bytes
Mémoire utilisée par le conteneur, en octets.
container_memory_working_set_bytes
Ensemble de travail mémoire du conteneur, en octets.
container_network_receive_bytes_total
Total des octets reçus par le conteneur via le réseau.
container_network_transmit_bytes_total
Total des octets transmis par le conteneur via le réseau.
container_scrape_error
Une valeur de 1 indique une erreur lors de la collecte des métriques du conteneur.
container_spec_memory_limit_bytes
Limite de mémoire configurée pour le conteneur, en octets.
container_spec_cpu_quota
Quota CPU CFS configuré pour le conteneur.
container_sockets
Nombre de sockets réseau TCP/UDP actifs dans le conteneur.
container_network_transmit_errors_total
Total des erreurs de transmission (sortantes) de paquets sur l'interface réseau du conteneur.
container_network_receive_errors_total
Total des erreurs de réception (entrantes) de paquets sur l'interface réseau du conteneur.
container_memory_rss
Taille de l'ensemble résident (RSS) du conteneur, en octets.
container_cpu_user_seconds_total
Temps CPU total consommé par le conteneur en mode utilisateur, en secondes.
container_cpu_system_seconds_total
Temps CPU total consommé par le conteneur en mode noyau, en secondes.
DCGM_CUSTOM_CONTAINER_CP_ALLOCATED
Proportion de la puissance de calcul totale d'un GPU allouée au conteneur. La valeur est comprise entre 0 et 1. Si un conteneur demande uniquement de la mémoire graphique, cette métrique est égale à 0, ce qui signifie qu'il n'y a aucune limite sur la puissance de calcul. Par exemple, si un GPU dispose de 100 unités de puissance de calcul et que 30 unités sont allouées à un conteneur, le ratio alloué est de 30/100 = 0,3.
DCGM_CUSTOM_CONTAINER_MEM_ALLOCATED
Mémoire graphique allouée au conteneur, en octets.
DCGM_CUSTOM_DEV_FB_ALLOCATED
Proportion de la mémoire graphique allouée par rapport à la mémoire graphique totale du GPU. La valeur est comprise entre 0 et 1.
DCGM_CUSTOM_DEV_FB_TOTAL
Mémoire graphique totale du GPU, en octets.
DCGM_CUSTOM_DEV_HEALTH
État de santé du GPU.
DCGM_CUSTOM_PROCESS_DECODE_UTIL
Utilisation du décodeur pour un processus GPU.
DCGM_CUSTOM_PROCESS_ENCODE_UTIL
Utilisation de l'encodeur pour un processus GPU.
DCGM_CUSTOM_PROCESS_MEM_COPY_UTIL
Utilisation de la copie mémoire pour un processus GPU.
DCGM_CUSTOM_PROCESS_MEM_USED
Mémoire graphique actuellement utilisée par un processus GPU, en octets.
DCGM_CUSTOM_PROCESS_SM_UTIL
Utilisation SM pour un processus GPU.
DCGM_CUSTOM_PROF_MEM_BANDWIDTH_USED
Bande passante de la mémoire graphique utilisée.
DCGM_CUSTOM_PROF_TENS_TFPS_USED
Utilisation des Tensor Cores du GPU.
DCGM_FI_DEV_DEC_UTIL
Utilisation du décodeur du GPU.
DCGM_FI_DEV_ENC_UTIL
Utilisation de l'encodeur du GPU.
DCGM_FI_DEV_FB_FREE
Mémoire framebuffer libre, en octets.
DCGM_FI_DEV_FB_USED
Mémoire framebuffer utilisée, en octets. Cette valeur correspond à la valeur de mémoire utilisée sous Memory-Usage indiquée par la commande nvidia-smi.
DCGM_FI_DEV_GPU_TEMP
Température du GPU, en degrés Celsius.
DCGM_FI_DEV_GPU_UTIL
Utilisation du GPU, qui représente le pourcentage de temps pendant une période d'échantillonnage (par exemple, 1 s ou 1/6 s, selon le produit GPU) durant lequel une ou plusieurs fonctions kernel étaient actives. Cette métrique indique que les ressources GPU sont utilisées par une fonction kernel, mais ne détaille pas l'intensité de cette utilisation.
DCGM_FI_DEV_MEM_CLOCK
Fréquence d'horloge de la mémoire, en MHz.
DCGM_FI_DEV_MEM_COPY_UTIL
Utilisation de la bande passante mémoire. Par exemple, un GPU NVIDIA V100 possède une bande passante mémoire maximale de 900 Go/s. Si la bande passante mémoire actuelle est de 450 Go/s, l'utilisation est de 50 %.
DCGM_FI_DEV_POWER_USAGE
Consommation électrique, en watts.
DCGM_FI_DEV_SM_CLOCK
Fréquence d'horloge SM, en MHz.
DCGM_FI_DEV_TOTAL_ENERGY_CONSUMPTION
Énergie totale consommée depuis le chargement du pilote, en millijoules.
DCGM_FI_DEV_XID_ERRORS
Code de la dernière erreur XID survenue pendant la période d'échantillonnage.
DCGM_FI_PROF_DRAM_ACTIVE
Fraction des cycles pendant lesquels des données sont envoyées vers ou reçues depuis la mémoire de l'appareil. Cette métrique représente l'utilisation de la bande passante mémoire.
Cette valeur est une moyenne sur un intervalle de temps, et non une valeur instantanée.
Une valeur plus élevée indique une utilisation plus importante de la mémoire de l'appareil.
Une valeur de 1,0 (100 %) signifie qu'une instruction DRAM a été exécutée à chaque cycle pendant l'intervalle. En pratique, la valeur maximale atteignable est d'environ 0,8 (80 %).
Par exemple, une valeur de 0,2 (20 %) signifie que pendant 20 % des cycles de l'intervalle, la mémoire de l'appareil a été lue ou écrite.
DCGM_FI_PROF_NVLINK_RX_BYTES
Taux de réception des données via NVLink, hors en-têtes de protocole.
Cette valeur est une moyenne sur un intervalle de temps, et non une valeur instantanée.
Le taux est moyenné sur l'intervalle. Par exemple, le transfert de 1 Go de données en 1 seconde donne un taux de 1 Go/s, que le transfert ait eu lieu à débit constant ou par rafales. La bande passante théorique maximale pour NVLink Gen2 est de 25 Go/s par lien dans chaque direction.
DCGM_FI_PROF_NVLINK_TX_BYTES
Total des octets transmis (envoyés) via NVLink.
DCGM_FI_PROF_PCIE_RX_BYTES
Taux de réception des données via le bus PCIe, y compris les en-têtes de protocole et la charge utile des données.
Cette valeur est une moyenne sur un intervalle de temps, et non une valeur instantanée.
Le taux est moyenné sur l'intervalle. Par exemple, le transfert de 1 Go de données en 1 seconde donne un taux de 1 Go/s, que le transfert ait eu lieu à débit constant ou par rafales. La bande passante théorique maximale pour PCIe Gen3 est de 985 Mo/s par voie.
DCGM_FI_PROF_PCIE_TX_BYTES
Taux de transmission des données via le bus PCIe, y compris les en-têtes de protocole et la charge utile des données.
Cette valeur est une moyenne sur un intervalle de temps, et non une valeur instantanée.
Le taux est moyenné sur l'intervalle. Par exemple, le transfert de 1 Go de données en 1 seconde donne un taux de 1 Go/s, que le transfert ait eu lieu à débit constant ou par rafales. La bande passante théorique maximale pour PCIe Gen3 est de 985 Mo/s par voie.
DCGM_FI_PROF_PIPE_TENSOR_ACTIVE
Fraction des cycles pendant lesquels le pipeline Tensor (HMMA/IMMA) est actif.
Cette valeur est une moyenne sur un intervalle de temps, et non une valeur instantanée.
Une valeur plus élevée indique une utilisation plus importante des Tensor Cores.
Une valeur de 1,0 (100 %) signifie qu'une instruction Tensor a été émise tous les deux cycles, car une instruction prend deux cycles pour être terminée.
Une valeur de 0,2 (20 %) peut indiquer l'un des scénarios suivants :
20 % des SM ont exécuté leurs Tensor Cores avec une utilisation de 100 % tout au long de l'intervalle.
100 % des SM ont exécuté leurs Tensor Cores avec une utilisation de 20 % tout au long de l'intervalle.
100 % des SM ont exécuté leurs Tensor Cores avec une utilisation de 100 % pendant un cinquième de l'intervalle.
Autres combinaisons.
DCGM_FI_PROF_SM_ACTIVE
Pourcentage de temps pendant un intervalle durant lequel au moins un warp était actif sur un multiprocesseur de flux (SM). Cette valeur est une moyenne sur tous les SM et n'est pas sensible au nombre de threads par bloc. Un warp est considéré comme actif s'il est planifié et si ses ressources sont allouées, qu'il soit en état de calcul ou non (par exemple, en attente d'une requête mémoire). Une valeur inférieure à 0,5 indique une utilisation inefficace du GPU, tandis qu'une valeur supérieure à 0,8 est souhaitable. Pour un GPU doté de N SM, considérez les exemples suivants : Si une fonction kernel s'exécute avec N blocs de threads sur tous les SM pendant tout l'intervalle, la valeur est de 1 (100 %). Si une fonction kernel s'exécute avec N/5 blocs de threads pendant l'intervalle, la valeur est de 0,2. Si une fonction kernel s'exécute avec N blocs de threads mais seulement pendant un cinquième de l'intervalle, la valeur est de 0,2.
machine_cpu_cores
Nombre de cœurs CPU sur la machine.
node_exporter_build_info
Informations de build pour le node exporter.
nvidia_gpu_duty_cycle
Pourcentage de temps pendant la dernière période d'échantillonnage durant lequel une ou plusieurs fonctions kernel étaient en cours d'exécution sur le GPU.
nvidia_gpu_memory_total_bytes
Mémoire totale du GPU NVIDIA, en octets.
nvidia_gpu_memory_used_bytes
Mémoire utilisée sur le GPU NVIDIA, en octets.
nvidia_gpu_num_devices
Nombre d'appareils GPU NVIDIA.
nvidia_gpu_power_usage_milliwatts
Consommation électrique du GPU NVIDIA, en milliwatts.
nvidia_gpu_temperature_celsius
Température du GPU NVIDIA, en degrés Celsius.
rdma_service_monitor_local_ack_timeout_err
Nombre d'erreurs de délai d'attente du réseau RDMA.
rdma_service_monitor_out_of_seq
Nombre de paquets de données réseau RDMA hors séquence.
rdma_service_monitor_packet_seq_err
Nombre d'erreurs de séquence de paquets réseau RDMA pendant la transmission.
rdma_service_monitor_rx_bytes
Débit de réception du réseau RDMA.
rdma_service_monitor_rx_packets
Nombre de paquets reçus par le réseau RDMA.
rdma_service_monitor_tx_bytes
Débit de transmission du réseau RDMA.
rdma_service_monitor_tx_packets
Nombre de paquets transmis par le réseau RDMA.
up
Une valeur de 1 signifie que la cible est active et accessible, tandis que 0 indique qu'elle est inactive.
Plan de contrôle ACK APIServer (inclut les composants du plan de contrôle — APIServer, etcd, scheduler, KCM et CCM — pour les clusters ACK Pro, et uniquement l'APIServer pour les clusters ACK dédiés) (nom du job : apiserver)
|
Métrique |
Description |
|
aggregator_discovery_aggregation_count_total |
Nombre total d'agrégations de découverte effectuées par l' |
|
aggregator_openapi_v2_regeneration_count |
Nombre de régénérations de la spécification OpenAPI v2 par l' |
|
aggregator_openapi_v2_regeneration_duration |
Durée de la régénération de la spécification OpenAPI v2 par l' |
|
aggregator_unavailable_apiservice |
Jauge indiquant le nombre d'instances |
|
aggregator_unavailable_apiservice_count |
Nombre d'instances |
|
aggregator_unavailable_apiservice_total |
Nombre cumulé d'instances |
|
aliyun_prometheus_agent_append_duration_seconds |
Durée des opérations d'ajout par l' |
|
aliyun_prometheus_agent_job_discovery_status |
État de la découverte des tâches pour l' |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Nombre total de scrapes par cible pour l' |
|
aliyun_prometheus_agent_target_info |
Informations sur les cibles de l' |
|
apiextensions_apiserver_validation_ratcheting_seconds_bucket |
Histogramme de latence du mécanisme de validation ratcheting de l' |
|
apiextensions_apiserver_validation_ratcheting_seconds_count |
Nombre total d'observations dans l'histogramme de latence du mécanisme de validation ratcheting de l' |
|
apiextensions_apiserver_validation_ratcheting_seconds_sum |
Somme totale des durées pour l'histogramme de latence du mécanisme de validation ratcheting de l' |
|
apiextensions_openapi_v2_regeneration_count |
Nombre de régénérations de la spécification apiextensions OpenAPI v2. |
|
apiextensions_openapi_v3_regeneration_count |
Nombre de régénérations de la spécification apiextensions OpenAPI v3. |
|
apiserver_accepted_listall_requests_total |
Nombre total de requêtes list-all acceptées par l' |
|
apiserver_admission_controller_admission_duration_seconds_bucket |
Histogramme de latence du contrôleur d'admission ( |
|
apiserver_admission_controller_admission_duration_seconds_count |
Nombre total d'observations dans l'histogramme de latence du contrôleur d'admission ( |
|
apiserver_admission_controller_admission_duration_seconds_sum |
Somme totale des durées pour l'histogramme de latence du contrôleur d'admission ( |
|
apiserver_admission_step_admission_duration_seconds_bucket |
Histogramme de latence des étapes d'admission individuelles, en secondes. |
|
apiserver_admission_step_admission_duration_seconds_count |
Nombre total d'observations dans l'histogramme de latence des étapes d'admission. |
|
apiserver_admission_step_admission_duration_seconds_sum |
Somme totale des durées pour l'histogramme de latence des étapes d'admission, en secondes. |
|
apiserver_admission_step_admission_duration_seconds_summary |
Résumé de la latence des étapes d'admission individuelles, en secondes. |
|
apiserver_admission_step_admission_duration_seconds_summary_count |
Nombre total d'observations dans le résumé de latence des étapes d'admission. |
|
apiserver_admission_step_admission_duration_seconds_summary_sum |
Somme totale des durées pour le résumé de latence des étapes d'admission, en secondes. |
|
apiserver_admission_webhook_admission_duration_seconds_bucket |
Histogramme de latence du webhook d'admission ( |
|
apiserver_admission_webhook_admission_duration_seconds_count |
Nombre total d'observations dans l'histogramme de latence du webhook d'admission ( |
|
apiserver_admission_webhook_admission_duration_seconds_sum |
Somme totale des durées pour l'histogramme de latence du webhook d'admission ( |
|
apiserver_admission_webhook_fail_open_count |
Nombre de fois où un webhook d'admission ( |
|
apiserver_admission_webhook_rejection_count |
Nombre de rejets par les webhooks d'admission ( |
|
apiserver_admission_webhook_request_total |
Nombre total de requêtes adressées aux webhooks d'admission ( |
|
apiserver_audit_error_total |
Nombre total d'erreurs de journalisation d'audit ( |
|
apiserver_audit_event_total |
Nombre total d'événements d'audit ( |
|
apiserver_audit_level_total |
Nombre total d'événements d'audit ( |
|
apiserver_audit_requests_rejected_total |
Nombre total de requêtes d'audit ( |
|
apiserver_authorization_decisions_total |
Nombre total de décisions d'autorisation prises par l' |
|
apiserver_cache_list_fetched_objects_total |
Nombre total d'objets récupérés depuis le cache de liste ( |
|
apiserver_cache_list_returned_objects_total |
Nombre total d'objets renvoyés depuis le cache de liste ( |
|
apiserver_cache_list_total |
Nombre total d'opérations de cache de liste ( |
|
apiserver_cacher_received_events |
Nombre d'événements reçus par le cacher de l' |
|
apiserver_cacher_sended_events_latency_milliseconds_bucket |
Histogramme de latence des événements envoyés par le cacher de l' |
|
apiserver_cacher_sended_events_latency_milliseconds_count |
Nombre total d'observations dans l'histogramme de latence d'envoi des événements du cacher. |
|
apiserver_cacher_sended_events_latency_milliseconds_sum |
Somme totale des durées pour l'histogramme de latence d'envoi des événements du cacher, en millisecondes. |
|
apiserver_cacher_watcher_channel_length |
Longueur du canal du watcher ( |
|
apiserver_cel_compilation_duration_seconds_bucket |
Histogramme de latence des compilations CEL ( |
|
apiserver_cel_compilation_duration_seconds_count |
Nombre total de compilations CEL ( |
|
apiserver_cel_compilation_duration_seconds_sum |
Durée totale de toutes les compilations CEL ( |
|
apiserver_cel_evaluation_duration_seconds_bucket |
Histogramme de latence des évaluations CEL ( |
|
apiserver_cel_evaluation_duration_seconds_count |
Nombre total d'évaluations CEL ( |
|
apiserver_cel_evaluation_duration_seconds_sum |
Durée totale de toutes les évaluations CEL ( |
|
apiserver_client_certificate_expiration_seconds_bucket |
Histogramme des secondes restantes avant l'expiration du certificat client ( |
|
apiserver_client_certificate_expiration_seconds_count |
Nombre total d'observations dans l'histogramme d'expiration du certificat client ( |
|
apiserver_client_certificate_expiration_seconds_sum |
Somme totale des secondes restantes pour l'histogramme d'expiration du certificat client ( |
|
apiserver_clusterip_repair_ip_errors_total |
Nombre total d'erreurs liées aux IP lors de la réparation de ClusterIP ( |
|
apiserver_clusterip_repair_reconcile_errors_total |
Nombre total d'erreurs de réconciliation lors de la réparation de ClusterIP ( |
|
apiserver_conversion_webhook_duration_seconds_bucket |
Histogramme de latence des appels au webhook de conversion de l' |
|
apiserver_conversion_webhook_duration_seconds_count |
Nombre total d'appels au webhook de conversion de l' |
|
apiserver_conversion_webhook_duration_seconds_sum |
Durée totale de tous les appels au webhook de conversion de l' |
|
apiserver_conversion_webhook_request_total |
Nombre total de requêtes adressées aux webhooks de conversion de l' |
|
apiserver_crd_conversion_webhook_duration_seconds_bucket |
Histogramme de latence des appels au webhook de conversion CRD ( |
|
apiserver_crd_conversion_webhook_duration_seconds_count |
Nombre total d'appels au webhook de conversion CRD ( |
|
apiserver_crd_conversion_webhook_duration_seconds_sum |
Durée totale de tous les appels au webhook de conversion CRD ( |
|
apiserver_crd_webhook_conversion_duration_seconds_bucket |
Histogramme de latence des conversions par webhook CRD ( |
|
apiserver_crd_webhook_conversion_duration_seconds_count |
Nombre total de conversions par webhook CRD ( |
|
apiserver_crd_webhook_conversion_duration_seconds_sum |
Durée totale de toutes les conversions par webhook CRD ( |
|
apiserver_created_watchers |
Nombre de watchers ( |
|
apiserver_current_inflight_requests |
Nombre actuel de requêtes en cours de traitement par l' |
|
apiserver_current_inqueue_requests |
Nombre actuel de requêtes en file d'attente dans l' |
|
apiserver_dropped_requests_total |
Nombre total de requêtes abandonnées par l' |
|
apiserver_encryption_config_controller_automatic_reload_failures_total |
Nombre total d'échecs de rechargement automatique du contrôleur de configuration de chiffrement de l' |
|
apiserver_encryption_config_controller_automatic_reload_success_total |
Nombre total de rechargements automatiques réussis du contrôleur de configuration de chiffrement de l' |
|
apiserver_envelope_encryption_dek_cache_fill_percent |
<!--@p {"id":"cb83572ca2c3x"}--br>Pourcentage de remplissage du cache DEK ( |
|
apiserver_error_watchers |
Nombre de watchers d'erreur ( |
|
apiserver_flowcontrol_current_executing_requests |
Nombre actuel de requêtes en cours d'exécution sous le contrôle de flux ( |
|
apiserver_flowcontrol_current_executing_seats |
Nombre actuel de sièges occupés sous le contrôle de flux ( |
|
apiserver_flowcontrol_current_inqueue_requests |
Nombre actuel de requêtes en file d'attente sous le contrôle de flux ( |
|
apiserver_flowcontrol_current_inqueue_seats |
Nombre actuel de sièges en file d'attente sous le contrôle de flux ( |
|
apiserver_flowcontrol_current_limit_seats |
Limite actuelle de sièges pour le contrôle de flux ( |
|
apiserver_flowcontrol_current_r |
Valeur R actuelle pour le contrôle de flux ( |
|
apiserver_flowcontrol_demand_seats_average |
Demande moyenne de sièges pour le contrôle de flux ( |
|
apiserver_flowcontrol_demand_seats_bucket |
Histogramme de la demande de sièges pour le contrôle de flux ( |
|
apiserver_flowcontrol_demand_seats_count |
Nombre total d'observations dans l'histogramme de la demande de sièges. |
|
apiserver_flowcontrol_demand_seats_high_watermark |
Seuil haut (high watermark) de la demande de sièges pour le contrôle de flux ( |
|
apiserver_flowcontrol_demand_seats_smoothed |
Valeur lissée de la demande de sièges pour le contrôle de flux ( |
|
apiserver_flowcontrol_demand_seats_stdev |
Écart-type de la demande de sièges pour le contrôle de flux ( |
|
apiserver_flowcontrol_demand_seats_sum |
Somme totale des observations pour l'histogramme de la demande de sièges. |
|
apiserver_flowcontrol_dispatch_r |
Valeur R de distribution pour le contrôle de flux ( |
|
apiserver_flowcontrol_dispatched_requests_total |
Nombre total de requêtes distribuées sous le contrôle de flux ( |
|
apiserver_flowcontrol_latest_s |
Dernière valeur S limite pour le contrôle de flux ( |
|
apiserver_flowcontrol_lower_limit_seats |
Limite inférieure de sièges pour le contrôle de flux ( |
|
apiserver_flowcontrol_next_discounted_s_bounds |
Prochaine valeur S limite réduite pour le contrôle de flux ( |
|
apiserver_flowcontrol_next_s_bounds |
Prochaine valeur S limite pour le contrôle de flux ( |
|
apiserver_flowcontrol_nominal_limit_seats |
Limite nominale de sièges pour le contrôle de flux ( |
|
apiserver_flowcontrol_priority_level_request_count_samples_bucket |
Histogramme des échantillons de nombre de requêtes pour chaque niveau de priorité dans le contrôle de flux ( |
|
apiserver_flowcontrol_priority_level_request_count_samples_count |
Nombre total d'observations dans l'histogramme des échantillons de nombre de requêtes par niveau de priorité. |
|
apiserver_flowcontrol_priority_level_request_count_samples_sum |
Somme totale pour l'histogramme des échantillons de nombre de requêtes par niveau de priorité. |
|
apiserver_flowcontrol_priority_level_request_count_watermarks_bucket |
Histogramme des seuils (watermarks) de nombre de requêtes pour chaque niveau de priorité dans le contrôle de flux ( |
|
apiserver_flowcontrol_priority_level_request_count_watermarks_count |
Nombre total d'observations dans l'histogramme des seuils de nombre de requêtes par niveau de priorité. |
|
apiserver_flowcontrol_priority_level_request_count_watermarks_sum |
Somme totale pour l'histogramme des seuils de nombre de requêtes par niveau de priorité. |
|
apiserver_flowcontrol_priority_level_request_utilization_bucket |
Histogramme de l'utilisation des requêtes pour chaque niveau de priorité dans le contrôle de flux ( |
|
apiserver_flowcontrol_priority_level_request_utilization_count |
Nombre total d'observations dans l'histogramme d'utilisation des requêtes par niveau de priorité. |
|
apiserver_flowcontrol_priority_level_request_utilization_sum |
Somme totale pour l'histogramme d'utilisation des requêtes par niveau de priorité. |
|
apiserver_flowcontrol_priority_level_seat_count_samples_bucket |
Histogramme des échantillons de nombre de sièges pour chaque niveau de priorité dans le contrôle de flux ( |
|
apiserver_flowcontrol_priority_level_seat_count_samples_count |
Nombre total d'observations dans l'histogramme des échantillons de nombre de sièges par niveau de priorité. |
|
apiserver_flowcontrol_priority_level_seat_count_samples_sum |
Somme totale pour l'histogramme des échantillons de nombre de sièges par niveau de priorité. |
|
apiserver_flowcontrol_priority_level_seat_count_watermarks_bucket |
Histogramme des seuils (watermarks) de nombre de sièges pour chaque niveau de priorité dans le contrôle de flux ( |
|
apiserver_flowcontrol_priority_level_seat_count_watermarks_count |
Nombre total d'observations dans l'histogramme des seuils de nombre de sièges par niveau de priorité. |
|
apiserver_flowcontrol_priority_level_seat_count_watermarks_sum |
Somme totale pour l'histogramme des seuils de nombre de sièges par niveau de priorité. |
|
apiserver_flowcontrol_priority_level_seat_utilization_bucket |
Histogramme de l'utilisation des sièges pour chaque niveau de priorité dans le contrôle de flux ( |
|
apiserver_flowcontrol_priority_level_seat_utilization_count |
Nombre total d'observations dans l'histogramme d'utilisation des sièges par niveau de priorité. |
|
apiserver_flowcontrol_priority_level_seat_utilization_sum |
Somme totale pour l'histogramme d'utilisation des sièges par niveau de priorité. |
|
apiserver_flowcontrol_read_vs_write_current_requests_bucket |
Histogramme des requêtes de lecture et d'écriture actuelles dans le contrôle de flux ( |
|
apiserver_flowcontrol_read_vs_write_current_requests_count |
Nombre total d'observations dans l'histogramme des requêtes de lecture et d'écriture actuelles. |
|
apiserver_flowcontrol_read_vs_write_current_requests_sum |
Somme totale pour l'histogramme des requêtes de lecture et d'écriture actuelles. |
|
apiserver_flowcontrol_read_vs_write_request_count_samples_bucket |
Histogramme des échantillons de nombre de requêtes de lecture et d'écriture dans le contrôle de flux ( |
|
apiserver_flowcontrol_read_vs_write_request_count_samples_count |
Nombre total d'échantillons pour l'histogramme du nombre de requêtes de lecture et d'écriture. |
|
apiserver_flowcontrol_read_vs_write_request_count_samples_sum |
Somme totale pour l'histogramme des échantillons de nombre de requêtes de lecture et d'écriture. |
|
apiserver_flowcontrol_read_vs_write_request_count_watermarks_bucket |
Histogramme des seuils (watermarks) de nombre de requêtes de lecture et d'écriture dans le contrôle de flux ( |
|
apiserver_flowcontrol_read_vs_write_request_count_watermarks_count |
Nombre total d'échantillons pour l'histogramme des seuils de nombre de requêtes de lecture et d'écriture. |
|
apiserver_flowcontrol_read_vs_write_request_count_watermarks_sum |
Somme totale pour l'histogramme des seuils de nombre de requêtes de lecture et d'écriture. |
|
apiserver_flowcontrol_rejected_requests_total |
Nombre total de requêtes rejetées par le contrôle de flux ( |
|
apiserver_flowcontrol_request_concurrency_in_use |
Nombre de requêtes concurrentes en cours d'utilisation par le contrôle de flux ( |
|
apiserver_flowcontrol_request_concurrency_limit |
Limite de concurrence des requêtes dans le contrôle de flux ( |
|
apiserver_flowcontrol_request_dispatch_no_accommodation_total |
Nombre total de requêtes qui n'ont pas pu être distribuées en raison d'un manque de capacité dans le contrôle de flux ( |
|
apiserver_flowcontrol_request_execution_seconds_bucket |
Histogramme de latence d'exécution des requêtes dans le contrôle de flux ( |
|
apiserver_flowcontrol_request_execution_seconds_count |
Nombre total d'observations dans l'histogramme de latence d'exécution des requêtes. |
|
apiserver_flowcontrol_request_execution_seconds_sum |
Somme totale des durées pour l'histogramme de latence d'exécution des requêtes, en secondes. |
|
apiserver_flowcontrol_request_queue_length_after_enqueue_bucket |
Histogramme de la longueur de la file d'attente après mise en file pour les requêtes du contrôle de flux ( |
|
apiserver_flowcontrol_request_queue_length_after_enqueue_count |
Nombre total d'observations dans l'histogramme de la longueur de la file d'attente des requêtes. |
|
apiserver_flowcontrol_request_queue_length_after_enqueue_sum |
Somme totale pour l'histogramme de la longueur de la file d'attente des requêtes. |
|
apiserver_flowcontrol_request_wait_duration_seconds_bucket |
Histogramme de latence du temps d'attente des requêtes dans le contrôle de flux ( |
|
apiserver_flowcontrol_request_wait_duration_seconds_count |
Nombre total d'observations dans l'histogramme de latence d'attente des requêtes. |
|
apiserver_flowcontrol_request_wait_duration_seconds_sum |
Somme totale des durées pour l'histogramme de latence d'attente des requêtes, en secondes. |
|
apiserver_flowcontrol_seat_fair_frac |
Fraction équitable déterminée lors de la dernière période d'ajustement d'emprunt pour le contrôle de flux ( |
|
apiserver_flowcontrol_target_seats |
Nombre cible de sièges pour le contrôle de flux ( |
|
apiserver_flowcontrol_upper_limit_seats |
Limite supérieure de sièges pour le contrôle de flux ( |
|
apiserver_flowcontrol_watch_count_samples_bucket |
Histogramme des échantillons de nombre de watches dans le contrôle de flux ( |
|
apiserver_flowcontrol_watch_count_samples_count |
Nombre total d'observations dans l'histogramme des échantillons de nombre de watches. |
|
apiserver_flowcontrol_watch_count_samples_sum |
Somme totale pour l'histogramme des échantillons de nombre de watches. |
|
apiserver_flowcontrol_work_estimated_seats_bucket |
Histogramme des sièges estimés pour le travail dans le contrôle de flux ( |
|
apiserver_flowcontrol_work_estimated_seats_count |
Nombre total d'observations dans l'histogramme des sièges estimés pour le travail. |
|
apiserver_flowcontrol_work_estimated_seats_sum |
Somme totale pour l'histogramme des sièges estimés pour le travail. |
|
apiserver_init_events_total |
Nombre total d'événements d'initialisation de l' |
|
apiserver_kube_aggregator_x509_insecure_sha1_total |
Nombre total de requêtes adressées à l'agrégateur kube ( |
|
apiserver_kube_aggregator_x509_missing_san_total |
Nombre total de certificats X.509 avec un SAN manquant dans l'agrégateur kube ( |
|
apiserver_longrunning_gauge |
Jauge des requêtes longue durée de l' |
|
apiserver_longrunning_requests |
Nombre de requêtes longue durée de l' |
|
apiserver_nodeport_repair_reconcile_errors_total |
Nombre total d'erreurs de réconciliation lors de la réparation NodePort de l' |
|
apiserver_realtime_watchers |
Nombre de watchers en temps réel ( |
|
apiserver_registered_watchers |
Nombre de watchers enregistrés ( |
|
apiserver_request_aborts_total |
Nombre total de requêtes de l' |
|
apiserver_request_body_size_bytes_bucket |
Histogramme des tailles de corps de requête de l' |
|
apiserver_request_body_size_bytes_count |
Nombre total d'observations dans l'histogramme des tailles de corps de requête. |
|
apiserver_request_body_size_bytes_sum |
Somme totale pour l'histogramme des tailles de corps de requête, en octets. |
|
apiserver_request_count |
Nombre de requêtes adressées à l' |
|
apiserver_request_duration_seconds_bucket |
Histogramme de latence des requêtes de l' |
|
apiserver_request_duration_seconds_count |
Nombre total d'observations dans l'histogramme de latence des requêtes. |
|
apiserver_request_duration_seconds_sum |
Somme totale des durées pour l'histogramme de latence des requêtes, en secondes. |
|
apiserver_request_filter_duration_seconds_bucket |
Histogramme de latence des filtres de requête de l' |
|
apiserver_request_filter_duration_seconds_count |
Nombre total d'observations dans l'histogramme de latence des filtres de requête. |
|
apiserver_request_filter_duration_seconds_sum |
Somme totale des durées pour l'histogramme de latence des filtres de requête, en secondes. |
|
apiserver_request_latencies_summary |
Résumé de la distribution de latence des requêtes de l' |
|
apiserver_request_no_resourceversion_list_total |
Nombre total de requêtes LIST sans version de ressource. |
|
apiserver_request_post_timeout_total |
Nombre total de délais d'attente dépassés pour les requêtes API POST. |
|
apiserver_request_sli_duration_seconds_bucket |
Histogramme de latence des indicateurs de niveau de service (SLI) des requêtes API, en secondes. |
|
apiserver_request_sli_duration_seconds_count |
Nombre total d'observations dans l'histogramme de latence des SLI des requêtes API. |
|
apiserver_request_sli_duration_seconds_sum |
Somme totale des durées pour l'histogramme de latence des SLI des requêtes API, en secondes. |
|
apiserver_request_slo_duration_seconds_bucket |
Histogramme de latence des objectifs de niveau de service (SLO) des requêtes API, en secondes. |
|
apiserver_request_slo_duration_seconds_count |
Nombre total d'observations dans l'histogramme de latence des SLO des requêtes API. |
|
apiserver_request_slo_duration_seconds_sum |
Somme totale des durées pour l'histogramme de latence des SLO des requêtes API, en secondes. |
|
apiserver_request_terminations_total |
Nombre total de terminaisons de requêtes API. |
|
apiserver_request_timestamp_comparison_time_bucket |
Histogramme des temps de comparaison des horodatages des requêtes API. |
|
apiserver_request_timestamp_comparison_time_count |
Nombre total d'échantillons pour l'histogramme des temps de comparaison des horodatages des requêtes API. |
|
apiserver_request_timestamp_comparison_time_sum |
Somme totale pour l'histogramme des temps de comparaison des horodatages des requêtes API. |
|
apiserver_request_total |
Nombre total de requêtes API. |
|
apiserver_requested_deprecated_apis |
Nombre de requêtes adressées à l' |
|
apiserver_response_sizes_bucket |
Histogramme des tailles de réponse API. |
|
apiserver_response_sizes_count |
Nombre total d'observations dans l'histogramme des tailles de réponse API. |
|
apiserver_response_sizes_sum |
Somme totale pour l'histogramme des tailles de réponse API. |
|
apiserver_selfrequest_total |
Nombre total de requêtes internes adressées à l' |
|
apiserver_storage_data_key_generation_duration_seconds_bucket |
Histogramme de latence de la génération de clés de données de stockage de l' |
|
apiserver_storage_data_key_generation_duration_seconds_count |
Nombre total d'observations dans l'histogramme de latence de génération des clés de données. |
|
apiserver_storage_data_key_generation_duration_seconds_sum |
Somme totale des durées pour l'histogramme de latence de génération des clés de données, en secondes. |
|
apiserver_storage_data_key_generation_failures_total |
Nombre total d'échecs de génération de clés de données de stockage de l' |
|
apiserver_storage_db_total_size_in_bytes |
Taille totale de la base de données de stockage de l' |
|
apiserver_storage_decode_errors_total |
Nombre total d'erreurs de décodage du stockage de l' |
|
apiserver_storage_envelope_transformation_cache_misses_total |
Nombre total d'échecs de cache ( |
|
apiserver_storage_events_received_total |
Nombre total d'événements reçus par le stockage de l' |
|
apiserver_storage_list_evaluated_objects_total |
Nombre total d'objets évalués par les opérations de liste du stockage de l' |
|
apiserver_storage_list_fetched_objects_total |
Nombre total d'objets récupérés par les opérations de liste du stockage de l' |
|
apiserver_storage_list_returned_objects_total |
Nombre total d'objets renvoyés par les opérations de liste du stockage de l' |
|
apiserver_storage_list_total |
Nombre total d'opérations de liste du stockage de l' |
|
apiserver_storage_objects |
Nombre d'objets dans le stockage de l' |
|
apiserver_storage_size_bytes |
Taille du stockage de l' |
|
apiserver_terminated_watchers_total |
Nombre total de watchers terminés ( |
|
apiserver_tls_handshake_errors_total |
Nombre total d'erreurs de handshake TLS de l' |
|
apiserver_too_large_resourceversion_errors |
Nombre de requêtes de l' |
|
apiserver_watch_cache_events_dispatched_total |
Nombre total d'événements distribués depuis le cache de watch ( |
|
apiserver_watch_cache_events_received_total |
Nombre total d'événements reçus par le cache de watch ( |
|
apiserver_watch_cache_initializations_total |
Nombre total d'initialisations du cache de watch ( |
|
apiserver_watch_cache_read_wait_seconds_bucket |
Histogramme de latence des attentes de lecture pour le cache de watch ( |
|
apiserver_watch_cache_read_wait_seconds_count |
Nombre total d'observations dans l'histogramme de latence des attentes de lecture du cache de watch ( |
|
apiserver_watch_cache_read_wait_seconds_sum |
Somme totale des durées pour l'histogramme de latence des attentes de lecture du cache de watch ( |
|
apiserver_watch_cache_watch_cache_initializations_total |
Nombre total d'initialisations du cache de watch ( |
|
apiserver_watch_events_sizes_bucket |
Histogramme des tailles d'événements de watch de l' |
|
apiserver_watch_events_sizes_count |
Nombre total d'observations dans l'histogramme des tailles d'événements de watch. |
|
apiserver_watch_events_sizes_sum |
Somme totale pour l'histogramme des tailles d'événements de watch. |
|
apiserver_watch_events_total |
Nombre total d'événements de watch de l' |
|
apiserver_webhooks_x509_insecure_sha1_total |
Nombre total de requêtes adressées aux webhooks signées avec une signature SHA-1 non sécurisée. |
|
apiserver_webhooks_x509_missing_san_total |
Nombre total de certificats X.509 avec un SAN manquant dans les webhooks de l' |
|
authenticated_user_requests |
Nombre total de requêtes d'utilisateurs authentifiés. |
|
authentication_attempts |
Nombre de tentatives d'authentification. |
|
authentication_duration_seconds_bucket |
Histogramme de latence du processus d'authentification, en secondes. |
|
authentication_duration_seconds_count |
Nombre total d'observations dans l'histogramme de latence d'authentification. |
|
authentication_duration_seconds_sum |
Somme totale des durées pour l'histogramme de latence d'authentification, en secondes. |
|
authentication_token_cache_active_fetch_count |
Nombre de récupérations actives depuis le cache de jetons d'authentification ( |
|
authentication_token_cache_fetch_total |
Nombre total de récupérations depuis le cache de jetons d'authentification ( |
|
authentication_token_cache_request_duration_seconds_bucket |
Histogramme de latence des requêtes adressées au cache de jetons d'authentification ( |
|
authentication_token_cache_request_duration_seconds_count |
Nombre total d'observations dans l'histogramme de latence des requêtes adressées au cache de jetons ( |
|
authentication_token_cache_request_duration_seconds_sum |
Somme totale des durées pour l'histogramme de latence des requêtes adressées au cache de jetons ( |
|
authentication_token_cache_request_total |
Nombre total de requêtes adressées au cache de jetons d'authentification ( |
|
authorization_attempts_total |
Nombre total de tentatives d'autorisation. |
|
authorization_duration_seconds_bucket |
Histogramme de latence du processus d'autorisation, en secondes. |
|
authorization_duration_seconds_count |
Nombre total d'observations dans l'histogramme de latence d'autorisation. |
|
authorization_duration_seconds_sum |
Somme totale des durées pour l'histogramme de latence d'autorisation, en secondes. |
|
cardinality_enforcement_unexpected_categorizations_total |
Nombre total de catégorisations inattendues dans l'application de la cardinalité. |
|
count |
Nombre d'éléments. |
|
cpu_utilization_core |
Utilisation du CPU, en cœurs. |
|
disabled_metric_total |
Nombre total de métriques désactivées. |
|
disabled_metrics_total |
Nombre total de métriques désactivées. |
|
etcd_bookmark_counts |
Nombre de marque-pages (bookmarks) |
|
etcd_db_total_size_in_bytes |
Taille totale de la base de données |
|
etcd_lease_object_counts_bucket |
Histogramme du nombre d'objets de bail (lease) |
|
etcd_lease_object_counts_count |
Nombre total d'observations dans l'histogramme du nombre d'objets de bail (lease) |
|
etcd_lease_object_counts_sum |
Somme totale pour l'histogramme du nombre d'objets de bail (lease) |
|
etcd_object_counts |
Nombre d'objets dans |
|
etcd_request_duration_seconds_bucket |
Histogramme de latence des requêtes |
|
etcd_request_duration_seconds_count |
Nombre total d'observations dans l'histogramme de latence des requêtes |
|
etcd_request_duration_seconds_sum |
Somme totale des durées pour l'histogramme de latence des requêtes |
|
etcd_request_errors_total |
Nombre total d'erreurs de requêtes |
|
etcd_requests_total |
Nombre total de requêtes |
|
etcd_watcher_channel_length |
Longueur du canal du watcher ( |
|
etcd_watcher_received_events |
Nombre d'événements reçus par le watcher ( |
|
etcd_watcher_sended_events_latency_milliseconds_bucket |
Histogramme de latence des événements envoyés par le watcher ( |
|
etcd_watcher_sended_events_latency_milliseconds_count |
Nombre total d'observations dans l'histogramme de latence d'envoi des événements du watcher ( |
|
etcd_watcher_sended_events_latency_milliseconds_sum |
Somme totale des durées pour l'histogramme de latence d'envoi des événements du watcher ( |
|
field_validation_request_duration_seconds_bucket |
Histogramme de latence des requêtes de validation de champ, en secondes. |
|
field_validation_request_duration_seconds_count |
Nombre total d'observations dans l'histogramme de latence des requêtes de validation de champ. |
|
field_validation_request_duration_seconds_sum |
Somme totale des durées pour l'histogramme de latence des requêtes de validation de champ, en secondes. |
|
get_token_count |
Nombre d'opérations de récupération de jeton. |
|
get_token_fail_count |
Nombre d'échecs des opérations de récupération de jeton. |
|
grpc_client_handled_total |
Nombre total de requêtes gRPC client traitées. |
|
grpc_client_msg_received_total |
Nombre total de messages reçus par le client gRPC. |
|
grpc_client_msg_sent_total |
Nombre total de messages envoyés par le client gRPC. |
|
grpc_client_started_total |
Nombre total d'appels client gRPC démarrés. |
|
hidden_metric_total |
Nombre total de métriques masquées. |
|
hidden_metrics_total |
Nombre total de métriques masquées. |
|
http_request_duration_microseconds |
Durée des requêtes HTTP, en microsecondes. |
|
http_request_size_bytes |
Taille des requêtes HTTP, en octets. |
|
http_requests_total |
Nombre total de requêtes HTTP. |
|
http_response_size_bytes |
Taille des réponses HTTP, en octets. |
|
job |
Nom de la tâche. |
|
job_instance_mode |
Mode de l'instance de tâche. |
|
kube_apiserver_clusterip_allocator_allocated_ips |
Kubernetes |
|
kube_apiserver_clusterip_allocator_allocation_errors_total |
Kubernetes |
|
kube_apiserver_clusterip_allocator_allocation_total |
Kubernetes |
|
kube_apiserver_clusterip_allocator_available_ips |
Kubernetes |
|
kube_apiserver_nodeport_allocator_allocated_ports |
Kubernetes |
|
kube_apiserver_nodeport_allocator_allocation_errors_total |
Kubernetes |
|
kube_apiserver_nodeport_allocator_allocation_total |
Kubernetes |
|
kube_apiserver_nodeport_allocator_available_ports |
Kubernetes |
|
kube_apiserver_pod_logs_backend_tls_failure_total |
Kubernetes |
|
kube_apiserver_pod_logs_insecure_backend_total |
Kubernetes |
|
kube_apiserver_pod_logs_pods_logs_backend_tls_failure_total |
Kubernetes |
|
kube_apiserver_pod_logs_pods_logs_insecure_backend_total |
Kubernetes |
|
kubelet_container_log_filesystem_used_bytes |
|
|
kubelet_node_name |
|
|
kubelet_pleg_relist_duration_seconds_bucket |
|
|
kubelet_pod_worker_duration_seconds_bucket |
|
|
kubelet_volume_stats_available_bytes |
|
|
kubelet_volume_stats_capacity_bytes |
|
|
kubelet_volume_stats_inodes |
|
|
kubelet_volume_stats_inodes_free |
|
|
kubelet_volume_stats_inodes_used |
|
|
kubelet_volume_stats_used_bytes |
|
|
kubernetes_build_info |
Informations de build Kubernetes. |
|
kubernetes_feature_enabled |
État d'activation d'une fonctionnalité Kubernetes. |
|
last_list_all_response_size_in_bytes |
Taille de la dernière réponse list-all, en octets. |
|
memory_utilization_byte |
Utilisation de la mémoire, en octets. |
|
node_authorizer_graph_actions_duration_seconds_bucket |
Histogramme de latence des actions du graphe de l'autoriseur de nœud ( |
|
node_authorizer_graph_actions_duration_seconds_count |
Nombre total d'observations dans l'histogramme de latence des actions du graphe de l'autoriseur de nœud ( |
|
node_authorizer_graph_actions_duration_seconds_sum |
Somme totale des durées pour l'histogramme de latence des actions du graphe de l'autoriseur de nœud ( |
|
pod_security_evaluations_total |
Nombre total d'évaluations de sécurité des pods ( |
|
pod_security_exemptions_total |
Nombre total d'exemptions de sécurité des pods ( |
|
process_cpu_seconds_total |
Temps CPU total utilisé par le processus, en secondes. |
|
process_max_fds |
Nombre maximal de descripteurs de fichiers pour le processus. |
|
process_open_fds |
Nombre de descripteurs de fichiers ouverts pour le processus. |
|
process_resident_memory_bytes |
Taille de la mémoire résidente du processus, en octets. |
|
process_start_time_seconds |
Heure de démarrage du processus, en secondes depuis l'époque Unix. |
|
process_virtual_memory_bytes |
Taille de la mémoire virtuelle du processus, en octets. |
|
process_virtual_memory_max_bytes |
Taille maximale de la mémoire virtuelle du processus, en octets. |
|
registered_metric_total |
Nombre total de métriques enregistrées. |
|
registered_metrics_total |
Nombre total de métriques enregistrées. |
|
rest_client_exec_plugin_certificate_rotation_age_bucket |
Histogramme de l'âge de rotation des certificats pour le plugin exec du client REST, en secondes. |
|
rest_client_exec_plugin_certificate_rotation_age_count |
Nombre total d'observations dans l'histogramme de l'âge de rotation des certificats. |
|
rest_client_exec_plugin_certificate_rotation_age_sum |
Somme totale pour l'histogramme de l'âge de rotation des certificats, en secondes. |
|
rest_client_exec_plugin_ttl_seconds |
TTL du certificat pour le plugin exec du client REST, en secondes. |
|
rest_client_request_duration_seconds_bucket |
Histogramme de latence des requêtes du client REST, en secondes. |
|
rest_client_request_duration_seconds_count |
Nombre total d'observations dans l'histogramme de latence des requêtes du client REST. |
|
rest_client_request_duration_seconds_sum |
Somme totale des durées pour l'histogramme de latence des requêtes du client REST, en secondes. |
|
rest_client_request_latency_seconds_bucket |
Histogramme de latence des requêtes du client REST, en secondes. |
|
rest_client_request_size_bytes_bucket |
Histogramme des tailles de requête du client REST, en octets. |
|
rest_client_request_size_bytes_count |
Nombre total d'observations dans l'histogramme des tailles de requête du client REST. |
|
rest_client_request_size_bytes_sum |
Somme totale pour l'histogramme des tailles de requête du client REST, en octets. |
|
rest_client_requests_total |
Nombre total de requêtes du client REST. |
|
rest_client_response_size_bytes_bucket |
Histogramme des tailles de réponse du client REST, en octets. |
|
rest_client_response_size_bytes_count |
Nombre total d'observations dans l'histogramme des tailles de réponse du client REST. |
|
rest_client_response_size_bytes_sum |
Somme totale pour l'histogramme des tailles de réponse du client REST, en octets. |
|
rest_client_transport_cache_entries |
Nombre d'entrées du cache de transport ( |
|
rest_client_transport_create_calls_total |
Nombre total d'appels de création de transport dans le client REST. |
|
scheduler_pending_pods |
Nombre de pods ( |
|
scheduler_pod_scheduling_attempts_bucket |
Histogramme des tentatives de planification de pod ( |
|
scheduler_scheduler_cache_size |
Taille du cache ( |
|
scrape_duration_seconds |
Durée du scrape ( |
|
scrape_samples_post_metric_relabeling |
Nombre d'échantillons après le réétiquetage des métriques. |
|
scrape_samples_scraped |
Nombre d'échantillons scrapés. |
|
scrape_series_added |
Nombre de nouvelles séries ajoutées lors d'un scrape ( |
|
serviceaccount_invalid_legacy_auto_token_uses_total |
Nombre total d'utilisations de jetons de compte de service ( |
|
serviceaccount_legacy_auto_token_uses_total |
Nombre total d'utilisations de jetons de compte de service ( |
|
serviceaccount_legacy_manual_token_uses_total |
Nombre total d'utilisations de jetons de compte de service ( |
|
serviceaccount_legacy_tokens_total |
Nombre total de jetons de compte de service ( |
|
serviceaccount_stale_tokens_total |
Nombre total de jetons de compte de service ( |
|
serviceaccount_valid_tokens_total |
Nombre total de jetons de compte de service ( |
|
ssh_tunnel_open_count |
Nombre de tunnels SSH ouverts. |
|
ssh_tunnel_open_fail_count |
Nombre d'échecs d'ouverture de tunnel SSH. |
|
up |
État de connectivité de la cible de scrape. Une valeur de 1 signifie que la cible est accessible ; 0 signifie qu'elle est inaccessible. |
|
watch_cache_capacity |
Capacité du cache de watch ( |
|
watch_cache_capacity_decrease_total |
Nombre total de diminutions de la capacité du cache de watch ( |
|
watch_cache_capacity_increase_total |
Nombre total d'augmentations de la capacité du cache de watch ( |
|
workqueue_adds_total |
Nombre total d'ajouts à la file de travail ( |
|
workqueue_depth |
Profondeur actuelle de la file de travail ( |
|
workqueue_longest_running_processor_seconds |
Durée du processeur le plus long en cours d'exécution dans la file de travail ( |
|
workqueue_queue_duration_seconds_bucket |
Histogramme de latence du temps de mise en file des éléments dans la file de travail ( |
|
workqueue_queue_duration_seconds_count |
Nombre total d'observations dans l'histogramme de latence de mise en file. |
|
workqueue_queue_duration_seconds_sum |
Somme totale des durées pour l'histogramme de latence de mise en file, en secondes. |
|
workqueue_retries_total |
Nombre total de tentatives dans la file de travail ( |
|
workqueue_unfinished_work_seconds |
Durée du travail non terminé dans la file de travail ( |
|
workqueue_work_duration_seconds_bucket |
Histogramme de latence du temps de traitement des éléments dans la file de travail ( |
|
workqueue_work_duration_seconds_count |
Nombre total d'observations dans l'histogramme de latence de traitement. |
|
workqueue_work_duration_seconds_sum |
Somme totale des durées pour l'histogramme de latence de traitement, en secondes. |
Node Exporter (nom de la tâche : node-exporter)
|
Métrique |
Description |
|
aliyun_prometheus_agent_append_duration_seconds |
Durée des opérations d'ajout pour l'agent Alibaba Cloud Prometheus, en secondes. |
|
aliyun_prometheus_agent_job_discovery_status |
Statut de découverte des tâches de collecte (scrape job) pour l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Nombre total de collectes par cible pour l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_target_info |
Informations sur les cibles de l'agent Alibaba Cloud Prometheus. |
|
job |
Nom de la tâche. |
|
node_boot_time_seconds |
Heure de démarrage du nœud, en secondes. |
|
node_context_switches_total |
Nombre total de changements de contexte sur le nœud. |
|
node_cpu_seconds_total |
Temps CPU total utilisé par le nœud, en secondes. |
|
node_disk_io_now |
Nombre actuel d'opérations d'E/S en cours sur les disques du nœud. |
|
node_disk_io_time_seconds_total |
Temps total consacré aux opérations d'E/S sur les disques du nœud, en secondes. |
|
node_disk_io_time_weighted_seconds_total |
Temps total pondéré consacré aux opérations d'E/S sur les disques du nœud, en secondes. |
|
node_disk_read_bytes_total |
Nombre total d'octets lus depuis les disques du nœud. |
|
node_disk_read_time_seconds_total |
Temps total passé à lire les disques du nœud, en secondes. |
|
node_disk_reads_completed_total |
Nombre total d'opérations de lecture terminées depuis les disques du nœud. |
|
node_disk_reads_merged_total |
Nombre total d'opérations de lecture fusionnées depuis les disques du nœud. |
|
node_disk_write_time_seconds_total |
Temps total passé à écrire sur les disques du nœud, en secondes. |
|
node_disk_writes_completed_total |
Nombre total d'opérations d'écriture terminées sur les disques du nœud. |
|
node_disk_writes_merged_total |
Nombre total d'opérations d'écriture fusionnées sur les disques du nœud. |
|
node_disk_written_bytes_total |
Nombre total d'octets écrits sur les disques du nœud. |
|
node_exporter_build_info |
Informations de build pour Node Exporter. |
|
node_filefd_allocated |
Nombre de descripteurs de fichier alloués sur le nœud. |
|
node_filefd_maximum |
Nombre maximal de descripteurs de fichier autorisés sur le nœud. |
|
node_filesystem_avail_bytes |
Espace disponible sur le système de fichiers pour les utilisateurs non root, en octets. |
|
node_filesystem_free_bytes |
Espace libre sur le système de fichiers, en octets. |
|
node_filesystem_size_bytes |
Taille totale du système de fichiers, en octets. |
|
node_intr_total |
Nombre total d'interruptions sur le nœud. |
|
node_load1 |
Moyenne de charge sur 1 minute pour le nœud. |
|
node_load15 |
Moyenne de charge sur 15 minutes pour le nœud. |
|
node_load5 |
Moyenne de charge sur 5 minutes pour le nœud. |
|
node_memory_MemAvailable_bytes |
Quantité de mémoire disponible sur le nœud, en octets. |
|
node_memory_MemFree_bytes |
Quantité de mémoire libre sur le nœud, en octets. |
|
node_memory_MemTotal_bytes |
Quantité totale de mémoire sur le nœud, en octets. |
|
node_memory_Slab_bytes |
Quantité de mémoire utilisée par l'allocateur Slab du noyau, en octets. |
|
node_memory_SReclaimable_bytes |
Partie récupérable de la mémoire Slab sur le nœud, en octets. |
|
node_netstat_Tcp_InErrs |
Nombre d'erreurs de réception TCP. |
|
node_netstat_Tcp_InSegs |
Nombre de segments TCP reçus. |
|
node_netstat_Tcp_OutSegs |
Nombre de segments TCP transmis. |
|
node_netstat_Tcp_PassiveOpens |
Nombre d'ouvertures de connexion TCP passives. |
|
node_netstat_Tcp_RetransSegs |
Nombre de segments TCP retransmis. |
|
node_network_receive_bytes_total |
Nombre total d'octets reçus via l'interface réseau. |
|
node_network_receive_drop_total |
Nombre total de paquets reçus et supprimés par l'interface réseau. |
|
node_network_receive_errs_total |
Nombre total d'erreurs de réception sur l'interface réseau. |
|
node_network_receive_packets_total |
Nombre total de paquets reçus via l'interface réseau. |
|
node_network_transmit_bytes_total |
Nombre total d'octets transmis via l'interface réseau. |
|
node_network_transmit_drop_total |
Nombre total de paquets transmis et supprimés par l'interface réseau. |
|
node_network_transmit_errs_total |
Nombre total d'erreurs de transmission sur l'interface réseau. |
|
node_network_transmit_packets_total |
Nombre total de paquets transmis via l'interface réseau. |
|
node_network_up |
Indique si l'interface réseau est active. Une valeur de 1 signifie qu'elle est active, tandis que 0 signifie qu'elle est inactive. |
|
node_processes_max_processes |
Nombre maximal de processus autorisés. |
|
node_processes_max_threads |
Nombre maximal de threads autorisés. |
|
node_processes_pids |
Nombre d'identifiants de processus (PID). |
|
node_processes_state |
Nombre de processus dans chaque état, tel que running, sleeping ou zombie. |
|
node_processes_threads |
Nombre de threads. |
|
node_schedstat_running_seconds_total |
Temps total passé par les processus dans un état d'exécution, en secondes. |
|
node_sockstat_TCP_alloc |
Nombre de sockets TCP alloués. |
|
node_sockstat_TCP_inuse |
Nombre de sockets TCP actuellement utilisés. |
|
node_sockstat_TCP_mem |
Quantité de mémoire utilisée par les sockets TCP, en pages. |
|
node_sockstat_TCP_mem_bytes |
Quantité de mémoire utilisée par les sockets TCP, en octets. |
|
node_sockstat_TCP_tw |
Nombre de sockets TCP dans l'état TIME_WAIT. |
|
node_time_zone_offset_seconds |
Décalage du fuseau horaire par rapport à UTC, en secondes. |
|
node_timex_offset_seconds |
Décalage temporel, en secondes. |
|
node_timex_sync_status |
Indique le statut de synchronisation de l'horloge. |
|
node_uname_info |
Informations système issues de uname. |
|
node_vmstat_pgfault |
Nombre total de défauts de page mineurs. |
|
node_vmstat_pgmajfault |
Nombre total de défauts de page majeurs. |
|
node_vmstat_pgpgin |
Nombre total de pages chargées depuis le disque. |
|
node_vmstat_pgpgout |
Nombre total de pages déchargées vers le disque. |
|
up |
Indique si la cible est saine. Une valeur de 1 signifie que la cible est active et accessible, tandis que 0 indique qu'elle est inactive. |
Kube-state-metrics (Nom de la tâche : _kube-state-metrics)
|
Métrique |
Description |
|
kube_configmap_info |
Informations sur ConfigMap. |
|
kube_cronjob_annotations |
Annotations du CronJob. |
|
kube_cronjob_created |
Horodatage de création du CronJob. |
|
kube_cronjob_info |
Informations sur le CronJob. |
|
kube_cronjob_labels |
Libellés du CronJob. |
|
kube_cronjob_metadata_resource_version |
Version de ressource des métadonnées du CronJob. |
|
kube_cronjob_next_schedule_time |
Prochaine heure planifiée pour le CronJob. |
|
kube_cronjob_spec_failed_job_history_limit |
Limite de conservation de l'historique pour les jobs échoués du CronJob. |
|
kube_cronjob_spec_starting_deadline_seconds |
Délai de démarrage en secondes pour le CronJob. |
|
kube_cronjob_spec_successful_job_history_limit |
Limite de conservation de l'historique pour les jobs réussis du CronJob. |
|
kube_cronjob_spec_suspend |
Indique si le CronJob est suspendu. |
|
kube_cronjob_status_active |
Nombre de jobs actifs pour le CronJob. |
|
kube_cronjob_status_last_schedule_time |
Dernière fois où le CronJob a été planifié. |
|
kube_cronjob_status_last_successful_time |
Dernière heure d'exécution réussie du CronJob. |
|
kube_daemonset_created |
Horodatage de création du DaemonSet. |
|
kube_daemonset_status_current_number_scheduled |
Nombre de nœuds exécutant actuellement un pod DaemonSet. |
|
kube_daemonset_status_desired_number_scheduled |
Nombre total de nœuds devant exécuter un pod DaemonSet. |
|
kube_daemonset_status_number_available |
Nombre de nœuds disposant d'un pod DaemonSet disponible. |
|
kube_daemonset_status_number_misscheduled |
Nombre de nœuds exécutant incorrectement un pod DaemonSet. |
|
kube_daemonset_status_number_ready |
Nombre de nœuds disposant d'un pod DaemonSet prêt. |
|
kube_daemonset_status_number_unavailable |
Nombre de nœuds ne disposant pas de pod DaemonSet disponible. |
|
kube_daemonset_status_updated_number_scheduled |
Nombre de nœuds exécutant le DaemonSet mis à jour. |
|
kube_daemonset_updated_number_scheduled |
Nombre de nœuds exécutant le DaemonSet mis à jour. |
|
kube_deployment_created |
Horodatage de création du Deployment. |
|
kube_deployment_labels |
Libellés du Deployment. |
|
kube_deployment_metadata_generation |
Génération des métadonnées du Deployment. |
|
kube_deployment_spec_replicas |
Nombre souhaité de réplicas pour le Deployment. |
|
kube_deployment_spec_strategy_rollingupdate_max_unavailable |
Nombre maximal de réplicas indisponibles lors d'une mise à jour progressive du Deployment. |
|
kube_deployment_status_observed_generation |
Dernière génération observée par le contrôleur de Deployment. |
|
kube_deployment_status_replicas |
Nombre total de réplicas pour le Deployment. |
|
kube_deployment_status_replicas_available |
Nombre de réplicas disponibles pour le Deployment. |
|
kube_deployment_status_replicas_ready |
Nombre de réplicas prêts pour le Deployment. |
|
kube_deployment_status_replicas_unavailable |
Nombre de réplicas indisponibles pour le Deployment. |
|
kube_deployment_status_replicas_updated |
Nombre de réplicas mis à jour pour le Deployment. |
|
kube_horizontalpodautoscaler_info |
Informations sur HorizontalPodAutoscaler. |
|
kube_horizontalpodautoscaler_labels |
Libellés de HorizontalPodAutoscaler. |
|
kube_horizontalpodautoscaler_metadata_generation |
Génération des métadonnées de HorizontalPodAutoscaler. |
|
kube_horizontalpodautoscaler_spec_max_replicas |
Nombre maximal de réplicas pour HorizontalPodAutoscaler. |
|
kube_horizontalpodautoscaler_spec_min_replicas |
Nombre minimal de réplicas pour HorizontalPodAutoscaler. |
|
kube_horizontalpodautoscaler_spec_target_metric |
Métrique cible pour HorizontalPodAutoscaler. |
|
kube_horizontalpodautoscaler_status_condition |
Condition actuelle de HorizontalPodAutoscaler. |
|
kube_horizontalpodautoscaler_status_current_replicas |
Nombre actuel de réplicas pour HorizontalPodAutoscaler. |
|
kube_horizontalpodautoscaler_status_desired_replicas |
Nombre souhaité de réplicas pour HorizontalPodAutoscaler. |
|
kube_hpa_labels |
Libellés du HPA. |
|
kube_hpa_metadata_generation |
Génération des métadonnées du HPA. |
|
kube_hpa_spec_max_replicas |
Nombre maximal de réplicas pour le HPA. |
|
kube_hpa_spec_min_replicas |
Nombre minimal de réplicas pour le HPA. |
|
kube_hpa_spec_target_metric |
Métrique cible pour le HPA. |
|
kube_hpa_status_condition |
Condition actuelle du HPA. |
|
kube_hpa_status_current_replicas |
Nombre actuel de réplicas pour le HPA. |
|
kube_hpa_status_desired_replicas |
Nombre souhaité de réplicas pour le HPA. |
|
kube_ingress_info |
Informations sur Ingress. |
|
kube_job_created |
Horodatage de création du Job. |
|
kube_job_failed |
Indique si le job a échoué. |
|
kube_job_info |
Informations sur le Job. |
|
kube_job_spec_completions |
Nombre souhaité d'achèvements réussis pour le job. |
|
kube_job_status_active |
Nombre de pods actifs pour le job. |
|
kube_job_status_failed |
Nombre de pods ayant échoué pour le job. |
|
kube_job_status_succeeded |
Nombre de pods réussis pour le job. |
|
kube_namespace_created |
Horodatage de création du namespace. |
|
kube_namespace_labels |
Libellés du namespace. |
|
kube_namespace_status_phase |
Phase actuelle du namespace. |
|
kube_node_info |
Informations sur le nœud. |
|
kube_node_labels |
Libellés du nœud. |
|
kube_node_spec_taint |
Taint spécifié pour le nœud. |
|
kube_node_spec_unschedulable |
Indique si le nœud est non planifiable. |
|
kube_node_status_allocatable |
Ressources allouables du nœud. |
|
kube_node_status_allocatable_cpu_cores |
Ressources CPU allouables du nœud, en cœurs. |
|
kube_node_status_allocatable_memory_bytes |
Ressources mémoire allouables du nœud, en octets. |
|
kube_node_status_allocatable_pods |
Nombre de pods pouvant être alloués au nœud. |
|
kube_node_status_capacity |
Capacité totale du nœud. |
|
kube_node_status_capacity_cpu_cores |
Capacité CPU totale du nœud, en cœurs. |
|
kube_node_status_capacity_memory_bytes |
Capacité mémoire totale du nœud, en octets. |
|
kube_node_status_capacity_pods |
Capacité totale en pods du nœud. |
|
kube_node_status_condition |
Condition actuelle du nœud. |
|
kube_persistentvolume_status_phase |
Phase actuelle du volume persistant. |
|
kube_persistentvolumeclaim_info |
Informations sur la revendication de volume persistant. |
|
kube_persistentvolumeclaim_resource_requests_storage_bytes |
Stockage demandé pour la revendication de volume persistant, en octets. |
|
kube_persistentvolumeclaim_status_phase |
Phase actuelle de la revendication de volume persistant. |
|
kube_pod_completion_time |
Heure d'achèvement du pod. |
|
kube_pod_container_info |
Informations sur le conteneur du pod. |
|
kube_pod_container_resource_limits |
Limites de ressources pour un conteneur. |
|
kube_pod_container_resource_limits_cpu_cores |
Limite de ressource CPU pour un conteneur, en cœurs. |
|
kube_pod_container_resource_limits_memory_bytes |
Limite de ressource mémoire pour un conteneur, en octets. |
|
kube_pod_container_resource_requests |
Demandes de ressources pour un conteneur. |
|
kube_pod_container_resource_requests_cpu_cores |
Demande de ressource CPU pour un conteneur, en cœurs. |
|
kube_pod_container_resource_requests_memory_bytes |
Demande de ressource mémoire pour un conteneur, en octets. |
|
kube_pod_container_status_last_terminated_reason |
Raison de la dernière terminaison d'un conteneur. |
|
kube_pod_container_status_ready |
Indique si un conteneur est prêt. |
|
kube_pod_container_status_restarts_total |
Nombre total de redémarrages de conteneur. |
|
kube_pod_container_status_running |
Indique si un conteneur est en cours d'exécution. |
|
kube_pod_container_status_terminated |
Indique si un conteneur est dans un état terminé. |
|
kube_pod_container_status_terminated_reason |
Raison pour laquelle un conteneur est dans un état terminé. |
|
kube_pod_container_status_waiting |
Indique si un conteneur est dans un état d'attente. |
|
kube_pod_container_status_waiting_reason |
Raison pour laquelle un conteneur est dans un état d'attente. |
|
kube_pod_created |
Horodatage de création du pod. |
|
kube_pod_deletion_timestamp |
Horodatage de suppression du pod. |
|
kube_pod_info |
Informations sur le pod. |
|
kube_pod_labels |
Libellés du pod. |
|
kube_pod_owner |
Informations sur le propriétaire d'un pod. |
|
kube_pod_start_time |
Heure de démarrage du pod. |
|
kube_pod_status_container_ready_time |
Heure à laquelle les conteneurs du pod sont devenus prêts. |
|
kube_pod_status_initialized_time |
Heure à laquelle le pod a été initialisé. |
|
kube_pod_status_phase |
Phase actuelle du pod. |
|
kube_pod_status_ready |
Indique si le pod est prêt. |
|
kube_pod_status_ready_time |
Heure à laquelle le pod est devenu prêt. |
|
kube_pod_status_reason |
Raison du statut actuel du pod. |
|
kube_pod_status_scheduled_time |
Heure à laquelle le pod a été planifié. |
|
kube_pod_status_unschedulable |
Indique si le pod est non planifiable. |
|
kube_replicaset_owner |
Informations sur le propriétaire d'un ReplicaSet. |
|
kube_replicaset_status_ready_replicas |
Nombre de réplicas prêts pour le ReplicaSet. |
|
kube_resource_relationship |
Relation entre les ressources. |
|
kube_resourcequota |
Informations sur le quota de ressources. |
|
kube_resourcequota_created |
Horodatage de création du quota de ressources. |
|
kube_secret_info |
Informations sur Secret. |
|
kube_service_info |
Informations sur Service. |
|
kube_service_spec_type |
Type du service. |
|
kube_service_status_load_balancer_ingress |
Informations d'entrée pour l'équilibreur de charge du service. |
|
kube_statefulset_created |
Horodatage de création du StatefulSet. |
|
kube_statefulset_metadata_generation |
Génération des métadonnées du StatefulSet. |
|
kube_statefulset_replicas |
Nombre souhaité de réplicas pour le StatefulSet. |
|
kube_statefulset_status_replicas |
Nombre actuel de réplicas pour le StatefulSet. |
|
kube_statefulset_status_replicas_available |
Nombre de réplicas disponibles pour le StatefulSet. |
|
kube_statefulset_status_replicas_ready |
Nombre de réplicas prêts pour le StatefulSet. |
|
kube_statefulset_status_replicas_updated |
Nombre de réplicas mis à jour pour le StatefulSet. |
|
rest_client_requests_total |
Total des requêtes envoyées par le client REST. |
|
up |
Indique si la cible est saine (1 pour actif, 0 pour inactif). |
|
workqueue_adds_total |
Total des ajouts à la file d'attente de travail. |
|
workqueue_depth |
Profondeur actuelle de la file d'attente de travail. |
|
workqueue_queue_duration_seconds_bucket |
Distribution du temps passé dans la file d'attente de travail, en secondes. |
kube-events (nom de la tâche de collecte : _arms/kube-event)
|
Métrique |
Description |
|
aliyun_prometheus_agent_append_duration_seconds |
Durée de l'opération d'ajout pour l'agent Alibaba Cloud Prometheus, en secondes. |
|
aliyun_prometheus_agent_job_discovery_status |
Statut de découverte des tâches de collecte pour l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrape_custom_error |
Nombre d'erreurs de collecte personnalisées provenant de l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Nombre total de collectes par cible pour l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_target_info |
Informations sur les cibles de l'agent Alibaba Cloud Prometheus. |
|
eventer_events_error_total |
Nombre total d'erreurs de traitement des événements. |
|
eventer_events_normal_total |
Nombre total d'événements normaux. |
|
eventer_events_warning_total |
Nombre total d'événements d'avertissement. |
|
eventer_exporter_duration_milliseconds_count |
Nombre d'observations pour la durée d'exportation des événements, en millisecondes. |
|
eventer_exporter_duration_milliseconds_sum |
Somme de toutes les durées d'exportation des événements, en millisecondes. |
|
eventer_manager_last_time_seconds |
Horodatage de la dernière opération effectuée par le gestionnaire d'événements, en secondes. |
|
eventer_scraper_duration_milliseconds_count |
Nombre d'observations pour la durée de collecte des événements, en millisecondes. |
|
eventer_scraper_duration_milliseconds_sum |
Somme de toutes les durées de collecte des événements, en millisecondes. |
|
eventer_scraper_events_total_number |
Nombre total d'événements collectés. |
|
eventer_scraper_last_time_seconds |
Horodatage de la dernière collecte d'événements, en secondes. |
|
up |
Indique si une cible est saine : 1 signifie qu'elle est active et accessible, tandis que 0 signifie qu'elle est inactive. |
CoreDNS (nom de la tâche : arms-ack-coredns)
|
Métrique |
Description |
|
aliyun_prometheus_agent_append_duration_seconds |
Durée des opérations d'ajout pour l'agent Alibaba Cloud Prometheus, en secondes. |
|
aliyun_prometheus_agent_job_discovery_status |
Statut de la découverte des tâches de collecte par l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrape_custom_error |
Nombre d'erreurs de collecte personnalisées provenant de l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Nombre total de collectes effectuées par l'agent Alibaba Cloud Prometheus, ventilé par cible. |
|
aliyun_prometheus_agent_target_info |
Informations relatives aux cibles collectées par l'agent Alibaba Cloud Prometheus. |
|
coredns_autopath_success_count_total |
Nombre total d'opérations autopath réussies. |
|
coredns_autopath_success_total |
Nombre total d'opérations autopath réussies. |
|
coredns_build_info |
Informations de build du binaire CoreDNS. |
|
coredns_cache_drops_total |
Nombre total d'entrées supprimées du cache. |
|
coredns_cache_entries |
Nombre d'entrées actuellement présentes dans le cache. |
|
coredns_cache_evictions_total |
Nombre total d'entrées évincées du cache. |
|
coredns_cache_hits_total |
Nombre total d'accès au cache (hits). |
|
coredns_cache_misses_total |
Nombre total d'échecs d'accès au cache (misses). |
|
coredns_cache_requests_total |
Nombre total de requêtes adressées au cache. |
|
coredns_cache_size |
Nombre d'entrées dans le cache. |
|
coredns_dns_do_requests_total |
Nombre total de requêtes DNS avec le bit DO (DNSSEC OK) activé. |
|
coredns_dns_request_count_total |
Nombre total de requêtes DNS. |
|
coredns_dns_request_duration_seconds_bucket |
Répartition des durées des requêtes DNS, en secondes. |
|
coredns_dns_request_duration_seconds_count |
Nombre total de requêtes DNS mesurées pour l'histogramme des durées. |
|
coredns_dns_request_duration_seconds_sum |
Durée totale de toutes les requêtes DNS mesurées, en secondes. |
|
coredns_dns_request_size_bytes_bucket |
Répartition des tailles des requêtes DNS, en octets. |
|
coredns_dns_request_size_bytes_count |
Nombre total de requêtes DNS mesurées pour l'histogramme des tailles. |
|
coredns_dns_request_size_bytes_sum |
Taille totale de toutes les requêtes DNS mesurées, en octets. |
|
coredns_dns_request_type_count_total |
Nombre total de requêtes DNS, par type de requête. |
|
coredns_dns_requests_total |
Nombre total de requêtes DNS. |
|
coredns_dns_response_rcode_count_total |
Nombre total de réponses DNS, par code de réponse (RCODE). |
|
coredns_dns_response_size_bytes_bucket |
Répartition des tailles des réponses DNS, en octets. |
|
coredns_dns_response_size_bytes_count |
Nombre total de réponses DNS mesurées pour l'histogramme des tailles. |
|
coredns_dns_response_size_bytes_sum |
Taille totale de toutes les réponses DNS mesurées, en octets. |
|
coredns_dns_responses_total |
Nombre total de réponses DNS. |
|
coredns_forward_conn_cache_hits_total |
Nombre total d'accès au cache de connexion pour les requêtes transférées. |
|
coredns_forward_conn_cache_misses_total |
Nombre total d'échecs d'accès au cache de connexion pour les requêtes transférées. |
|
coredns_forward_healthcheck_broken_total |
Nombre total de fois où un forwarder a été marqué comme défaillant. |
|
coredns_forward_healthcheck_failure_count_total |
Nombre total d'échecs des checks de santé pour les forwarders. |
|
coredns_forward_healthcheck_failures_total |
Nombre total d'échecs des checks de santé pour les forwarders. |
|
coredns_forward_max_concurrent_rejects_total |
Nombre total de requêtes transférées rejetées car la limite de requêtes simultanées a été atteinte. |
|
coredns_forward_request_count_total |
Nombre total de requêtes transférées. |
|
coredns_forward_request_duration_seconds_bucket |
Répartition des durées des requêtes transférées, en secondes. |
|
coredns_forward_request_duration_seconds_count |
Nombre total de requêtes transférées mesurées pour l'histogramme des durées. |
|
coredns_forward_request_duration_seconds_sum |
Durée totale de toutes les requêtes transférées mesurées, en secondes. |
|
coredns_forward_requests_total |
Nombre total de requêtes transférées. |
|
coredns_forward_response_rcode_count_total |
Nombre total de réponses provenant des forwarders, par code de réponse (RCODE). |
|
coredns_forward_responses_total |
Nombre total de réponses reçues des forwarders. |
|
coredns_forward_sockets_open |
Nombre de sockets actuellement ouverts pour le transfert. |
|
coredns_health_request_duration_seconds_bucket |
Répartition des durées des requêtes vers le endpoint de santé, en secondes. |
|
coredns_health_request_duration_seconds_count |
Nombre total de requêtes vers le endpoint de santé mesurées pour l'histogramme des durées. |
|
coredns_health_request_duration_seconds_sum |
Durée totale de toutes les requêtes mesurées vers le endpoint de santé, en secondes. |
|
coredns_health_request_failures_total |
Nombre total de requêtes échouées vers le endpoint de santé. |
|
coredns_hosts_entries |
Nombre d'entrées dans le plugin hosts. |
|
coredns_hosts_reload_timestamp_seconds |
Horodatage du dernier rechargement réussi du fichier hosts. |
|
coredns_kubernetes_dns_programming_duration_seconds_bucket |
Répartition des durées de programmation DNS Kubernetes, en secondes. |
|
coredns_kubernetes_dns_programming_duration_seconds_count |
Nombre total d'opérations de programmation DNS Kubernetes mesurées pour l'histogramme des durées. |
|
coredns_kubernetes_dns_programming_duration_seconds_sum |
Durée totale de toutes les opérations de programmation DNS Kubernetes mesurées, en secondes. |
|
coredns_local_localhost_requests_total |
Nombre total de requêtes « localhost » traitées par le plugin local. |
|
coredns_panic_count_total |
Nombre total de panics. |
|
coredns_panics_total |
Nombre total de panics. |
|
coredns_plugin_enabled |
Indique quels plugins sont activés via les labels. |
|
coredns_reload_failed_total |
Nombre total de rechargements échoués. |
|
coredns_reload_version_info |
Informations de version pour les rechargements. |
|
coredns_template_matches_total |
Nombre total de correspondances de modèle. |
|
up |
Indique si la cible a été collectée avec succès (1 pour actif, 0 pour inactif). |
CSI (niveau cluster) (Nom de la tâche : k8s-csi-cluster-pv)
|
Métrique |
Description |
|
alibaba_cloud_storage_operator_build_info |
Informations de build pour l'opérateur de stockage Alibaba Cloud. |
|
aliyun_prometheus_agent_append_duration_seconds |
Durée des opérations d'ajout pour l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_job_discovery_status |
Statut de découverte des tâches de collecte pour l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrape_custom_error |
Nombre d'erreurs de collecte personnalisées provenant de l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Nombre total de collectes par cible pour l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_target_info |
Affiche les informations sur les cibles surveillées par l'agent Alibaba Cloud Prometheus. |
|
cluster_pv_detail_num_total |
Nombre total de volumes persistants (PV) dans le cluster. |
|
cluster_pv_status_num_total |
Nombre total de PV dans le cluster, ventilé par statut. |
|
cluster_pvc_detail_num_total |
Nombre total de revendications de volume persistant (PVC) dans le cluster. |
|
cluster_pvc_status_num_total |
Nombre total de PVC dans le cluster, ventilé par statut. |
|
cluster_scrape_collector_duration_seconds |
Durée des collectes effectuées par le collecteur de cluster. |
|
cluster_scrape_collector_success |
Nombre de collectes réussies par le collecteur de cluster. |
|
up |
Indique si la cible est saine. Une valeur de 1 signifie que la cible est active, tandis qu'une valeur de 0 indique qu'elle est inactive. |
CSI (niveau nœud) (nom de la tâche : k8s-csi-node-pv)
|
Métrique |
Description |
|
alibaba_cloud_csi_driver_build_info |
Informations de build pour le pilote CSI Alibaba Cloud. |
|
aliyun_prometheus_agent_append_duration_seconds |
Durée des opérations d'ajout pour l'agent Alibaba Cloud Prometheus, en secondes. |
|
aliyun_prometheus_agent_job_discovery_status |
Statut de découverte des tâches de collecte pour l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrape_custom_error |
Nombre d'erreurs de collecte personnalisées provenant de l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Nombre total de collectes par cible pour l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_target_info |
Informations sur les cibles pour l'agent Alibaba Cloud Prometheus. |
|
cluster_scrape_collector_duration_seconds |
Durée de collecte pour le collecteur de cluster, en secondes. |
|
cluster_scrape_collector_success |
Nombre de collectes réussies par le collecteur de cluster. |
|
container_fs_available_bytes |
Espace disponible sur le système de fichiers du conteneur, en octets. |
|
container_fs_inodes_free |
Nombre d'inodes libres sur le système de fichiers du conteneur. |
|
container_fs_inodes_total |
Nombre total d'inodes sur le système de fichiers du conteneur. |
|
container_fs_inodes_used |
Nombre d'inodes utilisés sur le système de fichiers du conteneur. |
|
container_fs_limit_bytes |
Limite de taille du système de fichiers pour le conteneur, en octets. |
|
container_fs_usage_bytes |
Utilisation du système de fichiers pour le conteneur, en octets. |
|
ephemeral_storage_pod_available_bytes |
Stockage éphémère disponible pour le Pod, en octets. |
|
ephemeral_storage_pod_inodes_free |
Nombre d'inodes libres dans le stockage éphémère du Pod. |
|
ephemeral_storage_pod_inodes_total |
Nombre total d'inodes dans le stockage éphémère du Pod. |
|
ephemeral_storage_pod_inodes_used |
Nombre d'inodes utilisés dans le stockage éphémère du Pod. |
|
ephemeral_storage_pod_limit_bytes |
Limite de stockage éphémère pour le Pod, en octets. |
|
ephemeral_storage_pod_usage_bytes |
Utilisation du stockage éphémère pour le Pod, en octets. |
|
node_volume_backend_posix_access_total_counter |
Nombre total d'opérations d'accès POSIX sur le backend de volume de nœud. |
|
node_volume_backend_posix_getattr_total_counter |
Nombre total d'opérations getattr POSIX sur le backend de volume de nœud. |
|
node_volume_backend_posix_getmode_total_counter |
Nombre total d'opérations getmode POSIX sur le backend de volume de nœud. |
|
node_volume_backend_posix_link_total_counter |
Nombre total d'opérations de lien POSIX sur le backend de volume de nœud. |
|
node_volume_backend_posix_lookup_total_counter |
Nombre total d'opérations de recherche POSIX sur le backend de volume de nœud. |
|
node_volume_backend_posix_mknod_total_counter |
Nombre total d'opérations mknod POSIX sur le backend de volume de nœud. |
|
node_volume_backend_posix_readdir_total_counter |
Nombre total d'opérations readdir POSIX sur le backend de volume de nœud. |
|
node_volume_backend_posix_readlink_total_counter |
Nombre total d'opérations readlink POSIX sur le backend de volume de nœud. |
|
node_volume_backend_posix_remove_total_counter |
Nombre total d'opérations de suppression POSIX sur le backend de volume de nœud. |
|
node_volume_backend_posix_rename_total_counter |
Nombre total d'opérations de renommage POSIX sur le backend de volume de nœud. |
|
node_volume_backend_posix_setattr_total_counter |
Nombre total d'opérations setattr POSIX sur le backend de volume de nœud. |
|
node_volume_backend_posix_statfs_total_counter |
Nombre total d'opérations statfs POSIX sur le backend de volume de nœud. |
|
node_volume_backend_read_bytes_total_counter |
Nombre total d'octets lus depuis le backend de volume de nœud. |
|
node_volume_backend_read_completed_total_counter |
Nombre total d'opérations de lecture terminées sur le backend de volume de nœud. |
|
node_volume_backend_read_time_milliseconds_total_counter |
Temps total consacré aux opérations de lecture sur le backend de volume de nœud, en millisecondes. |
|
node_volume_backend_write_bytes_total_counter |
Nombre total d'octets écrits sur le backend de volume de nœud. |
|
node_volume_backend_write_completed_total_counter |
Nombre total d'opérations d'écriture terminées sur le backend de volume de nœud. |
|
node_volume_backend_write_time_milliseconds_total_counter |
Temps total consacré aux opérations d'écriture sur le backend de volume de nœud, en millisecondes. |
|
node_volume_capacity_bytes_available |
Capacité disponible du volume de nœud, en octets. |
|
node_volume_capacity_bytes_available_counter |
Compteur pour la capacité disponible du volume de nœud, en octets. |
|
node_volume_capacity_bytes_total |
Capacité totale du volume de nœud, en octets. |
|
node_volume_capacity_bytes_total_counter |
Compteur pour la capacité totale du volume de nœud, en octets. |
|
node_volume_capacity_bytes_used |
Capacité utilisée du volume de nœud, en octets. |
|
node_volume_capacity_bytes_used_counter |
Compteur pour la capacité utilisée du volume de nœud, en octets. |
|
node_volume_hot_spot_head_file_top |
Classement des fichiers les plus sollicités par le nombre de requêtes HEAD sur le volume de nœud. |
|
node_volume_hot_spot_read_file_top |
Classement des fichiers les plus sollicités par le nombre de requêtes de lecture sur le volume de nœud. |
|
node_volume_hot_spot_write_file_top |
Classement des fichiers les plus sollicités par le nombre de requêtes d'écriture sur le volume de nœud. |
|
node_volume_inode_bytes_available_counter |
Compteur pour l'espace d'inode disponible sur le volume de nœud, en octets. |
|
node_volume_inode_bytes_total_counter |
Compteur pour l'espace d'inode total sur le volume de nœud, en octets. |
|
node_volume_inode_bytes_used_counter |
Compteur pour l'espace d'inode utilisé sur le volume de nœud, en octets. |
|
node_volume_inodes_available |
Nombre d'inodes disponibles sur le volume de nœud. |
|
node_volume_inodes_total |
Nombre total d'inodes sur le volume de nœud. |
|
node_volume_inodes_used |
Nombre d'inodes utilisés sur le volume de nœud. |
|
node_volume_io_now |
Nombre d'opérations d'E/S en cours sur le volume de nœud. |
|
node_volume_io_time_seconds_total |
Temps total consacré aux opérations d'E/S sur le volume de nœud, en secondes. |
|
node_volume_oss_delete_object_total_counter |
Nombre total d'opérations de suppression d'objet OSS sur le volume de nœud. |
|
node_volume_oss_get_object_total_counter |
Nombre total d'opérations de récupération d'objet OSS sur le volume de nœud. |
|
node_volume_oss_head_object_total_counter |
Nombre total d'opérations head object OSS sur le volume de nœud. |
|
node_volume_oss_post_object_total_counter |
Nombre total d'opérations POST object OSS sur le volume de nœud. |
|
node_volume_oss_put_object_total_counter |
Nombre total d'opérations put object OSS sur le volume de nœud. |
|
node_volume_posix_access_total_counter |
Nombre total d'opérations d'accès POSIX sur le volume de nœud. |
|
node_volume_posix_chmod_total_counter |
Nombre total d'opérations chmod POSIX sur le volume de nœud. |
|
node_volume_posix_chown_total_counter |
Nombre total d'opérations chown POSIX sur le volume de nœud. |
|
node_volume_posix_create_total_counter |
Nombre total d'opérations de création POSIX sur le volume de nœud. |
|
node_volume_posix_flush_total_counter |
Nombre total d'opérations flush POSIX sur le volume de nœud. |
|
node_volume_posix_fsync_total_counter |
Nombre total d'opérations fsync POSIX sur le volume de nœud. |
|
node_volume_posix_mkdir_total_counter |
Nombre total d'opérations mkdir POSIX sur le volume de nœud. |
|
node_volume_posix_open_total_counter |
Nombre total d'opérations d'ouverture POSIX sur le volume de nœud. |
|
node_volume_posix_opendir_total_counter |
Nombre total d'opérations opendir POSIX sur le volume de nœud. |
|
node_volume_posix_read_total_counter |
Nombre total d'opérations de lecture POSIX sur le volume de nœud. |
|
node_volume_posix_readdir_total_counter |
Nombre total d'opérations readdir POSIX sur le volume de nœud. |
|
node_volume_posix_release_total_counter |
Nombre total d'opérations de libération POSIX sur le volume de nœud. |
|
node_volume_posix_rename_total_counter |
Nombre total d'opérations de renommage POSIX sur le volume de nœud. |
|
node_volume_posix_rmdir_total_counter |
Nombre total d'opérations rmdir POSIX sur le volume de nœud. |
|
node_volume_posix_truncate_total_counter |
Nombre total d'opérations de troncature POSIX sur le volume de nœud. |
|
node_volume_posix_write_total_counter |
Nombre total d'opérations d'écriture POSIX sur le volume de nœud. |
|
node_volume_read_bytes_total |
Nombre total d'octets lus depuis le volume de nœud. |
|
node_volume_read_bytes_total_counter |
Compteur pour le nombre total d'octets lus depuis le volume de nœud. |
|
node_volume_read_completed_total |
Nombre total d'opérations de lecture terminées sur le volume de nœud. |
|
node_volume_read_completed_total_counter |
Compteur pour le nombre total d'opérations de lecture terminées sur le volume de nœud. |
|
node_volume_read_merged_total |
Nombre total d'opérations de lecture fusionnées sur le volume de nœud. |
|
node_volume_read_queue_time_milliseconds_total |
Temps total passé en file d'attente pour les requêtes de lecture sur le volume de nœud, en millisecondes. |
|
node_volume_read_rtt_time_milliseconds_total |
Temps total d'aller-retour pour les requêtes de lecture sur le volume de nœud, en millisecondes. |
|
node_volume_read_sent_bytes_total |
Nombre total d'octets envoyés pour les requêtes de lecture sur le volume de nœud. |
|
node_volume_read_time_milliseconds_total |
Temps total consacré aux opérations de lecture sur le volume de nœud, en millisecondes. |
|
node_volume_read_time_milliseconds_total_counter |
Compteur pour le temps total consacré aux opérations de lecture sur le volume de nœud, en millisecondes. |
|
node_volume_read_timeouts_total |
Nombre total de délais d'expiration de lecture sur le volume de nœud. |
|
node_volume_read_transmissions_total |
Nombre total de transmissions de lecture sur le volume de nœud. |
|
node_volume_vg_free_bytes |
Espace libre dans le groupe de volumes (VG) du nœud, en octets. |
|
node_volume_vg_size_bytes |
Taille totale du groupe de volumes (VG) du nœud, en octets. |
|
node_volume_write_bytes_total |
Nombre total d'octets écrits sur le volume de nœud. |
|
node_volume_write_bytes_total_counter |
Compteur pour le nombre total d'octets écrits sur le volume de nœud. |
|
node_volume_write_completed_total |
Nombre total d'opérations d'écriture terminées sur le volume de nœud. |
|
node_volume_write_completed_total_counter |
Compteur pour le nombre total d'opérations d'écriture terminées sur le volume de nœud. |
|
node_volume_write_merged_total |
Nombre total d'opérations d'écriture fusionnées sur le volume de nœud. |
|
node_volume_write_queue_time_milliseconds_total |
Temps total passé en file d'attente pour les requêtes d'écriture sur le volume de nœud, en millisecondes. |
|
node_volume_write_recv_bytes_total |
Nombre total d'octets reçus pour les requêtes d'écriture sur le volume de nœud. |
|
node_volume_write_rtt_time_milliseconds_total |
Temps total d'aller-retour pour les requêtes d'écriture sur le volume de nœud, en millisecondes. |
|
node_volume_write_time_milliseconds_total |
Temps total consacré aux opérations d'écriture sur le volume de nœud, en millisecondes. |
|
node_volume_write_time_milliseconds_total_counter |
Compteur pour le temps total consacré aux opérations d'écriture sur le volume de nœud, en millisecondes. |
|
node_volume_write_timeouts_total |
Nombre total de délais d'expiration d'écriture sur le volume de nœud. |
|
node_volume_write_transmissions_total |
Nombre total de transmissions d'écriture sur le volume de nœud. |
|
up |
Indique si la cible est saine. Une valeur de 1 signifie que la cible est saine et accessible ; 0 signifie qu'elle est inactive. |
GPU-Exporter (Nom de la tâche : gpu-exporter)
|
Métrique |
Description |
|
DCGM_CUSTOM_ALLOCATE_MODE |
Indique le mode de fonctionnement du nœud. Les valeurs possibles sont les suivantes : |
|
DCGM_CUSTOM_CONTAINER_CP_ALLOCATED |
Pourcentage de la puissance de calcul totale d'un GPU alloué à un conteneur. La valeur est comprise entre 0 et 1. Une valeur de 0 signifie que le conteneur utilise un GPU exclusif ou partagé avec une demande de mémoire vidéo uniquement, sans limiter sa puissance de calcul. Par exemple, si un GPU fournit 100 unités de puissance de calcul et que 30 sont allouées à un conteneur, le ratio est de 0,3. |
|
DCGM_CUSTOM_CONTAINER_MEM_ALLOCATED |
Quantité de mémoire vidéo allouée au conteneur. |
|
DCGM_CUSTOM_DEV_FB_ALLOCATED |
Pourcentage de la mémoire framebuffer totale d'un GPU qui est allouée. La valeur est comprise entre 0 et 1. |
|
DCGM_CUSTOM_DEV_FB_TOTAL |
Mémoire framebuffer totale du GPU. |
|
DCGM_CUSTOM_ILLEGAL_PROCESS_DECODE_UTIL |
Utilisation du décodeur par des processus non autorisés. |
|
DCGM_CUSTOM_ILLEGAL_PROCESS_ENCODE_UTIL |
Utilisation de l'encodeur par des processus non autorisés. |
|
DCGM_CUSTOM_ILLEGAL_PROCESS_MEM_COPY_UTIL |
Utilisation de la copie mémoire par des processus non autorisés. |
|
DCGM_CUSTOM_ILLEGAL_PROCESS_MEM_USED |
Mémoire vidéo utilisée par des processus non autorisés. |
|
DCGM_CUSTOM_ILLEGAL_PROCESS_SM_UTIL |
Utilisation des multiprocesseurs en flux (SM) par des processus non autorisés. |
|
DCGM_CUSTOM_PROCESS_DECODE_UTIL |
Utilisation du décodeur par un processus GPU. |
|
DCGM_CUSTOM_PROCESS_ENCODE_UTIL |
Utilisation de l'encodeur par un processus GPU. |
|
DCGM_CUSTOM_PROCESS_MEM_COPY_UTIL |
Utilisation de la copie mémoire par un processus GPU. |
|
DCGM_CUSTOM_PROCESS_MEM_USED |
Quantité de mémoire vidéo utilisée par un processus GPU. |
|
DCGM_CUSTOM_PROCESS_SM_UTIL |
Utilisation des multiprocesseurs en flux (SM) par un processus GPU. |
|
DCGM_FI_DEV_APP_MEM_CLOCK |
Fréquence d'horloge de l'application pour la mémoire. |
|
DCGM_FI_DEV_APP_SM_CLOCK |
Fréquence d'horloge de l'application pour les multiprocesseurs en flux (SM). |
|
DCGM_FI_DEV_BAR1_FREE |
Quantité de mémoire BAR1 libre. |
|
DCGM_FI_DEV_BAR1_TOTAL |
Taille totale du registre d'adresse de base 1 (BAR1) du périphérique, utilisé pour mapper la mémoire GPU dans l'espace d'adressage du système. |
|
DCGM_FI_DEV_BAR1_USED |
Quantité de mémoire BAR1 utilisée. |
|
DCGM_FI_DEV_BOARD_LIMIT_VIOLATION |
Durée des violations de la limite de la carte. |
|
DCGM_FI_DEV_CLOCK_THROTTLE_REASONS |
Masque de bits indiquant les raisons de la limitation de l'horloge. |
|
DCGM_FI_DEV_COUNT |
Nombre de périphériques. |
|
DCGM_FI_DEV_DEC_UTIL |
Utilisation du décodeur. |
|
DCGM_FI_DEV_ENC_UTIL |
Utilisation de l'encodeur. |
|
DCGM_FI_DEV_FB_FREE |
Quantité de mémoire framebuffer libre. |
|
DCGM_FI_DEV_FB_USED |
Quantité de mémoire framebuffer utilisée. Cette valeur correspond à la valeur |
|
DCGM_FI_DEV_GPU_TEMP |
Température du GPU. |
|
DCGM_FI_DEV_GPU_UTIL |
Pourcentage de temps, sur une période d'échantillonnage (par exemple 1 s ou 1/6 s, selon le GPU), pendant lequel un ou plusieurs noyaux étaient actifs. Cette métrique indique que les ressources GPU étaient utilisées, mais ne mesure pas l'intensité de la charge de travail. |
|
DCGM_FI_DEV_LOW_UTIL_VIOLATION |
Durée des violations de la limite de faible utilisation. |
|
DCGM_FI_DEV_MEM_CLOCK |
Fréquence d'horloge de la mémoire. |
|
DCGM_FI_DEV_MEM_COPY_UTIL |
Utilisation de la bande passante mémoire. Par exemple, un GPU NVIDIA V100 dispose d'une bande passante mémoire maximale de 900 Go/s. Si la bande passante mémoire actuelle est de 450 Go/s, l'utilisation est de 50 %. |
|
DCGM_FI_DEV_MEMORY_TEMP |
Température de la mémoire. |
|
DCGM_FI_DEV_NVLINK_BANDWIDTH_TOTAL |
Bande passante NVLink totale. |
|
DCGM_FI_DEV_PCIE_REPLAY_COUNTER |
Nombre de tentatives de transmission PCIe causées par des erreurs de données. |
|
DCGM_FI_DEV_POWER_USAGE |
Consommation électrique. |
|
DCGM_FI_DEV_POWER_VIOLATION |
Durée des violations de la limite de puissance. |
|
DCGM_FI_DEV_PSTATE |
État d'alimentation du périphérique (état P). |
|
DCGM_FI_DEV_RELIABILITY_VIOLATION |
Durée des violations de la limite de fiabilité de la carte. |
|
DCGM_FI_DEV_RETIRED_DBE |
Nombre de pages retirées en raison d'erreurs double bit (DBE). |
|
DCGM_FI_DEV_RETIRED_PENDING |
Nombre de pages en attente de retrait, c'est-à-dire des pages de la mémoire GPU marquées comme inutilisables en raison d'erreurs. |
|
DCGM_FI_DEV_RETIRED_SBE |
Nombre de pages retirées en raison d'erreurs simple bit (SBE). |
|
DCGM_FI_DEV_SM_CLOCK |
Fréquence d'horloge des multiprocesseurs en flux (SM). |
|
DCGM_FI_DEV_SYNC_BOOST_VIOLATION |
Durée des violations de la limite de synchronisation boost. |
|
DCGM_FI_DEV_THERMAL_VIOLATION |
Durée des violations de la limite thermique. |
|
DCGM_FI_DEV_TOTAL_ENERGY_CONSUMPTION |
Énergie totale consommée depuis le chargement du pilote. |
|
DCGM_FI_DEV_VIDEO_CLOCK |
Fréquence d'horloge vidéo. |
|
DCGM_FI_DEV_XID_ERRORS |
Code d'erreur de la dernière erreur XID survenue au cours d'une période d'échantillonnage. |
|
DCGM_FI_PROF_DRAM_ACTIVE |
Fraction de cycles pendant lesquels la DRAM est active (envoi ou réception de données), ce qui représente l'utilisation de la bande passante mémoire. Cette valeur est une moyenne sur un intervalle, et non une lecture instantanée. Une valeur plus élevée indique une utilisation plus importante de la mémoire du périphérique. Une valeur de 1,0 (100 %) signifie qu'une instruction DRAM a été exécutée à chaque cycle, bien qu'un pic d'environ 0,8 (80 %) soit le maximum pratique. Une valeur de 0,2 (20 %) signifie que des données ont été lues ou écrites dans la mémoire du périphérique pendant 20 % des cycles de l'intervalle de mesure. |
|
DCGM_FI_PROF_GR_ENGINE_ACTIVE |
Pourcentage de temps, sur un intervalle, pendant lequel le moteur graphique ou de calcul était actif. Cette valeur est une moyenne sur tous les moteurs graphiques et de calcul. Le moteur est considéré comme actif lorsqu'un contexte graphique ou de calcul est lié à un thread et se trouve dans un état occupé. |
|
DCGM_FI_PROF_NVLINK_RX_BYTES |
Débit de données reçues via NVLink, hors en-têtes de protocole. Il s'agit d'un débit moyen sur l'intervalle de mesure, et non d'une valeur instantanée. Par exemple, le transfert de 1 Go de données en 1 seconde donne un débit de 1 Go/s, que le transfert soit un flux constant ou une rafale. La bande passante théorique maximale pour NVLink Gen2 est de 25 Go/s par lien dans chaque direction. |
|
DCGM_FI_PROF_NVLINK_TX_BYTES |
Débit de données transmises via NVLink (sortant), hors en-têtes de protocole. |
|
DCGM_FI_PROF_PCIE_RX_BYTES |
Débit de données reçues via le bus PCIe, y compris les en-têtes de protocole et la charge utile des données. Il s'agit d'un débit moyen sur l'intervalle de mesure, et non d'une valeur instantanée. Par exemple, le transfert de 1 Go de données en 1 seconde donne un débit de 1 Go/s, que le transfert soit un flux constant ou une rafale. La bande passante théorique maximale pour PCIe Gen3 est de 985 Mo/s par voie. |
|
DCGM_FI_PROF_PCIE_TX_BYTES |
Débit de données transmises via le bus PCIe, y compris les en-têtes de protocole et la charge utile des données. Il s'agit d'un débit moyen sur l'intervalle de mesure, et non d'une valeur instantanée. Par exemple, le transfert de 1 Go de données en 1 seconde donne un débit de 1 Go/s, que le transfert soit un flux constant ou une rafale. La bande passante théorique maximale pour PCIe Gen3 est de 985 Mo/s par voie. |
|
DCGM_FI_PROF_PIPE_FP16_ACTIVE |
Fraction de cycles pendant lesquels le pipeline FP16 (demi-précision) est actif. Cette valeur est une moyenne sur un intervalle de temps, et non une valeur instantanée. Une valeur plus élevée indique une utilisation plus importante des cœurs FP16. Une valeur de 1,0 (100 %) signifie qu'une instruction FP16 a été exécutée tous les deux cycles (pour les GPU basés sur Volta, par exemple) tout au long de l'intervalle. Une valeur de 0,2 (20 %) peut signifier l'une des choses suivantes : 20 % des SM ont fait fonctionner leurs cœurs FP16 à 100 % d'utilisation tout au long de l'intervalle. 100 % des SM ont fait fonctionner leurs cœurs FP16 à 20 % d'utilisation tout au long de l'intervalle. 100 % des SM ont fait fonctionner leurs cœurs FP16 à 100 % d'utilisation pendant un cinquième de l'intervalle. Autres combinaisons. |
|
DCGM_FI_PROF_PIPE_FP32_ACTIVE |
Fraction de cycles pendant lesquels le pipeline Fused Multiply-Add (FMA) est actif. Ce pipeline gère les opérations FP32 (simple précision) et entières. Cette valeur est une moyenne sur un intervalle de temps, et non une valeur instantanée. Une valeur plus élevée indique une utilisation plus importante des cœurs FP32. Une valeur de 1,0 (100 %) signifie qu'une instruction FP32 a été exécutée tous les deux cycles (pour les GPU basés sur Volta, par exemple) tout au long de l'intervalle. Une valeur de 0,2 (20 %) peut signifier l'une des choses suivantes : 20 % des SM ont fait fonctionner leurs cœurs FP32 à 100 % d'utilisation tout au long de l'intervalle. 100 % des SM ont fait fonctionner leurs cœurs FP32 à 20 % d'utilisation tout au long de l'intervalle. 100 % des SM ont fait fonctionner leurs cœurs FP32 à 100 % d'utilisation pendant un cinquième de l'intervalle. Autres combinaisons. |
|
DCGM_FI_PROF_PIPE_FP64_ACTIVE |
Fraction de cycles pendant lesquels le pipeline FP64 (double précision) est actif. Cette valeur est une moyenne sur un intervalle de temps, et non une valeur instantanée. Une valeur plus élevée indique une utilisation plus importante des cœurs FP64. Une valeur de 1,0 (100 %) signifie qu'une instruction FP64 a été exécutée tous les quatre cycles (pour les GPU basés sur Volta, par exemple) tout au long de l'intervalle. Une valeur de 0,2 (20 %) peut signifier l'une des choses suivantes : 20 % des SM ont fait fonctionner leurs cœurs FP64 à 100 % d'utilisation tout au long de l'intervalle. 100 % des SM ont fait fonctionner leurs cœurs FP64 à 20 % d'utilisation tout au long de l'intervalle. 100 % des SM ont fait fonctionner leurs cœurs FP64 à 100 % d'utilisation pendant un cinquième de l'intervalle. Autres combinaisons. |
|
DCGM_FI_PROF_PIPE_TENSOR_ACTIVE |
Fraction de cycles pendant lesquels le pipeline Tensor (HMMA/IMMA) est actif. Cette valeur est une moyenne sur un intervalle de temps, et non une valeur instantanée. Une valeur plus élevée indique une utilisation plus importante des cœurs Tensor. Une valeur de 1,0 (100 %) signifie qu'une instruction Tensor a été émise tous les deux cycles, car une instruction prend deux cycles pour s'exécuter. Une valeur de 0,2 (20 %) peut signifier l'une des choses suivantes : 20 % des SM ont fait fonctionner leurs cœurs Tensor à 100 % d'utilisation tout au long de l'intervalle. 100 % des SM ont fait fonctionner leurs cœurs Tensor à 20 % d'utilisation tout au long de l'intervalle. 100 % des SM ont fait fonctionner leurs cœurs Tensor à 100 % d'utilisation pendant un cinquième de l'intervalle. Autres combinaisons. |
|
DCGM_FI_PROF_SM_ACTIVE |
Pourcentage de temps, sur un intervalle, pendant lequel au moins un warp était actif sur un multiprocesseur en flux (SM). Cette valeur est une moyenne sur tous les SM et n'est pas sensible au nombre de threads par bloc. Un warp est considéré comme actif après avoir été planifié et avoir reçu des ressources, qu'il soit en cours de calcul ou en attente d'une dépendance (comme une requête mémoire). Une valeur inférieure à 0,5 indique une utilisation inefficace du GPU, tandis qu'une valeur supérieure à 0,8 est souhaitable. |
|
DCGM_FI_PROF_SM_OCCUPANCY |
Ratio entre le nombre de warps résidents sur un SM et le nombre maximal de warps résidents pris en charge par ce SM. Cette valeur est une moyenne sur tous les SM sur un intervalle de temps. Une occupation plus élevée ne signifie pas nécessairement une utilisation plus élevée du GPU. Pour les charges de travail limitées par la bande passante mémoire (indiquées par une valeur élevée de |
|
nvidia_gpu_allocated_num_devices |
Nombre de périphériques GPU alloués. Avertissement : cette métrique est obsolète. |
|
nvidia_gpu_memory_allocated_bytes |
Mémoire GPU totale allouée. Avertissement : cette métrique est obsolète et remplacée par |
|
nvidia_gpu_sharing_memory |
Mémoire allouée pour le partage GPU. Avertissement : cette métrique est obsolète et remplacée par |
|
up |
Indique si la cible de collecte est saine. Une valeur de 1 signifie que la cible est active et accessible, tandis que 0 indique qu'elle est inactive. |
Cost-Exporter (Nom de la tâche : alibaba-cloud-cost-exporter)
|
Métrique |
Description |
|
deducted_by_cash_coupons |
Déduction par coupons sur la facture d'une instance. |
|
deducted_by_prepaid_card |
Déduction par carte prépayée sur la facture d'une instance. |
|
invoice_discount |
Réduction sur la facture d'une instance. |
|
list_price |
Prix catalogue de l'instance. |
|
node_current_price |
Prix actuel du nœud. |
|
node_payAsYouGo_price |
Prix paiement à l'utilisation pour le nœud. |
|
node_payByPeriod_price |
Prix abonnement pour le nœud. |
|
node_spot_price |
Prix équivalent Spot Instance pour le nœud. |
|
outstanding_amount |
Montant impayé sur la facture de l'instance. |
|
payent_amount |
Paiement en espèces sur la facture de l'instance. |
|
pretax_amount |
Montant hors taxes sur la facture de l'instance. |
|
pretax_gross_amount |
Montant brut hors taxes sur la facture de l'instance. |
|
usage |
Utilisation des ressources pour l'instance. |
|
up |
Indique si la cible est saine. 1 signifie que la cible est active et accessible ; 0 signifie qu'elle est inactive. |
Ingress (Nom de la tâche : arms-ack-ingress, ingress-ask-default)
|
Métrique |
Description |
|
aliyun_prometheus_agent_append_duration_seconds |
Durée des opérations d'ajout pour l'agent Alibaba Cloud Prometheus, en secondes. |
|
aliyun_prometheus_agent_job_discovery_status |
Statut de découverte des tâches de collecte pour l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrape_custom_error |
Nombre d'erreurs de collecte personnalisées pour l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Nombre total de collectes par cible pour l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_target_info |
Informations sur les cibles de l'agent Alibaba Cloud Prometheus. |
|
nginx_ingress_controller_admission_config_size |
Taille de la configuration d'admission. |
|
nginx_ingress_controller_admission_render_duration |
Durée du processus de rendu d'admission. |
|
nginx_ingress_controller_admission_render_ingresses |
Nombre de ressources ingress rendues pour l'admission. |
|
nginx_ingress_controller_admission_roundtrip_duration |
Durée du traitement aller-retour d'admission. |
|
nginx_ingress_controller_admission_tested_duration |
Durée du test d'admission. |
|
nginx_ingress_controller_admission_tested_ingresses |
Nombre de ressources ingress testées pour l'admission. |
|
nginx_ingress_controller_build_info |
Informations de build. |
|
nginx_ingress_controller_bytes_sent_bucket |
Distribution des octets envoyés. |
|
nginx_ingress_controller_bytes_sent_count |
Nombre total d'observations d'octets envoyés. |
|
nginx_ingress_controller_bytes_sent_sum |
Total des octets envoyés. |
|
nginx_ingress_controller_check_errors |
Total des erreurs de vérification. |
|
nginx_ingress_controller_check_success |
Total des vérifications réussies. |
|
nginx_ingress_controller_config_hash |
Hachage de la configuration en cours d'exécution. |
|
nginx_ingress_controller_config_last_reload_successful |
Indique si le dernier rechargement de la configuration a réussi (1 pour succès, 0 pour échec). |
|
nginx_ingress_controller_config_last_reload_successful_timestamp_seconds |
Horodatage du dernier rechargement de configuration réussi, en secondes. |
|
nginx_ingress_controller_connect_duration_seconds_bucket |
Distribution du temps d'établissement de connexion, en secondes. |
|
nginx_ingress_controller_connect_duration_seconds_count |
Nombre total d'observations du temps d'établissement de connexion. |
|
nginx_ingress_controller_connect_duration_seconds_sum |
Temps total d'établissement de connexion, en secondes. |
|
nginx_ingress_controller_errors |
Total des erreurs. |
|
nginx_ingress_controller_header_duration_seconds_bucket |
Distribution du temps de traitement des en-têtes, en secondes. |
|
nginx_ingress_controller_header_duration_seconds_count |
Nombre total d'observations du temps de traitement des en-têtes. |
|
nginx_ingress_controller_header_duration_seconds_sum |
Temps total de traitement des en-têtes, en secondes. |
|
nginx_ingress_controller_ingress_upstream_latency_seconds |
Distribution de la latence amont, en secondes. |
|
nginx_ingress_controller_ingress_upstream_latency_seconds_count |
Nombre total d'observations de la latence amont. |
|
nginx_ingress_controller_ingress_upstream_latency_seconds_sum |
Latence amont totale, en secondes. |
|
nginx_ingress_controller_leader_election_status |
Statut actuel du processus d'élection du leader. |
|
nginx_ingress_controller_nginx_process_connections |
Nombre actuel de connexions pour le processus nginx. |
|
nginx_ingress_controller_nginx_process_connections_total |
Nombre total de connexions pour le processus nginx. |
|
nginx_ingress_controller_nginx_process_cpu_seconds_total |
Temps CPU total utilisé par le processus nginx, en secondes. |
|
nginx_ingress_controller_nginx_process_num_procs |
Nombre de processus nginx. |
|
nginx_ingress_controller_nginx_process_oldest_start_time_seconds |
Heure de démarrage du processus nginx le plus ancien, en secondes. |
|
nginx_ingress_controller_nginx_process_read_bytes_total |
Nombre total d'octets lus par le processus nginx. |
|
nginx_ingress_controller_nginx_process_requests_total |
Nombre total de requêtes traitées par le processus nginx. |
|
nginx_ingress_controller_nginx_process_resident_memory_bytes |
Taille de la mémoire résidente du processus nginx, en octets. |
|
nginx_ingress_controller_nginx_process_virtual_memory_bytes |
Taille de la mémoire virtuelle du processus nginx, en octets. |
|
nginx_ingress_controller_nginx_process_write_bytes_total |
Nombre total d'octets écrits par le processus nginx. |
|
nginx_ingress_controller_orphan_ingress |
Nombre actuel de ressources ingress orphelines. |
|
nginx_ingress_controller_request_duration_seconds_bucket |
Distribution de la durée des requêtes, en secondes. |
|
nginx_ingress_controller_request_duration_seconds_count |
Nombre total d'observations de la durée des requêtes. |
|
nginx_ingress_controller_request_duration_seconds_sum |
Durée totale des requêtes, en secondes. |
|
nginx_ingress_controller_request_size_bucket |
Distribution des tailles de requête. |
|
nginx_ingress_controller_request_size_count |
Nombre total d'observations de la taille des requêtes. |
|
nginx_ingress_controller_request_size_sum |
Taille totale des requêtes. |
|
nginx_ingress_controller_requests |
Nombre total de requêtes. |
|
nginx_ingress_controller_response_duration_seconds_bucket |
Distribution de la durée des réponses, en secondes. |
|
nginx_ingress_controller_response_duration_seconds_count |
Nombre total d'observations de la durée des réponses. |
|
nginx_ingress_controller_response_duration_seconds_sum |
Durée totale des réponses, en secondes. |
|
nginx_ingress_controller_response_size_bucket |
Distribution des tailles de réponse. |
|
nginx_ingress_controller_response_size_count |
Nombre total d'observations de la taille des réponses. |
|
nginx_ingress_controller_response_size_sum |
Taille totale des réponses. |
|
nginx_ingress_controller_ssl_certificate_info |
Informations sur le certificat SSL. |
|
nginx_ingress_controller_ssl_expire_time_seconds |
Date d'expiration du certificat SSL, en secondes. |
|
nginx_ingress_controller_success |
Total des opérations réussies. |
|
up |
Indique si une cible est saine. Une valeur de 1 signifie que la cible est active et accessible ; 0 signifie qu'elle est inactive. |
Koordinator (nom de la tâche : kube-system/koordlet-metrics-podmonitor, koord-manager-metrics-service)
|
Métrique |
Description |
|
aliyun_prometheus_agent_append_duration_seconds |
Durée des opérations d'ajout pour l'agent Alibaba Cloud Prometheus (secondes). |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Nombre total de collectes effectuées par l'agent Alibaba Cloud Prometheus, ventilé par cible. |
|
aliyun_prometheus_agent_target_info |
Informations sur la cible pour l'agent Alibaba Cloud Prometheus. |
|
koord_manager_recommender_recommendation_workload_target |
Spécifications de ressources recommandées pour une charge de travail, générées par la fonctionnalité de profilage des ressources. |
|
koordlet_container_resource_limits |
Limite de ressources pour un conteneur. |
|
koordlet_container_resource_requests |
Demande de ressources pour un conteneur. |
|
koordlet_node_priority_resource_reclaimable |
Quantité de ressources récupérables sur un nœud, catégorisée par priorité. |
|
koordlet_node_resource_allocatable |
Ressources allouables sur un nœud. |
|
slo_manager_recommender_recommendation_workload_target |
Spécifications de ressources recommandées pour une charge de travail, générées par la fonctionnalité de profilage des ressources. (obsolète) |
|
up |
Indique l'état de santé de la cible. 1 signifie que la cible est active et accessible ; 0 signifie qu'elle est inactive. |
Composant etcd dédié ACK (Nom de la tâche : etcd)
|
Métrique |
Description |
|
aliyun_prometheus_agent_append_duration_seconds |
Durée des opérations d'ajout pour l'agent Alibaba Cloud Prometheus, en secondes. |
|
aliyun_prometheus_agent_job_discovery_status |
Statut de découverte des tâches de collecte pour l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrape_custom_error |
Nombre total d'erreurs de collecte personnalisées provenant de l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Nombre total de collectes par cible pour l'agent Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_target_info |
Informations sur les cibles de l'agent Alibaba Cloud Prometheus. |
|
cpu_utilization_core |
Utilisation du CPU en cœurs. |
|
etcd_cluster_version |
Version du cluster etcd. |
|
etcd_debugging_auth_revision |
Révision du magasin d'authentification etcd à des fins de débogage. |
|
etcd_debugging_disk_backend_commit_rebalance_duration_seconds_bucket |
Distribution de la latence du rééquilibrage des validations du backend disque à des fins de débogage (en secondes). |
|
etcd_debugging_disk_backend_commit_rebalance_duration_seconds_count |
Nombre total d'opérations de rééquilibrage des validations du backend disque à des fins de débogage. |
|
etcd_debugging_disk_backend_commit_rebalance_duration_seconds_sum |
Durée totale des opérations de rééquilibrage des validations du backend disque à des fins de débogage (en secondes). |
|
etcd_debugging_disk_backend_commit_spill_duration_seconds_bucket |
Distribution de la latence du débordement des validations du backend disque à des fins de débogage (en secondes). |
|
etcd_debugging_disk_backend_commit_spill_duration_seconds_count |
Nombre total d'opérations de débordement des validations du backend disque à des fins de débogage. |
|
etcd_debugging_disk_backend_commit_spill_duration_seconds_sum |
Durée totale des opérations de débordement des validations du backend disque à des fins de débogage (en secondes). |
|
etcd_debugging_disk_backend_commit_write_duration_seconds_bucket |
Distribution de la latence des opérations d'écriture des validations du backend disque à des fins de débogage (en secondes). |
|
etcd_debugging_disk_backend_commit_write_duration_seconds_count |
Nombre total d'opérations d'écriture des validations du backend disque à des fins de débogage. |
|
etcd_debugging_disk_backend_commit_write_duration_seconds_sum |
Durée totale des opérations d'écriture des validations du backend disque à des fins de débogage (en secondes). |
|
etcd_debugging_lease_granted_total |
Nombre total de baux accordés à des fins de débogage. |
|
etcd_debugging_lease_renewed_total |
Nombre total de baux renouvelés à des fins de débogage. |
|
etcd_debugging_lease_revoked_total |
Nombre total de baux révoqués à des fins de débogage. |
|
etcd_debugging_lease_ttl_total_bucket |
Distribution de la durée de vie (TTL) des baux à des fins de débogage (en secondes). |
|
etcd_debugging_lease_ttl_total_count |
Nombre total de TTL de baux à des fins de débogage. |
|
etcd_debugging_lease_ttl_total_sum |
Durée totale des TTL de baux à des fins de débogage (en secondes). |
|
etcd_debugging_mvcc_compact_revision |
Révision de la dernière compaction MVCC à des fins de débogage. |
|
etcd_debugging_mvcc_current_revision |
Révision actuelle du magasin MVCC à des fins de débogage. |
|
etcd_debugging_mvcc_db_compaction_keys_total |
Nombre total de clés compactées dans la base de données MVCC à des fins de débogage. |
|
etcd_debugging_mvcc_db_compaction_last |
Horodatage de la dernière compaction de la base de données MVCC à des fins de débogage. |
|
etcd_debugging_mvcc_db_compaction_pause_duration_milliseconds_bucket |
Distribution de la latence des pauses de compaction de la base de données MVCC à des fins de débogage (en millisecondes). |
|
etcd_debugging_mvcc_db_compaction_pause_duration_milliseconds_count |
Nombre total de pauses de compaction de la base de données MVCC à des fins de débogage. |
|
etcd_debugging_mvcc_db_compaction_pause_duration_milliseconds_sum |
Durée totale des pauses de compaction de la base de données MVCC à des fins de débogage (en millisecondes). |
|
etcd_debugging_mvcc_db_compaction_total_duration_milliseconds_bucket |
Distribution de la latence des compactations de la base de données MVCC à des fins de débogage (en millisecondes). |
|
etcd_debugging_mvcc_db_compaction_total_duration_milliseconds_count |
Nombre total d'opérations de compaction de la base de données MVCC à des fins de débogage. |
|
etcd_debugging_mvcc_db_compaction_total_duration_milliseconds_sum |
Durée totale des opérations de compaction de la base de données MVCC à des fins de débogage (en millisecondes). |
|
etcd_debugging_mvcc_db_total_size_in_bytes |
Taille totale de la base de données MVCC à des fins de débogage (en octets). |
|
etcd_debugging_mvcc_delete_total |
Nombre total d'opérations de suppression MVCC à des fins de débogage. |
|
etcd_debugging_mvcc_events_total |
Nombre total d'événements MVCC à des fins de débogage. |
|
etcd_debugging_mvcc_index_compaction_pause_duration_milliseconds_bucket |
Distribution de la latence des pauses de compaction d'index MVCC à des fins de débogage (en millisecondes). |
|
etcd_debugging_mvcc_index_compaction_pause_duration_milliseconds_count |
Nombre total de pauses de compaction d'index MVCC à des fins de débogage. |
|
etcd_debugging_mvcc_index_compaction_pause_duration_milliseconds_sum |
Durée totale des pauses de compaction d'index MVCC à des fins de débogage (en millisecondes). |
|
etcd_debugging_mvcc_keys_total |
Nombre total de clés dans le magasin MVCC à des fins de débogage. |
|
etcd_debugging_mvcc_pending_events_total |
Nombre total d'événements MVCC en attente à des fins de débogage. |
|
etcd_debugging_mvcc_put_total |
Nombre total d'opérations d'écriture (put) MVCC à des fins de débogage. |
|
etcd_debugging_mvcc_range_total |
Nombre total de requêtes de plage MVCC à des fins de débogage. |
|
etcd_debugging_mvcc_slow_watcher_total |
Nombre total d'observateurs lents dans le magasin MVCC à des fins de débogage. |
|
etcd_debugging_mvcc_total_put_size_in_bytes |
Taille totale de toutes les opérations d'écriture (put) MVCC à des fins de débogage (en octets). |
|
etcd_debugging_mvcc_txn_total |
Nombre total de transactions MVCC à des fins de débogage. |
|
etcd_debugging_mvcc_watch_stream_total |
Nombre total de flux d'observation MVCC à des fins de débogage. |
|
etcd_debugging_mvcc_watcher_total |
Nombre total d'observateurs dans le magasin MVCC à des fins de débogage. |
|
etcd_debugging_server_lease_expired_total |
Nombre total de baux serveur expirés à des fins de débogage. |
|
etcd_debugging_snap_save_marshalling_duration_seconds_bucket |
Distribution de la latence des opérations de sérialisation lors de la sauvegarde des snapshots à des fins de débogage (en secondes). |
|
etcd_debugging_snap_save_marshalling_duration_seconds_count |
Nombre total d'opérations de sérialisation lors de la sauvegarde des snapshots à des fins de débogage. |
|
etcd_debugging_snap_save_marshalling_duration_seconds_sum |
Durée totale des opérations de sérialisation lors de la sauvegarde des snapshots à des fins de débogage (en secondes). |
|
etcd_debugging_snap_save_total_duration_seconds_bucket |
Distribution de la latence des opérations de sauvegarde des snapshots à des fins de débogage (en secondes). |
|
etcd_debugging_snap_save_total_duration_seconds_count |
Nombre total d'opérations de sauvegarde des snapshots à des fins de débogage. |
|
etcd_debugging_snap_save_total_duration_seconds_sum |
Durée totale des opérations de sauvegarde des snapshots à des fins de débogage (en secondes). |
|
etcd_debugging_store_expires_total |
Nombre total de clés expirées dans le magasin à des fins de débogage. |
|
etcd_debugging_store_reads_total |
Nombre total d'opérations de lecture sur le magasin à des fins de débogage. |
|
etcd_debugging_store_watch_requests_total |
Nombre total de requêtes d'observation sur le magasin à des fins de débogage. |
|
etcd_debugging_store_watchers |
Nombre d'observateurs sur le magasin à des fins de débogage. |
|
etcd_debugging_store_writes_total |
Nombre total d'opérations d'écriture sur le magasin à des fins de débogage. |
|
etcd_disk_backend_commit_duration_seconds_bucket |
Distribution de la latence des validations du backend disque (en secondes). |
|
etcd_disk_backend_commit_duration_seconds_count |
Nombre total d'opérations de validation du backend disque. |
|
etcd_disk_backend_commit_duration_seconds_sum |
Durée totale des opérations de validation du backend disque (en secondes). |
|
etcd_disk_backend_defrag_duration_seconds_bucket |
Distribution de la latence de la défragmentation du backend disque (en secondes). |
|
etcd_disk_backend_defrag_duration_seconds_count |
Nombre total d'opérations de défragmentation du backend disque. |
|
etcd_disk_backend_defrag_duration_seconds_sum |
Durée totale des opérations de défragmentation du backend disque (en secondes). |
|
etcd_disk_backend_snapshot_duration_seconds_bucket |
Distribution de la latence des snapshots du backend disque (en secondes). |
|
etcd_disk_backend_snapshot_duration_seconds_count |
Nombre total d'opérations de snapshot du backend disque. |
|
etcd_disk_backend_snapshot_duration_seconds_sum |
Durée totale des opérations de snapshot du backend disque (en secondes). |
|
etcd_disk_defrag_inflight |
Nombre d'opérations de défragmentation disque en cours. |
|
etcd_disk_wal_fsync_duration_seconds_bucket |
Distribution de la latence des synchronisations WAL (fsync) (en secondes). |
|
etcd_disk_wal_fsync_duration_seconds_count |
Nombre total d'opérations de synchronisation WAL (fsync). |
|
etcd_disk_wal_fsync_duration_seconds_sum |
Durée totale des opérations de synchronisation WAL (fsync) (en secondes). |
|
etcd_disk_wal_write_bytes_total |
Nombre total d'octets écrits dans le WAL. |
|
etcd_grpc_proxy_cache_hits_total |
Nombre total d'accès au cache dans le proxy gRPC. |
|
etcd_grpc_proxy_cache_keys_total |
Nombre total de clés dans le cache du proxy gRPC. |
|
etcd_grpc_proxy_cache_misses_total |
Nombre total d'échecs d'accès au cache dans le proxy gRPC. |
|
etcd_grpc_proxy_events_coalescing_total |
Nombre total d'événements fusionnés dans le proxy gRPC. |
|
etcd_grpc_proxy_watchers_coalescing_total |
Nombre total d'observateurs fusionnés dans le proxy gRPC. |
|
etcd_mvcc_db_open_read_transactions |
Nombre de transactions de lecture ouvertes dans la base de données MVCC. |
|
etcd_mvcc_db_total_size_in_bytes |
Taille totale de la base de données MVCC sur le disque (en octets). |
|
etcd_mvcc_db_total_size_in_use_in_bytes |
Taille réelle de la base de données MVCC utilisée (en octets). |
|
etcd_mvcc_delete_total |
Nombre total d'opérations de suppression MVCC. |
|
etcd_mvcc_hash_duration_seconds_bucket |
Distribution de la latence des opérations de hachage MVCC (en secondes). |
|
etcd_mvcc_hash_duration_seconds_count |
Nombre total d'opérations de hachage MVCC. |
|
etcd_mvcc_hash_duration_seconds_sum |
Durée totale des opérations de hachage MVCC (en secondes). |
|
etcd_mvcc_hash_rev_duration_seconds_bucket |
Distribution de la latence des opérations de hachage de révision MVCC (en secondes). |
|
etcd_mvcc_hash_rev_duration_seconds_count |
Nombre total d'opérations de hachage de révision MVCC. |
|
etcd_mvcc_hash_rev_duration_seconds_sum |
Durée totale des opérations de hachage de révision MVCC (en secondes). |
|
etcd_mvcc_put_total |
Nombre total d'opérations d'écriture (put) MVCC. |
|
etcd_mvcc_range_total |
Nombre total de requêtes de plage MVCC. |
|
etcd_mvcc_txn_total |
Nombre total de transactions MVCC. |
|
etcd_network_active_peers |
Nombre de pairs actifs. |
|
etcd_network_client_grpc_received_bytes_total |
Nombre total d'octets reçus des clients via gRPC. |
|
etcd_network_client_grpc_sent_bytes_total |
Nombre total d'octets envoyés aux clients via gRPC. |
|
etcd_network_disconnected_peers_total |
Nombre total de pairs déconnectés. |
|
etcd_network_peer_received_bytes_total |
Nombre total d'octets reçus des pairs. |
|
etcd_network_peer_received_failures_total |
Nombre total d'échecs de réception depuis les pairs. |
|
etcd_network_peer_round_trip_time_seconds_bucket |
Distribution de la latence du temps aller-retour des pairs (en secondes). |
|
etcd_network_peer_round_trip_time_seconds_count |
Nombre total de mesures du temps aller-retour des pairs. |
|
etcd_network_peer_round_trip_time_seconds_sum |
Durée totale des temps aller-retour des pairs (en secondes). |
|
etcd_network_peer_sent_bytes_total |
Nombre total d'octets envoyés aux pairs. |
|
etcd_network_peer_sent_failures_total |
Nombre total d'échecs d'envoi vers les pairs. |
|
etcd_network_server_stream_failures_total |
Nombre total d'échecs de flux serveur. |
|
etcd_network_snapshot_receive_inflights_total |
Nombre de snapshots en cours de réception. |
|
etcd_network_snapshot_receive_success |
Nombre total de réceptions de snapshots réussies. |
|
etcd_network_snapshot_receive_total_duration_seconds_bucket |
Distribution de la latence des réceptions de snapshots (en secondes). |
|
etcd_network_snapshot_receive_total_duration_seconds_count |
Nombre total d'opérations de réception de snapshots. |
|
etcd_network_snapshot_receive_total_duration_seconds_sum |
Durée totale des opérations de réception de snapshots (en secondes). |
|
etcd_network_snapshot_send_inflights_total |
Nombre de snapshots en cours d'envoi. |
|
etcd_network_snapshot_send_success |
Nombre total d'envois de snapshots réussis. |
|
etcd_network_snapshot_send_total_duration_seconds_bucket |
Distribution de la latence des envois de snapshots (en secondes). |
|
etcd_network_snapshot_send_total_duration_seconds_count |
Nombre total d'opérations d'envoi de snapshots. |
|
etcd_network_snapshot_send_total_duration_seconds_sum |
Durée totale des opérations d'envoi de snapshots (en secondes). |
|
etcd_server_apply_duration_seconds_bucket |
Distribution de la latence des opérations d'application serveur (en secondes). |
|
etcd_server_apply_duration_seconds_count |
Nombre total d'opérations d'application serveur. |
|
etcd_server_apply_duration_seconds_sum |
Durée totale des opérations d'application serveur (en secondes). |
|
etcd_server_client_requests_total |
Nombre total de requêtes client adressées au serveur. |
|
etcd_server_go_version |
Version Go du serveur etcd. |
|
etcd_server_has_leader |
Indique si ce serveur considère qu'un leader existe (1 pour oui, 0 pour non). |
|
etcd_server_health_failures |
Nombre total d'échecs des contrôles de santé. |
|
etcd_server_health_success |
Nombre total de contrôles de santé réussis. |
|
etcd_server_heartbeat_send_failures_total |
Nombre total d'échecs d'envoi des signaux heartbeat. |
|
etcd_server_id |
ID du serveur. |
|
etcd_server_is_leader |
Indique si ce serveur est le leader (1 pour oui, 0 pour non). |
|
etcd_server_is_learner |
Indique si ce serveur est un apprenant (learner) (1 pour oui, 0 pour non). |
|
etcd_server_leader_changes_seen_total |
Nombre total de changements de leader observés par le serveur. |
|
etcd_server_learner_promote_successes |
Nombre total de promotions d'apprenants (learner) réussies. |
|
etcd_server_proposals_applied_total |
Nombre total de propositions appliquées par le serveur. |
|
etcd_server_proposals_committed_total |
Nombre total de propositions validées par le serveur. |
|
etcd_server_proposals_failed_total |
Nombre total de propositions échouées. |
|
etcd_server_proposals_pending |
Nombre de propositions en attente. |
|
etcd_server_quota_backend_bytes |
Quota de stockage backend du serveur (en octets). |
|
etcd_server_read_indexes_failed_total |
Nombre total d'échecs des index de lecture. |
|
etcd_server_slow_apply_total |
Nombre total d'opérations d'application lentes. |
|
etcd_server_slow_read_indexes_total |
Nombre total d'opérations d'index de lecture lentes. |
|
etcd_server_snapshot_apply_in_progress_total |
Nombre d'opérations d'application de snapshot en cours. |
|
etcd_server_version |
Version du serveur etcd. |
|
etcd_snap_db_fsync_duration_seconds_bucket |
Distribution de la latence des synchronisations (fsync) de la base de données de snapshot (en secondes). |
|
etcd_snap_db_fsync_duration_seconds_count |
Nombre total de synchronisations (fsync) de la base de données de snapshot. |
|
etcd_snap_db_fsync_duration_seconds_sum |
Durée totale des synchronisations (fsync) de la base de données de snapshot (en secondes). |
|
etcd_snap_db_save_total_duration_seconds_bucket |
Distribution de la latence des opérations de sauvegarde de la base de données de snapshot (en secondes). |
|
etcd_snap_db_save_total_duration_seconds_count |
Nombre total d'opérations de sauvegarde de la base de données de snapshot. |
|
etcd_snap_db_save_total_duration_seconds_sum |
Durée totale des opérations de sauvegarde de la base de données de snapshot (en secondes). |
|
etcd_snap_fsync_duration_seconds_bucket |
Distribution de la latence des synchronisations (fsync) de snapshot (en secondes). |
|
etcd_snap_fsync_duration_seconds_count |
Nombre total d'opérations de synchronisation (fsync) de snapshot. |
|
etcd_snap_fsync_duration_seconds_sum |
Durée totale des synchronisations (fsync) de snapshot (en secondes). |
|
grpc_server_handled_total |
Nombre total de RPC traitées par le serveur gRPC. |
|
grpc_server_msg_received_total |
Nombre total de messages reçus par le serveur gRPC. |
|
grpc_server_msg_sent_total |
Nombre total de messages envoyés par le serveur gRPC. |
|
grpc_server_started_total |
Nombre total de RPC démarrées sur le serveur gRPC. |
|
memory_utilization_byte |
Utilisation de la mémoire en octets. |
|
os_fd_limit |
Limite du système d'exploitation pour les descripteurs de fichiers. |
|
os_fd_used |
Nombre de descripteurs de fichiers utilisés. |
|
up |
Indique si la cible est saine et accessible : 1 pour actif, 0 pour inactif. |
Composant planificateur ACK Dedicated (job : ack-scheduler)
|
Métrique |
Description |
|
aggregator_discovery_aggregation_count_total |
Nombre total d'agrégations de découverte par l'agrégateur |
|
aliyun_prometheus_agent_append_duration_seconds |
Durée des opérations d'ajout pour l'agent Alibaba Cloud Prometheus, en secondes |
|
aliyun_prometheus_agent_job_discovery_status |
Statut de découverte des tâches de collecte pour l'agent Alibaba Cloud Prometheus |
|
aliyun_prometheus_agent_scrape_custom_error |
Nombre total d'erreurs de collecte personnalisées provenant de l'agent Alibaba Cloud Prometheus |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Nombre total de collectes effectuées par l'agent Alibaba Cloud Prometheus, par cible |
|
aliyun_prometheus_agent_target_info |
Informations sur les cibles de collecte pour l'agent Alibaba Cloud Prometheus |
|
apiserver_audit_event_total |
Nombre total d'événements d'audit de l'APIServer |
|
apiserver_audit_requests_rejected_total |
Nombre total de requêtes d'audit rejetées par l'APIServer |
|
apiserver_client_certificate_expiration_seconds_bucket |
Répartition de la durée de vie restante des certificats client de l'APIServer, en secondes |
|
apiserver_client_certificate_expiration_seconds_count |
Nombre de mesures d'expiration des certificats client de l'APIServer |
|
apiserver_client_certificate_expiration_seconds_sum |
Somme de la durée de vie restante des certificats client de l'APIServer, en secondes |
|
apiserver_delegated_authn_request_duration_seconds_bucket |
Répartition de la latence d'authentification déléguée pour l'APIServer, en secondes |
|
apiserver_delegated_authn_request_duration_seconds_count |
Nombre de mesures de latence d'authentification déléguée pour l'APIServer |
|
apiserver_delegated_authn_request_duration_seconds_sum |
Latence totale d'authentification déléguée pour l'APIServer, en secondes |
|
apiserver_delegated_authn_request_total |
Nombre total de requêtes d'authentification déléguée vers l'APIServer |
|
apiserver_delegated_authz_request_duration_seconds_bucket |
Répartition de la latence d'autorisation déléguée pour l'APIServer, en secondes |
|
apiserver_delegated_authz_request_duration_seconds_count |
Nombre de mesures de latence d'autorisation déléguée pour l'APIServer |
|
apiserver_delegated_authz_request_duration_seconds_sum |
Latence totale d'autorisation déléguée pour l'APIServer, en secondes |
|
apiserver_delegated_authz_request_total |
Nombre total de requêtes d'autorisation déléguée vers l'APIServer |
|
apiserver_encryption_config_controller_automatic_reload_failures_total |
Nombre total d'échecs de rechargement automatique de la configuration de chiffrement de l'APIServer |
|
apiserver_encryption_config_controller_automatic_reload_success_total |
Nombre total de rechargements automatiques réussis de la configuration de chiffrement de l'APIServer |
|
apiserver_envelope_encryption_dek_cache_fill_percent |
Pourcentage de remplissage du cache DEK pour le chiffrement sous enveloppe de l'APIServer |
|
apiserver_storage_data_key_generation_duration_seconds_bucket |
Répartition de la latence de génération des clés de données de stockage de l'APIServer, en secondes |
|
apiserver_storage_data_key_generation_duration_seconds_count |
Nombre total d'opérations de génération de clés de données de stockage de l'APIServer |
|
apiserver_storage_data_key_generation_duration_seconds_sum |
Latence totale de génération des clés de données de stockage de l'APIServer, en secondes |
|
apiserver_storage_data_key_generation_failures_total |
Nombre total d'échecs de génération de clés de données dans le stockage de l'APIServer |
|
apiserver_storage_envelope_transformation_cache_misses_total |
Nombre total d'échecs de cache pour les transformations sous enveloppe du stockage de l'APIServer |
|
apiserver_webhooks_x509_insecure_sha1_total |
Nombre total de webhooks de l'APIServer utilisant un certificat X.509 SHA-1 non sécurisé |
|
apiserver_webhooks_x509_missing_san_total |
Nombre total de webhooks de l'APIServer dont le certificat X.509 ne contient pas de SAN |
|
authenticated_user_requests |
Nombre total de requêtes provenant d'utilisateurs authentifiés |
|
authentication_attempts |
Nombre total de tentatives d'authentification |
|
authentication_duration_seconds_bucket |
Répartition de la latence d'authentification, en secondes |
|
authentication_duration_seconds_count |
Nombre de mesures de latence d'authentification |
|
authentication_duration_seconds_sum |
Latence totale d'authentification, en secondes |
|
authentication_token_cache_active_fetch_count |
Nombre de récupérations actives dans le cache de jetons d'authentification |
|
authentication_token_cache_fetch_total |
Nombre total de récupérations depuis le cache de jetons d'authentification |
|
authentication_token_cache_request_duration_seconds_bucket |
Répartition de la latence des requêtes au cache de jetons d'authentification, en secondes |
|
authentication_token_cache_request_duration_seconds_count |
Nombre de mesures de latence des requêtes au cache de jetons d'authentification |
|
authentication_token_cache_request_duration_seconds_sum |
Latence totale des requêtes au cache de jetons d'authentification, en secondes |
|
authentication_token_cache_request_total |
Nombre total de requêtes adressées au cache de jetons d'authentification |
|
authorization_attempts_total |
Nombre total de tentatives d'autorisation |
|
authorization_duration_seconds_bucket |
Répartition de la latence d'autorisation, en secondes |
|
authorization_duration_seconds_count |
Nombre de mesures de latence d'autorisation |
|
authorization_duration_seconds_sum |
Latence totale d'autorisation, en secondes |
|
cardinality_enforcement_unexpected_categorizations_total |
Nombre total de catégorisations inattendues lors de l'application de la cardinalité |
|
kubernetes_build_info |
Informations sur la version de Kubernetes |
|
kubernetes_feature_enabled |
Indique si une fonctionnalité Kubernetes spécifique est activée |
|
leader_election_master_status |
Indique si le composant est le leader actuel lors de l'élection du leader |
|
registered_metric_total |
Nombre total de métriques enregistrées |
|
registered_metrics_total |
Nombre total de métriques enregistrées |
|
rest_client_exec_plugin_certificate_rotation_age_bucket |
Répartition de l'âge des certificats renouvelés pour le plugin exec du client REST |
|
rest_client_exec_plugin_certificate_rotation_age_count |
Nombre de mesures de l'âge des certificats renouvelés pour le plugin exec du client REST |
|
rest_client_exec_plugin_certificate_rotation_age_sum |
Somme de l'âge des certificats renouvelés pour le plugin exec du client REST |
|
rest_client_rate_limiter_duration_seconds_bucket |
Répartition de la latence du limiteur de débit du client REST, en secondes |
|
rest_client_rate_limiter_duration_seconds_count |
Nombre de mesures de latence du limiteur de débit du client REST |
|
rest_client_rate_limiter_duration_seconds_sum |
Latence totale du limiteur de débit du client REST, en secondes |
|
rest_client_request_duration_seconds_bucket |
Répartition de la latence des requêtes du client REST, en secondes |
|
rest_client_request_duration_seconds_count |
Nombre de mesures de latence des requêtes du client REST |
|
rest_client_request_duration_seconds_sum |
Latence totale des requêtes du client REST, en secondes |
|
rest_client_request_retries_total |
Nombre total de nouvelles tentatives de requêtes du client REST |
|
rest_client_request_size_bytes_bucket |
Répartition de la taille des requêtes du client REST, en octets |
|
rest_client_request_size_bytes_count |
Nombre de mesures de la taille des requêtes du client REST |
|
rest_client_request_size_bytes_sum |
Somme de la taille des requêtes du client REST, en octets |
|
rest_client_requests_total |
Nombre total de requêtes du client REST |
|
rest_client_response_size_bytes_bucket |
Répartition de la taille des réponses du client REST, en octets |
|
rest_client_response_size_bytes_count |
Nombre de mesures de la taille des réponses du client REST |
|
rest_client_response_size_bytes_sum |
Somme de la taille des réponses du client REST, en octets |
|
rest_client_transport_cache_entries |
Nombre d'entrées dans le cache de transport du client REST |
|
rest_client_transport_create_calls_total |
Nombre total d'appels de création de transport pour le client REST |
|
scheduler_binding_duration_seconds_bucket |
Répartition de la latence de liaison par l'ordonnanceur, en secondes |
|
scheduler_binding_duration_seconds_count |
Nombre total d'opérations de liaison par l'ordonnanceur |
|
scheduler_binding_duration_seconds_sum |
Latence totale des opérations de liaison par l'ordonnanceur, en secondes |
|
scheduler_e2e_scheduling_duration_seconds_bucket |
Répartition de la latence d'ordonnancement de bout en bout, en secondes |
|
scheduler_e2e_scheduling_duration_seconds_count |
Nombre de mesures de latence d'ordonnancement de bout en bout |
|
scheduler_e2e_scheduling_duration_seconds_sum |
Latence totale d'ordonnancement de bout en bout, en secondes |
|
scheduler_framework_extension_point_duration_seconds_bucket |
Répartition de la latence des points d'extension du framework de l'ordonnanceur, en secondes |
|
scheduler_framework_extension_point_duration_seconds_count |
Nombre de mesures de latence des points d'extension du framework de l'ordonnanceur |
|
scheduler_framework_extension_point_duration_seconds_sum |
Latence totale des points d'extension du framework de l'ordonnanceur, en secondes |
|
scheduler_goroutines |
Nombre de goroutines de l'ordonnanceur |
|
scheduler_pending_pods |
Nombre de pods en attente dans la file d'attente de l'ordonnanceur |
|
scheduler_plugin_evaluation_total |
Nombre total d'évaluations des plugins de l'ordonnanceur |
|
scheduler_plugin_execution_duration_seconds_bucket |
Répartition de la latence d'exécution des plugins de l'ordonnanceur, en secondes |
|
scheduler_plugin_execution_duration_seconds_count |
Nombre de mesures de latence d'exécution des plugins de l'ordonnanceur |
|
scheduler_plugin_execution_duration_seconds_sum |
Latence totale d'exécution des plugins de l'ordonnanceur, en secondes |
|
scheduler_pod_preemption_victims_bucket |
Répartition du nombre de pods sélectionnés comme victimes de préemption |
|
scheduler_pod_preemption_victims_count |
Nombre de mesures des victimes de préemption |
|
scheduler_pod_preemption_victims_sum |
Nombre total de pods sélectionnés comme victimes de préemption |
|
scheduler_pod_scheduling_attempts_bucket |
Répartition du nombre de tentatives d'ordonnancement pour un pod |
|
scheduler_pod_scheduling_attempts_count |
Nombre de mesures des tentatives d'ordonnancement de pods |
|
scheduler_pod_scheduling_attempts_sum |
Nombre total de tentatives d'ordonnancement de pods |
|
scheduler_pod_scheduling_duration_seconds_bucket |
Répartition de la latence d'ordonnancement des pods, en secondes |
|
scheduler_pod_scheduling_duration_seconds_count |
Nombre de mesures de latence d'ordonnancement des pods |
|
scheduler_pod_scheduling_duration_seconds_sum |
Latence totale d'ordonnancement des pods, en secondes |
|
scheduler_pod_scheduling_sli_duration_seconds_bucket |
Répartition de la latence SLI d'ordonnancement des pods, en secondes |
|
scheduler_pod_scheduling_sli_duration_seconds_count |
Nombre de mesures de latence SLI d'ordonnancement des pods |
|
scheduler_pod_scheduling_sli_duration_seconds_sum |
Latence totale SLI d'ordonnancement des pods, en secondes |
|
scheduler_preemption_attempts_total |
Nombre total de tentatives de préemption par l'ordonnanceur |
|
scheduler_preemption_victims_bucket |
Répartition du nombre de pods sélectionnés comme victimes de préemption |
|
scheduler_preemption_victims_count |
Nombre de mesures des victimes de préemption |
|
scheduler_preemption_victims_sum |
Nombre total de pods sélectionnés comme victimes de préemption |
|
scheduler_queue_incoming_pods_total |
Nombre total de pods entrants dans la file d'attente de l'ordonnanceur |
|
scheduler_schedule_attempts_total |
Nombre total de tentatives d'ordonnancement par l'ordonnanceur |
|
scheduler_scheduler_cache_size |
Taille du cache de l'ordonnanceur |
|
scheduler_scheduler_goroutines |
Nombre de goroutines de l'ordonnanceur |
|
scheduler_scheduling_algorithm_duration_seconds_bucket |
Répartition de la latence de l'algorithme d'ordonnancement, en secondes |
|
scheduler_scheduling_algorithm_duration_seconds_count |
Nombre de mesures de latence de l'algorithme d'ordonnancement |
|
scheduler_scheduling_algorithm_duration_seconds_sum |
Latence totale de l'algorithme d'ordonnancement, en secondes |
|
scheduler_scheduling_algorithm_predicate_evaluation_seconds_bucket |
Répartition de la latence d'évaluation des prédicats de l'algorithme d'ordonnancement, en secondes |
|
scheduler_scheduling_algorithm_predicate_evaluation_seconds_count |
Nombre de mesures de latence d'évaluation des prédicats de l'algorithme d'ordonnancement |
|
scheduler_scheduling_algorithm_predicate_evaluation_seconds_sum |
Latence totale d'évaluation des prédicats de l'algorithme d'ordonnancement, en secondes |
|
scheduler_scheduling_algorithm_preemption_evaluation_seconds_bucket |
Répartition de la latence d'évaluation de la préemption de l'algorithme d'ordonnancement, en secondes |
|
scheduler_scheduling_algorithm_preemption_evaluation_seconds_count |
Nombre de mesures de latence d'évaluation de la préemption de l'algorithme d'ordonnancement |
|
scheduler_scheduling_algorithm_preemption_evaluation_seconds_sum |
Latence totale d'évaluation de la préemption de l'algorithme d'ordonnancement, en secondes |
|
scheduler_scheduling_algorithm_priority_evaluation_seconds_bucket |
Répartition de la latence d'évaluation des priorités de l'algorithme d'ordonnancement, en secondes |
|
scheduler_scheduling_algorithm_priority_evaluation_seconds_count |
Nombre de mesures de latence d'évaluation des priorités de l'algorithme d'ordonnancement |
|
scheduler_scheduling_algorithm_priority_evaluation_seconds_sum |
Latence totale d'évaluation des priorités de l'algorithme d'ordonnancement, en secondes |
|
scheduler_scheduling_attempt_duration_seconds_bucket |
Répartition de la latence des tentatives d'ordonnancement, en secondes |
|
scheduler_scheduling_attempt_duration_seconds_count |
Nombre de mesures de latence des tentatives d'ordonnancement |
|
scheduler_scheduling_attempt_duration_seconds_sum |
Latence totale des tentatives d'ordonnancement, en secondes |
|
scheduler_scheduling_duration_seconds |
Durée de l'opération d'ordonnancement, en secondes |
|
scheduler_scheduling_duration_seconds_count |
Nombre de mesures de latence d'ordonnancement |
|
scheduler_scheduling_duration_seconds_sum |
Latence totale d'ordonnancement, en secondes |
|
scheduler_total_preemption_attempts |
Nombre total de tentatives de préemption par l'ordonnanceur |
|
scheduler_unschedulable_pods |
Nombre de pods non ordonnançables dans la file d'attente de l'ordonnanceur |
|
scheduler_volume_scheduling_duration_seconds_bucket |
Répartition de la latence d'ordonnancement des volumes, en secondes |
|
scheduler_volume_scheduling_duration_seconds_count |
Nombre de mesures de latence d'ordonnancement des volumes |
|
scheduler_volume_scheduling_duration_seconds_sum |
Latence totale d'ordonnancement des volumes, en secondes |
|
scheduler_volume_scheduling_stage_error_total |
Nombre total d'erreurs lors de l'étape d'ordonnancement des volumes |
|
scrape_duration_seconds |
Durée de la collecte, en secondes |
|
scrape_samples_post_metric_relabeling |
Échantillons restants après le réétiquetage des métriques |
|
scrape_samples_scraped |
Nombre total d'échantillons collectés depuis la cible |
|
scrape_series_added |
Nouvelles séries ajoutées lors d'une collecte |
|
up |
Indique l'état de santé de la cible de collecte (1 pour actif, 0 pour inactif) |
|
workqueue_adds_total |
Nombre total d'éléments ajoutés à la file d'attente de travail |
|
workqueue_depth |
Profondeur actuelle de la file d'attente de travail |
|
workqueue_longest_running_processor_seconds |
Durée d'exécution du processeur de file d'attente de travail le plus long, en secondes |
|
workqueue_queue_duration_seconds_bucket |
Répartition du temps d'attente des éléments dans la file d'attente de travail avant traitement, en secondes |
|
workqueue_queue_duration_seconds_count |
Nombre de mesures de latence de la file d'attente de travail |
|
workqueue_queue_duration_seconds_sum |
Somme du temps d'attente des éléments dans la file d'attente de travail avant traitement, en secondes |
|
workqueue_retries_total |
Nombre total de nouvelles tentatives dans la file d'attente de travail |
|
workqueue_unfinished_work_seconds |
Âge de l'élément de travail inachevé le plus ancien dans la file d'attente de travail, en secondes |
|
workqueue_work_duration_seconds_bucket |
Répartition du temps consacré au traitement des éléments de la file d'attente de travail, en secondes |
|
workqueue_work_duration_seconds_count |
Nombre de mesures de latence de traitement de la file d'attente de travail |
|
workqueue_work_duration_seconds_sum |
Somme du temps consacré au traitement des éléments de la file d'attente de travail, en secondes |
Managed Service for Prometheus collecte un ensemble de métriques de base auprès des clusters de conteneurs. Ces métriques sont répertoriées ci-dessous.
-
Managed Service for Prometheus facture en fonction du volume d'écriture ou du nombre de points de données rapportés. Les métriques sont classées en deux catégories :
Métriques de base : Managed Service for Prometheus ne facture pas les métriques de base collectées auprès d'Alibaba Cloud Container Service, telles que ACK, ACS, ASK, ACK One et ACK Edge. Cet avantage ne s'applique pas aux autres types de clusters de conteneurs.
Métriques personnalisées : Toutes les autres métriques sont des métriques personnalisées. La facturation des métriques personnalisées a débuté le 6 janvier 2020.
À compter du 12 novembre 2024 à 00:00:00 (UTC+8), Managed Service for Prometheus ajustera la portée des métriques de base collectées auprès des clusters Alibaba Cloud Container Service.
Seules les métriques de base répertoriées ci-dessous sont collectées par défaut auprès des clusters de conteneurs.
Toute autre métrique de cluster de conteneurs est une métrique personnalisée et est facturée. Pour connaître les normes de facturation, consultez Facturation des instances Prometheus.
Références
Pour les métriques de surveillance des applications ARMS, consultez Métriques de surveillance des applications.