O Managed Service for Prometheus coleta um conjunto de métricas básicas de clusters de contêineres. Essas métricas estão listadas abaixo.
-
A cobrança do Managed Service for Prometheus é baseada no volume de gravação ou na quantidade de pontos de dados reportados. As métricas se dividem em dois tipos:
Métricas básicas: não há cobrança pelas métricas básicas coletadas do Alibaba Cloud Container Service, como ACK, ACS, ASK, ACK One e ACK Edge. Esse benefício não se aplica a outros tipos de clusters de contêineres.
Métricas personalizadas: todas as demais métricas são consideradas personalizadas. A cobrança por métricas personalizadas teve início em 6 de janeiro de 2020.
A partir das 00:00:00 de 12 de novembro de 2024 (UTC+8), o Managed Service for Prometheus ajustará o escopo das métricas básicas coletadas dos clusters do Alibaba Cloud Container Service.
Por padrão, apenas as métricas básicas listadas abaixo são coletadas dos clusters de contêineres.
Quaisquer outras métricas de cluster de contêineres são classificadas como personalizadas e estão sujeitas a cobrança. Para consultar os padrões de faturamento, veja Prometheus instance billing.
cAdvisor (Nome do job: _arms/kubelet/cadvisor)
|
Métrica |
Descrição |
|
container_cpu_usage_seconds_total |
Tempo total de CPU consumido pelo contêiner, em segundos. |
|
container_fs_usage_bytes |
Espaço do sistema de arquivos utilizado pelo contêiner, em bytes. |
|
container_memory_cache |
Quantidade de cache de memória usada pelo contêiner, em bytes. |
|
container_memory_usage_bytes |
Volume de memória utilizado pelo contêiner, em bytes. |
|
container_memory_working_set_bytes |
Conjunto de trabalho de memória do contêiner, em bytes. |
|
container_network_receive_bytes_total |
Total de bytes recebidos pelo contêiner via rede. |
|
container_network_transmit_bytes_total |
Total de bytes transmitidos pelo contêiner via rede. |
|
container_scrape_error |
Valor igual a 1 indica erro na coleta de métricas do contêiner. |
|
container_spec_memory_limit_bytes |
Limite de memória configurado para o contêiner, em bytes. |
|
container_spec_cpu_quota |
Cota de CPU CFS configurada para o contêiner. |
|
container_sockets |
Número de sockets de rede TCP/UDP ativos no contêiner. |
|
container_network_transmit_errors_total |
Total de erros de pacotes de transmissão (saída) na interface de rede do contêiner. |
|
container_network_receive_errors_total |
Total de erros de pacotes de recepção (entrada) na interface de rede do contêiner. |
|
container_memory_rss |
Tamanho do conjunto residente (RSS) do contêiner, em bytes. |
|
container_cpu_user_seconds_total |
Tempo total de CPU consumido pelo contêiner em modo de usuário, em segundos. |
|
container_cpu_system_seconds_total |
Tempo total de CPU consumido pelo contêiner em modo kernel, em segundos. |
|
DCGM_CUSTOM_CONTAINER_CP_ALLOCATED |
Proporção do poder de computação total da GPU alocada ao contêiner. O valor varia de 0 a 1. Se um contêiner solicitar apenas memória gráfica, esta métrica será 0, indicando que não há limite de poder de computação. Por exemplo, se uma GPU possui 100 unidades de poder de computação e 30 unidades são alocadas a um contêiner, a proporção alocada é 30/100 = 0,3. |
|
DCGM_CUSTOM_CONTAINER_MEM_ALLOCATED |
Memória gráfica alocada ao contêiner, em bytes. |
|
DCGM_CUSTOM_DEV_FB_ALLOCATED |
Proporção da memória gráfica alocada em relação à memória gráfica total da GPU. O valor varia de 0 a 1. |
|
DCGM_CUSTOM_DEV_FB_TOTAL |
Memória gráfica total da GPU, em bytes. |
|
DCGM_CUSTOM_DEV_HEALTH |
Status de integridade da GPU. |
|
DCGM_CUSTOM_PROCESS_DECODE_UTIL |
Utilização do decodificador para um processo da GPU. |
|
DCGM_CUSTOM_PROCESS_ENCODE_UTIL |
Utilização do codificador para um processo da GPU. |
|
DCGM_CUSTOM_PROCESS_MEM_COPY_UTIL |
Utilização de cópia de memória para um processo da GPU. |
|
DCGM_CUSTOM_PROCESS_MEM_USED |
Memória gráfica atualmente utilizada por um processo da GPU, em bytes. |
|
DCGM_CUSTOM_PROCESS_SM_UTIL |
Utilização de SM para um processo da GPU. |
|
DCGM_CUSTOM_PROF_MEM_BANDWIDTH_USED |
Largura de banda de memória gráfica utilizada. |
|
DCGM_CUSTOM_PROF_TENS_TFPS_USED |
Uso dos Tensor Cores da GPU. |
|
DCGM_FI_DEV_DEC_UTIL |
Utilização do decodificador da GPU. |
|
DCGM_FI_DEV_ENC_UTIL |
Utilização do codificador da GPU. |
|
DCGM_FI_DEV_FB_FREE |
Memória framebuffer livre, em bytes. |
|
DCGM_FI_DEV_FB_USED |
Memória framebuffer utilizada, em bytes. Este valor corresponde ao valor de memória usada em Memory-Usage relatado pelo comando |
|
DCGM_FI_DEV_GPU_TEMP |
Temperatura da GPU, em graus Celsius. |
|
DCGM_FI_DEV_GPU_UTIL |
Utilização da GPU, representando a porcentagem de tempo durante um período de amostragem (por exemplo, 1s ou 1/6s, dependendo do produto GPU) em que uma ou mais funções de kernel estiveram ativas. Esta métrica mostra que os recursos da GPU estão sendo usados por uma função de kernel, mas não detalha a intensidade desse uso. |
|
DCGM_FI_DEV_MEM_CLOCK |
Frequência de clock da memória, em MHz. |
|
DCGM_FI_DEV_MEM_COPY_UTIL |
Utilização da largura de banda de memória. Por exemplo, uma GPU NVIDIA V100 tem largura de banda máxima de memória de 900 GB/s. Se a largura de banda atual for 450 GB/s, a utilização será de 50%. |
|
DCGM_FI_DEV_POWER_USAGE |
Consumo de energia, em watts. |
|
DCGM_FI_DEV_SM_CLOCK |
Frequência de clock do SM, em MHz. |
|
DCGM_FI_DEV_TOTAL_ENERGY_CONSUMPTION |
Energia total consumida desde o carregamento do driver, em milijoules. |
|
DCGM_FI_DEV_XID_ERRORS |
Código do último erro XID ocorrido durante o período de amostragem. |
|
DCGM_FI_PROF_DRAM_ACTIVE |
Fração de ciclos durante os quais dados são enviados para ou recebidos da memória do dispositivo. Esta métrica representa a utilização da largura de banda de memória. Este valor é uma média ao longo de um intervalo de tempo, não um valor instantâneo. Um valor mais alto indica maior utilização da memória do dispositivo. O valor 1,0 (100%) significa que uma instrução DRAM foi executada a cada ciclo durante o intervalo. Na prática, o valor máximo alcançável é aproximadamente 0,8 (80%). Por exemplo, um valor de 0,2 (20%) significa que, em 20% dos ciclos do intervalo, houve leitura ou escrita na memória do dispositivo. |
|
DCGM_FI_PROF_NVLINK_RX_BYTES |
Taxa de recebimento de dados via NVLink, excluindo cabeçalhos de protocolo. Este valor é uma média ao longo de um intervalo de tempo, não um valor instantâneo. A taxa é calculada como média no intervalo. Por exemplo, transferir 1 GB de dados em 1 segundo resulta em uma taxa de 1 GB/s, independentemente de a transferência ter ocorrido a uma taxa constante ou em rajadas. A largura de banda máxima teórica para NVLink Gen2 é de 25 GB/s por link em cada direção. |
|
DCGM_FI_PROF_NVLINK_TX_BYTES |
Total de bytes transmitidos (enviados) via NVLink. |
|
DCGM_FI_PROF_PCIE_RX_BYTES |
Taxa de recebimento de dados via barramento PCIe, incluindo cabeçalhos de protocolo e carga útil de dados. Este valor é uma média ao longo de um intervalo de tempo, não um valor instantâneo. A taxa é calculada como média no intervalo. Por exemplo, transferir 1 GB de dados em 1 segundo resulta em uma taxa de 1 GB/s, independentemente de a transferência ter ocorrido a uma taxa constante ou em rajadas. A largura de banda máxima teórica para PCIe Gen3 é de 985 MB/s por pista. |
|
DCGM_FI_PROF_PCIE_TX_BYTES |
Taxa de transmissão de dados via barramento PCIe, incluindo cabeçalhos de protocolo e carga útil de dados. Este valor é uma média ao longo de um intervalo de tempo, não um valor instantâneo. A taxa é calculada como média no intervalo. Por exemplo, transferir 1 GB de dados em 1 segundo resulta em uma taxa de 1 GB/s, independentemente de a transferência ter ocorrido a uma taxa constante ou em rajadas. A largura de banda máxima teórica para PCIe Gen3 é de 985 MB/s por pista. |
|
DCGM_FI_PROF_PIPE_TENSOR_ACTIVE |
Fração de ciclos em que o pipeline Tensor (HMMA/IMMA) está ativo. Este valor é uma média ao longo de um intervalo de tempo, não um valor instantâneo. Valores mais altos indicam maior utilização dos Tensor Cores. O valor 1,0 (100%) significa que uma instrução Tensor foi emitida a cada dois ciclos, pois uma instrução leva dois ciclos para ser concluída. Um valor de 0,2 (20%) pode indicar qualquer um dos seguintes cenários: 20% dos SMs executaram seus Tensor Cores com 100% de utilização durante todo o intervalo. 100% dos SMs executaram seus Tensor Cores com 20% de utilização durante todo o intervalo. 100% dos SMs executaram seus Tensor Cores com 100% de utilização durante um quinto do intervalo. Outras combinações. |
|
DCGM_FI_PROF_SM_ACTIVE |
Porcentagem de tempo durante um intervalo em que pelo menos um warp esteve ativo em um multiprocessador de streaming (SM). Este valor é uma média entre todos os SMs e não é sensível ao número de threads por bloco. Um warp é considerado ativo se estiver agendado e seus recursos alocados, independentemente de estar computando ou em estado de não computação (por exemplo, aguardando uma solicitação de memória). Um valor abaixo de 0,5 indica utilização ineficiente da GPU, enquanto um valor acima de 0,8 é desejável. Para uma GPU com N SMs, considere estes exemplos: se uma função de kernel for executada com N blocos de threads em todos os SMs durante todo o intervalo, o valor será 1 (100%). Se uma função de kernel for executada com N/5 blocos de threads durante o intervalo, o valor será 0,2. Se uma função de kernel for executada com N blocos de threads, mas apenas durante um quinto do intervalo, o valor será 0,2. |
|
machine_cpu_cores |
Número de núcleos de CPU na máquina. |
|
node_exporter_build_info |
Informações de compilação do node exporter. |
|
nvidia_gpu_duty_cycle |
Porcentagem de tempo durante o último período de amostragem em que uma ou mais funções de kernel estavam sendo executadas na GPU. |
|
nvidia_gpu_memory_total_bytes |
Memória total da GPU NVIDIA, em bytes. |
|
nvidia_gpu_memory_used_bytes |
Memória utilizada na GPU NVIDIA, em bytes. |
|
nvidia_gpu_num_devices |
Número de dispositivos GPU NVIDIA. |
|
nvidia_gpu_power_usage_milliwatts |
Consumo de energia da GPU NVIDIA, em miliwatts. |
|
nvidia_gpu_temperature_celsius |
Temperatura da GPU NVIDIA, em graus Celsius. |
|
rdma_service_monitor_local_ack_timeout_err |
Número de erros de timeout na rede RDMA. |
|
rdma_service_monitor_out_of_seq |
Número de pacotes de dados fora de sequência na rede RDMA. |
|
rdma_service_monitor_packet_seq_err |
Número de erros de sequência de pacotes na rede RDMA durante a transmissão. |
|
rdma_service_monitor_rx_bytes |
Throughput de recepção da rede RDMA. |
|
rdma_service_monitor_rx_packets |
Número de pacotes recebidos pela rede RDMA. |
|
rdma_service_monitor_tx_bytes |
Throughput de transmissão da rede RDMA. |
|
rdma_service_monitor_tx_packets |
Número de pacotes transmitidos pela rede RDMA. |
|
up |
Valor igual a 1 significa que o alvo está ativo e acessível, enquanto 0 indica que está inativo. |
APIServer do plano de controle do ACK (Inclui componentes do plano de controle — APIServer, etcd, scheduler, KCM e CCM — para clusters ACK Pro, e apenas o APIServer para clusters dedicados do ACK) (nome do job: apiserver)
|
Métrica |
Descrição |
|
aggregator_discovery_aggregation_count_total |
Contagem total de agregações de descoberta realizadas pelo |
|
aggregator_openapi_v2_regeneration_count |
Número de vezes que o |
|
aggregator_openapi_v2_regeneration_duration |
Duração da regeneração da especificação OpenAPI v2 pelo |
|
aggregator_unavailable_apiservice |
Medidor de instâncias |
|
aggregator_unavailable_apiservice_count |
Quantidade de instâncias |
|
aggregator_unavailable_apiservice_total |
Total acumulado de instâncias |
|
aliyun_prometheus_agent_append_duration_seconds |
Duração das operações de append do |
|
aliyun_prometheus_agent_job_discovery_status |
Status de descoberta de jobs do |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Total de coletas por alvo realizadas pelo |
|
aliyun_prometheus_agent_target_info |
Informações sobre os alvos do |
|
apiextensions_apiserver_validation_ratcheting_seconds_bucket |
Histograma de latência do ratcheting de validação do |
|
apiextensions_apiserver_validation_ratcheting_seconds_count |
Total de observações no histograma de latência do ratcheting de validação do |
|
apiextensions_apiserver_validation_ratcheting_seconds_sum |
Soma total das durações no histograma de latência do ratcheting de validação do |
|
apiextensions_openapi_v2_regeneration_count |
Número de regenerações da especificação OpenAPI v2 do apiextensions. |
|
apiextensions_openapi_v3_regeneration_count |
Número de regenerações da especificação OpenAPI v3 do apiextensions. |
|
apiserver_accepted_listall_requests_total |
Total de requisições list-all aceitas pelo |
|
apiserver_admission_controller_admission_duration_seconds_bucket |
Histograma de latência do |
|
apiserver_admission_controller_admission_duration_seconds_count |
Total de observações no histograma de latência do |
|
apiserver_admission_controller_admission_duration_seconds_sum |
Soma total das durações no histograma de latência do |
|
apiserver_admission_step_admission_duration_seconds_bucket |
Histograma de latência para etapas individuais de admissão, em segundos. |
|
apiserver_admission_step_admission_duration_seconds_count |
Total de observações no histograma de latência da etapa de admissão. |
|
apiserver_admission_step_admission_duration_seconds_sum |
Soma total das durações no histograma de latência da etapa de admissão, em segundos. |
|
apiserver_admission_step_admission_duration_seconds_summary |
Resumo da latência das etapas individuais de admissão, em segundos. |
|
apiserver_admission_step_admission_duration_seconds_summary_count |
Total de observações no resumo de latência da etapa de admissão. |
|
apiserver_admission_step_admission_duration_seconds_summary_sum |
Soma total das durações no resumo de latência da etapa de admissão, em segundos. |
|
apiserver_admission_webhook_admission_duration_seconds_bucket |
Histograma de latência do |
|
apiserver_admission_webhook_admission_duration_seconds_count |
Total de observações no histograma de latência do |
|
apiserver_admission_webhook_admission_duration_seconds_sum |
Soma total das durações no histograma de latência do |
|
apiserver_admission_webhook_fail_open_count |
Número de vezes que um |
|
apiserver_admission_webhook_rejection_count |
Quantidade de rejeições efetuadas por |
|
apiserver_admission_webhook_request_total |
Total de requisições enviadas a |
|
apiserver_audit_error_total |
Total de erros de log de |
|
apiserver_audit_event_total |
Total de eventos de |
|
apiserver_audit_level_total |
Total de eventos de |
|
apiserver_audit_requests_rejected_total |
Total de requisições de |
|
apiserver_authorization_decisions_total |
Total de decisões de autorização tomadas pelo |
|
apiserver_cache_list_fetched_objects_total |
Total de objetos buscados na |
|
apiserver_cache_list_returned_objects_total |
Total de objetos retornados pela |
|
apiserver_cache_list_total |
Total de operações na |
|
apiserver_cacher_received_events |
Quantidade de eventos recebidos pelo cacher do |
|
apiserver_cacher_sended_events_latency_milliseconds_bucket |
Histograma de latência dos eventos enviados pelo cacher do |
|
apiserver_cacher_sended_events_latency_milliseconds_count |
Total de observações no histograma de latência de envio de eventos do cacher. |
|
apiserver_cacher_sended_events_latency_milliseconds_sum |
Soma total das durações no histograma de latência de envio de eventos do cacher, em milissegundos. |
|
apiserver_cacher_watcher_channel_length |
Tamanho do canal do |
|
apiserver_cel_compilation_duration_seconds_bucket |
Histograma de latência das compilações |
|
apiserver_cel_compilation_duration_seconds_count |
Total de compilações |
|
apiserver_cel_compilation_duration_seconds_sum |
Duração total de todas as compilações |
|
apiserver_cel_evaluation_duration_seconds_bucket |
Histograma de latência das avaliações |
|
apiserver_cel_evaluation_duration_seconds_count |
Contagem total de avaliações |
|
apiserver_cel_evaluation_duration_seconds_sum |
Duração total de todas as avaliações |
|
apiserver_client_certificate_expiration_seconds_bucket |
Histograma dos segundos restantes até a expiração do |
|
apiserver_client_certificate_expiration_seconds_count |
Total de observações no histograma de expiração do |
|
apiserver_client_certificate_expiration_seconds_sum |
Soma total dos segundos restantes no histograma de expiração do |
|
apiserver_clusterip_repair_ip_errors_total |
Total de erros relacionados a IP durante o reparo de |
|
apiserver_clusterip_repair_reconcile_errors_total |
Total de erros de reconciliação durante o reparo de |
|
apiserver_conversion_webhook_duration_seconds_bucket |
Histograma de latência das chamadas ao webhook de conversão do |
|
apiserver_conversion_webhook_duration_seconds_count |
Total de chamadas ao webhook de conversão do |
|
apiserver_conversion_webhook_duration_seconds_sum |
Duração total de todas as chamadas ao webhook de conversão do |
|
apiserver_conversion_webhook_request_total |
Total de requisições aos webhooks de conversão do |
|
apiserver_crd_conversion_webhook_duration_seconds_bucket |
Histograma de latência das chamadas ao webhook de conversão de |
|
apiserver_crd_conversion_webhook_duration_seconds_count |
Total de chamadas ao webhook de conversão de |
|
apiserver_crd_conversion_webhook_duration_seconds_sum |
Duração total de todas as chamadas ao webhook de conversão de |
|
apiserver_crd_webhook_conversion_duration_seconds_bucket |
Histograma de latência das conversões via webhook de |
|
apiserver_crd_webhook_conversion_duration_seconds_count |
Contagem total de conversões via webhook de |
|
apiserver_crd_webhook_conversion_duration_seconds_sum |
Duração total de todas as conversões via webhook de |
|
apiserver_created_watchers |
Quantidade de |
|
apiserver_current_inflight_requests |
Número atual de requisições em andamento no |
|
apiserver_current_inqueue_requests |
Número atual de requisições na fila do |
|
apiserver_dropped_requests_total |
Total de requisições descartadas pelo |
|
apiserver_encryption_config_controller_automatic_reload_failures_total |
Total de recarregamentos automáticos com falha no controlador de configuração de criptografia do |
|
apiserver_encryption_config_controller_automatic_reload_success_total |
Total de recarregamentos automáticos bem-sucedidos no controlador de configuração de criptografia do |
|
apiserver_envelope_encryption_dek_cache_fill_percent |
Percentual de preenchimento da |
|
apiserver_error_watchers |
Quantidade de |
|
apiserver_flowcontrol_current_executing_requests |
Número atual de requisições em execução sob o |
|
apiserver_flowcontrol_current_executing_seats |
Número atual de seats ocupados sob o |
|
apiserver_flowcontrol_current_inqueue_requests |
Número atual de requisições na fila sob o |
|
apiserver_flowcontrol_current_inqueue_seats |
Número atual de seats na fila sob o |
|
apiserver_flowcontrol_current_limit_seats |
Limite atual de seats para o |
|
apiserver_flowcontrol_current_r |
Valor R atual para o |
|
apiserver_flowcontrol_demand_seats_average |
Média da demanda de seats para o |
|
apiserver_flowcontrol_demand_seats_bucket |
Histograma da demanda de seats para o |
|
apiserver_flowcontrol_demand_seats_count |
Total de observações no histograma de demanda de seats. |
|
apiserver_flowcontrol_demand_seats_high_watermark |
Marca d'água alta da demanda de seats para o |
|
apiserver_flowcontrol_demand_seats_smoothed |
Valor suavizado da demanda de seats para o |
|
apiserver_flowcontrol_demand_seats_stdev |
Desvio padrão da demanda de seats para o |
|
apiserver_flowcontrol_demand_seats_sum |
Soma total das observações no histograma de demanda de seats. |
|
apiserver_flowcontrol_dispatch_r |
Valor R de despacho para o |
|
apiserver_flowcontrol_dispatched_requests_total |
Total de requisições despachadas sob o |
|
apiserver_flowcontrol_latest_s |
Último limite de valor S para o |
|
apiserver_flowcontrol_lower_limit_seats |
Limite inferior de seats para o |
|
apiserver_flowcontrol_next_discounted_s_bounds |
Próximo limite de valor S com desconto para o |
|
apiserver_flowcontrol_next_s_bounds |
Próximo limite de valor S para o |
|
apiserver_flowcontrol_nominal_limit_seats |
Limite nominal de seats para o |
|
apiserver_flowcontrol_priority_level_request_count_samples_bucket |
Histograma de amostras de contagem de requisições para cada nível de prioridade no |
|
apiserver_flowcontrol_priority_level_request_count_samples_count |
Total de observações no histograma de amostras de contagem de requisições por nível de prioridade. |
|
apiserver_flowcontrol_priority_level_request_count_samples_sum |
Soma total no histograma de amostras de contagem de requisições por nível de prioridade. |
|
apiserver_flowcontrol_priority_level_request_count_watermarks_bucket |
Histograma de marcas d'água de contagem de requisições para cada nível de prioridade no |
|
apiserver_flowcontrol_priority_level_request_count_watermarks_count |
Total de observações no histograma de marcas d'água de contagem de requisições por nível de prioridade. |
|
apiserver_flowcontrol_priority_level_request_count_watermarks_sum |
Soma total no histograma de marcas d'água de contagem de requisições por nível de prioridade. |
|
apiserver_flowcontrol_priority_level_request_utilization_bucket |
Histograma de utilização de requisições para cada nível de prioridade no |
|
apiserver_flowcontrol_priority_level_request_utilization_count |
Total de observações no histograma de utilização de requisições por nível de prioridade. |
|
apiserver_flowcontrol_priority_level_request_utilization_sum |
Soma total no histograma de utilização de requisições por nível de prioridade. |
|
apiserver_flowcontrol_priority_level_seat_count_samples_bucket |
Histograma de amostras de contagem de seats para cada nível de prioridade no |
|
apiserver_flowcontrol_priority_level_seat_count_samples_count |
Total de observações no histograma de amostras de contagem de seats por nível de prioridade. |
|
apiserver_flowcontrol_priority_level_seat_count_samples_sum |
Soma total no histograma de amostras de contagem de seats por nível de prioridade. |
|
apiserver_flowcontrol_priority_level_seat_count_watermarks_bucket |
Histograma de marcas d'água de contagem de seats para cada nível de prioridade no |
|
apiserver_flowcontrol_priority_level_seat_count_watermarks_count |
Total de observações no histograma de marcas d'água de contagem de seats por nível de prioridade. |
|
apiserver_flowcontrol_priority_level_seat_count_watermarks_sum |
Soma total no histograma de marcas d'água de contagem de seats por nível de prioridade. |
|
apiserver_flowcontrol_priority_level_seat_utilization_bucket |
Histograma de utilização de seats para cada nível de prioridade no |
|
apiserver_flowcontrol_priority_level_seat_utilization_count |
Total de observações no histograma de utilização de seats por nível de prioridade. |
|
apiserver_flowcontrol_priority_level_seat_utilization_sum |
Soma total no histograma de utilização de seats por nível de prioridade. |
|
apiserver_flowcontrol_read_vs_write_current_requests_bucket |
Histograma de requisições atuais de leitura versus escrita no |
|
apiserver_flowcontrol_read_vs_write_current_requests_count |
Total de observações no histograma de requisições atuais de leitura versus escrita. |
|
apiserver_flowcontrol_read_vs_write_current_requests_sum |
Soma total no histograma de requisições atuais de leitura versus escrita. |
|
apiserver_flowcontrol_read_vs_write_request_count_samples_bucket |
Histograma de amostras de contagem de requisições de leitura versus escrita no |
|
apiserver_flowcontrol_read_vs_write_request_count_samples_count |
Total de amostras no histograma de contagem de requisições de leitura versus escrita. |
|
apiserver_flowcontrol_read_vs_write_request_count_samples_sum |
Soma total no histograma de amostras de contagem de requisições de leitura versus escrita. |
|
apiserver_flowcontrol_read_vs_write_request_count_watermarks_bucket |
Histograma de marcas d'água de contagem de requisições de leitura versus escrita no |
|
apiserver_flowcontrol_read_vs_write_request_count_watermarks_count |
Total de amostras no histograma de marcas d'água de contagem de requisições de leitura versus escrita. |
|
apiserver_flowcontrol_read_vs_write_request_count_watermarks_sum |
Soma total no histograma de marcas d'água de contagem de requisições de leitura versus escrita. |
|
apiserver_flowcontrol_rejected_requests_total |
Total de requisições rejeitadas pelo |
|
apiserver_flowcontrol_request_concurrency_in_use |
Número de requisições simultâneas em uso pelo |
|
apiserver_flowcontrol_request_concurrency_limit |
Limite de concorrência para requisições no |
|
apiserver_flowcontrol_request_dispatch_no_accommodation_total |
Total de requisições que não puderam ser despachadas por falta de acomodação no |
|
apiserver_flowcontrol_request_execution_seconds_bucket |
Histograma de latência da execução de requisições no |
|
apiserver_flowcontrol_request_execution_seconds_count |
Total de observações no histograma de latência de execução de requisições. |
|
apiserver_flowcontrol_request_execution_seconds_sum |
Soma total das durações no histograma de latência de execução de requisições, em segundos. |
|
apiserver_flowcontrol_request_queue_length_after_enqueue_bucket |
Histograma do tamanho da fila após enfileiramento para requisições do |
|
apiserver_flowcontrol_request_queue_length_after_enqueue_count |
Total de observações no histograma de tamanho da fila de requisições. |
|
apiserver_flowcontrol_request_queue_length_after_enqueue_sum |
Soma total no histograma de tamanho da fila de requisições. |
|
apiserver_flowcontrol_request_wait_duration_seconds_bucket |
Histograma de latência do tempo de espera de requisições no |
|
apiserver_flowcontrol_request_wait_duration_seconds_count |
Total de observações no histograma de latência de espera de requisições. |
|
apiserver_flowcontrol_request_wait_duration_seconds_sum |
Soma total das durações no histograma de latência de espera de requisições, em segundos. |
|
apiserver_flowcontrol_seat_fair_frac |
Fração de compartilhamento justo determinada durante o último período de ajuste de empréstimo para o |
|
apiserver_flowcontrol_target_seats |
Contagem alvo de seats para o |
|
apiserver_flowcontrol_upper_limit_seats |
Limite superior de seats para o |
|
apiserver_flowcontrol_watch_count_samples_bucket |
Histograma de amostras de contagem de watch no |
|
apiserver_flowcontrol_watch_count_samples_count |
Total de observações no histograma de amostras de contagem de watch. |
|
apiserver_flowcontrol_watch_count_samples_sum |
Soma total no histograma de amostras de contagem de watch. |
|
apiserver_flowcontrol_work_estimated_seats_bucket |
Histograma de seats estimados de trabalho no |
|
apiserver_flowcontrol_work_estimated_seats_count |
Total de observações no histograma de seats estimados de trabalho. |
|
apiserver_flowcontrol_work_estimated_seats_sum |
Soma total no histograma de seats estimados de trabalho. |
|
apiserver_init_events_total |
Total de eventos de inicialização do |
|
apiserver_kube_aggregator_x509_insecure_sha1_total |
Total de requisições ao kube- |
|
apiserver_kube_aggregator_x509_missing_san_total |
Total de certificados X.509 com SAN ausente no kube- |
|
apiserver_longrunning_gauge |
Medidor de requisições de longa duração do |
|
apiserver_longrunning_requests |
Quantidade de requisições de longa duração do |
|
apiserver_nodeport_repair_reconcile_errors_total |
Total de erros de reconciliação durante o reparo de NodePort do |
|
apiserver_realtime_watchers |
Quantidade de |
|
apiserver_registered_watchers |
Quantidade de |
|
apiserver_request_aborts_total |
Total de requisições abortadas pelo |
|
apiserver_request_body_size_bytes_bucket |
Histograma dos tamanhos de corpo de requisição do |
|
apiserver_request_body_size_bytes_count |
Total de observações no histograma de tamanho do corpo de requisição. |
|
apiserver_request_body_size_bytes_sum |
Soma total no histograma de tamanho do corpo de requisição, em bytes. |
|
apiserver_request_count |
Quantidade de requisições ao |
|
apiserver_request_duration_seconds_bucket |
Histograma de latência das requisições do |
|
apiserver_request_duration_seconds_count |
Total de observações no histograma de latência de requisições. |
|
apiserver_request_duration_seconds_sum |
Soma total das durações no histograma de latência de requisições, em segundos. |
|
apiserver_request_filter_duration_seconds_bucket |
Histograma de latência dos filtros de requisição do |
|
apiserver_request_filter_duration_seconds_count |
Total de observações no histograma de latência do filtro de requisições. |
|
apiserver_request_filter_duration_seconds_sum |
Soma total das durações no histograma de latência do filtro de requisições, em segundos. |
|
apiserver_request_latencies_summary |
Resumo da distribuição de latência das requisições do |
|
apiserver_request_no_resourceversion_list_total |
Total de requisições LIST sem versão de recurso. |
|
apiserver_request_post_timeout_total |
Total de timeouts em requisições POST da API. |
|
apiserver_request_sli_duration_seconds_bucket |
Histograma de latência dos SLIs (Indicadores de Nível de Serviço) de requisições da API, em segundos. |
|
apiserver_request_sli_duration_seconds_count |
Total de observações no histograma de latência do SLI de requisições da API. |
|
apiserver_request_sli_duration_seconds_sum |
Soma total das durações no histograma de latência do SLI de requisições da API, em segundos. |
|
apiserver_request_slo_duration_seconds_bucket |
Histograma de latência dos SLOs (Objetivos de Nível de Serviço) de requisições da API, em segundos. |
|
apiserver_request_slo_duration_seconds_count |
Total de observações no histograma de latência do SLO de requisições da API. |
|
apiserver_request_slo_duration_seconds_sum |
Soma total das durações no histograma de latência do SLO de requisições da API, em segundos. |
|
apiserver_request_terminations_total |
Total de encerramentos de requisições da API. |
|
apiserver_request_timestamp_comparison_time_bucket |
Histograma dos tempos de comparação de timestamp de requisições da API. |
|
apiserver_request_timestamp_comparison_time_count |
Total de amostras no histograma de tempo de comparação de timestamp de requisições da API. |
|
apiserver_request_timestamp_comparison_time_sum |
Soma total no histograma de tempo de comparação de timestamp de requisições da API. |
|
apiserver_request_total |
Total de requisições da API. |
|
apiserver_requested_deprecated_apis |
Quantidade de requisições do |
|
apiserver_response_sizes_bucket |
Histograma dos tamanhos de resposta da API. |
|
apiserver_response_sizes_count |
Total de observações no histograma de tamanho de resposta da API. |
|
apiserver_response_sizes_sum |
Soma total no histograma de tamanho de resposta da API. |
|
apiserver_selfrequest_total |
Total de autorrequisições ao |
|
apiserver_storage_data_key_generation_duration_seconds_bucket |
Histograma de latência da geração de chaves de dados de armazenamento do |
|
apiserver_storage_data_key_generation_duration_seconds_count |
Total de observações no histograma de latência de geração de chaves de dados. |
|
apiserver_storage_data_key_generation_duration_seconds_sum |
Soma total das durações no histograma de latência de geração de chaves de dados, em segundos. |
|
apiserver_storage_data_key_generation_failures_total |
Total de falhas na geração de chaves de dados de armazenamento do |
|
apiserver_storage_db_total_size_in_bytes |
Tamanho total do banco de dados de armazenamento do |
|
apiserver_storage_decode_errors_total |
Total de erros de decodificação no armazenamento do |
|
apiserver_storage_envelope_transformation_cache_misses_total |
Total de faltas na |
|
apiserver_storage_events_received_total |
Total de eventos recebidos pelo armazenamento do |
|
apiserver_storage_list_evaluated_objects_total |
Total de objetos avaliados pelas operações de listagem do armazenamento do |
|
apiserver_storage_list_fetched_objects_total |
Total de objetos buscados nas operações de listagem do armazenamento do |
|
apiserver_storage_list_returned_objects_total |
Total de objetos retornados pelas operações de listagem do armazenamento do |
|
apiserver_storage_list_total |
Total de operações de listagem no armazenamento do |
|
apiserver_storage_objects |
Quantidade de objetos no armazenamento do |
|
apiserver_storage_size_bytes |
Tamanho do armazenamento do |
|
apiserver_terminated_watchers_total |
Total de |
|
apiserver_tls_handshake_errors_total |
Total de erros de handshake TLS no |
|
apiserver_too_large_resourceversion_errors |
Quantidade de requisições do |
|
apiserver_watch_cache_events_dispatched_total |
Total de eventos despachados pela |
|
apiserver_watch_cache_events_received_total |
Total de eventos recebidos pela |
|
apiserver_watch_cache_initializations_total |
Total de inicializações da |
|
apiserver_watch_cache_read_wait_seconds_bucket |
Histograma de latência de espera de leitura na |
|
apiserver_watch_cache_read_wait_seconds_count |
Total de observações no histograma de latência de espera de leitura da |
|
apiserver_watch_cache_read_wait_seconds_sum |
Soma total das durações no histograma de latência de espera de leitura da |
|
apiserver_watch_cache_watch_cache_initializations_total |
Total de inicializações da |
|
apiserver_watch_events_sizes_bucket |
Histograma dos tamanhos de eventos de watch do |
|
apiserver_watch_events_sizes_count |
Total de observações no histograma de tamanho de eventos de watch. |
|
apiserver_watch_events_sizes_sum |
Soma total no histograma de tamanho de eventos de watch. |
|
apiserver_watch_events_total |
Total de eventos de watch do |
|
apiserver_webhooks_x509_insecure_sha1_total |
Total de requisições a webhooks assinadas com uma assinatura SHA-1 insegura. |
|
apiserver_webhooks_x509_missing_san_total |
Total de certificados X.509 com SAN ausente nos webhooks do |
|
authenticated_user_requests |
Total de requisições de usuários autenticados. |
|
authentication_attempts |
Quantidade de tentativas de autenticação. |
|
authentication_duration_seconds_bucket |
Histograma de latência do processo de autenticação, em segundos. |
|
authentication_duration_seconds_count |
Total de observações no histograma de latência de autenticação. |
|
authentication_duration_seconds_sum |
Soma total das durações no histograma de latência de autenticação, em segundos. |
|
authentication_token_cache_active_fetch_count |
Quantidade de buscas ativas na |
|
authentication_token_cache_fetch_total |
Total de buscas realizadas na |
|
authentication_token_cache_request_duration_seconds_bucket |
Histograma de latência das requisições à |
|
authentication_token_cache_request_duration_seconds_count |
Total de observações no histograma de latência de requisições à |
|
authentication_token_cache_request_duration_seconds_sum |
Soma total das durações no histograma de latência de requisições à |
|
authentication_token_cache_request_total |
Total de requisições à |
|
authorization_attempts_total |
Total de tentativas de autorização. |
|
authorization_duration_seconds_bucket |
Histograma de latência do processo de autorização, em segundos. |
|
authorization_duration_seconds_count |
Total de observações no histograma de latência de autorização. |
|
authorization_duration_seconds_sum |
Soma total das durações no histograma de latência de autorização, em segundos. |
|
cardinality_enforcement_unexpected_categorizations_total |
Total de categorizações inesperadas na aplicação de cardinalidade. |
|
count |
A contagem de itens. |
|
cpu_utilization_core |
Utilização de CPU, em núcleos. |
|
disabled_metric_total |
Total de métricas desativadas. |
|
disabled_metrics_total |
Total de métricas desabilitadas. |
|
etcd_bookmark_counts |
Contagem de bookmarks do |
|
etcd_db_total_size_in_bytes |
Tamanho total do banco de dados do |
|
etcd_lease_object_counts_bucket |
Histograma de contagens de objetos de lease do |
|
etcd_lease_object_counts_count |
Total de observações no histograma de contagem de objetos de lease do |
|
etcd_lease_object_counts_sum |
Soma total no histograma de contagem de objetos de lease do |
|
etcd_object_counts |
Contagem de objetos no |
|
etcd_request_duration_seconds_bucket |
Histograma de latência das requisições ao |
|
etcd_request_duration_seconds_count |
Total de observações no histograma de latência de requisições ao |
|
etcd_request_duration_seconds_sum |
Soma total das durações no histograma de latência de requisições ao |
|
etcd_request_errors_total |
Total de erros de requisição ao |
|
etcd_requests_total |
Total de requisições ao |
|
etcd_watcher_channel_length |
Tamanho do canal do |
|
etcd_watcher_received_events |
Quantidade de eventos recebidos pelo |
|
etcd_watcher_sended_events_latency_milliseconds_bucket |
Histograma de latência dos eventos enviados pelo |
|
etcd_watcher_sended_events_latency_milliseconds_count |
Total de observações no histograma de latência de envio de eventos do |
|
etcd_watcher_sended_events_latency_milliseconds_sum |
Soma total das durações no histograma de latência de envio de eventos do |
|
field_validation_request_duration_seconds_bucket |
Histograma de latência das requisições de validação de campos, em segundos. |
|
field_validation_request_duration_seconds_count |
Total de observações no histograma de latência de requisições de validação de campos. |
|
field_validation_request_duration_seconds_sum |
Soma total das durações no histograma de latência de requisições de validação de campos, em segundos. |
|
get_token_count |
Quantidade de operações get-token. |
|
get_token_fail_count |
Quantidade de operações get-token com falha. |
|
grpc_client_handled_total |
Total de requisições de cliente gRPC atendidas. |
|
grpc_client_msg_received_total |
Total de mensagens recebidas pelo cliente gRPC. |
|
grpc_client_msg_sent_total |
Total de mensagens enviadas pelo cliente gRPC. |
|
grpc_client_started_total |
Total de chamadas iniciadas pelo cliente gRPC. |
|
hidden_metric_total |
Total de métricas ocultas. |
|
hidden_metrics_total |
Total de métricas escondidas. |
|
http_request_duration_microseconds |
Duração da requisição HTTP, em microssegundos. |
|
http_request_size_bytes |
Tamanho da requisição HTTP, em bytes. |
|
http_requests_total |
Total de requisições HTTP. |
|
http_response_size_bytes |
Tamanho da resposta HTTP, em bytes. |
|
job |
O nome do job. |
|
job_instance_mode |
O modo da instância do job. |
|
kube_apiserver_clusterip_allocator_allocated_ips |
Kubernetes |
|
kube_apiserver_clusterip_allocator_allocation_errors_total |
Kubernetes |
|
kube_apiserver_clusterip_allocator_allocation_total |
Kubernetes |
|
kube_apiserver_clusterip_allocator_available_ips |
Kubernetes |
|
kube_apiserver_nodeport_allocator_allocated_ports |
Kubernetes |
|
kube_apiserver_nodeport_allocator_allocation_errors_total |
Kubernetes |
|
kube_apiserver_nodeport_allocator_allocation_total |
Kubernetes |
|
kube_apiserver_nodeport_allocator_available_ports |
Kubernetes |
|
kube_apiserver_pod_logs_backend_tls_failure_total |
Kubernetes |
|
kube_apiserver_pod_logs_insecure_backend_total |
Kubernetes |
|
kube_apiserver_pod_logs_pods_logs_backend_tls_failure_total |
Kubernetes |
|
kube_apiserver_pod_logs_pods_logs_insecure_backend_total |
Kubernetes |
|
kubelet_container_log_filesystem_used_bytes |
|
|
kubelet_node_name |
|
|
kubelet_pleg_relist_duration_seconds_bucket |
|
|
kubelet_pod_worker_duration_seconds_bucket |
|
|
kubelet_volume_stats_available_bytes |
|
|
kubelet_volume_stats_capacity_bytes |
|
|
kubelet_volume_stats_inodes |
|
|
kubelet_volume_stats_inodes_free |
|
|
kubelet_volume_stats_inodes_used |
|
|
kubelet_volume_stats_used_bytes |
|
|
kubernetes_build_info |
Informações de build do Kubernetes. |
|
kubernetes_feature_enabled |
Status de ativação de um recurso do Kubernetes. |
|
last_list_all_response_size_in_bytes |
Tamanho da última resposta list-all, em bytes. |
|
memory_utilization_byte |
Utilização de memória, em bytes. |
|
node_authorizer_graph_actions_duration_seconds_bucket |
Histograma de latência das ações de grafo do autorizador de |
|
node_authorizer_graph_actions_duration_seconds_count |
Total de observações no histograma de latência das ações de grafo do autorizador de |
|
node_authorizer_graph_actions_duration_seconds_sum |
Soma total das durações no histograma de latência das ações de grafo do autorizador de |
|
pod_security_evaluations_total |
Total de avaliações de segurança de |
|
pod_security_exemptions_total |
Total de isenções de segurança de |
|
process_cpu_seconds_total |
Tempo total de CPU usado pelo processo, em segundos. |
|
process_max_fds |
Número máximo de descritores de arquivo do processo. |
|
process_open_fds |
Quantidade de descritores de arquivo abertos pelo processo. |
|
process_resident_memory_bytes |
Tamanho da memória residente do processo, em bytes. |
|
process_start_time_seconds |
Horário de início do processo, em segundos desde a época Unix. |
|
process_virtual_memory_bytes |
Tamanho da memória virtual do processo, em bytes. |
|
process_virtual_memory_max_bytes |
Tamanho máximo da memória virtual do processo, em bytes. |
|
registered_metric_total |
Total de métricas registradas. |
|
registered_metrics_total |
Total de métricas cadastradas. |
|
rest_client_exec_plugin_certificate_rotation_age_bucket |
Histograma da idade de rotação de certificado para o plugin exec do cliente REST, em segundos. |
|
rest_client_exec_plugin_certificate_rotation_age_count |
Total de observações no histograma de idade de rotação de certificado. |
|
rest_client_exec_plugin_certificate_rotation_age_sum |
Soma total no histograma de idade de rotação de certificado, em segundos. |
|
rest_client_exec_plugin_ttl_seconds |
TTL do certificado para o plugin exec do cliente REST, em segundos. |
|
rest_client_request_duration_seconds_bucket |
Histograma de latência das requisições do cliente REST, em segundos. |
|
rest_client_request_duration_seconds_count |
Total de observações no histograma de latência de requisições do cliente REST. |
|
rest_client_request_duration_seconds_sum |
Soma total das durações no histograma de latência de requisições do cliente REST, em segundos. |
|
rest_client_request_latency_seconds_bucket |
Histograma de latência das requisições do cliente REST, em segundos. |
|
rest_client_request_size_bytes_bucket |
Histograma dos tamanhos de requisição do cliente REST, em bytes. |
|
rest_client_request_size_bytes_count |
Total de observações no histograma de tamanho de requisição do cliente REST. |
|
rest_client_request_size_bytes_sum |
Soma total no histograma de tamanho de requisição do cliente REST, em bytes. |
|
rest_client_requests_total |
Total de requisições do cliente REST. |
|
rest_client_response_size_bytes_bucket |
Histograma dos tamanhos de resposta do cliente REST, em bytes. |
|
rest_client_response_size_bytes_count |
Total de observações no histograma de tamanho de resposta do cliente REST. |
|
rest_client_response_size_bytes_sum |
Soma total no histograma de tamanho de resposta do cliente REST, em bytes. |
|
rest_client_transport_cache_entries |
Quantidade de entradas na |
|
rest_client_transport_create_calls_total |
Total de chamadas de criação de transporte no cliente REST. |
|
scheduler_pending_pods |
Quantidade de |
|
scheduler_pod_scheduling_attempts_bucket |
Histograma de tentativas de agendamento de |
|
scheduler_scheduler_cache_size |
Tamanho da |
|
scrape_duration_seconds |
Duração da |
|
scrape_samples_post_metric_relabeling |
Quantidade de amostras após o rotulamento de métricas. |
|
scrape_samples_scraped |
Quantidade de amostras coletadas. |
|
scrape_series_added |
Quantidade de novas séries adicionadas em uma |
|
serviceaccount_invalid_legacy_auto_token_uses_total |
Total de usos de tokens legados gerados automaticamente inválidos de |
|
serviceaccount_legacy_auto_token_uses_total |
Total de usos de tokens legados gerados automaticamente de |
|
serviceaccount_legacy_manual_token_uses_total |
Total de usos de tokens legados criados manualmente de |
|
serviceaccount_legacy_tokens_total |
Total de tokens legados de |
|
serviceaccount_stale_tokens_total |
Total de tokens obsoletos de |
|
serviceaccount_valid_tokens_total |
Total de tokens válidos de |
|
ssh_tunnel_open_count |
Contagem de túneis SSH abertos. |
|
ssh_tunnel_open_fail_count |
Contagem de falhas na abertura de túneis SSH. |
|
up |
O status de conectividade do alvo de coleta. O valor 1 indica que o alvo está acessível; 0 indica que está inacessível. |
|
watch_cache_capacity |
Capacidade da |
|
watch_cache_capacity_decrease_total |
Total de reduções na capacidade da |
|
watch_cache_capacity_increase_total |
Total de aumentos na capacidade da |
|
workqueue_adds_total |
Total de adições à |
|
workqueue_depth |
Profundidade atual da |
|
workqueue_longest_running_processor_seconds |
Duração do processador em execução há mais tempo na |
|
workqueue_queue_duration_seconds_bucket |
Histograma de latência do tempo de enfileiramento de itens na |
|
workqueue_queue_duration_seconds_count |
Total de observações no histograma de latência de enfileiramento. |
|
workqueue_queue_duration_seconds_sum |
Soma total das durações no histograma de latência de enfileiramento, em segundos. |
|
workqueue_retries_total |
Total de tentativas repetidas na |
|
workqueue_unfinished_work_seconds |
Duração do trabalho não concluído na |
|
workqueue_work_duration_seconds_bucket |
Histograma de latência do tempo de processamento de itens na |
|
workqueue_work_duration_seconds_count |
Total de observações no histograma de latência de processamento. |
|
workqueue_work_duration_seconds_sum |
Soma total das durações no histograma de latência de processamento, em segundos. |
Node Exporter (job name: node-exporter)
|
Métrica |
Descrição |
|
aliyun_prometheus_agent_append_duration_seconds |
Duração das operações de append do |
|
aliyun_prometheus_agent_job_discovery_status |
Status de descoberta dos |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Número total de scrapes por |
|
aliyun_prometheus_agent_target_info |
Informações sobre os |
|
job |
Nome do |
|
node_boot_time_seconds |
Tempo de inicialização do |
|
node_context_switches_total |
Número total de |
|
node_cpu_seconds_total |
Tempo total de CPU utilizado pelo |
|
node_disk_io_now |
Quantidade atual de operações de I/O em andamento nos |
|
node_disk_io_time_seconds_total |
Tempo total gasto em operações de I/O nos |
|
node_disk_io_time_weighted_seconds_total |
Tempo total ponderado gasto em operações de I/O nos |
|
node_disk_read_bytes_total |
Total de bytes lidos dos |
|
node_disk_read_time_seconds_total |
Tempo total de leitura dos |
|
node_disk_reads_completed_total |
Quantidade de operações de leitura concluídas nos |
|
node_disk_reads_merged_total |
Número de operações de leitura mescladas nos |
|
node_disk_write_time_seconds_total |
Tempo total de gravação nos |
|
node_disk_writes_completed_total |
Quantidade de operações de gravação concluídas nos |
|
node_disk_writes_merged_total |
Número de operações de gravação mescladas nos |
|
node_disk_written_bytes_total |
Total de bytes gravados nos |
|
node_exporter_build_info |
Informações de build do |
|
node_filefd_allocated |
Quantidade de |
|
node_filefd_maximum |
Limite máximo de |
|
node_filesystem_avail_bytes |
Espaço disponível no |
|
node_filesystem_free_bytes |
Espaço livre no |
|
node_filesystem_size_bytes |
Tamanho total do |
|
node_intr_total |
Soma de interrupções no |
|
node_load1 |
Média de |
|
node_load15 |
Média de |
|
node_load5 |
Média de |
|
node_memory_MemAvailable_bytes |
Quantidade de |
|
node_memory_MemFree_bytes |
Volume de |
|
node_memory_MemTotal_bytes |
Capacidade total de |
|
node_memory_Slab_bytes |
Quantidade de |
|
node_memory_SReclaimable_bytes |
Parte recuperável da |
|
node_netstat_Tcp_InErrs |
Contagem de erros de recebimento TCP. |
|
node_netstat_Tcp_InSegs |
Quantidade de |
|
node_netstat_Tcp_OutSegs |
Quantidade de |
|
node_netstat_Tcp_PassiveOpens |
Número de aberturas passivas de conexão TCP. |
|
node_netstat_Tcp_RetransSegs |
Quantidade de |
|
node_network_receive_bytes_total |
Total de bytes recebidos pela |
|
node_network_receive_drop_total |
Soma de |
|
node_network_receive_errs_total |
Total de erros de recebimento na |
|
node_network_receive_packets_total |
Quantidade de |
|
node_network_transmit_bytes_total |
Total de bytes transmitidos pela |
|
node_network_transmit_drop_total |
Soma de |
|
node_network_transmit_errs_total |
Total de erros de transmissão na |
|
node_network_transmit_packets_total |
Quantidade de |
|
node_network_up |
Indica se a |
|
node_processes_max_processes |
Limite máximo de |
|
node_processes_max_threads |
Limite máximo de |
|
node_processes_pids |
Quantidade de IDs de |
|
node_processes_state |
Distribuição de |
|
node_processes_threads |
Contagem de |
|
node_schedstat_running_seconds_total |
Tempo acumulado que os |
|
node_sockstat_TCP_alloc |
Quantidade de |
|
node_sockstat_TCP_inuse |
Número de |
|
node_sockstat_TCP_mem |
Volume de |
|
node_sockstat_TCP_mem_bytes |
Volume de |
|
node_sockstat_TCP_tw |
Quantidade de |
|
node_time_zone_offset_seconds |
Deslocamento do |
|
node_timex_offset_seconds |
Offset de tempo, em segundos. |
|
node_timex_sync_status |
Indica o status de sincronização do relógio. |
|
node_uname_info |
As |
|
node_vmstat_pgfault |
Total de |
|
node_vmstat_pgmajfault |
Total de |
|
node_vmstat_pgpgin |
Soma de páginas carregadas do |
|
node_vmstat_pgpgout |
Soma de páginas descarregadas para o |
|
up |
Indica se o |
Kube-state-metrics (Job Name: _kube-state-metrics)
|
Métrica |
Descrição |
|
kube_configmap_info |
Informações do ConfigMap. |
|
kube_cronjob_annotations |
Anotações do CronJob. |
|
kube_cronjob_created |
Timestamp de criação do CronJob. |
|
kube_cronjob_info |
Detalhes do CronJob. |
|
kube_cronjob_labels |
Rótulos do CronJob. |
|
kube_cronjob_metadata_resource_version |
Versão do recurso nos metadados do CronJob. |
|
kube_cronjob_next_schedule_time |
Próximo horário agendado para o CronJob. |
|
kube_cronjob_spec_failed_job_history_limit |
Limite de retenção de histórico para jobs com falha do CronJob. |
|
kube_cronjob_spec_starting_deadline_seconds |
Prazo limite de início do CronJob, em segundos. |
|
kube_cronjob_spec_successful_job_history_limit |
Limite de retenção de histórico para jobs bem-sucedidos do CronJob. |
|
kube_cronjob_spec_suspend |
Indica se o CronJob está suspenso. |
|
kube_cronjob_status_active |
Quantidade de jobs ativos do CronJob. |
|
kube_cronjob_status_last_schedule_time |
Último agendamento do CronJob. |
|
kube_cronjob_status_last_successful_time |
Última execução bem-sucedida do CronJob. |
|
kube_daemonset_created |
Timestamp de criação do DaemonSet. |
|
kube_daemonset_status_current_number_scheduled |
Nós que executam atualmente um pod do DaemonSet. |
|
kube_daemonset_status_desired_number_scheduled |
Total de nós que deveriam executar um pod do DaemonSet. |
|
kube_daemonset_status_number_available |
Nós com um pod disponível do DaemonSet. |
|
kube_daemonset_status_number_misscheduled |
Nós executando incorretamente um Pod do DaemonSet. |
|
kube_daemonset_status_number_ready |
Nós com um pod pronto do DaemonSet. |
|
kube_daemonset_status_number_unavailable |
Nós sem um pod disponível do DaemonSet. |
|
kube_daemonset_status_updated_number_scheduled |
Nós executando a versão atualizada do DaemonSet. |
|
kube_daemonset_updated_number_scheduled |
Contagem de nós rodando o DaemonSet atualizado. |
|
kube_deployment_created |
Timestamp de criação do Deployment. |
|
kube_deployment_labels |
Rótulos associados ao Deployment. |
|
kube_deployment_metadata_generation |
Geração dos metadados do Deployment. |
|
kube_deployment_spec_replicas |
Réplicas desejadas para o Deployment. |
|
kube_deployment_spec_strategy_rollingupdate_max_unavailable |
Máximo de réplicas indisponíveis durante uma rolling update do Deployment. |
|
kube_deployment_status_observed_generation |
Geração mais recente observada pelo controller do Deployment. |
|
kube_deployment_status_replicas |
Total de réplicas do Deployment. |
|
kube_deployment_status_replicas_available |
Réplicas disponíveis do Deployment. |
|
kube_deployment_status_replicas_ready |
Réplicas prontas do Deployment. |
|
kube_deployment_status_replicas_unavailable |
Réplicas indisponíveis do Deployment. |
|
kube_deployment_status_replicas_updated |
Réplicas atualizadas do Deployment. |
|
kube_horizontalpodautoscaler_info |
Informações do HorizontalPodAutoscaler. |
|
kube_horizontalpodautoscaler_labels |
Rótulos do HorizontalPodAutoscaler. |
|
kube_horizontalpodautoscaler_metadata_generation |
Geração dos metadados do HorizontalPodAutoscaler. |
|
kube_horizontalpodautoscaler_spec_max_replicas |
Limite máximo de réplicas do HorizontalPodAutoscaler. |
|
kube_horizontalpodautoscaler_spec_min_replicas |
Limite mínimo de réplicas do HorizontalPodAutoscaler. |
|
kube_horizontalpodautoscaler_spec_target_metric |
Métrica alvo do HorizontalPodAutoscaler. |
|
kube_horizontalpodautoscaler_status_condition |
Condição atual do HorizontalPodAutoscaler. |
|
kube_horizontalpodautoscaler_status_current_replicas |
Réplicas atuais do HorizontalPodAutoscaler. |
|
kube_horizontalpodautoscaler_status_desired_replicas |
Réplicas desejadas do HorizontalPodAutoscaler. |
|
kube_hpa_labels |
Rótulos do HPA. |
|
kube_hpa_metadata_generation |
Geração dos metadados do HPA. |
|
kube_hpa_spec_max_replicas |
Máximo de réplicas configurado para o HPA. |
|
kube_hpa_spec_min_replicas |
Mínimo de réplicas configurado para o HPA. |
|
kube_hpa_spec_target_metric |
Métrica alvo definida para o HPA. |
|
kube_hpa_status_condition |
Estado atual do HPA. |
|
kube_hpa_status_current_replicas |
Contagem atual de réplicas do HPA. |
|
kube_hpa_status_desired_replicas |
Contagem desejada de réplicas do HPA. |
|
kube_ingress_info |
Dados do Ingress. |
|
kube_job_created |
Timestamp de criação do Job. |
|
kube_job_failed |
Indica se o job falhou. |
|
kube_job_info |
Informações gerais do Job. |
|
kube_job_spec_completions |
Conclusões bem-sucedidas desejadas para o job. |
|
kube_job_status_active |
Pods ativos pertencentes ao job. |
|
kube_job_status_failed |
Pods com falha pertencentes ao job. |
|
kube_job_status_succeeded |
Pods bem-sucedidos pertencentes ao job. |
|
kube_namespace_created |
Timestamp de criação do Namespace. |
|
kube_namespace_labels |
Rótulos atribuídos ao namespace. |
|
kube_namespace_status_phase |
Fase atual do namespace. |
|
kube_node_info |
Informações detalhadas do nó. |
|
kube_node_labels |
Rótulos aplicados ao nó. |
|
kube_node_spec_taint |
Taint configurada para o nó. |
|
kube_node_spec_unschedulable |
Indica se o nó é não agendável. |
|
kube_node_status_allocatable |
Recursos alocáveis disponíveis no nó. |
|
kube_node_status_allocatable_cpu_cores |
Recursos de CPU alocáveis do nó, em núcleos. |
|
kube_node_status_allocatable_memory_bytes |
Recursos de memória alocáveis do nó, em bytes. |
|
kube_node_status_allocatable_pods |
Quantidade de Pods que podem ser alocados ao nó. |
|
kube_node_status_capacity |
Capacidade total de recursos do nó. |
|
kube_node_status_capacity_cpu_cores |
Capacidade total de CPU do nó, em núcleos. |
|
kube_node_status_capacity_memory_bytes |
Capacidade total de memória do nó, em bytes. |
|
kube_node_status_capacity_pods |
Capacidade total de Pods suportada pelo nó. |
|
kube_node_status_condition |
Condição de saúde atual do nó. |
|
kube_persistentvolume_status_phase |
Fase atual do volume persistente. |
|
kube_persistentvolumeclaim_info |
Informações da requisição de volume persistente. |
|
kube_persistentvolumeclaim_resource_requests_storage_bytes |
Armazenamento solicitado pela requisição de volume persistente, em bytes. |
|
kube_persistentvolumeclaim_status_phase |
Fase atual da requisição de volume persistente. |
|
kube_pod_completion_time |
Horário de conclusão do Pod. |
|
kube_pod_container_info |
Detalhes do contêiner do Pod. |
|
kube_pod_container_resource_limits |
Limites de recursos definidos para o contêiner. |
|
kube_pod_container_resource_limits_cpu_cores |
Limite de CPU do contêiner, em núcleos. |
|
kube_pod_container_resource_limits_memory_bytes |
Limite de memória do contêiner, em bytes. |
|
kube_pod_container_resource_requests |
Solicitações de recursos do contêiner. |
|
kube_pod_container_resource_requests_cpu_cores |
Solicitação de CPU do contêiner, em núcleos. |
|
kube_pod_container_resource_requests_memory_bytes |
Solicitação de memória do contêiner, em bytes. |
|
kube_pod_container_status_last_terminated_reason |
Motivo da última finalização do contêiner. |
|
kube_pod_container_status_ready |
Indica se o contêiner está pronto. |
|
kube_pod_container_status_restarts_total |
Total de reinicializações do contêiner. |
|
kube_pod_container_status_running |
Indica se o contêiner está em execução. |
|
kube_pod_container_status_terminated |
Indica se o contêiner está finalizado. |
|
kube_pod_container_status_terminated_reason |
Motivo pelo qual o contêiner está finalizado. |
|
kube_pod_container_status_waiting |
Indica se o contêiner está aguardando. |
|
kube_pod_container_status_waiting_reason |
Motivo pelo qual o contêiner está aguardando. |
|
kube_pod_created |
Timestamp de criação do Pod. |
|
kube_pod_deletion_timestamp |
Timestamp de exclusão do Pod. |
|
kube_pod_info |
Informações gerais do Pod. |
|
kube_pod_labels |
Rótulos associados ao Pod. |
|
kube_pod_owner |
Informações do proprietário do Pod. |
|
kube_pod_start_time |
Horário de início do Pod. |
|
kube_pod_status_container_ready_time |
Momento em que os contêineres do Pod ficaram prontos. |
|
kube_pod_status_initialized_time |
Momento em que o Pod foi inicializado. |
|
kube_pod_status_phase |
Fase atual do ciclo de vida do Pod. |
|
kube_pod_status_ready |
Indica se o Pod está pronto. |
|
kube_pod_status_ready_time |
Momento em que o Pod ficou pronto. |
|
kube_pod_status_reason |
Razão do status atual do Pod. |
|
kube_pod_status_scheduled_time |
Momento em que o Pod foi agendado. |
|
kube_pod_status_unschedulable |
Indica se o Pod não pode ser agendado. |
|
kube_replicaset_owner |
Informações do proprietário do ReplicaSet. |
|
kube_replicaset_status_ready_replicas |
Réplicas prontas do ReplicaSet. |
|
kube_resource_relationship |
Relacionamento entre recursos. |
|
kube_resourcequota |
Informações sobre cota de recursos. |
|
kube_resourcequota_created |
Timestamp de criação da cota de recursos. |
|
kube_secret_info |
Informações do Secret. |
|
kube_service_info |
Detalhes do Service. |
|
kube_service_spec_type |
Tipo especificado para o service. |
|
kube_service_status_load_balancer_ingress |
Informações de ingress do balanceador de carga do service. |
|
kube_statefulset_created |
Timestamp de criação do StatefulSet. |
|
kube_statefulset_metadata_generation |
Geração dos metadados do StatefulSet. |
|
kube_statefulset_replicas |
Réplicas desejadas para o StatefulSet. |
|
kube_statefulset_status_replicas |
Réplicas atuais do StatefulSet. |
|
kube_statefulset_status_replicas_available |
Réplicas disponíveis do StatefulSet. |
|
kube_statefulset_status_replicas_ready |
Réplicas prontas do StatefulSet. |
|
kube_statefulset_status_replicas_updated |
Réplicas atualizadas do StatefulSet. |
|
rest_client_requests_total |
Total de requisições enviadas pelo cliente REST. |
|
up |
Saúde do target (1 para ativo, 0 para inativo). |
|
workqueue_adds_total |
Adições totais à workqueue. |
|
workqueue_depth |
Profundidade atual da workqueue. |
|
workqueue_queue_duration_seconds_bucket |
Distribuição do tempo de permanência na workqueue, em segundos. |
kube-events (scrape job name: _arms/kube-event)
|
Métrica |
Descrição |
|
aliyun_prometheus_agent_append_duration_seconds |
Duração da operação de append do agent do Alibaba Cloud Prometheus, em segundos. |
|
aliyun_prometheus_agent_job_discovery_status |
Status de descoberta de scrape jobs do agent do Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrape_custom_error |
Quantidade de erros personalizados de scrape do agent do Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Total de scrapes por target realizados pelo agent do Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_target_info |
Informações sobre os targets monitorados pelo agent do Alibaba Cloud Prometheus. |
|
eventer_events_error_total |
Soma de erros no processamento de eventos. |
|
eventer_events_normal_total |
Contagem de eventos normais. |
|
eventer_events_warning_total |
Contagem de eventos de aviso. |
|
eventer_exporter_duration_milliseconds_count |
Observações da duração de exportação de eventos, em milissegundos. |
|
eventer_exporter_duration_milliseconds_sum |
Soma acumulada das durações de exportação de eventos, em milissegundos. |
|
eventer_manager_last_time_seconds |
Timestamp da última operação do gerenciador de eventos, em segundos. |
|
eventer_scraper_duration_milliseconds_count |
Observações da duração de scrape de eventos, em milissegundos. |
|
eventer_scraper_duration_milliseconds_sum |
Soma acumulada das durações de scrape de eventos, em milissegundos. |
|
eventer_scraper_events_total_number |
Total absoluto de eventos coletados. |
|
eventer_scraper_last_time_seconds |
Timestamp do último scrape de eventos, em segundos. |
|
up |
Saúde do target: 1 indica ativo e acessível, 0 indica inativo. |
CoreDNS (job name: arms-ack-coredns)
|
Métrica |
Descrição |
|
aliyun_prometheus_agent_append_duration_seconds |
Duração das operações de append do Agent do Alibaba Cloud Prometheus, em segundos. |
|
aliyun_prometheus_agent_job_discovery_status |
Status da descoberta de scrape jobs pelo Agent do Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrape_custom_error |
Erros personalizados de scrape gerados pelo Agent do Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Scrapes totais do Agent do Alibaba Cloud Prometheus, divididos por target. |
|
aliyun_prometheus_agent_target_info |
Detalhes dos targets coletados pelo Agent do Alibaba Cloud Prometheus. |
|
coredns_autopath_success_count_total |
Operações autopath concluídas com sucesso. |
|
coredns_autopath_success_total |
Contagem cumulativa de sucessos em operações autopath. |
|
coredns_build_info |
Dados de build do binário CoreDNS. |
|
coredns_cache_drops_total |
Entradas removidas do cache. |
|
coredns_cache_entries |
Entradas presentes no cache atualmente. |
|
coredns_cache_evictions_total |
Entradas expurgadas do cache. |
|
coredns_cache_hits_total |
Acertos registrados no cache. |
|
coredns_cache_misses_total |
Falhas de acerto no cache. |
|
coredns_cache_requests_total |
Requisições direcionadas ao cache. |
|
coredns_cache_size |
Tamanho atual do cache em entradas. |
|
coredns_dns_do_requests_total |
Requisições DNS com o bit DO (DNSSEC OK) ativado. |
|
coredns_dns_request_count_total |
Volume total de requisições DNS. |
|
coredns_dns_request_duration_seconds_bucket |
Distribuição das durações de requisições DNS, em segundos. |
|
coredns_dns_request_duration_seconds_count |
Medições de duração de requisições DNS para o histograma. |
|
coredns_dns_request_duration_seconds_sum |
Soma das durações de todas as requisições DNS medidas, em segundos. |
|
coredns_dns_request_size_bytes_bucket |
Distribuição dos tamanhos de requisições DNS, em bytes. |
|
coredns_dns_request_size_bytes_count |
Medições de tamanho de requisições DNS para o histograma. |
|
coredns_dns_request_size_bytes_sum |
Soma dos tamanhos de todas as requisições DNS medidas, em bytes. |
|
coredns_dns_request_type_count_total |
Requisições DNS agrupadas por tipo de consulta. |
|
coredns_dns_requests_total |
Total acumulado de requisições DNS. |
|
coredns_dns_response_rcode_count_total |
Respostas DNS agrupadas por código de resposta (RCODE). |
|
coredns_dns_response_size_bytes_bucket |
Distribuição dos tamanhos de respostas DNS, em bytes. |
|
coredns_dns_response_size_bytes_count |
Medições de tamanho de respostas DNS para o histograma. |
|
coredns_dns_response_size_bytes_sum |
Soma dos tamanhos de todas as respostas DNS medidas, em bytes. |
|
coredns_dns_responses_total |
Total acumulado de respostas DNS. |
|
coredns_forward_conn_cache_hits_total |
Acertos no cache de conexões para requisições encaminhadas. |
|
coredns_forward_conn_cache_misses_total |
Falhas no cache de conexões para requisições encaminhadas. |
|
coredns_forward_healthcheck_broken_total |
Vezes em que um forwarder foi marcado como quebrado. |
|
coredns_forward_healthcheck_failure_count_total |
Falhas de health check nos forwarders. |
|
coredns_forward_healthcheck_failures_total |
Contagem acumulada de falhas de health check nos forwarders. |
|
coredns_forward_max_concurrent_rejects_total |
Requisições encaminhadas rejeitadas por atingirem o limite de concorrência. |
|
coredns_forward_request_count_total |
Requisições que foram encaminhadas. |
|
coredns_forward_request_duration_seconds_bucket |
Distribuição das durações de requisições encaminhadas, em segundos. |
|
coredns_forward_request_duration_seconds_count |
Medições de duração de requisições encaminhadas para o histograma. |
|
coredns_forward_request_duration_seconds_sum |
Soma das durações de todas as requisições encaminhadas medidas, em segundos. |
|
coredns_forward_requests_total |
Total de requisições encaminhadas. |
|
coredns_forward_response_rcode_count_total |
Respostas dos forwarders agrupadas por código de resposta (RCODE). |
|
coredns_forward_responses_total |
Respostas recebidas dos forwarders. |
|
coredns_forward_sockets_open |
Sockets abertos no momento para encaminhamento. |
|
coredns_health_request_duration_seconds_bucket |
Distribuição das durações de requisições ao endpoint de health, em segundos. |
|
coredns_health_request_duration_seconds_count |
Medições de duração de requisições ao endpoint de health para o histograma. |
|
coredns_health_request_duration_seconds_sum |
Soma das durações de todas as requisições ao endpoint de health medidas, em segundos. |
|
coredns_health_request_failures_total |
Requisições com falha para o endpoint de health. |
|
coredns_hosts_entries |
Entradas carregadas pelo plugin hosts. |
|
coredns_hosts_reload_timestamp_seconds |
Timestamp do último reload bem-sucedido do arquivo hosts. |
|
coredns_kubernetes_dns_programming_duration_seconds_bucket |
Distribuição das durações de programação de DNS do Kubernetes, em segundos. |
|
coredns_kubernetes_dns_programming_duration_seconds_count |
Medições de duração de operações de programação de DNS do Kubernetes para o histograma. |
|
coredns_kubernetes_dns_programming_duration_seconds_sum |
Soma das durações de todas as operações de programação de DNS do Kubernetes medidas, em segundos. |
|
coredns_local_localhost_requests_total |
Requisições "localhost" tratadas pelo plugin local. |
|
coredns_panic_count_total |
Ocorrências de panic registradas. |
|
coredns_panics_total |
Total acumulado de panics. |
|
coredns_plugin_enabled |
Plugins habilitados identificados por rótulos. |
|
coredns_reload_failed_total |
Recarregamentos que falharam. |
|
coredns_reload_version_info |
Informações de versão dos recarregamentos. |
|
coredns_template_matches_total |
Correspondências de template encontradas. |
|
up |
Sucesso na coleta do target (1 para ativo, 0 para inativo). |
CSI (cluster-level) (Job name: k8s-csi-cluster-pv)
|
Métrica |
Descrição |
|
alibaba_cloud_storage_operator_build_info |
Informações de build do operador de armazenamento do Alibaba Cloud. |
|
aliyun_prometheus_agent_append_duration_seconds |
Duração das operações de append do agent do Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_job_discovery_status |
Status de descoberta de scrape jobs do agent do Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrape_custom_error |
Erros personalizados de scrape do agent do Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Scrapes totais por target do agent do Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_target_info |
Exibe informações sobre os targets monitorados pelo agent do Alibaba Cloud Prometheus. |
|
cluster_pv_detail_num_total |
Quantidade total de Persistent Volumes (PVs) no cluster. |
|
cluster_pv_status_num_total |
PVs no cluster distribuídos por status. |
|
cluster_pvc_detail_num_total |
Quantidade total de Persistent Volume Claims (PVCs) no cluster. |
|
cluster_pvc_status_num_total |
PVCs no cluster distribuídos por status. |
|
cluster_scrape_collector_duration_seconds |
Duração das coletas realizadas pelo collector do cluster. |
|
cluster_scrape_collector_success |
Coletas bem-sucedidas pelo collector do cluster. |
|
up |
Saúde do target. Valor 1 indica ativo e 0 indica inativo. |
CSI (node-level) (job name: k8s-csi-node-pv)
|
Métrica |
Descrição |
|
alibaba_cloud_csi_driver_build_info |
Informações de build do driver CSI do Alibaba Cloud. |
|
aliyun_prometheus_agent_append_duration_seconds |
Duração da operação de append do agent do Alibaba Cloud Prometheus, em segundos. |
|
aliyun_prometheus_agent_job_discovery_status |
Status de descoberta de scrape jobs do agent do Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrape_custom_error |
Erros personalizados de scrape do agent do Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Total de scrapes por target do agent do Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_target_info |
Informações sobre os targets do agent do Alibaba Cloud Prometheus. |
|
cluster_scrape_collector_duration_seconds |
Duração da coleta do collector do cluster, em segundos. |
|
cluster_scrape_collector_success |
Coletas bem-sucedidas do collector do cluster. |
|
container_fs_available_bytes |
Espaço disponível no sistema de arquivos do contêiner, em bytes. |
|
container_fs_inodes_free |
Inodes livres no sistema de arquivos do contêiner. |
|
container_fs_inodes_total |
Inodes totais no sistema de arquivos do contêiner. |
|
container_fs_inodes_used |
Inodes utilizados no sistema de arquivos do contêiner. |
|
container_fs_limit_bytes |
Limite de tamanho do sistema de arquivos do contêiner, em bytes. |
|
container_fs_usage_bytes |
Uso do sistema de arquivos do contêiner, em bytes. |
|
ephemeral_storage_pod_available_bytes |
Armazenamento efêmero disponível para o Pod, em bytes. |
|
ephemeral_storage_pod_inodes_free |
Inodes livres no armazenamento efêmero do Pod. |
|
ephemeral_storage_pod_inodes_total |
Inodes totais no armazenamento efêmero do Pod. |
|
ephemeral_storage_pod_inodes_used |
Inodes utilizados no armazenamento efêmero do Pod. |
|
ephemeral_storage_pod_limit_bytes |
Limite de armazenamento efêmero do Pod, em bytes. |
|
ephemeral_storage_pod_usage_bytes |
Uso de armazenamento efêmero do Pod, em bytes. |
|
node_volume_backend_posix_access_total_counter |
Operações de acesso POSIX no backend do volume do nó. |
|
node_volume_backend_posix_getattr_total_counter |
Operações POSIX getattr no backend do volume do nó. |
|
node_volume_backend_posix_getmode_total_counter |
Operações POSIX getmode no backend do volume do nó. |
|
node_volume_backend_posix_link_total_counter |
Operações POSIX link no backend do volume do nó. |
|
node_volume_backend_posix_lookup_total_counter |
Operações POSIX lookup no backend do volume do nó. |
|
node_volume_backend_posix_mknod_total_counter |
Operações POSIX mknod no backend do volume do nó. |
|
node_volume_backend_posix_readdir_total_counter |
Operações POSIX readdir no backend do volume do nó. |
|
node_volume_backend_posix_readlink_total_counter |
Operações POSIX readlink no backend do volume do nó. |
|
node_volume_backend_posix_remove_total_counter |
Operações POSIX remove no backend do volume do nó. |
|
node_volume_backend_posix_rename_total_counter |
Operações POSIX rename no backend do volume do nó. |
|
node_volume_backend_posix_setattr_total_counter |
Operações POSIX setattr no backend do volume do nó. |
|
node_volume_backend_posix_statfs_total_counter |
Operações POSIX statfs no backend do volume do nó. |
|
node_volume_backend_read_bytes_total_counter |
Bytes lidos do backend do volume do nó. |
|
node_volume_backend_read_completed_total_counter |
Leituras concluídas no backend do volume do nó. |
|
node_volume_backend_read_time_milliseconds_total_counter |
Tempo gasto em leituras no backend do volume do nó, em milissegundos. |
|
node_volume_backend_write_bytes_total_counter |
Bytes gravados no backend do volume do nó. |
|
node_volume_backend_write_completed_total_counter |
Gravações concluídas no backend do volume do nó. |
|
node_volume_backend_write_time_milliseconds_total_counter |
Tempo gasto em gravações no backend do volume do nó, em milissegundos. |
|
node_volume_capacity_bytes_available |
Capacidade disponível do volume do nó, em bytes. |
|
node_volume_capacity_bytes_available_counter |
Contador da capacidade disponível do volume do nó, em bytes. |
|
node_volume_capacity_bytes_total |
Capacidade total do volume do nó, em bytes. |
|
node_volume_capacity_bytes_total_counter |
Contador da capacidade total do volume do nó, em bytes. |
|
node_volume_capacity_bytes_used |
Capacidade utilizada do volume do nó, em bytes. |
|
node_volume_capacity_bytes_used_counter |
Contador da capacidade utilizada do volume do nó, em bytes. |
|
node_volume_hot_spot_head_file_top |
Classificação dos principais arquivos por requisições HEAD no volume do nó. |
|
node_volume_hot_spot_read_file_top |
Classificação dos principais arquivos por requisições de leitura no volume do nó. |
|
node_volume_hot_spot_write_file_top |
Classificação dos principais arquivos por requisições de gravação no volume do nó. |
|
node_volume_inode_bytes_available_counter |
Contador do espaço de inode disponível no volume do nó, em bytes. |
|
node_volume_inode_bytes_total_counter |
Contador do espaço total de inode no volume do nó, em bytes. |
|
node_volume_inode_bytes_used_counter |
Contador do espaço de inode utilizado no volume do nó, em bytes. |
|
node_volume_inodes_available |
Inodes disponíveis no volume do nó. |
|
node_volume_inodes_total |
Inodes totais no volume do nó. |
|
node_volume_inodes_used |
Inodes utilizados no volume do nó. |
|
node_volume_io_now |
Operações de I/O em andamento no volume do nó. |
|
node_volume_io_time_seconds_total |
Tempo total de I/O no volume do nó, em segundos. |
|
node_volume_oss_delete_object_total_counter |
Operações de exclusão de objeto OSS no volume do nó. |
|
node_volume_oss_get_object_total_counter |
Operações de obtenção de objeto OSS no volume do nó. |
|
node_volume_oss_head_object_total_counter |
Operações HEAD de objeto OSS no volume do nó. |
|
node_volume_oss_post_object_total_counter |
Operações POST de objeto OSS no volume do nó. |
|
node_volume_oss_put_object_total_counter |
Operações PUT de objeto OSS no volume do nó. |
|
node_volume_posix_access_total_counter |
Operações POSIX access no volume do nó. |
|
node_volume_posix_chmod_total_counter |
Operações POSIX chmod no volume do nó. |
|
node_volume_posix_chown_total_counter |
Operações POSIX chown no volume do nó. |
|
node_volume_posix_create_total_counter |
Operações POSIX create no volume do nó. |
|
node_volume_posix_flush_total_counter |
Operações POSIX flush no volume do nó. |
|
node_volume_posix_fsync_total_counter |
Operações POSIX fsync no volume do nó. |
|
node_volume_posix_mkdir_total_counter |
Operações POSIX mkdir no volume do nó. |
|
node_volume_posix_open_total_counter |
Operações POSIX open no volume do nó. |
|
node_volume_posix_opendir_total_counter |
Operações POSIX opendir no volume do nó. |
|
node_volume_posix_read_total_counter |
Operações POSIX read no volume do nó. |
|
node_volume_posix_readdir_total_counter |
Operações POSIX readdir no volume do nó. |
|
node_volume_posix_release_total_counter |
Operações POSIX release no volume do nó. |
|
node_volume_posix_rename_total_counter |
Operações POSIX rename no volume do nó. |
|
node_volume_posix_rmdir_total_counter |
Operações POSIX rmdir no volume do nó. |
|
node_volume_posix_truncate_total_counter |
Operações POSIX truncate no volume do nó. |
|
node_volume_posix_write_total_counter |
Operações POSIX write no volume do nó. |
|
node_volume_read_bytes_total |
Bytes lidos do volume do nó. |
|
node_volume_read_bytes_total_counter |
Contador de bytes lidos do volume do nó. |
|
node_volume_read_completed_total |
Leituras concluídas no volume do nó. |
|
node_volume_read_completed_total_counter |
Contador de leituras concluídas no volume do nó. |
|
node_volume_read_merged_total |
Leituras mescladas no volume do nó. |
|
node_volume_read_queue_time_milliseconds_total |
Tempo de fila para leituras no volume do nó, em milissegundos. |
|
node_volume_read_rtt_time_milliseconds_total |
Tempo de ida e volta (RTT) para leituras no volume do nó, em milissegundos. |
|
node_volume_read_sent_bytes_total |
Bytes enviados para leituras no volume do nó. |
|
node_volume_read_time_milliseconds_total |
Tempo gasto em leituras no volume do nó, em milissegundos. |
|
node_volume_read_time_milliseconds_total_counter |
Contador do tempo gasto em leituras no volume do nó, em milissegundos. |
|
node_volume_read_timeouts_total |
Timeouts de leitura no volume do nó. |
|
node_volume_read_transmissions_total |
Transmissões de leitura no volume do nó. |
|
node_volume_vg_free_bytes |
Espaço livre no grupo de volumes (VG) do nó, em bytes. |
|
node_volume_vg_size_bytes |
Tamanho total do grupo de volumes (VG) do nó, em bytes. |
|
node_volume_write_bytes_total |
Bytes gravados no volume do nó. |
|
node_volume_write_bytes_total_counter |
Contador de bytes gravados no volume do nó. |
|
node_volume_write_completed_total |
Gravações concluídas no volume do nó. |
|
node_volume_write_completed_total_counter |
Contador de gravações concluídas no volume do nó. |
|
node_volume_write_merged_total |
Gravações mescladas no volume do nó. |
|
node_volume_write_queue_time_milliseconds_total |
Tempo de fila para gravações no volume do nó, em milissegundos. |
|
node_volume_write_recv_bytes_total |
Bytes recebidos para gravações no volume do nó. |
|
node_volume_write_rtt_time_milliseconds_total |
Tempo de ida e volta (RTT) para gravações no volume do nó, em milissegundos. |
|
node_volume_write_time_milliseconds_total |
Tempo gasto em gravações no volume do nó, em milissegundos. |
|
node_volume_write_time_milliseconds_total_counter |
Contador do tempo gasto em gravações no volume do nó, em milissegundos. |
|
node_volume_write_timeouts_total |
Timeouts de gravação no volume do nó. |
|
node_volume_write_transmissions_total |
Transmissões de gravação no volume do nó. |
|
up |
Saúde do target. Valor 1 significa saudável e acessível; 0 significa inativo. |
GPU-Exporter (Job Name: gpu-exporter)
|
Métrica |
Descrição |
|
DCGM_CUSTOM_ALLOCATE_MODE |
Indica o modo de operação do nó. Os valores possíveis são: |
|
DCGM_CUSTOM_CONTAINER_CP_ALLOCATED |
Percentual do poder de computação total de uma única GPU alocado a um contêiner. O valor varia de 0 a 1. O valor 0 significa que o contêiner usa uma GPU exclusiva ou compartilhada com solicitação apenas de memória de vídeo, sem impor limite ao seu poder de computação. Por exemplo, se uma GPU oferece 100 unidades de poder de computação e 30 são alocadas a um contêiner, a proporção é 0,3. |
|
DCGM_CUSTOM_CONTAINER_MEM_ALLOCATED |
Quantidade de memória de vídeo alocada para o contêiner. |
|
DCGM_CUSTOM_DEV_FB_ALLOCATED |
Percentual da memória de framebuffer total da GPU que está alocada. O valor varia de 0 a 1. |
|
DCGM_CUSTOM_DEV_FB_TOTAL |
Memória de framebuffer total da GPU. |
|
DCGM_CUSTOM_ILLEGAL_PROCESS_DECODE_UTIL |
Utilização do decodificador por processos não autorizados. |
|
DCGM_CUSTOM_ILLEGAL_PROCESS_ENCODE_UTIL |
Utilização do codificador por processos não autorizados. |
|
DCGM_CUSTOM_ILLEGAL_PROCESS_MEM_COPY_UTIL |
Utilização de cópia de memória por processos não autorizados. |
|
DCGM_CUSTOM_ILLEGAL_PROCESS_MEM_USED |
Memória de vídeo utilizada por processos não autorizados. |
|
DCGM_CUSTOM_ILLEGAL_PROCESS_SM_UTIL |
Utilização do Streaming Multiprocessor (SM) por processos não autorizados. |
|
DCGM_CUSTOM_PROCESS_DECODE_UTIL |
Utilização do decodificador por um processo da GPU. |
|
DCGM_CUSTOM_PROCESS_ENCODE_UTIL |
Utilização do codificador por um processo da GPU. |
|
DCGM_CUSTOM_PROCESS_MEM_COPY_UTIL |
Utilização de cópia de memória por um processo da GPU. |
|
DCGM_CUSTOM_PROCESS_MEM_USED |
Quantidade de memória de vídeo utilizada por um processo da GPU. |
|
DCGM_CUSTOM_PROCESS_SM_UTIL |
Utilização do Streaming Multiprocessor (SM) por um processo da GPU. |
|
DCGM_FI_DEV_APP_MEM_CLOCK |
Frequência de clock de aplicação da memória. |
|
DCGM_FI_DEV_APP_SM_CLOCK |
Frequência de clock de aplicação do Streaming Multiprocessor (SM). |
|
DCGM_FI_DEV_BAR1_FREE |
Quantidade de memória BAR1 livre. |
|
DCGM_FI_DEV_BAR1_TOTAL |
Tamanho total do Base Address Register 1 (BAR1) do dispositivo, usado para mapear a memória da GPU no espaço de endereçamento do sistema. |
|
DCGM_FI_DEV_BAR1_USED |
Quantidade de memória BAR1 utilizada. |
|
DCGM_FI_DEV_BOARD_LIMIT_VIOLATION |
Duração das violações de limite da placa. |
|
DCGM_FI_DEV_CLOCK_THROTTLE_REASONS |
Máscara de bits com os motivos para limitação de clock. |
|
DCGM_FI_DEV_COUNT |
Número de dispositivos. |
|
DCGM_FI_DEV_DEC_UTIL |
Utilização do decodificador. |
|
DCGM_FI_DEV_ENC_UTIL |
Utilização do codificador. |
|
DCGM_FI_DEV_FB_FREE |
Quantidade de memória de framebuffer livre. |
|
DCGM_FI_DEV_FB_USED |
Quantidade de memória de framebuffer utilizada. Este valor corresponde ao valor |
|
DCGM_FI_DEV_GPU_TEMP |
Temperatura da GPU. |
|
DCGM_FI_DEV_GPU_UTIL |
Percentual de tempo, durante um período de amostragem (como 1s ou 1/6s, dependendo da GPU), em que um ou mais kernels estiveram ativos. Esta métrica indica que os recursos da GPU estavam em uso, mas não mede a intensidade da carga de trabalho. |
|
DCGM_FI_DEV_LOW_UTIL_VIOLATION |
Duração das violações de limite de baixa utilização. |
|
DCGM_FI_DEV_MEM_CLOCK |
Frequência de clock da memória. |
|
DCGM_FI_DEV_MEM_COPY_UTIL |
Utilização da largura de banda da memória. Por exemplo, uma GPU NVIDIA V100 tem largura de banda máxima de memória de 900 GB/s. Se a largura de banda atual for 450 GB/s, a utilização será de 50%. |
|
DCGM_FI_DEV_MEMORY_TEMP |
Temperatura da memória. |
|
DCGM_FI_DEV_NVLINK_BANDWIDTH_TOTAL |
Largura de banda total do NVLink. |
|
DCGM_FI_DEV_PCIE_REPLAY_COUNTER |
Contagem de novas tentativas de transmissão PCIe causadas por erros de dados. |
|
DCGM_FI_DEV_POWER_USAGE |
Consumo de energia. |
|
DCGM_FI_DEV_POWER_VIOLATION |
Duração das violações de limite de energia. |
|
DCGM_FI_DEV_PSTATE |
Estado de energia do dispositivo (P-state). |
|
DCGM_FI_DEV_RELIABILITY_VIOLATION |
Duração das violações de limite de confiabilidade da placa. |
|
DCGM_FI_DEV_RETIRED_DBE |
Número de páginas desativadas devido a erros de bit duplo (DBE). |
|
DCGM_FI_DEV_RETIRED_PENDING |
Número de páginas com desativação pendente, ou seja, páginas na memória da GPU marcadas como inutilizáveis devido a erros. |
|
DCGM_FI_DEV_RETIRED_SBE |
Número de páginas desativadas devido a erros de bit único (SBE). |
|
DCGM_FI_DEV_SM_CLOCK |
Frequência de clock do Streaming Multiprocessor (SM). |
|
DCGM_FI_DEV_SYNC_BOOST_VIOLATION |
Duração das violações de limite de sync boost. |
|
DCGM_FI_DEV_THERMAL_VIOLATION |
Duração das violações de limite térmico. |
|
DCGM_FI_DEV_TOTAL_ENERGY_CONSUMPTION |
Energia total consumida desde o carregamento do driver. |
|
DCGM_FI_DEV_VIDEO_CLOCK |
Frequência de clock de vídeo. |
|
DCGM_FI_DEV_XID_ERRORS |
Código do erro XID mais recente ocorrido dentro de um período de amostragem. |
|
DCGM_FI_PROF_DRAM_ACTIVE |
Fração de ciclos em que a DRAM está ativa (enviando ou recebendo dados), representando a utilização da largura de banda da memória. Este valor é uma média ao longo de um intervalo, não uma leitura instantânea. Um valor mais alto indica maior utilização da memória do dispositivo. O valor 1,0 (100%) significa que uma instrução da DRAM foi executada a cada ciclo, embora um pico de aproximadamente 0,8 (80%) seja o máximo prático. O valor 0,2 (20%) significa que dados foram lidos da memória do dispositivo ou gravados nela durante 20% dos ciclos no intervalo de medição. |
|
DCGM_FI_PROF_GR_ENGINE_ACTIVE |
Percentual de tempo, durante um intervalo, em que o mecanismo gráfico ou de computação esteve ativo. Este valor é uma média entre todos os mecanismos gráficos e de computação. O mecanismo é considerado ativo quando um contexto gráfico ou de computação está vinculado a um thread e se encontra em estado ocupado. |
|
DCGM_FI_PROF_NVLINK_RX_BYTES |
Taxa de dados recebidos pelo NVLink, excluindo cabeçalhos de protocolo. Trata-se de uma taxa média durante o intervalo de medição, não de um valor instantâneo. Por exemplo, transferir 1 GB de dados em 1 segundo resulta em uma taxa de 1 GB/s, independentemente de a transferência ter sido um fluxo constante ou um pico. A largura de banda máxima teórica para NVLink Gen2 é de 25 GB/s por link em cada direção. |
|
DCGM_FI_PROF_NVLINK_TX_BYTES |
Taxa de dados transmitidos pelo NVLink (saída), excluindo cabeçalhos de protocolo. |
|
DCGM_FI_PROF_PCIE_RX_BYTES |
Taxa de dados recebidos pelo barramento PCIe, incluindo cabeçalhos de protocolo e carga útil de dados. Trata-se de uma taxa média durante o intervalo de medição, não de um valor instantâneo. Por exemplo, transferir 1 GB de dados em 1 segundo resulta em uma taxa de 1 GB/s, independentemente de a transferência ter sido um fluxo constante ou um pico. A largura de banda máxima teórica para PCIe Gen3 é de 985 MB/s por pista. |
|
DCGM_FI_PROF_PCIE_TX_BYTES |
Taxa de dados transmitidos pelo barramento PCIe, incluindo cabeçalhos de protocolo e carga útil de dados. Trata-se de uma taxa média durante o intervalo de medição, não de um valor instantâneo. Por exemplo, transferir 1 GB de dados em 1 segundo resulta em uma taxa de 1 GB/s, independentemente de a transferência ter sido um fluxo constante ou um pico. A largura de banda máxima teórica para PCIe Gen3 é de 985 MB/s por pista. |
|
DCGM_FI_PROF_PIPE_FP16_ACTIVE |
Fração de ciclos em que o pipeline FP16 (meia precisão) está ativo. Este valor é uma média ao longo de um intervalo de tempo, não um valor instantâneo. Um valor mais alto indica maior utilização dos núcleos FP16. O valor 1,0 (100%) significa que uma instrução FP16 foi executada a cada dois ciclos (para GPUs baseadas em Volta, por exemplo) durante todo o intervalo. O valor 0,2 (20%) pode significar qualquer uma das opções a seguir: 20% dos SMs executaram seus núcleos FP16 com 100% de utilização durante todo o intervalo. 100% dos SMs executaram seus núcleos FP16 com 20% de utilização durante todo o intervalo. 100% dos SMs executaram seus núcleos FP16 com 100% de utilização durante um quinto do intervalo. Outras combinações. |
|
DCGM_FI_PROF_PIPE_FP32_ACTIVE |
Fração de ciclos em que o pipeline Fused Multiply-Add (FMA) está ativo. Este pipeline lida com operações FP32 (precisão simples) e inteiras. Este valor é uma média ao longo de um intervalo de tempo, não um valor instantâneo. Um valor mais alto indica maior utilização dos núcleos FP32. O valor 1,0 (100%) significa que uma instrução FP32 foi executada a cada dois ciclos (para GPUs baseadas em Volta, por exemplo) durante todo o intervalo. O valor 0,2 (20%) pode significar qualquer uma das opções a seguir: 20% dos SMs executaram seus núcleos FP32 com 100% de utilização durante todo o intervalo. 100% dos SMs executaram seus núcleos FP32 com 20% de utilização durante todo o intervalo. 100% dos SMs executaram seus núcleos FP32 com 100% de utilização durante um quinto do intervalo. Outras combinações. |
|
DCGM_FI_PROF_PIPE_FP64_ACTIVE |
Fração de ciclos em que o pipeline FP64 (dupla precisão) está ativo. Este valor é uma média ao longo de um intervalo de tempo, não um valor instantâneo. Um valor mais alto indica maior utilização dos núcleos FP64. O valor 1,0 (100%) significa que uma instrução FP64 foi executada a cada quatro ciclos (para GPUs baseadas em Volta, por exemplo) durante todo o intervalo. O valor 0,2 (20%) pode significar qualquer uma das opções a seguir: 20% dos SMs executaram seus núcleos FP64 com 100% de utilização durante todo o intervalo. 100% dos SMs executaram seus núcleos FP64 com 20% de utilização durante todo o intervalo. 100% dos SMs executaram seus núcleos FP64 com 100% de utilização durante um quinto do intervalo. Outras combinações. |
|
DCGM_FI_PROF_PIPE_TENSOR_ACTIVE |
Fração de ciclos em que o pipeline Tensor (HMMA/IMMA) está ativo. Este valor é uma média ao longo de um intervalo de tempo, não um valor instantâneo. Um valor mais alto indica maior utilização dos Tensor Cores. O valor 1,0 (100%) significa que uma instrução Tensor foi emitida a cada dois ciclos, pois uma instrução leva dois ciclos para ser concluída. O valor 0,2 (20%) pode significar qualquer uma das opções a seguir: 20% dos SMs executaram seus Tensor Cores com 100% de utilização durante todo o intervalo. 100% dos SMs executaram seus Tensor Cores com 20% de utilização durante todo o intervalo. 100% dos SMs executaram seus Tensor Cores com 100% de utilização durante um quinto do intervalo. Outras combinações. |
|
DCGM_FI_PROF_SM_ACTIVE |
Percentual de tempo, durante um intervalo, em que pelo menos um warp estava ativo em um Streaming Multiprocessor (SM). Este valor é uma média entre todos os SMs e não é sensível ao número de threads por bloco. Um warp é considerado ativo após ser agendado e receber alocação de recursos, independentemente de estar computando ou aguardando uma dependência (como uma solicitação de memória). Um valor abaixo de 0,5 indica utilização ineficiente da GPU, enquanto um valor acima de 0,8 é desejável. |
|
DCGM_FI_PROF_SM_OCCUPANCY |
Proporção de warps residentes em um SM em relação ao número máximo de warps residentes suportados por esse SM. Este valor é uma média entre todos os SMs ao longo de um intervalo de tempo. Maior ocupação não significa necessariamente maior utilização da GPU. Para cargas de trabalho limitadas pela largura de banda da memória (indicadas por um valor alto de |
|
nvidia_gpu_allocated_num_devices |
Número de dispositivos GPU alocados. Aviso: Esta métrica foi descontinuada. |
|
nvidia_gpu_memory_allocated_bytes |
Memória total da GPU alocada. Aviso: Esta métrica foi descontinuada e substituída por |
|
nvidia_gpu_sharing_memory |
Memória alocada para compartilhamento de GPU. Aviso: Esta métrica foi descontinuada e substituída por |
|
up |
Indica se o alvo de coleta está íntegro. O valor 1 significa que o alvo está ativo e acessível, enquanto 0 indica que está inativo. |
Cost-Exporter (Job name: alibaba-cloud-cost-exporter)
|
Métrica |
Descrição |
|
deducted_by_cash_coupons |
Dedução de cupom na fatura de uma instância. |
|
deducted_by_prepaid_card |
Dedução de cartão pré-pago na fatura de uma instância. |
|
invoice_discount |
Desconto aplicado na fatura de uma instância. |
|
list_price |
Preço de lista da instância. |
|
node_current_price |
Preço atual do nó. |
|
node_payAsYouGo_price |
Preço de pagamento conforme o uso do nó. |
|
node_payByPeriod_price |
Preço de assinatura do nó. |
|
node_spot_price |
Preço equivalente de Spot Instance para o nó. |
|
outstanding_amount |
Valor pendente na fatura da instância. |
|
payent_amount |
Pagamento em dinheiro na fatura da instância. |
|
pretax_amount |
Valor antes de impostos na fatura da instância. |
|
pretax_gross_amount |
Valor bruto antes de impostos na fatura da instância. |
|
usage |
Uso de recursos da instância. |
|
up |
Indica se o alvo está íntegro. O valor 1 significa que está ativo e acessível; 0 significa que está inativo. |
Ingress (Job Name: arms-ack-ingress, ingress-ask-default)
|
Métrica |
Descrição |
|
aliyun_prometheus_agent_append_duration_seconds |
Duração das operações de anexação do agente Alibaba Cloud Prometheus, em segundos. |
|
aliyun_prometheus_agent_job_discovery_status |
Status de descoberta de jobs de coleta do agente Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrape_custom_error |
Número de erros personalizados de coleta do agente Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Número total de coletas por alvo realizadas pelo agente Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_target_info |
Informações sobre os alvos do agente Alibaba Cloud Prometheus. |
|
nginx_ingress_controller_admission_config_size |
Tamanho da configuração de admissão. |
|
nginx_ingress_controller_admission_render_duration |
Duração do processo de renderização de admissão. |
|
nginx_ingress_controller_admission_render_ingresses |
Número de recursos de ingress renderizados para admissão. |
|
nginx_ingress_controller_admission_roundtrip_duration |
Duração do processamento de ida e volta da admissão. |
|
nginx_ingress_controller_admission_tested_duration |
Duração do teste de admissão. |
|
nginx_ingress_controller_admission_tested_ingresses |
Número de recursos de ingress testados para admissão. |
|
nginx_ingress_controller_build_info |
Informações de compilação. |
|
nginx_ingress_controller_bytes_sent_bucket |
Distribuição de bytes enviados. |
|
nginx_ingress_controller_bytes_sent_count |
Número total de observações de bytes enviados. |
|
nginx_ingress_controller_bytes_sent_sum |
Total de bytes enviados. |
|
nginx_ingress_controller_check_errors |
Total de erros de verificação. |
|
nginx_ingress_controller_check_success |
Total de verificações bem-sucedidas. |
|
nginx_ingress_controller_config_hash |
Hash da configuração em execução. |
|
nginx_ingress_controller_config_last_reload_successful |
Indica se o último recarregamento de configuração foi bem-sucedido (1 para sucesso, 0 para falha). |
|
nginx_ingress_controller_config_last_reload_successful_timestamp_seconds |
Timestamp do último recarregamento de configuração bem-sucedido, em segundos. |
|
nginx_ingress_controller_connect_duration_seconds_bucket |
Distribuição do tempo de estabelecimento de conexão, em segundos. |
|
nginx_ingress_controller_connect_duration_seconds_count |
Número total de observações de tempo de estabelecimento de conexão. |
|
nginx_ingress_controller_connect_duration_seconds_sum |
Tempo total de estabelecimento de conexão, em segundos. |
|
nginx_ingress_controller_errors |
Total de erros. |
|
nginx_ingress_controller_header_duration_seconds_bucket |
Distribuição do tempo de processamento de cabeçalho, em segundos. |
|
nginx_ingress_controller_header_duration_seconds_count |
Número total de observações de tempo de processamento de cabeçalho. |
|
nginx_ingress_controller_header_duration_seconds_sum |
Tempo total de processamento de cabeçalho, em segundos. |
|
nginx_ingress_controller_ingress_upstream_latency_seconds |
Distribuição da latência upstream, em segundos. |
|
nginx_ingress_controller_ingress_upstream_latency_seconds_count |
Número total de observações de latência upstream. |
|
nginx_ingress_controller_ingress_upstream_latency_seconds_sum |
Latência upstream total, em segundos. |
|
nginx_ingress_controller_leader_election_status |
Status atual do processo de eleição de líder. |
|
nginx_ingress_controller_nginx_process_connections |
Número atual de conexões do processo nginx. |
|
nginx_ingress_controller_nginx_process_connections_total |
Número total de conexões do processo nginx. |
|
nginx_ingress_controller_nginx_process_cpu_seconds_total |
Tempo total de CPU usado pelo processo nginx, em segundos. |
|
nginx_ingress_controller_nginx_process_num_procs |
Número de processos nginx. |
|
nginx_ingress_controller_nginx_process_oldest_start_time_seconds |
Hora de início do processo nginx mais antigo, em segundos. |
|
nginx_ingress_controller_nginx_process_read_bytes_total |
Número total de bytes lidos pelo processo nginx. |
|
nginx_ingress_controller_nginx_process_requests_total |
Número total de solicitações tratadas pelo processo nginx. |
|
nginx_ingress_controller_nginx_process_resident_memory_bytes |
Tamanho da memória residente do processo nginx, em bytes. |
|
nginx_ingress_controller_nginx_process_virtual_memory_bytes |
Tamanho da memória virtual do processo nginx, em bytes. |
|
nginx_ingress_controller_nginx_process_write_bytes_total |
Número total de bytes gravados pelo processo nginx. |
|
nginx_ingress_controller_orphan_ingress |
Número atual de recursos de ingress órfãos. |
|
nginx_ingress_controller_request_duration_seconds_bucket |
Distribuição da duração da solicitação, em segundos. |
|
nginx_ingress_controller_request_duration_seconds_count |
Número total de observações de duração de solicitação. |
|
nginx_ingress_controller_request_duration_seconds_sum |
Duração total da solicitação, em segundos. |
|
nginx_ingress_controller_request_size_bucket |
Distribuição dos tamanhos de solicitação. |
|
nginx_ingress_controller_request_size_count |
Número total de observações de tamanho de solicitação. |
|
nginx_ingress_controller_request_size_sum |
Tamanho total da solicitação. |
|
nginx_ingress_controller_requests |
Número total de solicitações. |
|
nginx_ingress_controller_response_duration_seconds_bucket |
Distribuição da duração da resposta, em segundos. |
|
nginx_ingress_controller_response_duration_seconds_count |
Número total de observações de duração de resposta. |
|
nginx_ingress_controller_response_duration_seconds_sum |
Duração total da resposta, em segundos. |
|
nginx_ingress_controller_response_size_bucket |
Distribuição dos tamanhos de resposta. |
|
nginx_ingress_controller_response_size_count |
Número total de observações de tamanho de resposta. |
|
nginx_ingress_controller_response_size_sum |
Tamanho total da resposta. |
|
nginx_ingress_controller_ssl_certificate_info |
Informações sobre o certificado SSL. |
|
nginx_ingress_controller_ssl_expire_time_seconds |
Tempo de expiração do certificado SSL, em segundos. |
|
nginx_ingress_controller_success |
Total de operações bem-sucedidas. |
|
up |
Indica se um alvo está íntegro. O valor 1 significa que o alvo está ativo e acessível; 0 significa que está inativo. |
Koordinator (job name: kube-system/koordlet-metrics-podmonitor, koord-manager-metrics-service)
|
Métrica |
Descrição |
|
aliyun_prometheus_agent_append_duration_seconds |
Duração das operações de anexação do agente Alibaba Cloud Prometheus (segundos). |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Número total de coletas realizadas pelo agente Alibaba Cloud Prometheus, divididas por alvo. |
|
aliyun_prometheus_agent_target_info |
Informações de alvo do agente Alibaba Cloud Prometheus. |
|
koord_manager_recommender_recommendation_workload_target |
Especificações de recursos recomendadas para uma carga de trabalho, geradas pelo recurso de perfil de recursos. |
|
koordlet_container_resource_limits |
Limite de recursos para um contêiner. |
|
koordlet_container_resource_requests |
Solicitação de recursos para um contêiner. |
|
koordlet_node_priority_resource_reclaimable |
Quantidade de recursos recuperáveis em um nó, categorizados por prioridade. |
|
koordlet_node_resource_allocatable |
Recursos alocáveis em um nó. |
|
slo_manager_recommender_recommendation_workload_target |
Especificações de recursos recomendadas para uma carga de trabalho, geradas pelo recurso de perfil de recursos. (descontinuado) |
|
up |
Indica a integridade do alvo. O valor 1 significa que o alvo está ativo e acessível; 0 significa que está inativo. |
Componente etcd do ACK Dedicated (Job name: etcd)
|
Métrica |
Descrição |
|
aliyun_prometheus_agent_append_duration_seconds |
Duração das operações de append do agente Alibaba Cloud Prometheus, em segundos. |
|
aliyun_prometheus_agent_job_discovery_status |
Status de descoberta dos jobs de scrape do agente Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrape_custom_error |
Quantidade total de erros personalizados de scrape do agente Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Número total de scrapes por alvo realizados pelo agente Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_target_info |
Informações sobre os alvos do agente Alibaba Cloud Prometheus. |
|
cpu_utilization_core |
Utilização de CPU medida em núcleos. |
|
etcd_cluster_version |
Versão do cluster etcd. |
|
etcd_debugging_auth_revision |
Revisão do armazenamento de autenticação do etcd para depuração. |
|
etcd_debugging_disk_backend_commit_rebalance_duration_seconds_bucket |
Distribuição de latência do rebalanceamento de commit do backend de disco para depuração (em segundos). |
|
etcd_debugging_disk_backend_commit_rebalance_duration_seconds_count |
Contagem total de operações de rebalanceamento de commit do backend de disco para depuração. |
|
etcd_debugging_disk_backend_commit_rebalance_duration_seconds_sum |
Duração total das operações de rebalanceamento de commit do backend de disco para depuração (em segundos). |
|
etcd_debugging_disk_backend_commit_spill_duration_seconds_bucket |
Distribuição de latência do spill de commit do backend de disco para depuração (em segundos). |
|
etcd_debugging_disk_backend_commit_spill_duration_seconds_count |
Contagem total de operações de spill de commit do backend de disco para depuração. |
|
etcd_debugging_disk_backend_commit_spill_duration_seconds_sum |
Duração total das operações de spill de commit do backend de disco para depuração (em segundos). |
|
etcd_debugging_disk_backend_commit_write_duration_seconds_bucket |
Distribuição de latência das operações de escrita de commit do backend de disco para depuração (em segundos). |
|
etcd_debugging_disk_backend_commit_write_duration_seconds_count |
Contagem total de operações de escrita de commit do backend de disco para depuração. |
|
etcd_debugging_disk_backend_commit_write_duration_seconds_sum |
Duração total das operações de escrita de commit do backend de disco para depuração (em segundos). |
|
etcd_debugging_lease_granted_total |
Quantidade total de leases concedidos para depuração. |
|
etcd_debugging_lease_renewed_total |
Quantidade total de leases renovados para depuração. |
|
etcd_debugging_lease_revoked_total |
Quantidade total de leases revogados para depuração. |
|
etcd_debugging_lease_ttl_total_bucket |
Distribuição do Time-To-Live (TTL) de leases para depuração (em segundos). |
|
etcd_debugging_lease_ttl_total_count |
Contagem total de TTLs de leases para depuração. |
|
etcd_debugging_lease_ttl_total_sum |
Duração total dos TTLs de leases para depuração (em segundos). |
|
etcd_debugging_mvcc_compact_revision |
Revisão da última compactação MVCC para depuração. |
|
etcd_debugging_mvcc_current_revision |
Revisão atual do armazenamento MVCC para depuração. |
|
etcd_debugging_mvcc_db_compaction_keys_total |
Número total de chaves compactadas no banco de dados MVCC para depuração. |
|
etcd_debugging_mvcc_db_compaction_last |
Timestamp da última compactação do banco de dados MVCC para depuração. |
|
etcd_debugging_mvcc_db_compaction_pause_duration_milliseconds_bucket |
Distribuição de latência das pausas de compactação do banco de dados MVCC para depuração (em milissegundos). |
|
etcd_debugging_mvcc_db_compaction_pause_duration_milliseconds_count |
Contagem total de pausas de compactação do banco de dados MVCC para depuração. |
|
etcd_debugging_mvcc_db_compaction_pause_duration_milliseconds_sum |
Duração total das pausas de compactação do banco de dados MVCC para depuração (em milissegundos). |
|
etcd_debugging_mvcc_db_compaction_total_duration_milliseconds_bucket |
Distribuição de latência das compactações do banco de dados MVCC para depuração (em milissegundos). |
|
etcd_debugging_mvcc_db_compaction_total_duration_milliseconds_count |
Contagem total de operações de compactação do banco de dados MVCC para depuração. |
|
etcd_debugging_mvcc_db_compaction_total_duration_milliseconds_sum |
Duração total das operações de compactação do banco de dados MVCC para depuração (em milissegundos). |
|
etcd_debugging_mvcc_db_total_size_in_bytes |
Tamanho total do banco de dados MVCC para depuração (em bytes). |
|
etcd_debugging_mvcc_delete_total |
Quantidade total de operações de exclusão MVCC para depuração. |
|
etcd_debugging_mvcc_events_total |
Quantidade total de eventos MVCC para depuração. |
|
etcd_debugging_mvcc_index_compaction_pause_duration_milliseconds_bucket |
Distribuição de latência das pausas de compactação de índice MVCC para depuração (em milissegundos). |
|
etcd_debugging_mvcc_index_compaction_pause_duration_milliseconds_count |
Contagem total de pausas de compactação de índice MVCC para depuração. |
|
etcd_debugging_mvcc_index_compaction_pause_duration_milliseconds_sum |
Duração total das pausas de compactação de índice MVCC para depuração (em milissegundos). |
|
etcd_debugging_mvcc_keys_total |
Número total de chaves no armazenamento MVCC para depuração. |
|
etcd_debugging_mvcc_pending_events_total |
Quantidade total de eventos MVCC pendentes para depuração. |
|
etcd_debugging_mvcc_put_total |
Quantidade total de operações put MVCC para depuração. |
|
etcd_debugging_mvcc_range_total |
Número total de requisições range MVCC para depuração. |
|
etcd_debugging_mvcc_slow_watcher_total |
Quantidade total de watchers lentos no armazenamento MVCC para depuração. |
|
etcd_debugging_mvcc_total_put_size_in_bytes |
Tamanho total de todas as operações put MVCC para depuração (em bytes). |
|
etcd_debugging_mvcc_txn_total |
Quantidade total de transações MVCC para depuração. |
|
etcd_debugging_mvcc_watch_stream_total |
Número total de streams watch MVCC para depuração. |
|
etcd_debugging_mvcc_watcher_total |
Quantidade total de watchers no armazenamento MVCC para depuração. |
|
etcd_debugging_server_lease_expired_total |
Número total de leases de servidor expirados para depuração. |
|
etcd_debugging_snap_save_marshalling_duration_seconds_bucket |
Distribuição de latência das operações de marshalling ao salvar snapshot para depuração (em segundos). |
|
etcd_debugging_snap_save_marshalling_duration_seconds_count |
Número total de operações de marshalling ao salvar snapshot para depuração. |
|
etcd_debugging_snap_save_marshalling_duration_seconds_sum |
Duração total das operações de marshalling ao salvar snapshot para depuração (em segundos). |
|
etcd_debugging_snap_save_total_duration_seconds_bucket |
Distribuição de latência das operações de salvamento de snapshot para depuração (em segundos). |
|
etcd_debugging_snap_save_total_duration_seconds_count |
Contagem total de operações de salvamento de snapshot para depuração. |
|
etcd_debugging_snap_save_total_duration_seconds_sum |
Duração total das operações de salvamento de snapshot para depuração (em segundos). |
|
etcd_debugging_store_expires_total |
Número total de chaves expiradas no armazenamento para depuração. |
|
etcd_debugging_store_reads_total |
Quantidade total de operações de leitura no armazenamento para depuração. |
|
etcd_debugging_store_watch_requests_total |
Número total de requisições watch no armazenamento para depuração. |
|
etcd_debugging_store_watchers |
Quantidade de watchers no armazenamento para depuração. |
|
etcd_debugging_store_writes_total |
Quantidade total de operações de escrita no armazenamento para depuração. |
|
etcd_disk_backend_commit_duration_seconds_bucket |
Distribuição de latência dos commits do backend de disco (em segundos). |
|
etcd_disk_backend_commit_duration_seconds_count |
Contagem total de operações de commit do backend de disco. |
|
etcd_disk_backend_commit_duration_seconds_sum |
Duração total das operações de commit do backend de disco (em segundos). |
|
etcd_disk_backend_defrag_duration_seconds_bucket |
Distribuição de latência da desfragmentação do backend de disco (em segundos). |
|
etcd_disk_backend_defrag_duration_seconds_count |
Contagem total de operações de desfragmentação do backend de disco. |
|
etcd_disk_backend_defrag_duration_seconds_sum |
Duração total das operações de desfragmentação do backend de disco (em segundos). |
|
etcd_disk_backend_snapshot_duration_seconds_bucket |
Distribuição de latência dos snapshots do backend de disco (em segundos). |
|
etcd_disk_backend_snapshot_duration_seconds_count |
Contagem total de operações de snapshot do backend de disco. |
|
etcd_disk_backend_snapshot_duration_seconds_sum |
Duração total das operações de snapshot do backend de disco (em segundos). |
|
etcd_disk_defrag_inflight |
Número de operações de desfragmentação de disco em andamento. |
|
etcd_disk_wal_fsync_duration_seconds_bucket |
Distribuição de latência dos fsyncs do WAL (em segundos). |
|
etcd_disk_wal_fsync_duration_seconds_count |
Contagem total de operações de fsync do WAL. |
|
etcd_disk_wal_fsync_duration_seconds_sum |
Duração total das operações de fsync do WAL (em segundos). |
|
etcd_disk_wal_write_bytes_total |
Total de bytes gravados no WAL. |
|
etcd_grpc_proxy_cache_hits_total |
Número total de acertos de cache no proxy gRPC. |
|
etcd_grpc_proxy_cache_keys_total |
Quantidade total de chaves no cache do proxy gRPC. |
|
etcd_grpc_proxy_cache_misses_total |
Número total de falhas de cache no proxy gRPC. |
|
etcd_grpc_proxy_events_coalescing_total |
Quantidade total de eventos coalescidos no proxy gRPC. |
|
etcd_grpc_proxy_watchers_coalescing_total |
Número total de watchers coalescidos no proxy gRPC. |
|
etcd_mvcc_db_open_read_transactions |
Quantidade de transações de leitura abertas no banco de dados MVCC. |
|
etcd_mvcc_db_total_size_in_bytes |
Tamanho total do banco de dados MVCC em disco (em bytes). |
|
etcd_mvcc_db_total_size_in_use_in_bytes |
Tamanho real do banco de dados MVCC em uso (em bytes). |
|
etcd_mvcc_delete_total |
Quantidade total de operações de exclusão MVCC. |
|
etcd_mvcc_hash_duration_seconds_bucket |
Distribuição de latência das operações de hash MVCC (em segundos). |
|
etcd_mvcc_hash_duration_seconds_count |
Contagem total de operações de hash MVCC. |
|
etcd_mvcc_hash_duration_seconds_sum |
Duração total das operações de hash MVCC (em segundos). |
|
etcd_mvcc_hash_rev_duration_seconds_bucket |
Distribuição de latência das operações de revisão de hash MVCC (em segundos). |
|
etcd_mvcc_hash_rev_duration_seconds_count |
Contagem total de operações de revisão de hash MVCC. |
|
etcd_mvcc_hash_rev_duration_seconds_sum |
Duração total das operações de revisão de hash MVCC (em segundos). |
|
etcd_mvcc_put_total |
Quantidade total de operações put MVCC. |
|
etcd_mvcc_range_total |
Número total de requisições range MVCC. |
|
etcd_mvcc_txn_total |
Quantidade total de transações MVCC. |
|
etcd_network_active_peers |
Número de peers ativos. |
|
etcd_network_client_grpc_received_bytes_total |
Total de bytes recebidos de clientes via gRPC. |
|
etcd_network_client_grpc_sent_bytes_total |
Total de bytes enviados para clientes via gRPC. |
|
etcd_network_disconnected_peers_total |
Quantidade total de peers desconectados. |
|
etcd_network_peer_received_bytes_total |
Total de bytes recebidos de peers. |
|
etcd_network_peer_received_failures_total |
Número total de falhas de recebimento de peers. |
|
etcd_network_peer_round_trip_time_seconds_bucket |
Distribuição de latência do tempo de ida e volta (round-trip) de peers (em segundos). |
|
etcd_network_peer_round_trip_time_seconds_count |
Contagem total de medições de tempo de ida e volta de peers. |
|
etcd_network_peer_round_trip_time_seconds_sum |
Duração total dos tempos de ida e volta de peers (em segundos). |
|
etcd_network_peer_sent_bytes_total |
Total de bytes enviados para peers. |
|
etcd_network_peer_sent_failures_total |
Número total de falhas de envio para peers. |
|
etcd_network_server_stream_failures_total |
Quantidade total de falhas de stream do servidor. |
|
etcd_network_snapshot_receive_inflights_total |
Número de snapshots sendo recebidos atualmente. |
|
etcd_network_snapshot_receive_success |
Quantidade total de recebimentos de snapshot bem-sucedidos. |
|
etcd_network_snapshot_receive_total_duration_seconds_bucket |
Distribuição de latência do recebimento de snapshots (em segundos). |
|
etcd_network_snapshot_receive_total_duration_seconds_count |
Contagem total de operações de recebimento de snapshot. |
|
etcd_network_snapshot_receive_total_duration_seconds_sum |
Duração total das operações de recebimento de snapshot (em segundos). |
|
etcd_network_snapshot_send_inflights_total |
Número de snapshots sendo enviados atualmente. |
|
etcd_network_snapshot_send_success |
Quantidade total de envios de snapshot bem-sucedidos. |
|
etcd_network_snapshot_send_total_duration_seconds_bucket |
Distribuição de latência do envio de snapshots (em segundos). |
|
etcd_network_snapshot_send_total_duration_seconds_count |
Contagem total de operações de envio de snapshot. |
|
etcd_network_snapshot_send_total_duration_seconds_sum |
Duração total das operações de envio de snapshot (em segundos). |
|
etcd_server_apply_duration_seconds_bucket |
Distribuição de latência das operações apply do servidor (em segundos). |
|
etcd_server_apply_duration_seconds_count |
Contagem total de operações apply do servidor. |
|
etcd_server_apply_duration_seconds_sum |
Duração total das operações apply do servidor (em segundos). |
|
etcd_server_client_requests_total |
Número total de requisições de clientes ao servidor. |
|
etcd_server_go_version |
Versão do Go utilizada pelo servidor etcd. |
|
etcd_server_has_leader |
Indica se o servidor considera que existe um líder (1 para sim, 0 para não). |
|
etcd_server_health_failures |
Quantidade total de verificações de integridade com falha. |
|
etcd_server_health_success |
Número total de verificações de integridade bem-sucedidas. |
|
etcd_server_heartbeat_send_failures_total |
Quantidade total de falhas no envio de heartbeat. |
|
etcd_server_id |
ID do servidor. |
|
etcd_server_is_leader |
Indica se este servidor é o líder (1 para sim, 0 para não). |
|
etcd_server_is_learner |
Indica se este servidor é um learner (1 para sim, 0 para não). |
|
etcd_server_leader_changes_seen_total |
Número total de mudanças de líder observadas pelo servidor. |
|
etcd_server_learner_promote_successes |
Quantidade total de promoções de learner bem-sucedidas. |
|
etcd_server_proposals_applied_total |
Número total de propostas aplicadas pelo servidor. |
|
etcd_server_proposals_committed_total |
Quantidade total de propostas commitadas pelo servidor. |
|
etcd_server_proposals_failed_total |
Número total de propostas com falha. |
|
etcd_server_proposals_pending |
Quantidade de propostas pendentes. |
|
etcd_server_quota_backend_bytes |
Cota de armazenamento do backend do servidor (em bytes). |
|
etcd_server_read_indexes_failed_total |
Número total de falhas em read indexes. |
|
etcd_server_slow_apply_total |
Quantidade total de operações apply lentas. |
|
etcd_server_slow_read_indexes_total |
Número total de operações slow read index. |
|
etcd_server_snapshot_apply_in_progress_total |
Quantidade de operações de aplicação de snapshot em andamento. |
|
etcd_server_version |
Versão do servidor etcd. |
|
etcd_snap_db_fsync_duration_seconds_bucket |
Distribuição de latência dos fsyncs do banco de dados de snapshot (em segundos). |
|
etcd_snap_db_fsync_duration_seconds_count |
Número total de fsyncs do banco de dados de snapshot. |
|
etcd_snap_db_fsync_duration_seconds_sum |
Duração total dos fsyncs do banco de dados de snapshot (em segundos). |
|
etcd_snap_db_save_total_duration_seconds_bucket |
Distribuição de latência das operações de salvamento do banco de dados de snapshot (em segundos). |
|
etcd_snap_db_save_total_duration_seconds_count |
Contagem total de operações de salvamento do banco de dados de snapshot. |
|
etcd_snap_db_save_total_duration_seconds_sum |
Duração total das operações de salvamento do banco de dados de snapshot (em segundos). |
|
etcd_snap_fsync_duration_seconds_bucket |
Distribuição de latência dos fsyncs de snapshot (em segundos). |
|
etcd_snap_fsync_duration_seconds_count |
Contagem total de operações de fsync de snapshot. |
|
etcd_snap_fsync_duration_seconds_sum |
Duração total dos fsyncs de snapshot (em segundos). |
|
grpc_server_handled_total |
Número total de RPCs processadas pelo servidor gRPC. |
|
grpc_server_msg_received_total |
Quantidade total de mensagens recebidas pelo servidor gRPC. |
|
grpc_server_msg_sent_total |
Número total de mensagens enviadas pelo servidor gRPC. |
|
grpc_server_started_total |
Quantidade total de RPCs iniciadas no servidor gRPC. |
|
memory_utilization_byte |
Utilização de memória em bytes. |
|
os_fd_limit |
Limite do sistema operacional para descritores de arquivo. |
|
os_fd_used |
Número de descritores de arquivo em uso. |
|
up |
Indica se o alvo está íntegro e acessível: 1 para ativo, 0 para inativo. |
Componente scheduler do ACK Dedicated (job: ack-scheduler)
|
Métrica |
Descrição |
|
aggregator_discovery_aggregation_count_total |
Total de agregações de descoberta do aggregator. |
|
aliyun_prometheus_agent_append_duration_seconds |
Duração das operações de append do Agente Alibaba Cloud Prometheus, em segundos. |
|
aliyun_prometheus_agent_job_discovery_status |
Status de descoberta dos jobs de scrape do Agente Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrape_custom_error |
Total de erros personalizados de scrape do Agente Alibaba Cloud Prometheus. |
|
aliyun_prometheus_agent_scrapes_by_target_total |
Total de scrapes realizados pelo Agente Alibaba Cloud Prometheus, por alvo. |
|
aliyun_prometheus_agent_target_info |
Informações sobre os alvos de scrape do Agente Alibaba Cloud Prometheus. |
|
apiserver_audit_event_total |
Quantidade total de eventos de auditoria do APIServer. |
|
apiserver_audit_requests_rejected_total |
Número total de requisições de auditoria rejeitadas pelo APIServer. |
|
apiserver_client_certificate_expiration_seconds_bucket |
Distribuição do tempo de vida restante dos certificados de cliente do APIServer, em segundos. |
|
apiserver_client_certificate_expiration_seconds_count |
Contagem de medições de expiração de certificados de cliente do APIServer. |
|
apiserver_client_certificate_expiration_seconds_sum |
Soma do tempo de vida restante dos certificados de cliente do APIServer, em segundos. |
|
apiserver_delegated_authn_request_duration_seconds_bucket |
Distribuição da latência de autenticação delegada do APIServer, em segundos. |
|
apiserver_delegated_authn_request_duration_seconds_count |
Contagem de medições de latência de autenticação delegada do APIServer. |
|
apiserver_delegated_authn_request_duration_seconds_sum |
Latência total de autenticação delegada do APIServer, em segundos. |
|
apiserver_delegated_authn_request_total |
Número total de requisições de autenticação delegada ao APIServer. |
|
apiserver_delegated_authz_request_duration_seconds_bucket |
Distribuição da latência de autorização delegada do APIServer, em segundos. |
|
apiserver_delegated_authz_request_duration_seconds_count |
Contagem de medições de latência de autorização delegada do APIServer. |
|
apiserver_delegated_authz_request_duration_seconds_sum |
Latência total de autorização delegada do APIServer, em segundos. |
|
apiserver_delegated_authz_request_total |
Quantidade total de requisições de autorização delegada ao APIServer. |
|
apiserver_encryption_config_controller_automatic_reload_failures_total |
Número total de recarregamentos automáticos com falha na configuração de criptografia do APIServer. |
|
apiserver_encryption_config_controller_automatic_reload_success_total |
Quantidade total de recarregamentos automáticos bem-sucedidos na configuração de criptografia do APIServer. |
|
apiserver_envelope_encryption_dek_cache_fill_percent |
Percentual de preenchimento do cache DEK de envelope encryption do APIServer. |
|
apiserver_storage_data_key_generation_duration_seconds_bucket |
Distribuição da latência de geração de chaves de dados de armazenamento do APIServer, em segundos. |
|
apiserver_storage_data_key_generation_duration_seconds_count |
Total de operações de geração de chaves de dados de armazenamento do APIServer. |
|
apiserver_storage_data_key_generation_duration_seconds_sum |
Latência total da geração de chaves de dados de armazenamento do APIServer, em segundos. |
|
apiserver_storage_data_key_generation_failures_total |
Número total de falhas na geração de chaves de dados no armazenamento do APIServer. |
|
apiserver_storage_envelope_transformation_cache_misses_total |
Quantidade total de falhas de cache nas transformações de envelope do armazenamento do APIServer. |
|
apiserver_webhooks_x509_insecure_sha1_total |
Total de webhooks do APIServer utilizando certificado X.509 SHA-1 inseguro. |
|
apiserver_webhooks_x509_missing_san_total |
Número de webhooks do APIServer com certificado X.509 sem SAN. |
|
authenticated_user_requests |
Quantidade total de requisições de usuários autenticados. |
|
authentication_attempts |
Número total de tentativas de autenticação. |
|
authentication_duration_seconds_bucket |
Distribuição da latência de autenticação, em segundos. |
|
authentication_duration_seconds_count |
Contagem de medições de latência de autenticação. |
|
authentication_duration_seconds_sum |
Latência total de autenticação, em segundos. |
|
authentication_token_cache_active_fetch_count |
Número de buscas ativas no cache de tokens de autenticação. |
|
authentication_token_cache_fetch_total |
Total de buscas realizadas no cache de tokens de autenticação. |
|
authentication_token_cache_request_duration_seconds_bucket |
Distribuição da latência de requisição ao cache de tokens de autenticação, em segundos. |
|
authentication_token_cache_request_duration_seconds_count |
Contagem de medições de latência de requisição ao cache de tokens de autenticação. |
|
authentication_token_cache_request_duration_seconds_sum |
Latência total de requisição ao cache de tokens de autenticação, em segundos. |
|
authentication_token_cache_request_total |
Quantidade total de requisições ao cache de tokens de autenticação. |
|
authorization_attempts_total |
Número total de tentativas de autorização. |
|
authorization_duration_seconds_bucket |
Distribuição da latência de autorização, em segundos. |
|
authorization_duration_seconds_count |
Contagem de medições de latência de autorização. |
|
authorization_duration_seconds_sum |
Latência total de autorização, em segundos. |
|
cardinality_enforcement_unexpected_categorizations_total |
Total de categorizações inesperadas durante a aplicação de cardinalidade. |
|
kubernetes_build_info |
Informações de build do Kubernetes. |
|
kubernetes_feature_enabled |
Indica se um recurso específico do Kubernetes está habilitado. |
|
leader_election_master_status |
Indica se o componente é o líder atual na eleição de líder. |
|
registered_metric_total |
Quantidade total de métricas registradas. |
|
registered_metrics_total |
Número total de métricas registradas. |
|
rest_client_exec_plugin_certificate_rotation_age_bucket |
Distribuição da idade dos certificados rotacionados pelo plugin exec do cliente REST. |
|
rest_client_exec_plugin_certificate_rotation_age_count |
Contagem de medições de idade de certificados rotacionados pelo plugin exec do cliente REST. |
|
rest_client_exec_plugin_certificate_rotation_age_sum |
Soma das idades dos certificados rotacionados pelo plugin exec do cliente REST. |
|
rest_client_rate_limiter_duration_seconds_bucket |
Distribuição da latência do limitador de taxa do cliente REST, em segundos. |
|
rest_client_rate_limiter_duration_seconds_count |
Contagem de medições de latência do limitador de taxa do cliente REST. |
|
rest_client_rate_limiter_duration_seconds_sum |
Latência total do limitador de taxa do cliente REST, em segundos. |
|
rest_client_request_duration_seconds_bucket |
Distribuição da latência de requisição do cliente REST, em segundos. |
|
rest_client_request_duration_seconds_count |
Contagem de medições de latência de requisição do cliente REST. |
|
rest_client_request_duration_seconds_sum |
Latência total de requisição do cliente REST, em segundos. |
|
rest_client_request_retries_total |
Número total de requisições do cliente REST repetidas. |
|
rest_client_request_size_bytes_bucket |
Distribuição dos tamanhos de requisição do cliente REST, em bytes. |
|
rest_client_request_size_bytes_count |
Contagem de medições de tamanho de requisição do cliente REST. |
|
rest_client_request_size_bytes_sum |
Soma dos tamanhos de requisição do cliente REST, em bytes. |
|
rest_client_requests_total |
Quantidade total de requisições do cliente REST. |
|
rest_client_response_size_bytes_bucket |
Distribuição dos tamanhos de resposta do cliente REST, em bytes. |
|
rest_client_response_size_bytes_count |
Contagem de medições de tamanho de resposta do cliente REST. |
|
rest_client_response_size_bytes_sum |
Soma dos tamanhos de resposta do cliente REST, em bytes. |
|
rest_client_transport_cache_entries |
Número de entradas no cache de transporte do cliente REST. |
|
rest_client_transport_create_calls_total |
Total de chamadas para criação de transporte do cliente REST. |
|
scheduler_binding_duration_seconds_bucket |
Distribuição da latência de binding do scheduler, em segundos. |
|
scheduler_binding_duration_seconds_count |
Total de operações de binding do scheduler. |
|
scheduler_binding_duration_seconds_sum |
Latência total das operações de binding do scheduler, em segundos. |
|
scheduler_e2e_scheduling_duration_seconds_bucket |
Distribuição da latência de agendamento ponta a ponta, em segundos. |
|
scheduler_e2e_scheduling_duration_seconds_count |
Contagem de medições de latência de agendamento ponta a ponta. |
|
scheduler_e2e_scheduling_duration_seconds_sum |
Latência total de agendamento ponta a ponta, em segundos. |
|
scheduler_framework_extension_point_duration_seconds_bucket |
Distribuição da latência do ponto de extensão do framework do scheduler, em segundos. |
|
scheduler_framework_extension_point_duration_seconds_count |
Contagem de medições de latência do ponto de extensão do framework do scheduler. |
|
scheduler_framework_extension_point_duration_seconds_sum |
Latência total do ponto de extensão do framework do scheduler, em segundos. |
|
scheduler_goroutines |
Quantidade de goroutines do scheduler. |
|
scheduler_pending_pods |
Número de pods pendentes na fila do scheduler. |
|
scheduler_plugin_evaluation_total |
Total de avaliações de plugins do scheduler. |
|
scheduler_plugin_execution_duration_seconds_bucket |
Distribuição da latência de execução de plugins do scheduler, em segundos. |
|
scheduler_plugin_execution_duration_seconds_count |
Contagem de medições de latência de execução de plugins do scheduler. |
|
scheduler_plugin_execution_duration_seconds_sum |
Latência total de execução de plugins do scheduler, em segundos. |
|
scheduler_pod_preemption_victims_bucket |
Distribuição da quantidade de pods escolhidos como vítimas de preempção. |
|
scheduler_pod_preemption_victims_count |
Contagem de medições de vítimas de preempção. |
|
scheduler_pod_preemption_victims_sum |
Número total de pods escolhidos como vítimas de preempção. |
|
scheduler_pod_scheduling_attempts_bucket |
Distribuição do número de tentativas de agendamento de um pod. |
|
scheduler_pod_scheduling_attempts_count |
Contagem de medições de tentativas de agendamento de pods. |
|
scheduler_pod_scheduling_attempts_sum |
Quantidade total de tentativas de agendamento de pods. |
|
scheduler_pod_scheduling_duration_seconds_bucket |
Distribuição da latência de agendamento de pods, em segundos. |
|
scheduler_pod_scheduling_duration_seconds_count |
Contagem de medições de latência de agendamento de pods. |
|
scheduler_pod_scheduling_duration_seconds_sum |
Latência total de agendamento de pods, em segundos. |
|
scheduler_pod_scheduling_sli_duration_seconds_bucket |
Distribuição da latência SLI de agendamento de pods, em segundos. |
|
scheduler_pod_scheduling_sli_duration_seconds_count |
Contagem de medições de latência SLI de agendamento de pods. |
|
scheduler_pod_scheduling_sli_duration_seconds_sum |
Latência total SLI de agendamento de pods, em segundos. |
|
scheduler_preemption_attempts_total |
Total de tentativas de preempção realizadas pelo scheduler. |
|
scheduler_preemption_victims_bucket |
Distribuição da quantidade de pods escolhidos como vítimas de preempção. |
|
scheduler_preemption_victims_count |
Contagem de medições de vítimas de preempção. |
|
scheduler_preemption_victims_sum |
Número total de pods escolhidos como vítimas de preempção. |
|
scheduler_queue_incoming_pods_total |
Quantidade total de pods recebidos na fila do scheduler. |
|
scheduler_schedule_attempts_total |
Número total de tentativas de agendamento pelo scheduler. |
|
scheduler_scheduler_cache_size |
Tamanho do cache do scheduler. |
|
scheduler_scheduler_goroutines |
Quantidade de goroutines do scheduler. |
|
scheduler_scheduling_algorithm_duration_seconds_bucket |
Distribuição da latência do algoritmo de agendamento, em segundos. |
|
scheduler_scheduling_algorithm_duration_seconds_count |
Contagem de medições de latência do algoritmo de agendamento. |
|
scheduler_scheduling_algorithm_duration_seconds_sum |
Latência total do algoritmo de agendamento, em segundos. |
|
scheduler_scheduling_algorithm_predicate_evaluation_seconds_bucket |
Distribuição da latência de avaliação de predicados do algoritmo de agendamento, em segundos. |
|
scheduler_scheduling_algorithm_predicate_evaluation_seconds_count |
Contagem de medições de latência de avaliação de predicados do algoritmo de agendamento. |
|
scheduler_scheduling_algorithm_predicate_evaluation_seconds_sum |
Latência total de avaliação de predicados do algoritmo de agendamento, em segundos. |
|
scheduler_scheduling_algorithm_preemption_evaluation_seconds_bucket |
Distribuição da latência de avaliação de preempção do algoritmo de agendamento, em segundos. |
|
scheduler_scheduling_algorithm_preemption_evaluation_seconds_count |
Contagem de medições de latência de avaliação de preempção do algoritmo de agendamento. |
|
scheduler_scheduling_algorithm_preemption_evaluation_seconds_sum |
Latência total de avaliação de preempção do algoritmo de agendamento, em segundos. |
|
scheduler_scheduling_algorithm_priority_evaluation_seconds_bucket |
Distribuição da latência de avaliação de prioridade do algoritmo de agendamento, em segundos. |
|
scheduler_scheduling_algorithm_priority_evaluation_seconds_count |
Contagem de medições de latência de avaliação de prioridade do algoritmo de agendamento. |
|
scheduler_scheduling_algorithm_priority_evaluation_seconds_sum |
Latência total de avaliação de prioridade do algoritmo de agendamento, em segundos. |
|
scheduler_scheduling_attempt_duration_seconds_bucket |
Distribuição da latência de tentativa de agendamento, em segundos. |
|
scheduler_scheduling_attempt_duration_seconds_count |
Contagem de medições de latência de tentativa de agendamento. |
|
scheduler_scheduling_attempt_duration_seconds_sum |
Latência total de tentativas de agendamento, em segundos. |
|
scheduler_scheduling_duration_seconds |
Duração da operação de agendamento, em segundos. |
|
scheduler_scheduling_duration_seconds_count |
Contagem de medições de latência de agendamento. |
|
scheduler_scheduling_duration_seconds_sum |
Latência total de agendamento, em segundos. |
|
scheduler_total_preemption_attempts |
Número total de tentativas de preempção pelo scheduler. |
|
scheduler_unschedulable_pods |
Quantidade de pods não agendáveis na fila do scheduler. |
|
scheduler_volume_scheduling_duration_seconds_bucket |
Distribuição da latência de agendamento de volumes, em segundos. |
|
scheduler_volume_scheduling_duration_seconds_count |
Contagem de medições de latência de agendamento de volumes. |
|
scheduler_volume_scheduling_duration_seconds_sum |
Latência total de agendamento de volumes, em segundos. |
|
scheduler_volume_scheduling_stage_error_total |
Total de erros durante a etapa de agendamento de volumes. |
|
scrape_duration_seconds |
Duração do scrape, em segundos. |
|
scrape_samples_post_metric_relabeling |
Amostras restantes após o relabeling de métricas. |
|
scrape_samples_scraped |
Total de amostras coletadas do alvo. |
|
scrape_series_added |
Novas séries adicionadas em um scrape. |
|
up |
Indica a integridade do alvo de scrape (1 para ativo, 0 para inativo). |
|
workqueue_adds_total |
Quantidade total de itens adicionados à workqueue. |
|
workqueue_depth |
Profundidade atual da workqueue. |
|
workqueue_longest_running_processor_seconds |
Tempo de execução do processador mais longo da workqueue, em segundos. |
|
workqueue_queue_duration_seconds_bucket |
Distribuição do tempo de espera dos itens na workqueue antes do processamento, em segundos. |
|
workqueue_queue_duration_seconds_count |
Contagem de medições de latência da workqueue. |
|
workqueue_queue_duration_seconds_sum |
Soma do tempo de espera dos itens na workqueue antes do processamento, em segundos. |
|
workqueue_retries_total |
Total de novas tentativas na workqueue. |
|
workqueue_unfinished_work_seconds |
Idade do item de trabalho não concluído mais antigo na workqueue, em segundos. |
|
workqueue_work_duration_seconds_bucket |
Distribuição do tempo gasto processando itens da workqueue, em segundos. |
|
workqueue_work_duration_seconds_count |
Contagem de medições de latência de processamento da workqueue. |
|
workqueue_work_duration_seconds_sum |
Soma do tempo gasto processando itens da workqueue, em segundos. |
Referências
Para consultar as métricas de monitoramento de aplicações do ARMS, consulte Application monitoring metrics.