Todos os produtos
Search
Central de documentação

Container Service for Kubernetes:Cloud-controller-manager monitoring metrics and dashboards

Última atualização: Jun 27, 2026

O componente cloud-controller-manager permite que os componentes principais do Kubernetes interajam com o provedor de nuvem por meio da API do Kubernetes. Este tópico lista as métricas, explica como usar os painéis de monitoramento e analisa anomalias comuns nas métricas do cloud-controller-manager, além de orientar na solução de problemas frequentes.

Antes de começar

Acessar os painéis

Consulte Visualizar painéis de monitoramento para componentes do plano de controle.

Lista de métricas

O componente cloud-controller-manager expõe as seguintes métricas.

Métrica

Tipo

Descrição

ccm_slb_latency_ms

Histogram

Latência de sincronização do Classic Load Balancer (CLB). Unidade: ms.

Limiares de bucket: {100, 200, 300, 400, 500, 600, 700, 800, 900, 1000,1500, 2000, 3000, 4000, 5000, 6000, 7000, 8000, 9000, 10000}.

ccm_node_latency_ms

Histogram

Latência de sincronização de nós. Unidade: ms.

Limiares de bucket: {100, 200, 300, 400, 500, 600, 700, 800, 900, 1000,1500, 2000, 3000, 4000, 5000, 6000, 7000, 8000, 9000, 10000}.

ccm_route_latency_ms

Histogram

Latência de sincronização de rotas. Unidade: ms.

Limiares de bucket: {100, 200, 300, 400, 500, 600, 700, 800, 900, 1000,1500, 2000, 3000, 4000, 5000, 6000, 7000, 8000, 9000, 10000}.

workqueue_adds_total

Counter

Total de eventos adicionados à Workqueue.

workqueue_depth

Gauge

Profundidade atual da Workqueue. Um valor alto persistente indica que o controlador não processa tarefas com rapidez suficiente, causando acúmulo.

workqueue_queue_duration_seconds_bucket

Histogram

Tempo de espera de um item na Workqueue. Limiares de bucket: {10-8, 10-7, 10-6, 10-5, 10-4, 10-3, 10-2, 10-1, 1, 10}. Unidade: segundos.

memory_utilization_byte

Gauge

Utilização de memória. Unidade: bytes.

cpu_utilization_core

Gauge

Utilização de CPU. Unidade: núcleos.

resource_utilization_level

Gauge

Nível de utilização de recursos.

  • resource: tipo de recurso. Valores válidos: cpu e memory.

  • utilization_level: nível de utilização. Valores válidos: high (utilização ≥ 80%) e normal (utilização < 80%).

  • container: container de destino. Valores válidos: kube-apiserver, kube-scheduler, kube-controller-manager, cloud-controller-manager e etcd.

rest_client_requests_total

Counter

Total de requisições HTTP por código de status, método e host.

rest_client_request_duration_seconds_bucket

Histogram

Latência de requisição HTTP por verbo e URL.

Nota

As seguintes métricas de utilização de recursos estão obsoletas. Remova alertas ou regras de monitoramento baseados nessas métricas:

  • cpu_utilization_ratio: utilização de CPU.

  • memory_utilization_ratio: utilização de memória.

Painéis

Painéis baseados em PromQL visualizam as métricas do componente.

CCM

Visualize de observabilidadeccm1

Detalhes dos painéis

Nome do painel

PromQL

Descrição

Latência de sincronização de rotas

histogram_quantile($quantile, sum(rate(ccm_route_latencies_duration_milliseconds_bucket[$interval])) by (verb, le))

Latência de sincronização de rotas. Unidade: ms.

Latência de sincronização de nós

histogram_quantile($quantile, sum(rate(ccm_node_latencies_duration_milliseconds_bucket[$interval])) by (verb, le))

Latência de sincronização de nós. Unidade: ms.

Latência de sincronização do CLB (Classic Load Balancer)

histogram_quantile($quantile, sum(rate(ccm_slb_latencies_duration_milliseconds_bucket[$interval])) by (verb, le))

Latência de sincronização do CLB. Unidade: ms.

Fila

Visualize de observabilidadeccm2

Detalhes dos painéis

Nome do painel

PromQL

Descrição

Taxa de adição à Workqueue

sum(rate(workqueue_adds_total{job="ack-cloud-controller-manager"}[$interval])) by (name)

Taxa de eventos adicionados à Workqueue.

Profundidade da Workqueue

workqueue_depth{job="ack-cloud-controller-manager"}

Taxa média de variação na profundidade da Workqueue.

Latência de processamento da Workqueue

histogram_quantile($quantile, sum(rate(workqueue_queue_duration_seconds_bucket{job="ack-cloud-controller-manager"}[$interval])) by (name, le))

Tempo de espera de um item na Workqueue.

Recursos

Visualize de observabilidade

image

Detalhes dos painéis

Nome do painel

PromQL

Descrição

Uso de memória

memory_utilization_byte{container="cloud-controller-manager"}

Utilização de memória. Unidade: bytes.

CPU Usage

cpu_utilization_core{container="cloud-controller-manager"}*1000

Utilização de CPU. Unidade: milinúcleos.

Nível de utilização de memória

  • resource_utilization_level{resource="memory",container="cloud-controller-manager",utilization_level="high"}

  • resource_utilization_level{resource="memory",container="cloud-controller-manager",utilization_level="normal"}

  • Se resource_utilization_level{utilization_level="high",...} for 1, a utilização de recursos do container é ≥ 80%.

  • Se resource_utilization_level{utilization_level="normal",...} for 1, a utilização de recursos do container é < 80%.

Nível de utilização de CPU

  • resource_utilization_level{resource="cpu",container="cloud-controller-manager",utilization_level="high"}

  • resource_utilization_level{resource="cpu",container="cloud-controller-manager",utilization_level="normal"}

Kube API

Visualize de observabilidadeccm4

Detalhes dos painéis

Nome do painel

PromQL

Descrição

QPS de requisições à Kube API

  • sum(rate(rest_client_requests_total{job="ack-cloud-controller-manager",code=~"2.."}[$interval])) by (method,code)

  • sum(rate(rest_client_requests_total{job="ack-cloud-controller-manager",code=~"3.."}[$interval])) by (method,code)

  • sum(rate(rest_client_requests_total{job="ack-cloud-controller-manager",code=~"4.."}[$interval])) by (method,code)

  • sum(rate(rest_client_requests_total{job="ack-cloud-controller-manager",code=~"5.."}[$interval])) by (method,code)

QPS de requisições HTTP do cloud-controller-manager para o kube-apiserver, por método e código de status.

Anomalias comuns de métricas

Latência de sincronização do Classic Load Balancer (CLB)

Condições normais

Condições anormais

Descrição

Recomendações

A latência de sincronização do CLB (Classic Load Balancer) é ≤ 10 s.

A latência de sincronização do CLB (Classic Load Balancer) excede 10 s.

A sincronização do CLB está demorada.

Verifique eventos anormais no Service.

Profundidade da Workqueue

Condições normais

Condições anormais

Descrição

Recomendações

A profundidade da Workqueue é ≤ 10.

A profundidade da Workqueue excede 10.

Grande acúmulo de itens aguardando sincronização.

Filas muito longas retardam a sincronização do Service. Reduza a frequência de alterações em nós, Pods e Services no cluster.

Documentação relacionada

Para outros componentes do plano de controle, consulte métricas de monitoramento do kube-apiserver, métricas de monitoramento do etcd, métricas de monitoramento do kube-scheduler e métricas de monitoramento do kube-controller-manager.