O ACK é compatível com produtos de observabilidade da Alibaba Cloud, como CloudMonitor e Managed Service for Prometheus, e oferece add-ons de monitoramento para observar a integridade do cluster, além de identificar e responder proativamente a problemas. Este tópico descreve as soluções de monitoramento full-stack para clusters ACK, abrangendo recursos básicos, aplicações, clusters, eventos, componentes do plano de controle, redes e containers no nível do kernel.
Observabilidade do cluster
O ACK fornece os seguintes módulos de monitoramento:
|
Módulo |
Descrição |
Referências |
Add-on |
|
Monitoramento de recursos básicos |
Monitore o uso e a integridade dos recursos básicos do cluster (CPU, memória e rede) com CloudMonitor ou Prometheus. Ative notificações de alerta nas métricas principais para aumentar a estabilidade. |
||
|
ack-prometheus-operator |
|||
|
Monitoramento de aplicações |
Use o Application Real-Time Monitoring Service (ARMS) e o ack-onepilot para analisar topologias, monitorar APIs e eventos, rastrear solicitações e detectar gargalos de desempenho em aplicações containerizadas. |
||
|
Monitoramento do cluster |
Utilize o Application Monitoring eBPF Edition para coletar dados de desempenho de containers sem intrusão de código. Identifique problemas em pods, localize Services e workloads de controladores relacionados e reduza o tempo de detecção. |
||
|
Monitoramento de eventos |
Use o Node Problem Detector (NPD) e o Kubernetes Event Center do Log Service (SLS) para monitorar o status do sistema em tempo real e enviar notificações. Diagnostique exceções de nós convertendo-as em eventos e gerencie alertas com notificações offline e em ciclo fechado. |
||
|
Monitoramento de componentes do plano de controle |
Monitore componentes do plano de controle em tempo real com Prometheus e Grafana, incluindo API server, etcd, kube-scheduler e kube-controller-manager. Otimize o acesso aos componentes e configure um Prometheus autogerenciado. |
||
|
etcd |
|||
|
Monitoramento de rede |
Integre o serviço de log de Ingress e utilize o Ingress Dashboard com ARMS para solucionar problemas de Ingress conjuntamente. Monitore e solucione problemas do CoreDNS. Visualize o tráfego de rede e a topologia de serviços em clusters baseados em Terway para obter observabilidade da rede de containers e dos serviços. |
||
|
Alcançar observabilidade de rede com ACK Terway e Cilium Hubble |
|||
|
Monitoramento de containers no nível do kernel |
Monitore containers no nível do kernel do SO com System Observer Monitoring (SysOM) para facilitar a implantação e a migração de aplicações containerizadas. |