Este tópico descreve como integrar o monitoramento de eventos de contêiner ao Managed Service for Prometheus, visualizar painéis e definir regras de alerta. O monitoramento de eventos é um método do Kubernetes que complementa o monitoramento de recursos e supera limitações de tempestividade, precisão e cobertura de cenários. Monitore anomalias e problemas no cluster em tempo real usando o NPD (node-problem-detector) com o centro de eventos do Kubernetes do SLS. Configure verificações de cluster do NPD e o recurso de eventos anormais offline. Utilize também o DingTalk, os eventos offline do Kubernetes no SLS e os eventos offline do Kubernetes no EventBridge.
Pré-requisitos
Ative o Managed Service for Prometheus. Para mais informações, consulte Faturamento de instâncias do Prometheus.
Ative o Managed Service for Prometheus. Para mais informações, consulte Faturamento de instância do Prometheus.
Crie um cluster Kubernetes. Para mais informações, consulte Criar um cluster gerenciado do ACK.
Ative o Resource Center. Para mais informações, consulte Ativar o Resource Center.
Etapa 1: Integrar o monitoramento de eventos de contêiner
Faça login no ou no console do Prometheus. No painel de navegação à esquerda, clique em Integration Center.
-
Clique no cartão Kubernetes Event, selecione o cluster ACK para integração e siga as instruções na tela para concluir a integração dos componentes.
NotaApós a integração, a ingestão completa de dados leva aproximadamente um a dois minutos. Os painéis não exibem dados até a conclusão da ingestão.
Etapa 2: Visualizar painéis
O Managed Service for Prometheus oferece diversos painéis integrados para monitoramento de contêineres, abrangendo visões gerais do cluster, componentes principais, nós e pods. Acesse esses painéis pelo console do Container Service for Kubernetes (ACK), pelo console do ARMS ou pelo console do Prometheus.
Faça login no ou no console do Prometheus. No painel de navegação à esquerda, clique em Integration Management.
Na página Integration Management, clique na aba Query Dashboards. Na lista suspensa Select Environment, selecione o ambiente de contêiner desejado, por exemplo,
mengtu-test-api. Filtre os painéis pelas listas suspensas Scenario e Source Component ou aplique filtros de rótulo como api-server, etcd, kubernetes, node e storage. A lista atualiza automaticamente para exibir os painéis disponíveis correspondentes aos critérios definidos.
Etapa 3: Configurar alertas
Faça login no ou no console do Prometheus. No painel de navegação à esquerda, clique em Integration Management.
Na página Integration Management, clique na aba Integrated Environments. Selecione Container Service e clique no nome do ambiente desejado para abrir a página de detalhes.
Clique na aba Component Management. Na lista de tipos de componente à esquerda, selecione Kubernetes Event. Em seguida, à direita, clique na aba Alert Rule para visualizar as regras de alerta integradas.
-
As regras de alerta integradas geram eventos de aviso, mas não enviam notificações automaticamente. Para enviar notificações por e-mail ou outra plataforma, clique em Edit e configure uma política de notificação.
Na página de configuração de alertas, personalize limiares, duração e conteúdo do alerta. Para mais informações sobre configuração de alertas, consulte Criar uma regra de alerta do Prometheus.
Na seção Alert Notification, selecione Normal Mode. Na lista suspensa Quickly specify notification policy, escolha uma política de notificação existente ou clique em Create notification policy. Expanda Advanced Settings e defina o Alert check cycle como
1minuto.
Métricas coletadas
|
Métrica |
Tipo |
Descrição |
|
eventer_events_error_total |
COUNTER |
Número total de eventos de erro. |
|
eventer_events_normal_total |
COUNTER |
Número total de eventos normais. |
|
eventer_events_warning_total |
COUNTER |
Número total de eventos de aviso. |
|
eventer_exporter_duration_milliseconds |
SUMMARY |
Tempo gasto para exportar eventos, em milissegundos. |
|
eventer_manager_last_time_seconds |
GAUGE |
Timestamp Unix da última tarefa de manutenção do eventer, em segundos. |
|
eventer_scraper_duration_milliseconds |
SUMMARY |
Tempo gasto para coletar eventos, em milissegundos. |
|
eventer_scraper_events_total_number |
COUNTER |
Número total de eventos coletados. |
|
eventer_scraper_last_time_seconds |
GAUGE |
Timestamp Unix do último evento coletado, em segundos. |