Este tópico descreve como integrar o monitoramento de eventos de contêiner ao Managed Service for Prometheus, visualizar painéis e definir regras de alerta. O monitoramento de eventos é um método do Kubernetes que complementa o monitoramento de recursos, superando limitações de tempestividade, precisão e cobertura de cenários. Monitore anomalias e problemas no cluster em tempo real utilizando o NPD (node-problem-detector) com o centro de eventos do Kubernetes do SLS. Configure verificações de cluster do NPD e o recurso de eventos anormais offline, e utilize DingTalk, eventos offline do Kubernetes no SLS e eventos offline do Kubernetes no EventBridge.
Pré-requisitos
Ative o Managed Service for Prometheus. Para mais informações, consulte Billing of Prometheus instances.
Crie um cluster Kubernetes. Para mais informações, consulte Create an ACK managed cluster.
Ative o Resource Center. Para mais informações, consulte Activate Resource Center.
Etapa 1: Integrar o monitoramento de eventos de contêiner
Faça login no ou no Prometheus console. No painel de navegação à esquerda, clique em Integration Center.
-
Clique no cartão Kubernetes Event, selecione o cluster ACK a ser integrado e siga as instruções na tela para concluir a integração dos componentes.
NotaApós a integração, a ingestão completa de dados leva aproximadamente um a dois minutos. Os painéis não exibirão dados até que a ingestão seja concluída.
Etapa 2: Visualizar painéis
O Managed Service for Prometheus oferece diversos painéis integrados para monitoramento de contêineres, abrangendo visões gerais do cluster, componentes principais, nós e pods. Acesse esses painéis pelo console do Container Service for Kubernetes (ACK), pelo ARMS console ou pelo Prometheus console.
Faça login no ou no Prometheus console. No painel de navegação à esquerda, clique em Integration Management.
Na página Integration Management, clique na aba Query Dashboards. Na lista suspensa Select Environment, selecione o ambiente de contêiner desejado, por exemplo,
mengtu-test-api. Filtre os painéis usando as listas suspensas Scenario e Source Component, ou aplique filtros de rótulo como api-server, etcd, kubernetes, node e storage. A lista será atualizada para mostrar os painéis disponíveis correspondentes aos critérios definidos.
Etapa 3: Configurar alertas
Faça login no ou no Prometheus console. No painel de navegação à esquerda, clique em Integration Management.
Na página Integration Management, clique na aba Integrated Environments. Selecione Container Service e clique no nome do ambiente desejado para abrir sua página de detalhes.
Clique na aba Component Management. Na lista de tipos de componente à esquerda, selecione Kubernetes Event. Em seguida, à direita, clique na aba Alert Rule para visualizar as regras de alerta integradas.
-
As regras de alerta integradas geram eventos de aviso, mas não enviam notificações automaticamente. Para enviar notificações de alerta para um endereço de e-mail ou outra plataforma, clique em Edit e configure uma política de notificação.
Na página de configuração de alertas, também é possível personalizar limiares, duração e conteúdo do alerta. Para mais informações sobre a configuração de alertas, consulte Create a Prometheus alert rule.
Na seção Alert Notification, selecione Normal Mode. Na lista suspensa Quickly specify notification policy, escolha uma política de notificação existente ou clique em Create notification policy. Expanda Advanced Settings e defina o Alert check cycle como
1minuto.
Métricas coletadas
|
Métrica |
Tipo |
Descrição |
|
eventer_events_error_total |
COUNTER |
Número total de eventos de erro. |
|
eventer_events_normal_total |
COUNTER |
Número total de eventos normais. |
|
eventer_events_warning_total |
COUNTER |
Número total de eventos de aviso. |
|
eventer_exporter_duration_milliseconds |
SUMMARY |
Tempo gasto na exportação de eventos, em milissegundos. |
|
eventer_manager_last_time_seconds |
GAUGE |
Timestamp Unix, em segundos, da última tarefa de manutenção do eventer. |
|
eventer_scraper_duration_milliseconds |
SUMMARY |
Tempo gasto na coleta de eventos, em milissegundos. |
|
eventer_scraper_events_total_number |
COUNTER |
Número total de eventos coletados. |
|
eventer_scraper_last_time_seconds |
GAUGE |
Timestamp Unix, em segundos, do último evento coletado. |