O monitoramento de frota do ACK One usa o Managed Service for Prometheus para coletar métricas das instâncias de Fleet. Defina regras de alerta personalizadas do Prometheus para acompanhar o uso de recursos dos pods do Argo CD em tempo real e enviar notificações quando os limiares forem ultrapassados.
Pré-requisitos
Antes de começar, verifique se você tem:
Monitoramento de frota ativado. Consulte Ativar monitoramento de Fleet.
Objeto de notificação configurado. Consulte Objetos de notificação.
Se o objeto de notificação for o DingTalk, adicione Custom Keywords nas configurações de segurança do chatbot do DingTalk antes de prosseguir.
Crie uma regra de alerta do Argo CD
Faça login no console do ACK One. No painel de navegação à esquerda, escolha Fleet > Fleet Observability > Fleet Monitoring.
No canto superior direito da página Fleet Monitoring, clique em Alert Settings para abrir a página Prometheus Alert Rules.
-
Clique em Create Prometheus Alert Rule e preencha os campos descritos na tabela a seguir.
Parâmetro
Descrição
Padrão
Exemplo
Alert rule name
Nome da regra de alerta.
—
ACK One Argo CD pod memory alertCheck type
Método de detecção. Static Threshold compara uma métrica com um valor fixo. Custom PromQL permite escrever uma expressão PromQL diretamente.
—
Static ThresholdPrometheus instance
Instância do ACK One Fleet a ser monitorada.
—
text-XXXXAlert contact group
Grupo de aplicativos Kubernetes a ser monitorado no ambiente.
—
Kubernetes workloadAlert metric
Métrica a ser avaliada. Para pods do Argo CD, as métricas mais importantes são Container Memory Usage e Container CPU Utilization.
—
Container Memory UsageAlert condition
Condição de limiar que dispara o evento de alerta.
—
Utilização de CPU maior que
80%Filter conditions
Restringe o escopo da regra de alerta. Consulte os tipos de condição de filtro abaixo.
Traverse
Namespace Equal argocd, Pod: TraverseDuration
Controla o disparo do evento de alerta. Consulte as opções de duração abaixo.
—
Condição de alerta atendida continuamente por 2 minutos
Alert level
Nível de severidade. Default é o mais baixo; P1 é o mais alto. Valores válidos: Default, P4, P3, P2, P1.
Default
P1Alert message
Mensagem enviada aos destinatários quando o alerta é disparado. Especifique variáveis personalizadas na mensagem de alerta com base na sintaxe de modelo do Go.
—
Namespace: {{$labels.namespace}} / Pod: {{$labels.pod_name}} / Container: {{$labels.container}} CPU utilization: {{$labels.metrics_params_opt_label_value}} {{$labels.metrics_params_value}}%. Current value: {{ printf "%.2f" $value }}%Alert notification
Formato da notificação. Valores válidos: Simple Mode e Standard Mode.
—
Simple ModeNotification objects
Canais que recebem mensagens de alerta, como um grupo do DingTalk.
—
DingTalk alertNotification period
Janela de tempo para envio das notificações de alerta.
—
23:00–01:00Whether to resend notifications
Frequência de reenvio do alerta caso ele não seja resolvido.
—
A cada 10 minutos
Filter condition types
Tipo
Escopo
Entrada adicional necessária
Suporta múltiplos valores
Traverse (padrão)
Todos os recursos na instância do Prometheus
Não
N/A
Equal
Apenas o recurso especificado
Nome do recurso
Não
Not equal
Todos os recursos, exceto o especificado
Nome do recurso
Não
Regex match
Recursos cujos nomes correspondem à expressão
Expressão regular
Sim (via regex)
Regex not match
Recursos cujos nomes não correspondem à expressão
Expressão regular
Sim (via regex)
Opções de duração
Opção
Disparo do alerta
Se a condição de alerta for atendida
Assim que um único ponto de dados ultrapassar o limiar
Se a condição de alerta for atendida continuamente por N minutos
Somente após o limiar ser excedido por pelo menos N minutos consecutivos
Clique em Completed para salve a regra de alerta.
Verifique a regra de alerta
Após salvar a regra, simule a condição de alerta para confirme se as notificações chegam aos destinatários corretos:
Reduza temporariamente o limiar de alerta para um valor que seus pods do Argo CD atualmente excedam ou gere um pico de carga nos pods.
Aguarde o término da Duration configurada.
Verifique o objeto de notificação (por exemplo, o grupo do DingTalk) em busca de uma mensagem de alerta.
Confirme se o conteúdo da mensagem corresponde ao modelo de Alert message configurado.
Para revisar eventos históricos de alerta, abra o console do Prometheus. Consulte Visualizar alertas históricos.
Próximos passos
Criar e gerencie um modelo de regra de alerta — reutilize configurações de alerta em várias instâncias de Fleet.
Ative monitoramento de Fleet — configure a base de monitoramento caso ainda não tenha feito isso.