O ApsaraDB for ClickHouse permite configurar alertas para métricas essenciais do cluster. Quando o valor de uma métrica ultrapassa o limiar definido, o sistema envia uma notificação de alerta aos contatos de um grupo de alertas, facilitando a identificação rápida de problemas. Este tópico descreve como configurar regras de alerta para um cluster do ApsaraDB for ClickHouse.
Pré-requisitos
O cluster deve ser da Community Edition ou Enterprise Edition.
O sistema de alertas do ApsaraDB for ClickHouse depende do Application Real-Time Monitoring Service (ARMS). Se você for um usuário RAM, precisará da permissão AliyunARMSFullAccess para gerenciar o ARMS. Para obter mais informações sobre como conceder essa permissão, consulte Manage permissions for a RAM user.
Observações de uso
Não é possível visualizar informações de monitoramento de clusters da Enterprise Edition no console do CloudMonitor.
Procedimento
Console do ApsaraDB for ClickHouse
Se o seu cluster atender a ambas as condições abaixo, consulte Procedure for the old console.
O cluster foi criado antes de 1º de dezembro de 2021.
O cluster está localizado na região China (Qingdao) ou China (Hohhot).
Faça login no console do ApsaraDB for ClickHouse.
No canto superior esquerdo da página, selecione a região onde o cluster de destino está localizado.
Na página Clusters, selecione Clusters of Community-compatible Edition ou Enterprise Edition Clusters e clique em ID do cluster de destino.
No painel de navegação à esquerda, clique em Monitoring and Alerting.
Na página Monitoring Details, clique em aba Cluster Alerting.
-
Clique em botão para criar uma regra de alerta de cluster.
NotaPara clusters da Community Edition, o botão é Create ClickHouse Alert Rule.
Para clusters da Enterprise Edition, o botão é Create Enterprise Edition ClickHouse Alert Rule.
-
Na página Create ClickHouse Alert Rule ou Create Enterprise Edition ClickHouse Alert Rule, configure os seguintes parâmetros.
NotaO ApsaraDB for ClickHouse oferece dois tipos de verificação para regras de alerta: limiar estático e PromQL personalizado. Os parâmetros variam conforme o tipo de verificação selecionado.
O tipo de verificação por limiar estático permite criar rapidamente uma regra de alerta selecionando métricas predefinidas.
O tipo de verificação por PromQL personalizado destina-se à criação de regras de alerta para métricas não predefinidas pelo sistema.
Limiar estático
Parâmetro
Descrição
Exemplo
Alert Name
Nome da regra de alerta.
Alerta de utilização de CPU
Check Type
Selecione Static Threshold.
Static Threshold
Cluster
Cluster de destino da regra de alerta.
cc-bp1lxbo89u95****
Alert group
Selecione um grupo de alertas.
Os grupos de alertas disponíveis variam conforme o tipo de instância do Prometheus.
ClickHouse Open Source Edition
Alert Metric
Métrica a ser monitorada. As métricas disponíveis dependem do Alert group selecionado.
Utilização de CPU
Alert Condition
Configure a condição de acionamento para a métrica selecionada.
O alerta é acionado quando a utilização da CPU é
greater than80%.Filter Conditions
Sem filtro
Nenhum
Preview Data
A seção Preview Data exibe a instrução PromQL correspondente à condição de alerta e plota os valores das métricas de monitoramento configuradas para a regra atual como uma curva de série temporal.
-
Por padrão, apenas o valor em tempo real de um recurso é exibido.
-
Selecione um recurso de destino e um intervalo de tempo para visualizar valores de diferentes recursos em diversos períodos.
Nota-
O limiar de alerta aparece como uma linha horizontal vermelha no gráfico. Os dados da série temporal que atingem o limiar são exibidos em vermelho escuro, enquanto os dados abaixo do limiar aparecem em azul.
-
Passe o mouse sobre o gráfico de série temporal para ver detalhes do recurso em um ponto específico no tempo.
-
No gráfico de série temporal, selecione um intervalo de tempo para visualizar a série referente ao período especificado.
Nenhum
Duration
-
Acionar alerta imediatamente quando a condição for atendida: Um alerta é disparado se qualquer ponto de dados atingir o limiar.
-
Acionar alerta somente quando a condição persistir por N minutos.
1
Alert Level
Nível de severidade do alerta. O nível padrão é Default. Os níveis de severidade, do menor para o maior, são Default, P4, P3, P2 e P1.
P2
Alert Content
Conteúdo da notificação de alerta. É possível usar a sintaxe de modelo do Go para incluir variáveis.
Node: {{$labels.pod_name}} CPU utilization {{$labels.metrics_params_opt_label_value}} {{$labels.metrics_params_value}}%, current value {{ printf "%.2f" $value }}%
Alert Notification
Simple mode
Alert Contact: objeto a ser notificado quando um alerta for acionado.
Notification period: período durante o qual as notificações de alerta são enviadas. Alertas acionados fora desse período são ignorados.
Repetition policy: política para envio de notificações repetidas quando um alerta é acionado.
-
Alert Contact: Selecione contatos e especifique métodos de notificação (Email, Phone, SMS ou Group @). Clique em + Create Notification Object para adicionar um novo contato.
-
Notification Period: Defina a hora de início e término (por exemplo, 00:00~23:59). Há suporte para configuração que abrange dias diferentes dentro de 24 horas.
-
Whether to Resend Notifications: Selecione No escalation policy required. Send only once when the alert is not recovered ou escolha When the alert is not recovered, send repeated notifications at specified intervals.
Standard Mode
Especifique uma política usando Quickly Specify Notification Policy.
ImportanteA opção Quickly Specify Notification Policy garante que os eventos da regra de alerta atual correspondam à política de notificação selecionada. No entanto, esses eventos também podem corresponder a outras políticas de notificação que usam correspondência difusa. A relação entre eventos de regras de alerta e políticas de notificação é de muitos para muitos.
-
Não especifique uma regra de notificação.
-
Selecione uma política de notificação existente.
NotaClique em Create Notification Policy para criar uma política de notificação. Para obter mais informações, consulte Notification policies.
Não especificar uma política de notificação
Advanced Settings
Alert check period
Frequência de verificação da condição de alerta. O valor mínimo e padrão é 1 minuto.
1 minuto
Data complete check
Aguarde até que os dados sejam coletados, transmitidos e armazenados antes de verificar o alerta. O valor padrão é Yes. Na maioria dos casos, não é necessário alterar esse valor.
Yes
Tag
Defina tags para a regra de alerta. As tags podem ser usadas como condições de correspondência nas políticas de notificação.
Nenhum
Comment
Adicione anotações à regra de alerta.
Nenhum
PromQL personalizado
Parâmetro
Descrição
Exemplo
Alert Name
Nome da regra de alerta.
Utilização de CPU do Pod maior que 8%
Check Type
Defina como custom PromQL.
custom PromQL
Cluster
Cluster de destino da regra de alerta.
cc-bp1lxbo89u95****
Reference Alert Contact Group
Selecione um grupo de alertas.
Os grupos de alertas disponíveis variam conforme o tipo de instância do Prometheus.
ClickHouse Open Source Edition
Reference Metrics
Opcional. Fornece modelos PromQL para métricas comuns. Selecione um modelo e modifique-o conforme necessário.
As opções disponíveis de Reference alert metric são filtradas automaticamente com base no tipo de instância do Prometheus selecionado.
Número de conexões HTTP
Custom PromQL statement
Expressão PromQL que define a condição de alerta.
clickhouse_http_conn_usage_count{} > 1000Preview Data
Duration
-
Acionar alerta imediatamente quando a condição for atendida: Um alerta é disparado se qualquer ponto de dados atingir o limiar.
-
Acionar alerta somente quando a condição persistir por N minutos.
1
Alert Level
Nível de severidade do alerta. O nível padrão é Default. Os níveis de severidade, do menor para o maior, são Default, P4, P3, P2 e P1.
Default
Alert Content
Conteúdo da notificação de alerta. É possível usar a sintaxe de modelo do Go para incluir variáveis.
Namespace: {{$labels.namespace}}/Pod: {{$labels.pod_name}}/Disk device: {{$labels.device}} utilization exceeds 90%, current value {{ printf "%.2f" $value }}%
Alert Notification
Simple mode
Alert Contact: objeto a ser notificado quando um alerta for acionado.
Notification period: período durante o qual as notificações de alerta são enviadas. Alertas acionados fora desse período são ignorados.
Whether to Resend Notifications: política para envio de notificações repetidas quando um alerta é acionado.
Standard Mode
Especifique uma política usando Quickly Specify Notification Policy.
ImportanteA opção Quickly Specify Notification Policy garante que os eventos da regra de alerta atual correspondam à política de notificação selecionada. No entanto, esses eventos também podem corresponder a outras políticas de notificação que usam correspondência difusa. A relação entre eventos de regras de alerta e políticas de notificação é de muitos para muitos.
-
Não especifique uma regra de notificação.
-
Selecione uma política de notificação existente.
NotaClique em Create Notification Policy para criar uma política de notificação. Para obter mais informações, consulte Notification policies.
Não especificar uma política de notificação
Advanced Settings
Alert check period
Frequência de verificação da condição de alerta. O valor mínimo e padrão é 1 minuto.
1 minuto
Check When Data Is Complete
Aguarde até que os dados sejam coletados, transmitidos e armazenados antes de verificar o alerta. O valor padrão é Yes. Na maioria dos casos, não é necessário alterar esse valor.
Yes
Tag
Defina tags para a regra de alerta. As tags podem ser usadas como condições de correspondência nas políticas de notificação.
Nenhum
Comment
Adicione anotações à regra de alerta.
Nenhum
Após configurar os parâmetros, clique em Completed.
Console do CloudMonitor
Faça login no console do CloudMonitor.
No painel de navegação à esquerda, escolha .
Na página Alert Rules, clique em Create Alert Rule.
-
No painel Create Alert Rule, configure os seguintes parâmetros.
Parâmetro
Descrição
Products
Selecione o tipo de cluster para ApsaraDB for ClickHouse. Valores válidos:
-
ApsaraDB for ClickHouse: Clusters da Community Edition adquiridos antes de 1º de dezembro de 2021.
-
ApsaraDB for ClickHouse Community Edition: Clusters da Community Edition adquiridos em ou após 1º de dezembro de 2021.
Resource Range
Escopo dos recursos aos quais a regra de alerta se aplica. Valores válidos:
-
All Resources: A regra de alerta aplica-se a todos os recursos do serviço de nuvem especificado, incluindo recursos adicionados recentemente.
-
Application Group: A regra de alerta aplica-se a todos os recursos dentro de um grupo de aplicativos especificado do serviço de nuvem, incluindo recursos adicionados recentemente.
-
Instance: A regra de alerta aplica-se a recursos específicos do serviço de nuvem.
Description
Define as condições de acionamento do alerta. Para configurar a descrição da regra, siga estas etapas:
-
Clique em Add Rule.
-
No painel Set Rule Description , insira um Rule Name e defina as condições da regra.
-
Single Metric: Selecione uma métrica e defina um limiar e um nível de alerta para ela.
-
Multiple Metrics: Selecione um nível de alerta e defina condições de alerta para duas ou mais métricas.
-
Dynamic Threshold: Para obter mais informações sobre limiares inteligentes, consulte Overview e Create an alert rule for an intelligent threshold.
NotaO recurso de limiar inteligente está em teste beta. Você deve enviar um ticket para solicitar acesso.
-
-
Clique em OK.
NotaPara obter informações sobre como definir condições de alerta complexas, consulte Expressions for alert rules.
Mute Period
Atraso antes que o CloudMonitor reenvie uma notificação para um alerta não resolvido. Valores válidos: 5 minutos, 15 minutos, 30 minutos, 60 minutos, 3 horas, 6 horas, 12 horas e 24 horas.
Quando uma métrica monitorada atinge seu limiar, um alerta é enviado. Se a métrica continuar excedendo o limiar durante o período de silêncio, nenhum novo alerta será enviado. Caso a métrica ainda esteja em estado de alerta após o período de silêncio, o CloudMonitor enviará outra notificação de alerta.
Por exemplo, se você definir o Mute Period como 12 Hours, o CloudMonitor reenviará a notificação após 12 horas se o alerta não for resolvido.
Effective Time
Período durante o qual a regra de alerta está ativa. As notificações são enviadas apenas para alertas acionados nesse período.
NotaSe um alerta for acionado fora do período efetivo, nenhuma notificação será enviada, mas o alerta ainda será registrado na lista Alert History.
Alert Contact Group
Grupo de contatos para o qual as notificações de alerta são enviadas.
As notificações de alerta de um grupo de aplicativos são enviadas aos contatos no grupo de contatos especificado. Um grupo de contatos pode conter um ou mais contatos.
Para obter informações sobre como criar contatos e grupos de contatos, consulte Create an alert contact or a contact group.
Tag
Tags da regra de alerta, compostas por uma chave de tag e um valor de tag.
NotaÉ possível adicionar até seis tags.
Advanced Settings
Alert Callback
URL publicamente acessível que recebe informações de alerta do CloudMonitor por meio de solicitações POST. Apenas o protocolo HTTP é suportado. Para obter informações sobre como configurar um callback de alerta, consulte Use a webhook to send threshold-triggered alerts.
Para testar a conectividade da URL de callback de alerta, execute as seguintes etapas:
-
Clique em Test ao lado da URL de callback.
No painel Webhook Test, verifique o código de status do webhook e os detalhes do resultado do teste para diagnosticar problemas de conectividade.
NotaVocê também pode definir o Callback Template Type e o Language para o webhook e clicar em Test novamente para visualizar os resultados de teste correspondentes.
-
Clique em Disable.
Auto Scaling
Se você ativar o Auto Scaling, a regra de dimensionamento correspondente será acionada quando ocorrer um alerta. É necessário configurar a Region, o ESS Group e a ESS Rule para o Auto Scaling.
-
Para obter informações sobre como criar um grupo de dimensionamento, consulte Manage scaling groups.
-
Para obter informações sobre como criar uma regra de dimensionamento, consulte Manage scaling rules.
Log Service
Se você ativar o Log Service, as informações de alerta serão enviadas para um Logstore no Log Service quando ocorrer um alerta. É necessário configurar a Region, o ProjectName e o Logstore para o Log Service.
Para obter informações sobre como criar um Project e um Logstore, consulte Use iLogtail to collect and analyze text logs from ECS instances.
Simple Message Queue (formerly MNS) - Topic
Se você ativar o Message Service MNS-Topic, as informações de alerta serão enviadas para um tópico no Message Service (MNS) quando ocorrer um alerta.
Para ativar esse recurso, configure a região e o tópico para o Message Service (MNS). Para obter informações sobre como criar um tópico, consulte Create a topic.
Function Compute
Se você ativar o Function Compute, as notificações de alerta serão enviadas ao Function Compute para formatação quando ocorrer um alerta. É necessário configurar a região, o serviço e a função para o Function Compute.
Para obter informações sobre como criar um serviço e uma função, consulte Create a function.
NoDataPolicy
Método para lidar com alertas quando não há dados de monitoramento disponíveis. Valores válidos:
-
Do not do anything (Padrão)
-
Send alert notifications
-
Treat as recovered
-
(Opcional) Console antigo
Próximas etapas
Para gerenciar regras de alerta criadas no console do ApsaraDB for ClickHouse, consulte Manage alert rules.
Documentos relacionados
Se você é novo no CloudMonitor, consulte What is CloudMonitor?.