Regras de alerta personalizadas permitem monitorar o status de execução de tarefas e o uso de recursos conforme as necessidades do seu negócio, facilitando a detecção e o tratamento rápidos de exceções. Este tópico descreve como criar regras de alerta personalizadas na página Rule Management e como obter uma URL de webhook adicionando um chatbot do DingTalk.
Limitações
As regras de alerta personalizadas aplicam-se apenas à Scheduled Instance acionada automaticamente. Elas não monitoram resultados de execuções de teste ou tarefas de backfill de dados.
-
As regras de alerta personalizadas suportam notificações por Email, SMS, phone call, DingTalk Chatbot e Webhook. Aplicam-se as seguintes limitações:
Telephone: Notificações por chamada telefônica são suportadas apenas para números de celular da China continental.
-
Webhook:
O DataWorks Basic Edition permite enviar alertas para grupos do DingTalk, Lark e WeCom usando webhooks de grupo.
O DataWorks Enterprise Edition também suporta webhooks definidos pelo usuário para receber alertas.
NotaPara enviar mensagens usando um webhook personalizado, adapte-o seguindo as instruções em Webhooks personalizados para monitoramento inteligente. Após concluir a adaptação, entre em contato conosco para obter mais assistência.Envie um ticket para entrar em contato conosco.
Apenas o DataWorks Professional Edition e versões superiores suportam condições de acionamento como número de instâncias com erro, proporção de instâncias com erro e logs de nó contêm palavras-chave. Para mais informações, consulte Recursos das edições do DataWorks. Para assinar o DataWorks, consulte Assinatura.
Somente o proprietário da regra de monitoramento, um administrador de tenant ou a conta Alibaba Cloud podem modificar a regra de monitoramento.
Observações
Ao monitorar instâncias agendadas com uma regra de alerta personalizada, o intervalo de tempo de monitoramento varia conforme a condição de acionamento.
|
Escopo de monitoramento |
Condição de acionamento |
Descrição |
|
Data de negócio (ontem, T) |
|
O DataWorks monitora instâncias agendadas cuja data de negócio é ontem e cujo horário agendado é hoje. O sistema aciona um alerta quando a condição de acionamento é atendida. |
|
Data de negócio (ontem T) e anteontem (T-1) |
|
O DataWorks monitora instâncias agendadas cuja data de negócio é ontem ou anteontem e cujo horário agendado é hoje ou ontem. O sistema aciona um alerta quando a condição de acionamento é atendida. |
|
Data de negócio (ontem T), anteontem (T-1) e dois dias antes de ontem (T-2) |
|
O DataWorks monitora instâncias agendadas cuja data de negócio é ontem, anteontem ou dois dias antes de ontem e cujo horário agendado é hoje, ontem ou anteontem. O sistema aciona um alerta quando a condição de acionamento é atendida. |
Instâncias agendadas fora do escopo de monitoramento não acionam alertas, mesmo que a condição de acionamento seja atendida. Para detalhes sobre as regras de monitoramento para diferentes condições de acionamento, consulte Configurar métodos de acionamento.
Acessar o Rule Management
Acesse a página Operation Center.
-
No painel de navegação à esquerda, clique em .
NotaVocê também pode acessar a página Scheduled Tasks para selecionar nós em lote e criar regras de monitoramento. Para mais informações, consulte Criar regras de monitoramento para tarefas agendadas.
Faça login no console do DataWorks, mude para a região de destino e clique em no painel de navegação à esquerda. Selecione o workspace desejado na lista suspensa e clique em Operation Center.
Criar uma regra personalizada
Na página Rule Management, crie regras de monitoramento personalizadas conforme necessário.
Configurar informações básicas
|
Parâmetro |
Descrição |
|
Rule Name |
Insira um nome para a regra personalizada. |
|
Object Type |
Especifique o tipo de objeto de monitoramento para definir a granularidade do monitoramento. Valores válidos: Node, Baseline, Workspace, Workflow, Exclusive Resource Group for Scheduling e Exclusive Resource Group for Data Integration. Nota
Quando o tipo de objeto é baseline, apenas o status de execução das tarefas na baseline é monitorado. As tarefas upstream das tarefas da baseline não são monitoradas. Se você também quiser monitorar tarefas upstream das tarefas da baseline, consulte Baseline inteligente. |
|
Rule Object |
Especifique os objetos de monitoramento. Insira o nome ou ID de um objeto de monitoramento, selecione o objeto desejado na lista e clique em Add. Os tipos de objetos de monitoramento suportados e suas quantidades máximas são:
|
|
Task Blacklist |
Especifique quais tarefas entre os objetos de monitoramento são excluídas da regra atual. Quando o Object Type está definido como Baseline, Workspace ou Workflow, insira um nome ou ID de nó e clique em Add para adicionar a tarefa à lista de bloqueios. Nota
As tarefas na lista de bloqueios não são monitoradas. É possível adicionar até 50 tarefas à lista de bloqueios. |
|
Resource Group Name |
Especifique o nome do grupo de recursos exclusivo a ser monitorado. Quando o Object Type está definido como Exclusive Resource Group for Scheduling ou Exclusive Resource Group for Data Integration, selecione o Resource Group Name a ser monitorado na lista suspensa. |
Configurar métodos de acionamento
Na lógica de alerta personalizado, uma tarefa congelada é considerada concluída.
|
Tipo de objeto |
Condição de acionamento |
Descrição |
|
Node, Baseline, Workspace, Workflow |
Complete |
O sistema monitora uma tarefa desde o início da execução. Um alerta é enviado quando a tarefa é executada com sucesso.
Nota
Para tarefas horárias, a tarefa é considerada concluída somente após todos os ciclos serem executados com sucesso. |
|
Incomplete |
O sistema monitora uma tarefa desde o início da execução. Se a tarefa não terminar a execução até o horário alvo especificado, um alerta é enviado. Nota
Este alerta difere da política de alerta de baseline inteligente. Uma baseline inteligente pode detectar exceções que impedem a conclusão pontual das tarefas na baseline e enviar avisos antecipados. Para mais informações, consulte Baseline inteligente. Exemplos:
Nota
Para tarefas horárias ou de nível de minuto, o sistema verifica se todos os ciclos não foram concluídos até o horário especificado naquele dia. |
|
|
Error |
O sistema monitora uma tarefa desde o início da execução. Se a tarefa encontrar um erro, um alerta é enviado. Nota
Um erro de execução de instância significa que a instância alvo mostra o status
|
|
|
Número de instâncias com erro |
Indica o número de instâncias em estado de erro, incluindo instâncias que falham nas verificações de Qualidade de Dados e instâncias que falham devido a erros de lógica de código. Quando o tipo de objeto é Workspace e a Trigger Condition está definida como Instances with Errors, configure um limiar. Um alerta é acionado quando o número de instâncias com erro atinge o limiar. Nota
|
|
|
Proportion of Instances with Errors |
Quando o tipo de objeto é Workspace e a Trigger Condition está definida como Proportion of Instances with Errors, configure um limiar. Um alerta é acionado quando a proporção de instâncias com erro em relação ao número total de instâncias hoje atinge o limiar. Nota
|
|
|
Node Logs Contain Keywords |
Quando o tipo de objeto é Workspace e a Trigger Condition está definida como Node Logs Contain Keywords, configure palavras-chave. Um alerta é acionado quando os logs de execução das tarefas hoje contêm as palavras-chave especificadas. Nota
|
|
|
Incomplete in Cycle |
O sistema monitora uma tarefa dentro de um ciclo especificado. Se a tarefa não terminar a execução dentro do ciclo, um alerta é enviado. Esta condição é normalmente usada para instâncias agendadas por hora. Quando um workflow é configurado com a condição de monitoramento Incomplete in Cycle, o sistema monitora o N-ésimo ciclo das tarefas no workflow (como tarefas diárias, horárias e de nível de minuto) com base no ciclo N que você especificar. Se o número de instâncias for menor que N, o alerta para essa tarefa será ignorado. Por exemplo, se o ciclo estiver definido como 3, o workflow contiver as duas tarefas a seguir e o monitoramento de alerta funcionar da seguinte maneira:
|
|
|
Timeout |
O sistema monitora uma tarefa desde o início da execução. Se a tarefa não terminar a execução após a duração especificada, um alerta é enviado. Esta condição é normalmente usada para monitorar a duração da tarefa. |
|
|
Error Persisting After Automatic Rerun of Node |
O sistema monitora uma tarefa desde o início da execução. Se a tarefa encontrar um erro e ainda falhar após novas execuções automáticas, um alerta é enviado. Nota
Se você quiser acionar um alerta sempre que uma tarefa encontrar um erro, defina a condição de acionamento como Error. |
|
|
Instance Generated |
Esta condição de acionamento está disponível apenas quando o tipo de objeto é Workspace. |
|
|
Fluctuation of Instance Count |
Esta condição de acionamento está disponível apenas quando o tipo de objeto é Workspace. O DataWorks gera instâncias agendadas para o próximo dia antes das 24:00 todos os dias. Você recebe este alerta quando o número de instâncias no workspace flutua significativamente em comparação com a média histórica. |
|
|
Exclusive Resource Group for Scheduling, Exclusive Resource Group for Data Integration |
Resource Group Usage |
Um alerta é acionado quando o Usage excede um valor especificado por uma duração especificada. Exemplo: Um alerta é acionado quando o Usage excede 50% por 15 minutos consecutivos. |
|
Número de instâncias aguardando recursos no grupo de recursos |
Um alerta é acionado quando o Number of Instances Waiting for Resources in Resource Group excede um valor especificado por uma duração especificada. Exemplo: Um alerta é acionado quando o Number of Instances Waiting for Resources in Resource Group excede 10 por 15 minutos consecutivos. |
Configurar ações de alerta
|
Método de notificação de alerta |
Destinatário do alerta |
Descrição |
|
Email, SMS, phone call |
Os alertas podem ser enviados para Node Owner, Shift Schedule e Others. |
|
|
DingTalk ChatbotWebhook |
Membros do grupo |
|
Configurar controle de fadiga de alerta
|
Parâmetro |
Descrição |
|
Maximum Alerts |
O número máximo de alertas. Nenhum outro alerta é enviado após esse número ser atingido. |
|
Minimum Alert Interval |
O intervalo mínimo de tempo entre dois alertas consecutivos. |
|
Alerting Do-Not-Disturb Period |
Após definir um período de não perturbe, nenhum alerta é enviado durante esse período. Por exemplo, se as condições de acionamento estiverem definidas como Timeout, Error e Incomplete, e o período de não perturbe estiver definido das |
Após concluir a configuração, clique em OK para gerar a regra. Na página Rule Management, clique em View Details, Enable/Disable ou Delete ao lado de uma regra para executar as operações correspondentes.
View Details: Clique em View Details para visualizar as informações básicas da regra.
Enable ou Disable: Controla o status da regra. A regra monitora a execução da tarefa apenas depois de ativada. Visualize os detalhes do alerta no painel Detalhes do alerta.
Delete: Clique em Delete para excluir diretamente a regra.
Modificar uma regra de monitoramento
Uma regra criada pode ser modificada apenas pelo proprietário da regra de monitoramento, um administrador de tenant ou a conta Alibaba Cloud.
Melhor prática: Enviar mensagens de alerta para um grupo do DingTalk
Abra o grupo do DingTalk de destino para o qual deseja enviar alertas e clique em Group Settings no canto superior direito.
Clique em Smart Group Assistant.
Na página Smart Group Assistant, clique em Add Robot.
Na página Group Robots, clique no ícone
.Na página Select a Robot to Add, clique em Custom.
Na caixa de diálogo Custom, clique em Add.
-
Na caixa de diálogo Add Robot, configure os parâmetros.
Parâmetro
Descrição
Robot Name
O nome personalizado do robô.
Add to Group
O grupo ao qual o robô é adicionado. Este valor não pode ser modificado.
Custom Keywords
Após definir palavras-chave personalizadas, apenas mensagens que contenham as palavras-chave podem ser enviadas. Adicione DataWorks como palavra-chave. Observe que as palavras-chave diferenciam maiúsculas de minúsculas.
NotaÉ possível definir até 10 palavras-chave. Uma mensagem deve conter pelo menos uma das palavras-chave para ser enviada com sucesso.
Selecione I have read and agree to the Custom Robot Service and Disclaimer e clique em Complete.
-
Após concluir as configurações de segurança, copie a URL do Webhook do robô e clique em Complete.
ImportanteMantenha a URL do webhook segura. A exposição da URL pode representar riscos de segurança.
Acesse a página Rule Management, clique em Create Custom Rule, defina o método de notificação de alerta como DingTalk Chatbot e cole a Webhook URL no campo DingTalk Chatbot Webhook URL.
FAQ
P: Como evito notificações de alerta frequentes?
R: Configure o controle de fadiga de alerta para definir o número máximo de alertas, intervalos de alerta e um período de não perturbe. Para detalhes, consulte Controle de fadiga de alerta.