Vous pouvez configurer des règles d'alerte pour un cluster AnalyticDB for MySQL afin de surveiller des métriques telles que l'utilisation du CPU, l'utilisation du disque, l'utilisation des IOPS, la durée des requêtes et les connexions à la base de données. Lorsqu'une métrique satisfait à sa condition d'alerte, le système notifie tous les contacts du groupe de contacts d'alerte spécifié.
Contexte
AnalyticDB for MySQL prend en charge la surveillance et les alertes via Alibaba Cloud CloudMonitor. Avec CloudMonitor, vous pouvez définir des règles d'alerte pour les métriques. Lorsqu'une règle est déclenchée, CloudMonitor notifie tous les contacts du groupe de contacts d'alerte spécifié. Vous pouvez également gérer les groupes de contacts d'alerte pour vos métriques afin de garantir que le personnel concerné soit informé.
Les métriques incluent l'utilisation du CPU du cluster, l'utilisation du disque, l'utilisation des IOPS, la durée des requêtes et les connexions à la base de données. Pour plus d'informations, consultez la documentation relative à AnalyticDB for MySQL (Data Warehouse Edition) 3,0. Par exemple, vous pouvez configurer une alerte sur l'utilisation du disque. Lorsque l'utilisation du disque est supérieure ou égale à 80 %, le système envoie une notification d'alerte. Si l'utilisation du disque atteint 90 % ou plus, le cluster est verrouillé, une alerte est envoyée et les requêtes d'écriture sont rejetées. Cela signifie que les opérations d'écriture échouent avec une erreur, mais les opérations de lecture ne sont pas affectées. Les alertes immédiates en cas d'anomalie de disque vous aident à surveiller et à gérer votre espace disque. Toutefois, chaque contact d'alerte reçoit un maximum de quatre alertes d'utilisation du disque par jour. Lorsque vous recevez une alerte, résolvez le problème rapidement pour assurer le bon fonctionnement de vos services.
Procédure
Connectez-vous à la console AnalyticDB for MySQL. Dans le coin supérieur gauche de la console, sélectionnez une région. Dans le volet de navigation de gauche, cliquez sur Clusters. Recherchez le cluster que vous souhaitez gérer et cliquez sur son ID.
Dans le volet de navigation de gauche, cliquez sur Monitoring and Alerting.
Cliquez sur l'onglet Alerts. Sur la page Alerts, cliquez sur Create Alert Rule.
-
Sur la page Create Alert Rule, configurez les paramètres.
Paramètre
Description
Resource Range
La portée de la règle d'alerte. Valeurs possibles :
-
All Resources : cette option applique la règle à toutes les instances d'un produit sous votre compte. Par exemple, si vous définissez une alerte qui se déclenche lorsque l'utilisation du disque de AnalyticDB for MySQL est supérieure ou égale à 80 %, la règle s'applique à toutes les instances AnalyticDB for MySQL. Lorsque Resource Range est défini sur All Resources, les alertes peuvent être déclenchées pour un maximum de 1 000 ressources. Si le nombre de ressources dépasse 1 000, les alertes risquent de ne pas être déclenchées même si le seuil est atteint. Nous vous recommandons d'utiliser des groupes d'applications pour regrouper les ressources par activité métier avant de configurer les alertes.
-
Application Group : la règle d'alerte s'applique à toutes les ressources d'un groupe d'applications spécifié pour le produit.
-
Instance : la règle s'applique uniquement à des instances spécifiques du produit. Par exemple, si vous définissez une alerte au niveau de l'instance pour une utilisation du disque supérieure ou égale à 80 %, une notification est envoyée lorsque l'utilisation du disque de cette instance spécifique atteint ou dépasse le seuil.
Description de la règle
Les conditions qui déclenchent l'alerte. Pour configurer la description de la règle :
-
Cliquez sur Add Rule.
-
Dans le panneau Add Rule Description, définissez les paramètres tels que Rule Name, Metric Type, Monitoring Metric, Threshold and Alert Level et Chart Preview.
-
Cliquez sur OK.
Mute Period
L'intervalle entre les notifications répétées pour une alerte non résolue. Valeurs possibles : 5 minutes, 15 minutes, 30 minutes, 60 minutes, 3 heures, 6 heures, 12 heures et 24 heures. Lorsqu'une métrique atteint le seuil d'alerte, une alerte est envoyée. Si la métrique continue de dépasser le seuil pendant la période de silence, aucune notification répétée n'est envoyée. Si la condition n'est pas résolue à la fin de la période de silence, CloudMonitor envoie une autre notification d'alerte.
Effective Time
La période pendant laquelle la règle d'alerte est active.
ImportantPour les alertes d'utilisation du disque, chaque contact d'alerte est notifié au maximum quatre fois par jour. Les alertes suivantes sont mises en sourdine.
Alert Contact Group
Le groupe de contacts qui reçoit les notifications d'alerte.
Les notifications pour les groupes d'applications sont envoyées aux contacts de ce groupe de contacts d'alerte. Un groupe de contacts d'alerte peut contenir un ou plusieurs contacts d'alerte. Pour savoir comment créer des contacts d'alerte et des groupes de contacts d'alerte, consultez la rubrique Créer un contact d'alerte ou un groupe de contacts d'alerte.
Alert Callback
Une URL accessible publiquement. CloudMonitor pousse les informations d'alerte vers cette URL via des requêtes POST. Seul le protocole HTTP est pris en charge. Pour savoir comment configurer un rappel d'alerte, consultez la rubrique Utiliser les rappels d'alerte basés sur des seuils.
RemarqueCliquez sur Advanced Settings pour configurer ce paramètre.
Auto Scaling
Si vous activez Auto Scaling, la règle de mise à l'échelle correspondante est déclenchée lorsqu'une alerte se produit. Vous devez spécifier la Region, le ESS Group et la ESS Rule pour Auto Scaling.
-
Pour savoir comment créer un groupe de mise à l'échelle, consultez la rubrique Configurer un groupe de mise à l'échelle.
-
Pour savoir comment créer une règle de mise à l'échelle, consultez la rubrique Configurer une règle de mise à l'échelle.
RemarqueCliquez sur Advanced Settings pour configurer ce paramètre.
Simple Log Service
Si vous activez Simple Log Service, les informations d'alerte sont écrites dans Log Service lorsqu'une alerte se produit. Vous devez spécifier la Region, le Project et le Logstore pour Log Service.
Pour savoir comment créer un projet et un Logstore, consultez la rubrique Collecter et analyser les journaux textuels ECS à l'aide de LoongCollector.
RemarqueCliquez sur Advanced Settings pour configurer ce paramètre.
Simple Message Queue (formerly MNS) - Topic
Si vous activez Simple Message Queue (formerly MNS) - Topic, les informations d'alerte sont envoyées vers une rubrique spécifiée dans Message Service. Vous devez spécifier la région et la rubrique pour Message Service.
Pour savoir comment créer une rubrique, consultez la rubrique Créer une rubrique.
Method for handling alerts when no monitoring data is available
L'action à effectuer lorsqu'aucune donnée de surveillance n'est disponible pour une règle d'alerte. Valeurs possibles :
-
Do not do anything (par défaut)
-
Send alert notifications
-
Consider as recovered
RemarqueCliquez sur Advanced Settings pour configurer ce paramètre.
Tag
Ajoute des paires clé-valeur personnalisées en tant que tags au contenu de l'alerte.
-
Une fois les paramètres configurés, cliquez sur OK.