CloudOps Orchestration Service (OOS) vous permet de créer des tâches d'exploitation et de maintenance déclenchées par des alertes de seuil portant sur les métriques des services cloud. Lorsqu'une métrique d'une ressource cloud surveillée atteint un seuil spécifié, OOS exécute un modèle prédéfini pour effectuer les opérations d'exploitation et de maintenance correspondantes. Ces tâches s'exécutent en continu et surveillent les alertes jusqu'à ce que vous les annuliez. Par exemple, vous pouvez créer une tâche d'exploitation et de maintenance pour nettoyer un répertoire de journaux lorsque l'utilisation du disque dépasse 80 %.
Pour plus d'informations sur les métriques prises en charge, consultez la rubrique Principales métriques des services Alibaba Cloud.
Pour créer une tâche d'exploitation et de maintenance basée sur une alerte, procédez comme suit :
Définissez une règle d'alerte
Sélectionnez un modèle
Configurez les paramètres du modèle pour le déclencheur d'alerte
Définir une règle d'alerte
Champ | Obligatoire | Description |
Type de produit | Oui | Sélectionnez un produit dans la liste déroulante. Vous ne pouvez en sélectionner qu'un seul. |
Description de la règle | Oui | Règle définissant l'alerte de seuil. |
Silence pendant | Non | Si les données de surveillance dépassent continuellement le seuil d'alerte, l'alerte n'est déclenchée qu'une seule fois durant chaque période de silence. La période par défaut est d'un jour. |
Période d'efficacité | Non | Plage horaire durant laquelle la règle d'alerte est active. Par défaut, la règle s'applique toute la journée. |
Ressources concernées par l'alerte | Oui | Remarque Si vous ne sélectionnez pas de ressources à l'aide de l'une des trois méthodes suivantes, la règle s'applique à toutes les ressources de votre compte.
|
Une règle d'alerte de seuil comprend les champs suivants :
Nom de la métrique
Période d'agrégation des données de surveillance
Nombre de périodes statistiques
Méthode statistique
Opérateur de comparaison
Seuil

Sélectionner un modèle
Sélectionnez le modèle à exécuter lorsqu'une alerte se produit.
Configurer les paramètres du modèle pour le déclencheur d'alerte
Pour les paramètres du modèle, vous pouvez saisir des valeurs statiques ou sélectionner des paramètres issus du message d'alerte. Si vous utilisez des paramètres statiques, le modèle sera toujours exécuté avec ces valeurs. Si vous sélectionnez des paramètres depuis le message d'alerte, vous pouvez configurer des expressions jq pour extraire des champs du message.
Pour extraire des champs d'un message d'alerte, commencez par un signe dollar ($) et ajoutez une expression jq. Par exemple, le code suivant illustre le format d'un message d'alerte pour la métrique cpu_total d'une instance ECS :
{
"Average": 50.15,
"Maximum": 50.75,
"Minimum": 49.75,
"curLevel": "INFO",
"instanceId": "i-bp1gn7od******qh5r12",
"ruleName": "alarmtrigger-130920******0047-exec-de81413d******71b537",
"timestamp": 1575970560000,
"userId": "130920******0047"
}
Pour extraire l'ID de l'instance ayant déclenché l'alerte, utilisez l'expression $.instanceId.
Les champs statiques suivants peuvent être extraits du message d'alerte :
|
Expression d'extraction |
Description |
Valeur d'exemple |
|
$.timestamp |
L'horodatage de l'alerte, en millisecondes. |
1575970560000 |
|
$.curLevel |
Le niveau d'alerte. |
INFO |
|
$.userId |
L'ID du compte Alibaba Cloud. |
130920**0047 |
|
$.dimensionFieldName |
La valeur de la dimension de surveillance. Remplacez `dimensionFieldName` par le nom du champ de dimension de la métrique. Par exemple, le processeur d'une instance ECS est surveillé via la dimension `instanceId`. Vous pouvez utiliser |
S/O |
Exemple de sélection de paramètres depuis un message d'alerte :

La méthode de définition des paramètres statiques est identique à celle utilisée pour les paramètres de modèle classiques.
Notes :
Paramètres statiques (configuration statique) : ces paramètres sont spécifiés manuellement lors de la création de la tâche et ne changent pas pendant l'exécution. Si une tâche utilise ces paramètres, elle opère toujours sur des ressources prédéfinies et ne peut pas identifier l'instance spécifique qui a déclenché l'alerte.
Paramètres du message d'alerte (paramètres dynamiques) : ils sont automatiquement extraits du contenu du message d'un événement d'alerte, tels que les champs
resourceIdetinstanceIddans un événement CloudMonitor. Ils reflètent avec précision la ressource réelle associée à l'alerte actuelle.
Si une tâche utilise des paramètres statiques au lieu d'obtenir dynamiquement l'identité de la ressource à partir du message d'alerte, la tâche d'exploitation et de maintenance risque d'agir sur le mauvais objet. Cela peut empêcher le traitement de la ressource ayant déclenché l'alerte.