Tous les produits
Search
Centre de documentation

CloudOps Orchestration Service:Create an alert O&M task

Dernière mise à jour :Aug 11, 2026

CloudOps Orchestration Service (OOS) vous permet de créer des tâches d'exploitation et de maintenance déclenchées par des alertes de seuil portant sur les métriques des services cloud. Lorsqu'une métrique d'une ressource cloud surveillée atteint un seuil spécifié, OOS exécute un modèle prédéfini pour effectuer les opérations d'exploitation et de maintenance correspondantes. Ces tâches s'exécutent en continu et surveillent les alertes jusqu'à ce que vous les annuliez. Par exemple, vous pouvez créer une tâche d'exploitation et de maintenance pour nettoyer un répertoire de journaux lorsque l'utilisation du disque dépasse 80 %.

Pour plus d'informations sur les métriques prises en charge, consultez la rubrique Principales métriques des services Alibaba Cloud.

Pour créer une tâche d'exploitation et de maintenance basée sur une alerte, procédez comme suit :

  1. Définissez une règle d'alerte

  2. Sélectionnez un modèle

  3. Configurez les paramètres du modèle pour le déclencheur d'alerte

Définir une règle d'alerte

Champ

Obligatoire

Description

Type de produit

Oui

Sélectionnez un produit dans la liste déroulante. Vous ne pouvez en sélectionner qu'un seul.

Description de la règle

Oui

Règle définissant l'alerte de seuil.

Silence pendant

Non

Si les données de surveillance dépassent continuellement le seuil d'alerte, l'alerte n'est déclenchée qu'une seule fois durant chaque période de silence. La période par défaut est d'un jour.

Période d'efficacité

Non

Plage horaire durant laquelle la règle d'alerte est active. Par défaut, la règle s'applique toute la journée.

Ressources concernées par l'alerte

Oui

Remarque

Si vous ne sélectionnez pas de ressources à l'aide de l'une des trois méthodes suivantes, la règle s'applique à toutes les ressources de votre compte.

  • Sélection manuelle des instances : choisissez des instances spécifiques à surveiller.

  • Spécification des tags d'instance : filtrez rapidement un ensemble d'instances partageant les mêmes caractéristiques ou utilisées dans le même but.

  • Spécification du groupe de ressources : utilisez un groupe de ressources pour gérer centralement les instances associées, afin d'unifier leur configuration et leur maintenance.

Une règle d'alerte de seuil comprend les champs suivants :

  • Nom de la métrique

  • Période d'agrégation des données de surveillance

  • Nombre de périodes statistiques

  • Méthode statistique

  • Opérateur de comparaison

  • Seuil

image

Sélectionner un modèle

Sélectionnez le modèle à exécuter lorsqu'une alerte se produit.

Configurer les paramètres du modèle pour le déclencheur d'alerte

Pour les paramètres du modèle, vous pouvez saisir des valeurs statiques ou sélectionner des paramètres issus du message d'alerte. Si vous utilisez des paramètres statiques, le modèle sera toujours exécuté avec ces valeurs. Si vous sélectionnez des paramètres depuis le message d'alerte, vous pouvez configurer des expressions jq pour extraire des champs du message.

Pour extraire des champs d'un message d'alerte, commencez par un signe dollar ($) et ajoutez une expression jq. Par exemple, le code suivant illustre le format d'un message d'alerte pour la métrique cpu_total d'une instance ECS :

{
    "Average": 50.15,
    "Maximum": 50.75,
    "Minimum": 49.75,
    "curLevel": "INFO",
    "instanceId": "i-bp1gn7od******qh5r12",
    "ruleName": "alarmtrigger-130920******0047-exec-de81413d******71b537",
    "timestamp": 1575970560000,
    "userId": "130920******0047"
}

Pour extraire l'ID de l'instance ayant déclenché l'alerte, utilisez l'expression $.instanceId.

Les champs statiques suivants peuvent être extraits du message d'alerte :

Expression d'extraction

Description

Valeur d'exemple

$.timestamp

L'horodatage de l'alerte, en millisecondes.

1575970560000

$.curLevel

Le niveau d'alerte.

INFO

$.userId

L'ID du compte Alibaba Cloud.

130920**0047

$.dimensionFieldName

La valeur de la dimension de surveillance. Remplacez `dimensionFieldName` par le nom du champ de dimension de la métrique. Par exemple, le processeur d'une instance ECS est surveillé via la dimension `instanceId`. Vous pouvez utiliser $.instanceId pour extraire l'ID de l'instance. Pour plus d'informations, consultez la section Dimensions de la rubrique Principales métriques des services Alibaba Cloud.

S/O

Exemple de sélection de paramètres depuis un message d'alerte :

La méthode de définition des paramètres statiques est identique à celle utilisée pour les paramètres de modèle classiques.

Notes :

  • Paramètres statiques (configuration statique) : ces paramètres sont spécifiés manuellement lors de la création de la tâche et ne changent pas pendant l'exécution. Si une tâche utilise ces paramètres, elle opère toujours sur des ressources prédéfinies et ne peut pas identifier l'instance spécifique qui a déclenché l'alerte.

  • Paramètres du message d'alerte (paramètres dynamiques) : ils sont automatiquement extraits du contenu du message d'un événement d'alerte, tels que les champs resourceId et instanceId dans un événement CloudMonitor. Ils reflètent avec précision la ressource réelle associée à l'alerte actuelle.

Si une tâche utilise des paramètres statiques au lieu d'obtenir dynamiquement l'identité de la ressource à partir du message d'alerte, la tâche d'exploitation et de maintenance risque d'agir sur le mauvais objet. Cela peut empêcher le traitement de la ressource ayant déclenché l'alerte.