Surveillez les ressources d'abonnement MaxCompute, la consommation des jobs en paiement à l'utilisation ainsi que les chargements et téléchargements Tunnel pour rester informé de l'état de santé de vos ressources, anticiper les montées en charge ou planifier vos jobs. Configurez des règles d'alerte afin que Cloud Monitor vous notifie automatiquement lorsqu'une métrique atteint un seuil spécifié.
et les chargements et téléchargements Tunnel
Solutions de surveillance et d'alerte
MaxCompute prend en charge les méthodes de surveillance et d'alerte suivantes :
-
Utilisez Cloud Monitor pour configurer des métriques pour les ressources d'abonnement, la consommation des jobs en temps réel .
Utilisez un tableau de bord pour observer les graphiques en temps réel et comprendre l'évolution de chaque métrique.
Créez des règles d'alerte personnalisées et ajoutez des contacts d'alerte. Lorsqu'une métrique atteint ou dépasse un seuil spécifié, Cloud Monitor envoie automatiquement une alerte aux contacts désignés. Les notifications peuvent être envoyées par téléphone, SMS, e-mail ou via un robot de discussion DingTalk.
Connectez-vous à la console MaxCompute. La section Overview affiche le nombre d'alertes pour chaque métrique dans la section Alert and Risk Warnings.
Utilisez le client MaxCompute pour surveiller la consommation d'une requête SQL unique . Pour plus d'informations, consultez les rubriques Limite de consommation par requête SQL unique.
Métriques
Le tableau suivant répertorie les types et les métriques pris en charge par MaxCompute.
|
Type de métrique |
Catégorie de métrique |
Métrique |
Description |
|
MaxCompute-Subscription Compute Quota |
level1 |
Taux d'utilisation du CPU du quota de niveau 1 |
Taux d'utilisation du CPU d'un quota de niveau 1, exprimé en pourcentage du total des CU (CU réservés + CU réservés élastiques). Unité : %. Les données sont collectées toutes les minutes. |
|
Consommation du CPU du quota de niveau 1 |
Consommation totale du CPU d'un quota de niveau 1. Unité : cœur. Les données sont collectées toutes les minutes. |
||
|
Taux d'utilisation de la mémoire du quota de niveau 1 |
Taux d'utilisation de la mémoire d'un quota de niveau 1, exprimé en pourcentage de la mémoire totale (mémoire réservée + mémoire réservée élastique). Unité : %. Les données sont collectées toutes les minutes. |
||
|
Consommation de la mémoire du quota de niveau 1 |
Consommation de la mémoire d'un quota de niveau 1. Unité : Mo. Les données sont collectées toutes les minutes. |
||
|
level2 |
Taux d'utilisation du CPU du quota de niveau 2 |
Taux d'utilisation du CPU d'un quota de niveau 2, exprimé en pourcentage du total des CU (CU Min réservés + CU réservés élastiques). Unité : %. Les données sont collectées toutes les minutes. |
|
|
Consommation du CPU du quota de niveau 2 |
Consommation totale du CPU d'un quota de niveau 2. Unité : cœur. Les données sont collectées toutes les minutes. |
||
|
Taux d'utilisation de la mémoire du quota de niveau 2 |
Taux d'utilisation de la mémoire d'un quota de niveau 2, exprimé en pourcentage de la mémoire totale (mémoire Min réservée + mémoire réservée élastique). Unité : %. Les données sont collectées toutes les minutes. |
||
|
Consommation de la mémoire du quota de niveau 2 |
Consommation de la mémoire d'un quota de niveau 2. Unité : Mo. Les données sont collectées toutes les minutes. |
||
|
Jobs en attente du quota de niveau 2 |
Nombre de jobs en attente dans un quota de niveau 2. Unité : nombre. Les données sont collectées toutes les minutes. |
||
|
MaxCompute-General |
Tunnel |
Trafic de téléchargement Tunnel_Niveau projet |
Surveille le trafic de téléchargement en temps réel au niveau du projet. Vous pouvez définir un trafic de téléchargement maximal (octets/min). Une alerte est déclenchée lorsque le trafic atteint ou dépasse ce seuil. |
|
Trafic de chargement Tunnel_Niveau projet |
Surveille le trafic de chargement en temps réel au niveau du projet. Vous pouvez définir un trafic de chargement maximal (octets/min). Une alerte est déclenchée lorsque le trafic atteint ou dépasse ce seuil. |
||
|
Volume cumulatif quotidien de téléchargement Tunnel_Niveau projet |
Surveille le volume cumulé de téléchargement pour un projet sur une journée. Vous pouvez définir un volume de données maximal (Mo). Une alerte est déclenchée lorsque le volume atteint ou dépasse ce seuil. |
||
|
Volume cumulatif quotidien de chargement Tunnel_Niveau projet |
Surveille le volume cumulé de chargement pour un projet sur une journée. Vous pouvez définir un volume de données maximal (Mo). Une alerte est déclenchée lorsque le volume atteint ou dépasse ce seuil. |
||
|
Concurrence Tunnel actuelle (Slots)_Niveau projet |
Nombre de slots concurrents actuellement utilisés par le projet sélectionné. Une alerte est déclenchée lorsque ce nombre atteint ou dépasse le seuil. |
||
|
Concurrence Tunnel actuelle (Slots)_Niveau locataire |
Nombre de slots concurrents actuellement utilisés par le locataire sélectionné. Une alerte est déclenchée lorsque ce nombre atteint ou dépasse le seuil. |
||
|
Job |
Durée d'exécution du job |
Surveille tous les jobs au sein d'un projet MaxCompute. Si la durée d'exécution d'un job, y compris son temps d'attente, dépasse le seuil configuré, le système envoie une notification d'alerte aux contacts spécifiés selon la règle d'alerte. Important
Les jobs dont la durée d'exécution est inférieure à 1 minute ne peuvent pas être surveillés. |
|
|
Durée d'exécution du job_Type SQL |
Surveille tous les jobs SQL au sein d'un projet MaxCompute. Si la durée d'exécution d'un job SQL, y compris son temps d'attente, dépasse le seuil configuré, le système envoie une notification d'alerte aux contacts spécifiés selon la règle d'alerte. Important
Les jobs dont la durée d'exécution est inférieure à 1 minute ne peuvent pas être surveillés. |
||
|
Durée d'exécution du job_Type SQL_Soumetteur |
Surveille la durée d'exécution, y compris le temps d'attente, de tous les jobs SQL dans un projet MaxCompute. Lorsque la durée d'exécution d'un job SQL dépasse le seuil, le système envoie une notification d'alerte aux contacts spécifiés. Le contenu de l'alerte inclut les informations sur le soumetteur du job pour aider à identifier le propriétaire du job. Important
Les jobs dont la durée d'exécution est inférieure à 1 minute ne peuvent pas être surveillés. |
||
|
Coût |
Consommation quotidienne StorageAPIRead |
Surveille la consommation cumulative quotidienne des lectures Storage API au niveau du projet. Unité : GiB. Une alerte est déclenchée lorsque la consommation atteint ou dépasse le seuil. Remarque
Chaque locataire bénéficie d'un quota mensuel gratuit de 1 To pour les lectures et écritures de données. La surveillance commence lorsque la consommation dépasse 1 To. |
|
|
Consommation mensuelle StorageAPIRead |
Surveille la consommation cumulative mensuelle des lectures Storage API au niveau du projet. Unité : GiB. Une alerte est déclenchée lorsque la consommation atteint ou dépasse le seuil. Remarque
Chaque locataire bénéficie d'un quota mensuel gratuit de 1 To pour les lectures et écritures de données. La surveillance commence lorsque la consommation dépasse 1 To. |
||
|
Consommation quotidienne StorageAPIWrite |
Surveille la consommation cumulative quotidienne des écritures Storage API au niveau du projet. Unité : GiB. Une alerte est déclenchée lorsque la consommation atteint ou dépasse le seuil. Remarque
Chaque locataire bénéficie d'un quota mensuel gratuit de 1 To pour les lectures et écritures de données. La surveillance commence lorsque la consommation dépasse 1 To. |
||
|
Consommation mensuelle StorageAPIWrite |
Surveille la consommation cumulative mensuelle des écritures Storage API au niveau du projet. Unité : GiB. Une alerte est déclenchée lorsque la consommation atteint ou dépasse le seuil. Remarque
Chaque locataire bénéficie d'un quota mensuel gratuit de 1 To pour les lectures et écritures de données. La surveillance commence lorsque la consommation dépasse 1 To. |
||
|
Consommation quotidienne des jobs en paiement à l'utilisation(USD) |
Surveille le coût cumulatif quotidien des jobs SQL et MapReduce au niveau du projet. Vous pouvez définir une limite de dépenses quotidienne maximale en USD. Une alerte est déclenchée lorsque le coût atteint ou dépasse ce seuil. |
||
|
Consommation mensuelle des jobs en paiement à l'utilisation(USD) |
Surveille le coût cumulatif mensuel des jobs SQL et MapReduce au niveau du projet. Vous pouvez définir une limite de dépenses mensuelle maximale en USD. Une alerte est déclenchée lorsque le coût atteint ou dépasse ce seuil. |
||
|
Stockage |
Taille du stockage Standard_Niveau projet |
Taille du stockage Standard pour le projet. Unité : Go. Les données sont collectées toutes les heures. |
|
|
Taille du stockage Infrequent Access (IA)_Niveau projet |
Taille du stockage Infrequent Access (IA) pour le projet. Unité : Go. Les données sont collectées toutes les heures. |
||
|
Pourcentage d'accès au stockage Infrequent Access (IA) au cours des 30 derniers jours_Niveau projet |
La valeur est calculée à l'aide de la formule suivante : |
||
|
Taille du stockage Archive_Niveau projet |
Taille du stockage Archive pour le projet. Unité : Go. Les données sont collectées toutes les heures. |
||
|
Pourcentage d'accès au stockage Archive au cours des 180 derniers jours_Niveau projet |
La valeur est calculée à l'aide de la formule suivante : |
Vous pouvez configurer un tableau de bord ou une règle d'alerte pour n'importe quelle métrique. Pour plus d'informations, consultez les rubriques Configurer un tableau de bord ou Configurer une règle d'alerte.
Configuration du tableau de bord
Connectez-vous à la console Cloud Monitor.
Dans le volet de navigation de gauche, choisissez .
Sur la page Custom Dashboards, cliquez sur Create Dashboard. Dans la boîte de dialogue Create Dashboard, saisissez un Board Name, sélectionnez un Folder, puis cliquez sur OK.
Cliquez sur le nom du tableau de bord que vous avez créé. Sur la page des détails, cliquez sur Add Chart.
Dans le coin supérieur droit de la page, sélectionnez un type de graphique. Les options incluent Line, Bar, Stats, Gauge, Meter, Pie, Table, Facet, Stream et Histogram.
Dans la section Metrics, définissez Data Source sur Cloud Service Monitoring, puis configurez les métriques.
Pour plus d'informations sur la gestion des graphiques de surveillance, consultez la rubrique Gérer les graphiques de surveillance dans un tableau de bord personnalisé.
Configuration des règles d'alerte
Vous pouvez créer une règle d'alerte pour n'importe laquelle des métriques.
L'exemple suivant configure une alerte pour un groupe de quotas afin de vous notifier lorsque l'utilisation de ses CU ou de sa mémoire dépasse un seuil. Supposons que le groupe de quotas dispose de 150 CU. Un cœur à pleine utilisation équivaut à 100 %, donc l'utilisation maximale est de 15 000 %. Définir le seuil d'alerte sur >12 000 % signifie que, lorsqu'elle est déclenchée, le groupe de quotas approche de sa capacité maximale et que de nouveaux jobs peuvent être mis en file d'attente. Vous pouvez alors mettre à niveau le groupe de quotas ou replanifier les jobs pour réduire la charge.
Connectez-vous à la console Cloud Monitor.
Dans le volet de navigation de gauche, cliquez sur .
Sur la page Alert Rules, cliquez sur Create Alert Rule.
-
Sur la page Create Alert Rule, configurez les paramètres en fonction du scénario. Pour plus d'informations, consultez la rubrique Créer une règle d'alerte. Pour plus de détails sur la configuration des contacts d'alerte, consultez la rubrique Créer un contact d'alerte ou un groupe de contacts d'alerte.
Les paramètres clés pour ce scénario sont décrits dans le tableau suivant :
Paramètre
Description
Product
Sélectionnez MaxCompute_Subscription dans la liste déroulante.
Resource Range
Sélectionnez Instances.
Associated Resources
Cliquez sur Add Instance. Dans le panneau Add Instance, sélectionnez le groupe de quotas d'abonnement dans la région de votre projet MaxCompute, puis cliquez sur OK. Pour plus d'informations sur les groupes de quotas, consultez la rubrique Gérer les ressources de calcul (quotas).
Rule Description
Cliquez sur , et configurez les paramètres suivants dans le panneau Configure Rule Description :
-
Alert Rule : Saisissez un nom pour la règle d'alerte.
-
Metric Type : Sélectionnez Metric.
-
Metric : Sélectionnez la métrique d'utilisation du CPU correspondante dans la liste déroulante.
Remarque-
Si la ressource associée est un groupe de quotas de niveau 1, sélectionnez . Pour un groupe de quotas de niveau 2, sélectionnez .
-
Vous pouvez également surveiller le nombre de jobs en attente. Si l'utilisation du CPU est élevée et qu'un grand nombre de jobs sont en attente pendant N périodes de collecte consécutives, vous devrez peut-être intervenir manuellement.
-
-
Cliquez sur Confirm.
Documentation connexe
Pour définir des limites de dépenses et des alertes pour les jobs de calcul en paiement à l'utilisation, consultez la rubrique Contrôle de la consommation.