Un système complet de surveillance des métriques dans le cloud
Managed Service for Prometheus est une plateforme cloud native de surveillance des métriques, compatible avec l'écosystème Prometheus open source. Managed Service for Prometheus offre une plateforme tout-en-un de surveillance des métriques pour différents rôles tels que les ingénieurs d'exploitation et maintenance et les ingénieurs en fiabilité des sites (SRE). La plateforme fournit également des services de surveillance et d'alertes pour divers scénarios : surveillance métier personnalisée, surveillance des composants applicatifs, surveillance des services cloud, surveillance des conteneurs et surveillance système.
Performances supérieures
Par rapport à Prometheus open source, Managed Service for Prometheus améliore les performances de collecte de données d'un facteur 20. Managed Service for Prometheus prend en charge les requêtes de données sur de longues périodes en quelques secondes, ainsi que les requêtes agrégées à l'échelle mondiale.
Rentabilité
Managed Service for Prometheus fournit des services entièrement gérés qui réduisent les coûts d'exploitation et maintenance de 90 %. La facturation repose sur le nombre de métriques, et un grand nombre de métriques gratuites sont incluses.
Disponibilité renforcée
Déployez plusieurs réplicas pour assurer la mise à l'échelle horizontale des composants de collecte. Le stockage distribué dans le cloud garantit la fiabilité des données.
Fonctionnalités
Conteneurs spécialisés pour la surveillance full-stack et tableaux de bord intégrés
Couvre la surveillance métier, la surveillance des composants applicatifs, la surveillance des services cloud, la surveillance des conteneurs et la surveillance système.
Métriques de la couche système
Fournit des métriques de base telles que l'utilisation du processeur, l'utilisation de la mémoire, l'utilisation du disque et les E/S.
Métriques multi-cloud et multi-cluster
Fournit des métriques pour les clusters Alibaba Cloud tels que les clusters Kubernetes et Elastic Compute Service (ECS), ainsi que les clusters de cloud hybride.
Métriques de la couche conteneur
S'intègre en profondeur à Alibaba Cloud Container Service for Kubernetes (ACK) et fournit des métriques de base gratuitement.
Métriques des services cloud
Fournit des métriques pour les services cloud tels que les bases de données, les files de messages, les microservices et le stockage.
Métriques de la couche des composants applicatifs autogérés
Fournit des métriques pour les composants applicatifs autogérés tels que les middlewares, les bases de données et les files de messages.
Métriques de performance des applications
S'intègre en profondeur aux fonctionnalités de surveillance des applications et de surveillance du navigateur d'Application Real-Time Monitoring Service (ARMS) et respecte le standard OpenTelemetry.
Métriques métier personnalisées
Prend en charge les métriques personnalisées telles que le taux de transaction, le taux de commande et le taux de clics.
Tableaux de bord Grafana améliorés
Intègre divers tableaux de bord et alertes en quelques clics.
Modèles de tableaux de bord préconfigurés pour les services cloud et composants applicatifs courants
Fournit des configurations de sources de données et des tableaux de bord préconfigurés pour les services cloud afin d'afficher les données de surveillance de manière unifiée.
Extension personnalisée des plug-ins Grafana
Permet d'ajouter des plug-ins Grafana, des modèles visuels et des sources de données pour répondre aux besoins personnalisés d'exploitation, de maintenance et de surveillance.
Modèles de tableaux de bord Prometheus pour les principaux services cloud
Fournit des tableaux de bord Prometheus Grafana pour les principaux services cloud, tels qu'ACK et Message Queue for Apache Kafka, afin d'aider les équipes d'exploitation et maintenance à effectuer une surveillance plus fine des métriques.
Systèmes de gestion des permissions renforcés
Prend en charge l'authentification unique (SSO) Alibaba Cloud et Resource Access Management (RAM), et vous permet d'accéder aux services avec des comptes Alibaba Cloud ou en tant qu'utilisateurs RAM.
Gestion intelligente et améliorée des alertes
Améliore l'efficacité de la collaboration pour le dépannage et la précision des alertes.
Envoi de données multicanal
Prend en charge plus de 10 méthodes de notification, telles que Slack, DingTalk, les e-mails, les SMS et les webhooks, pour des notifications en temps opportun.
Collaboration améliorée sur les alertes
Permet de collaborer sur le traitement des alertes, de tracer les alertes et de collecter des statistiques grâce aux fonctionnalités de gestion, d'enregistrement et d'historique des alertes, basées sur ChatOps via DingTalk.
Réduction intelligente du bruit
Fournit des capacités algorithmiques, telles que la détection d'anomalies et la réduction intelligente du bruit, pour réduire efficacement les alertes non pertinentes.
Analyse des causes profondes des alertes
Vous aide à analyser les causes profondes des alertes en fonction du contexte applicatif afin d'améliorer l'efficacité du dépannage.
Requêtes agrégées globales sur plusieurs instances
Fournit des fonctionnalités telles que les requêtes agrégées globales, les sources de données Grafana unifiées et les alertes centralisées.
Comparaison entre Alibaba Cloud Managed Service for Prometheus et Prometheus open source
| Élément | Alibaba Cloud Managed Service for Prometheus | Prometheus autogéré |
|---|---|---|
| Achat des ressources et déploiement des systèmes | Les ressources sont entièrement gérées par Alibaba Cloud. | Vous devez acheter les ressources et déployer les systèmes vous-même. |
| Coûts d'exploitation et maintenance | Aucune opération d'exploitation et maintenance requise. | Opérations d'exploitation et maintenance courantes requises. |
| Haute disponibilité | Plusieurs réplicas peuvent être déployés pour prendre en charge la mise à l'échelle horizontale des composants de collecte et de stockage. Cela garantit une haute disponibilité. | Vous ne pouvez exécuter qu'un seul processus à la fois. La mise à l'échelle horizontale n'est pas prise en charge pour les composants de collecte et de stockage des données. |
| Accès aux données | Vous pouvez intégrer les services cloud courants, les composants applicatifs standards tels que les bases de données et le middleware, ainsi que les applications développées avec des langages courants comme Java et Go. Vous pouvez surveiller le middleware hébergé sur des clusters ECS sans installer d'agent. | Pour collecter les données d'un composant, vous devez créer un exporter dédié à ce composant. |
| Stockage des données | Le stockage cloud offre une capacité de stockage illimitée. | La capacité de stockage est limitée. |
| Visualisation des données | Grafana est intégré à la console et tous les modèles de surveillance courants sont disponibles prêts à l'emploi. | Vous devez déployer Grafana et configurer les tableaux de bord vous-même. |
| Gestion des alertes | Le centre d'alertes d'ARMS est intégré à Managed Service for Prometheus pour améliorer l'efficacité et la précision des alertes. | Vous devez installer le plug-in Alertmanager vous-même. |
| Performance de collecte d'un réplica unique (2 cœurs CPU, 4 Go de mémoire) | 6 millions de points de données. | 1 million de points de données. |
| Performance des requêtes (0,6 milliard de points temporels) | 8 à 10 secondes. | 180 secondes. |
| Gestion de la sécurité | Managed Service for Prometheus est intégré aux fonctionnalités de sécurité d'Alibaba Cloud pour répondre aux exigences de sécurité et de conformité des entreprises. | Non pris en charge. |
| Autres fonctionnalités | Managed Service for Prometheus prend en charge les fonctionnalités de pré-agrégation et de sous-échantillonnage. | Non pris en charge. |
Scénarios
Métriques des services cloud
Managed Service for Prometheus surveille les services cloud, affiche les données de surveillance sur des tableaux de bord, prend en charge les requêtes de données et fournit des services d'alertes. Les équipes d'exploitation et maintenance peuvent ainsi effectuer leurs opérations courantes de manière pratique. Managed Service for Prometheus prend en charge plus de 50 services cloud et en prendra davantage en charge à l'avenir.
Métriques de la couche conteneur
Managed Service for Prometheus est profondément intégré à ACK. Vous pouvez activer Managed Service for Prometheus en tant que fonctionnalité lors de la configuration d'un cluster ACK. Managed Service for Prometheus fournit aux conteneurs des composants de surveillance des performances des charges de travail, des performances Ingress et des performances CoreDNS. Il propose également des tableaux de bord dédiés pour surveiller les métriques des services de conteneurs, des composants applicatifs, des services cloud et des applications, et affiche les données de surveillance en fonction des tags de ressources cloud.
Objets surveillés
Métriques de performance des applications
Managed Service for Prometheus est intégré à ARMS. Il fournit des tableaux de bord préconfigurés pour les métriques de performance des applications et vous permet de surveiller ces métriques avec des configurations simples. Il vous permet également de collecter les données de performance applicative via des configurations de découverte de services.
Objets surveillés
Métriques des composants applicatifs multi-cloud
Managed Service for Prometheus fournit des solutions pour installer des exporters sur les clouds tiers et les centres de données afin de répondre à leurs exigences de surveillance des métriques.
Métriques métier personnalisées
Managed Service for Prometheus vous permet de personnaliser les métriques d'objectifs métier, de qualité de service, de composants techniques et de ressources de base selon vos besoins. Une fois les tâches de capture de données configurées, toutes les métriques sont affichées de manière centralisée pour améliorer la pertinence des données.
