L'observabilité d'une architecture système reposant sur Container Service for Kubernetes (ACK) s'articule autour de quatre niveaux. De bas en haut : l'infrastructure, les performances des conteneurs, les performances des applications et le métier. Bien que l'architecture de surveillance d'ACK Edge soit alignée sur celle d'ACK, les capacités de surveillance diffèrent. Cette rubrique décrit les fonctionnalités d'observabilité de chaque niveau dans les clusters ACK Edge.
Observabilité de l'infrastructure
L'observabilité des ressources sous-jacentes dans ACK Edge vous permet de retracer les pools de ressources composés de pods et de nœuds, de visualiser les relations topologiques et de surveiller l'infrastructure. Par exemple, supervisez les performances des hôtes et des plug-ins réseau de base.
Solution | Description | Scénario | Référence |
Découverte visuelle de l'architecture | Les charges de travail d'un cluster ACK s'exécutent au sein de pools de ressources constitués de nœuds. Il est difficile de retracer les parcours et les relations topologiques des pods. Les défis consistent à surveiller visuellement l'état des charges de travail Kubernetes et à mieux visualiser le débit du trafic des clusters Kubernetes. La surveillance Kubernetes utilisée par ACK intègre Extended Berkeley Packet Filter (eBPF) et Managed Service for Prometheus pour prendre en charge la collecte de métriques, le traçage des applications, l'analyse des journaux et la surveillance des événements. La surveillance Kubernetes vous permet de superviser de bout en bout les clusters ACK Edge. Elle offre aux clusters ACK des capacités de surveillance réseau et de visualisation de l'architecture. La surveillance Kubernetes fournit aux développeurs et aux ingénieurs DevOps des solutions d'observabilité non intrusives. | Tous les scénarios sont pris en charge.
| Pour plus d'informations, consultez [Obsolète] Surveillance de la topologie des clusters. |
Observabilité des performances des conteneurs
L'observabilité des abstractions de conteneurs dans le système d'observabilité repose sur ACK Edge. L'observabilité des performances des conteneurs vous permet de surveiller les performances des clusters et des conteneurs, et de détecter les événements du cluster.
Collecter les métriques de performance des clusters et des conteneurs
|
Solution |
Description |
Scénario |
Référence |
|
Managed Service for Prometheus |
Service de surveillance entièrement géré compatible avec l'écosystème open source Prometheus. Fournit des tableaux de bord prêts à l'emploi pour une large gamme de composants sans nécessiter d'infrastructure de surveillance auto-gérée. Recommandé. |
Tous les scénarios sont pris en charge, tels que la collecte de métriques des composants du cluster et la personnalisation de l'observabilité pour les fonctionnalités de surveillance avancées. |
Pour plus d'informations, consultez Surveiller les clusters ACK Edge avec la surveillance Prometheus pour Alibaba Cloud. |
Surveiller les événements des clusters et des conteneurs
|
Solution |
Description |
Scénario |
Référence |
|
Surveillance des événements |
La surveillance des événements complète la surveillance des ressources en offrant des informations précises et en temps réel dans divers scénarios. Les développeurs peuvent diagnostiquer les problèmes de cluster à l'aide des données d'événements en temps réel. Nous vous recommandons d'utiliser Simple Log Service pour surveiller les événements. |
Tous les scénarios sont pris en charge. |
Pour plus d'informations, consultez surveillance des événements. |
Observabilité des performances des applications
L'observabilité couvrant les métriques d'application, le traçage et la journalisation dans le système d'observabilité repose sur ACK Edge. Par exemple, déployez une application Java dans un cluster ACK Edge et surveillez le nombre de threads de l'application.
|
Solution |
Description |
Scénario |
Référence |
|
APM non intrusif pour la surveillance des applications Java |
Application Real-Time Monitoring Service (ARMS) fournit une solution APM non intrusive pour les applications Java dans ACK. Installez le module ARMS pour identifier les interfaces défaillantes et lentes, ajuster les paramètres, détecter les fuites de mémoire et identifier les goulets d'étranglement de performance. Recommandé. |
Surveillance des applications Java. Non intrusive. |
Pour plus d'informations, consultez surveillance des applications Java. |
Observabilité métier
L'observabilité métier dans le système d'observabilité repose sur ACK Edge. Après avoir déployé un site web hautement disponible et évolutif basé sur ACK Edge, consultez des statistiques telles que les pages vues (PV) et les visiteurs uniques (UV). L'observabilité métier vous permet également d'auditer les coûts des applications.
|
Solution |
Description |
Scénario |
Référence |
|
Journalisation et surveillance personnalisées |
Personnalisez le contenu et le format des journaux d'application, collectez les journaux avec SLS et configurez des tableaux de bord pour la surveillance métier ou l'audit système. Recommandé. |
Tous les scénarios, tels que la surveillance du trafic, l'audit des coûts et l'analyse des tendances des commandes. |
Pour plus d'informations, consultez Collecter les journaux de conteneur depuis un cluster ACK Edge. |
|
Tableaux de bord personnalisés avec Managed Service for Grafana |
Managed Service for Grafana est une plateforme de visualisation cloud-native avec des environnements d'exécution ne nécessitant aucune opération de maintenance. Ingeste les données des services Alibaba Cloud tels que les bases de données, Message Queue, Prometheus et SLS, et fournit des tableaux de bord de surveillance granulaires. Analysez les métriques, les journaux et les traces sans gérer de serveurs ni de mises à jour, grâce à la sécurité intégrée et la haute disponibilité. |
Tous les scénarios sont pris en charge. Configurez des tableaux de bord adaptés aux besoins métier, tels que la surveillance en temps réel des PV et UV. |
Pour plus d'informations, consultez Qu'est-ce que Managed Service for Grafana ?. |
|
Surveillance du trafic métier et de la santé métier avec ARMS Browser Monitoring |
Surveille les applications web, Weex et les mini-programmes en suivant les vitesses de chargement des pages, la stabilité des erreurs JS et les taux de réussite des appels API. |
Cette solution convient aux applications front-end utilisant JavaScript. |
Pour plus d'informations, consultez |
Références
Pour plus d'informations sur la surveillance des journaux, consultez Collecter les journaux de conteneur depuis un cluster ACK Edge et Collecter les journaux des composants du plan de contrôle pour les clusters ACK Edge.
Pour plus d'informations sur les métriques de surveillance, consultez [[Interrompu] Surveillance des ressources de base](t947566.xdita#), surveillance des applications Java, [[Obsolète] Surveillance de la topologie des clusters](t2214403.xdita#) et surveillance des événements.
Pour plus d'informations sur l'utilisation des services de surveillance et la configuration des tableaux de bord, consultez Surveiller les clusters ACK Edge avec la surveillance Prometheus pour Alibaba Cloud et Interroger les données de surveillance Prometheus à l'aide de PromQL.