Cloud Monitor

Cloud Monitor 2.0, une plateforme d'observabilité tout-en-un alimentée par l'IA, intègre métriques, journaux, traces et événements pour une observabilité full-stack et des analyses intelligentes interdomaines.

Mises à jour

Nouvelles fonctionnalités

Lancement d'AI Application Observability

En savoir plus >
Nouvelles fonctionnalités

Lancement de l'assistant d'exploitation intelligent

En savoir plus >
Nouvelles fonctionnalités

Lancement de CloudLens for ECS

En savoir plus >

Observabilité tout-en-un pour les produits cloud

En tant que plateforme d'observabilité intelligente tout-en-un et full-stack d'Alibaba Cloud, Cloud Monitor 2.0 intègre de manière transparente Simple Log Service, Cloud Monitor et Application Real-Time Monitoring Service (ARMS) pour collecter les données d'observabilité telles que les métriques, les traces, les journaux et les événements dans une vue unifiée. La plateforme assure l'association automatique des ressources et le diagnostic intelligent grâce à la modélisation UModel et aux graphes d'observabilité, offrant une observabilité de bout en bout, de l'expérience utilisateur à l'infrastructure.

Observabilité full-stack

Intègre de manière unifiée les journaux, les métriques, les traces et les événements pour assurer une surveillance full-stack des produits cloud, des applications et de l'infrastructure, réduisant ainsi la complexité de l'exploitation et de la maintenance.

Stockage et analyse unifiés

Stocke les données d'observabilité de manière unifiée grâce à la technologie de lac de données et prend en charge le langage de requête SPL. Cette approche améliore l'efficacité de la recherche et de l'analyse des données, tout en éliminant les silos de données.

Association automatique et analyse par graphes

Construit un graphe d'observabilité basé sur UModel, découvre automatiquement les relations entre les ressources, met en œuvre l'association de données interdomaines et localise rapidement la cause profonde des problèmes.

Exploitation intelligente

Construit la plateforme AIOps à partir de données de haute qualité et de graphes d'observabilité, et fournit un ensemble de capacités d'exploitation intelligente basées sur les LLM, les modèles de domaine et les algorithmes.

Panorama

Fonctionnalités

Exploitation et surveillance

Surveillance des produits cloud

Fournit la surveillance des métriques clés, des alertes de base et des vues de ressources des produits cloud pour répondre à leurs besoins d'exploitation et de maintenance.

Analyse et surveillance réseau

Simule les accès utilisateur, surveille la disponibilité et la vitesse de réponse des sites, et identifie les problèmes d'accessibilité de manière proactive.

Centre d'événements

Gère de manière centralisée les événements système et les événements d'exploitation des produits cloud, avec prise en charge de l'agrégation, de la notification et de la réponse aux événements.

Réactivité

Intègre les alertes et les événements pour mettre en œuvre la réponse aux incidents, le traitement collaboratif et la gestion en boucle fermée de la reprise post-incident.

Tableau de bord

Vous pouvez personnaliser un tableau de bord visuel pour afficher les métriques clés et faciliter les décisions d'exploitation.

Managed Service for Grafana

Fournit un service Grafana géré qui prend en charge la configuration flexible de tableaux de bord et l'intégration avec de multiples sources de données.

Managed Service for Prometheus

Compatible avec Prometheus open source, il fournit des capacités de surveillance gérée et de gestion de clusters fédérés.

Observabilité des applications

Surveillance des applications

Surveille les performances des applications de bout en bout, avec prise en charge du traçage des appels, de l'analyse des appels lents et de la topologie des dépendances.

Observabilité des applications IA

Conçu pour les applications de grands modèles de langage (LLM), il surveille des métriques clés telles que la latence d'inférence et la consommation de tokens.

Real User Monitoring (RUM)

Collecte les données de performance front-end pour surveiller le chargement des pages, les erreurs JavaScript et l'expérience comportementale des utilisateurs.

CloudLens

CloudLens for Container

Fournit une visibilité sur l'utilisation des ressources, les charges de travail et les événements des clusters Container Service for Kubernetes (ACK)/Kubernetes pour améliorer l'efficacité de l'exploitation des conteneurs.

CloudLens for Simple Log Service

Analyse les performances et l'utilisation de Simple Log Service pour optimiser l'efficacité de la collecte et de l'interrogation des journaux.

CloudLens for Object Storage Service (OSS)

Surveille les accès OSS, la distribution des requêtes et les métriques de performance pour garantir la stabilité des services de stockage.

CloudLens for Redis

Analyse le taux de réussite du cache, le nombre de connexions et les commandes lentes des instances Tair (compatible Redis OSS) et optimise leurs performances.

CloudLens for ApsaraDB RDS

Fournit l'analyse des requêtes lentes, des temps d'attente de session et des tendances de performance pour faciliter l'optimisation des bases de données.

CloudLens for AI Training Service

Surveille l'utilisation des ressources d'entraînement IA et prend en charge l'analyse de l'utilisation GPU et de l'ordonnancement des tâches.

CloudLens for ECS

Analyse les performances des instances Elastic Compute Service (ECS) selon plusieurs dimensions telles que le processeur, la mémoire et le réseau, et fournit des alertes en cas d'anomalies.

CloudLens for AWS

Surveille les ressources AWS dans un environnement multi-cloud pour une observabilité unifiée en cloud hybride.

Sécurité et audit

Sécurité des applications

Assure la protection de l'environnement d'exécution des applications grâce à la technologie RASP pour détecter et bloquer les attaques.

Audit des journaux

Audite de manière centralisée les journaux d'exploitation et les événements de sécurité pour répondre aux exigences d'audit de conformité et de traçabilité des risques.

Cost Manager

Analyse le coût d'utilisation des ressources cloud et fournit des suggestions d'optimisation pour réduire les dépenses superflues.

Data Explorer

Metric Explorer

PromQL et SPL permettent d'interroger les métriques de séries temporelles et d'analyser les tendances de performance et les anomalies de manière flexible.

Data Explorer

Fournit un portail unifié pour explorer différents types de données d'observabilité tels que les journaux, les métriques et les traces.

UModel Explorer

Affiche le graphe de relations des entités UModel de manière visuelle pour comprendre les associations et les dépendances entre les ressources.

Analyse des journaux

Récupère, collecte et analyse les journaux pour identifier rapidement les indices de problèmes grâce à SPL.

Performance Testing

Construction de scénarios de test de charge

Les API peuvent être orchestrées de manière séquentielle ou parallèle, avec la possibilité de définir divers paramètres. Des fonctionnalités telles que la propagation de cookies, les points de rendez-vous (points de collecte) et les instructions de temps de réflexion sont fournies pour faciliter la simulation de scénarios métier complexes.

Contrôle du trafic

Deux modes de contrôle du trafic sont pris en charge : la simultanéité d'utilisateurs virtuels et le débit RPS (requêtes par seconde). Le trafic peut être ajusté automatiquement ou manuellement à la seconde, permettant des pics de trafic instantanés atteignant des dizaines de millions de requêtes. Combiné à la surveillance SLA et aux tests de charge planifiés, ce système permet des tests de résistance entièrement automatisés.

Surveillance et protection

Les métriques de débit et de simultanéité sont disponibles au niveau des API avec une granularité à la seconde. L'intégration transparente avec les produits de surveillance Alibaba Cloud simplifie le diagnostic des problèmes et la protection du trafic.

Enregistrement du trafic

Le trafic réel des utilisateurs peut être capturé directement depuis les navigateurs ou les appareils mobiles en environnement de production, en enregistrant les flux d'interaction utilisateur et les requêtes API back-end. Ce trafic enregistré peut ensuite être analysé pour élaborer un modèle de test de charge précis et les scénarios de test correspondants.

Sous-services

Simple Log Service - Facturation au volume d'écriture

100 Go de données écrites par mois

  • Paiement : intégral à l'avance
  • Volume d'écriture mensuel : 100 Go (prépayé)
  • Durée 1 an
Activer maintenant

ARMS - Surveillance des applications - Paiement à l'utilisation

Surveillance des applications

  • Avantages : 50 Go de quota gratuit par mois
  • Fonctionnalités : analyse des traces et profilage continu
  • Scénarios : surveillance applicative Java, Go et autres langages
Activer maintenant

Managed Service for Prometheus

Managed Service for Prometheus

  • Avantages : 50 Go de quota gratuit par mois
  • Fonctionnalités : collecte et stockage de métriques, requêtes et analyse
  • Scénarios : surveillance des conteneurs et services cloud
Activer maintenant

Performance Test Service PTS

Performance Testing

  • Avantages produit : haute simultanéité, contrôle précis du trafic
  • Fonctionnalités clés : enregistrement orchestré, ajustement à la seconde
  • Cas d'utilisation : test de charge en période de pointe, évaluation de capacité
Activer maintenant

Avantages

Observabilité tout-en-un

En intégrant en profondeur les fonctionnalités clés de Cloud Monitor, Simple Log Service et ARMS, Cloud Monitor 2.0 ingère de multiples sources de données telles que les métriques, les journaux, les traces et les événements. Sans avoir à déployer et maintenir plusieurs outils de surveillance indépendants, vous pouvez mettre en œuvre une observabilité complète et de bout en bout, de l'infrastructure sous-jacente aux applications de niveau supérieur, sur une plateforme unifiée, réduisant considérablement la complexité du système d'observabilité et les coûts de gestion.

Modélisation unifiée des données

Met en œuvre la modélisation unifiée et l'association relationnelle des objets observés grâce à UModel, éliminant les silos de données et améliorant l'efficacité de la localisation des pannes.

Diagnostic intelligent piloté par l'IA

Intègre les capacités de machine learning et de LLM pour prendre en charge la détection d'anomalies, l'analyse des causes profondes et les requêtes en langage naturel.

Compatibilité avec les écosystèmes open source

Cloud Monitor 2.0 adopte pleinement l'écosystème technologique open source et prend en charge les standards et outils majeurs du secteur tels que Prometheus, Grafana, OpenTelemetry et Elasticsearch. Qu'il s'agisse d'une application cloud native ou d'un environnement de cloud hybride, Cloud Monitor 2.0 garantit la migration fluide et l'intégration de vos ressources de surveillance existantes et de vos piles technologiques pour une observabilité unifiée et transparente.

phone Contacter
Hi, I'm Alibaba Cloud AI Assistant!
I can help with questions and solutions.