Cloud Monitor

Cloud Monitor 2.0 ist eine KI-gestützte Observabilitätsplattform aus einer Hand, die Metriken, Logs, Traces und Events integriert, um Full-Stack-Observabilität und domänenübergreifende intelligente Einblicke zu ermöglichen.

Updates

Neue Funktionen

KI-Anwendungs-Observability veröffentlicht

Mehr erfahren >
Neue Funktionen

Intelligenter O&M-Assistent veröffentlicht

Mehr erfahren >
Neue Funktionen

CloudLens für ECS veröffentlicht

Mehr erfahren >

Zentrale Observability für Cloud-Produkte

Als zentrale Full-Stack-Observability-Plattform von Alibaba Cloud integriert Cloud Monitor 2.0 nahtlos Simple Log Service (SLS), Cloud Monitor (CMS) und Application Real-Time Monitoring Service (ARMS), um Observability-Daten wie Metriken, Traces, Logs und Events in einer einheitlichen Ansicht zu erfassen. Die Plattform ermöglicht automatische Ressourcenzuordnung und intelligente Diagnose auf Basis von UModel-Modellierung und Observability-Graphen und bietet End-to-End-Observability von der Benutzererfahrung bis zur Infrastruktur.

Full-Stack-Observability

Integriert Logs, Metriken, Traces und Events einheitlich, um eine Full-Stack-Überwachung von Cloud-Produkten, Anwendungen und Infrastruktur zu ermöglichen und die Komplexität des Betriebs und der Wartung zu reduzieren.

Einheitliche Speicherung und Analyse

Speichert Observability-Daten einheitlich auf Basis der Data-Lake-Technologie und unterstützt die SPL-Abfragesprache. Dies verbessert die Effizienz der Datenabfrage und -analyse und beseitigt Datensilos.

Automatische Zuordnung und Graph-Einblicke

Erstellt einen Observability-Graphen auf Basis von UModel, erkennt automatisch Ressourcenbeziehungen, ermöglicht domänenübergreifende Datenzuordnung und lokalisiert schnell die Ursache von Problemen.

Intelligenter Betrieb und Wartung

Erstellt die AIOps-Plattform auf Basis hochwertiger Daten und Observability-Graphen und bietet vielfältige intelligente Betriebs- und Wartungsfunktionen auf Grundlage von LLMs, Domänenmodellen und Algorithmen.

Panorama

Funktionen

Betrieb und Überwachung

Cloud-Produktüberwachung

Bietet Überwachung zentraler Kennzahlen, grundlegende Warnmeldungen und Ressourcenansichten für Cloud-Produkte, um deren Betriebsanforderungen zu erfüllen.

Netzwerkanalyse und -überwachung

Simuliert Benutzerzugriffe, überwacht die Websiteverfügbarkeit und Antwortgeschwindigkeit und erkennt Zugänglichkeitsprobleme frühzeitig.

Ereigniscenter

Verwaltet Systemereignisse und Betriebsereignisse von Cloud-Produkten zentral und unterstützt Ereignisaggregation, Benachrichtigungen und Reaktionen.

Reaktionsfähigkeit

Integriert Warnmeldungen und Ereignisse für die Fehlerreaktion, kollaborative Verarbeitung und das geschlossene Management der Wiederaufnahme nach einem Vorfall.

Dashboard

Sie können ein visuelles Dashboard anpassen, um wichtige Metriken anzuzeigen und Betriebsentscheidungen zu erleichtern.

Managed Service for Grafana

Bietet einen verwalteten Grafana-Dienst mit flexibler Dashboard-Konfiguration und Integration mehrerer Datenquellen.

Managed Service for Prometheus

Kompatibel mit dem Open-Source-Prometheus und bietet Managed-Monitoring sowie Fähigkeiten zur Verwaltung föderierter Cluster.

Anwendungsobservabilität

Anwendungsüberwachung

Überwacht die Anwendungsleistung End-to-End und unterstützt Aufrufverfolgung, Analyse langsamer Aufrufe sowie Abhängigkeitstopologie.

KI-Anwendungsobservabilität

Entwickelt für Anwendungen großer Sprachmodelle (LLM): Überwachung wichtiger Metriken wie Inferenzlatenz und Token-Verbrauch.

Real User Monitoring (RUM)

Erfasst Frontend-Leistungsdaten zur Überwachung von Seitenladezeiten, JavaScript-Fehlern und dem Benutzererlebnis.

CloudLens

CloudLens für Container

Bietet Einblicke in Ressourcennutzung, Workloads und Ereignisse von Container Service for Kubernetes (ACK)/Kubernetes-Clustern zur Steigerung der Effizienz im Container-Betrieb.

CloudLens für Simple Log Service

Analysiert Leistung und Nutzung von Simple Log Service, um die Effizienz der Protokollerfassung und -abfrage zu optimieren.

CloudLens für Object Storage Service (OSS)

Überwacht OSS-Zugriffe, Anfrageverteilung und Leistungskennzahlen, um stabile Speicherdienste sicherzustellen.

CloudLens for Redis

Analysiert Trefferquote, Verbindungsanzahl und langsame Befehle von Tair-Instanzen (Redis-OSS-kompatibel) und optimiert deren Leistung.

CloudLens für ApsaraDB RDS

Bietet Analysen langsamer Abfragen, Sitzungswartezeiten und Leistungstrends zur Optimierung von Datenbanken.

CloudLens für KI-Trainingsdienst

Überwacht die Ressourcennutzung beim KI-Training und unterstützt die Analyse der GPU-Auslastung und Aufgabenplanung.

CloudLens for ECS

Analysiert die Leistung von Elastic Compute Service (ECS)-Instanzen in mehreren Dimensionen wie CPU, Arbeitsspeicher und Netzwerk und meldet Ausnahmen.

CloudLens for AWS

Überwacht AWS-Ressourcen cloudübergreifend für eine einheitliche Observierbarkeit in Hybrid-Cloud-Umgebungen.

Sicherheit und Audit

Anwendungssicherheit

Bietet Schutz für die Anwendungslaufzeit basierend auf RASP-Technologie zur Erkennung und Abwehr von Angriffen.

Protokollaudit

Prüft Betriebsprotokolle und Sicherheitsereignisse zentral, um Compliance-Audit- und Risikorückverfolgungsanforderungen zu erfüllen.

Kostenmanager

Analysiert die Kosten der Cloud-Ressourcennutzung und liefert Optimierungsvorschläge zur Reduzierung unnötiger Ausgaben.

Data Explorer

Metrik-Explorer

Mit PromQL und SPL können Zeitreihenmetriken abgefragt sowie Leistungstrends und Ausnahmen flexibel analysiert werden.

Data Explorer

Bietet ein einheitliches Portal zum Erkunden verschiedener Observabilitätsdaten wie Logs, Metriken und Traces.

UModel Explorer

Zeigt den Beziehungsgraphen von UModel-Entitäten in visueller Form, um Ressourcenzuordnungen und -abhängigkeiten nachzuvollziehen.

Protokollanalyse

Ruft Logs ab, sammelt und analysiert sie, um mithilfe von SPL schnell Hinweise auf Probleme zu identifizieren.

Leistungstests

Erstellung von Lasttestszenarien

APIs können sequenziell oder parallel orchestriert werden, mit Unterstützung für die Definition verschiedener Parameter. Funktionen wie Cookie-Weitergabe, Rendezvous-Punkte (Sammelpunkte) und Denkzeit-Anweisungen ermöglichen die Simulation komplexer Geschäftsszenarien.

Datenverkehrssteuerung

Zwei Modi zur Datenverkehrssteuerung werden unterstützt: virtuelle Benutzerparallelität und RPS-Durchsatz (Anfragen pro Sekunde). Der Datenverkehr kann automatisch oder manuell im Sekundentakt angepasst werden, wodurch spontane Lastspitzen von bis zu mehreren zehn Millionen Anfragen ermöglicht werden. In Kombination mit SLA-Überwachung und geplanten Lasttests ist eine vollständig unbeaufsichtigte Stresstestausführung möglich.

Überwachung und Schutz

Durchsatz- und Parallelitätsmetriken sind auf API-Ebene mit Sekundengenauigkeit verfügbar. Die nahtlose Integration mit Alibaba-Cloud-Überwachungsprodukten vereinfacht Problemdiagnose und Datenverkehrsschutz.

Datenverkehrsaufzeichnung

Realer Benutzerverkehr kann direkt aus Browsern oder Mobilgeräten in Produktionsumgebungen erfasst werden, wobei Benutzerinteraktionsabläufe und Backend-API-Anfragen aufgezeichnet werden. Dieser erfasste Verkehr lässt sich anschließend analysieren, um ein präzises Lasttestmodell und entsprechende Testszenarien abzuleiten.

Unterdienste

Simple Log Service – Abrechnung nach Datenschreibvolumen

100 GB geschriebene Daten pro Monat

  • Zahlung: vollständige Vorauszahlung
  • Monatliches Datenschreibvolumen: 100 GB (vollständige Vorauszahlung)
  • Laufzeit 1 Jahr
Jetzt aktivieren

ARMS – Anwendungsüberwachung – Nutzungsbasierte Abrechnung

Anwendungsüberwachung

  • Vorteile: 50 GB kostenloses Kontingent pro Monat
  • Funktionen: Trace-Analyse und kontinuierliches Profiling
  • Szenarien: Anwendungsüberwachung für Java, Go und weitere Sprachen
Jetzt aktivieren

Managed Service for Prometheus

Managed Service for Prometheus

  • Vorteile: 50 GB kostenloses Kontingent pro Monat
  • Funktionen: Metrikerfassung und -speicherung, Abfrage und Analyse
  • Szenarien: Container- und Cloud-Dienstüberwachung
Jetzt aktivieren

Performance Test Service PTS

Leistungstests

  • Produktvorteile: Hohe Parallelität, präzise Verkehrssteuerung
  • Kernfunktionen: Orchestrierte Aufzeichnung, sekundengenaue Anpassung
  • Anwendungsfälle: Lasttests in Spitzenzeiten, Kapazitätsbewertung
Jetzt aktivieren

Vorteile

Integrierte Observability aus einer Hand

Durch die tiefe Integration der Kernfunktionen von Cloud Monitor (CMS), Simple Log Service (SLS) und Application Real-Time Monitoring Service (ARMS) erfasst Cloud Monitor 2.0 verschiedene Datenquellen wie Metriken, Protokolle, Traces und Ereignisse. Ohne mehrere unabhängige Überwachungstools bereitstellen und warten zu müssen, können Sie auf einer einheitlichen Plattform eine umfassende End-to-End-Observability von der zugrunde liegenden Infrastruktur bis zu den Anwendungen der oberen Ebene realisieren – was die Komplexität des Observability-Systems und die Verwaltungskosten erheblich senkt.

Einheitliche Datenmodellierung

Implementiert eine einheitliche Modellierung und relationale Verknüpfung überwachter Objekte auf Basis von UModel, baut Datensilos ab und verbessert die Effizienz der Fehlerlokalisierung.

KI-gestützte intelligente Diagnose

Integriert Machine-Learning- und LLM-Funktionen zur Anomalieerkennung, Ursachenanalyse und Abfrage in natürlicher Sprache.

Kompatibilität mit Open-Source-Ökosystemen

Cloud Monitor 2.0 integriert sich vollständig in das Open-Source-Technologieökosystem und unterstützt branchenübliche Standards und Tools wie Prometheus, Grafana, OpenTelemetry und Elasticsearch. Ob Cloud-native Anwendung oder Hybrid-Cloud-Umgebung – Cloud Monitor 2.0 gewährleistet die reibungslose Migration und Anbindung bestehender Überwachungsressourcen und Technologiestacks für eine nahtlose, einheitliche Observability.

phone Kontakt
Hi, I'm Alibaba Cloud AI Assistant!
I can help with questions and solutions.