Alibaba Cloud の CloudMonitor 2.0 は、Simple Log Service (SLS)、CloudMonitor (CMS)、Application Real-Time Monitoring Service (ARMS) を統合した統一可観測性プラットフォームです。メトリック、トレース、ログ、イベントを単一のビューに統合します。UModel 可観測性フレームワークと可観測性グラフを使用して、CloudMonitor 2.0 は可視化とアラートを組み合わせ、リソースを自動的に関連付けてインテリジェントな診断を実行します。インフラストラクチャからアプリケーションまで、フルスタックかつエンドツーエンドの可観測性を提供することで、問題を迅速に検知・解決し、運用保守 (O&M) の効率を向上させます。マイクロサービス、コンテナー、クラウドサービスなどの複雑な環境をサポートします。
CloudMonitor 2.0 は、AI で強化されたクロスドメインインサイトを使用して、システムパフォーマンスをリアルタイムで分析・予測します。異常を早期に検知し、インテリジェントな障害診断と最適化の提案を提供します。これにより、企業は AI ネイティブ時代において、よりスマートで効率的、かつ低コストのフルスタック可観測性システムを構築し、ビジネスの安定性とセキュリティを確保できます。
Playground での試用
Alibaba Cloud Playground は、CloudMonitor 2.0 の主要な機能を体験できるデモ環境を提供します。
「」および「Playground デモ」にアクセスし、デフォルトでワークスペースに移動します。
メリット
統一された可観測性
CloudMonitor 2.0 は、CMS、SLS、ARMS のコア機能を深く統合しています。メトリック、ログ、トレース、イベントを 1 つのプラットフォームに統一します。これにより、複数のスタンドアロン監視ツールをデプロイまたはメンテナンスする必要はもうありません。代わりに、インフラストラクチャからアプリケーションまで、フルスタックかつエンドツーエンドの可視性を 1 か所で得ることができます。これにより、複雑さと管理コストが削減されます。
統一されたデータモデリング
UModel (Universal Observability Model) は、メトリック、ログ、トレース、設定変更などのデータサイロを接続し、IT システムの完全なデジタルビューを構築します。人、プログラム、AI のすべてが可観測データを理解し、分析できます。これにより、真のフルスタック可観測性が実現し、問題の検出が加速します。
AI を活用したインテリジェント分析
統一された可観測性データモデルを使用して、CloudMonitor 2.0 は機械学習を適用し、詳細なパターン認識と関連分析を行います。正確な異常検知、傾向予測、インテリジェントなアラートノイズリダクションを提供します。また、大規模言語モデルを使用して、複雑な可観測データを実用的なインサイトに変換します。これにより、革新的な「対話型 O&M」が実現します。インテリジェントアシスタントと自然言語で対話し、問題を迅速に特定、分析、修正できます。
主流エコシステムとのオープンな互換性
CloudMonitor 2.0 はオープンソース技術を全面的に採用しています。Prometheus、Grafana、OpenTelemetry、Elasticsearch、その他の業界標準やツールをネイティブにサポートします。既存の監視資産と技術スタックはスムーズに移行できます。クラウドネイティブアプリケーションを実行している場合でも、ハイブリッドクラウド環境を実行している場合でも、シームレスで統一された監視が可能です。これにより、柔軟でオープンな、ベンダーニュートラルなソリューションが得られます。
用語
CloudMonitor を使用する前に、これらの基本概念を学習してください。
用語 | 説明 |
ワークスペース | ワークスペースは、CloudMonitor 2.0 の抽象化レイヤーであり、リソースのセットをグループ化します。チームに統一された管理とリソースグループのデータ分離を提供します。選択したリージョンには、ワークスペースのデータと構成が保存されます。ワークスペースを使用すると、複数の独立したリソース環境を作成できます。各環境には、クラウドサービス、インフラストラクチャ、サーバーサイドおよびフロントエンドアプリケーション、ミドルウェアなど、独自のオブジェクトセットがあります。各グループのリソースは分離されています。これにより、グループ間のリソースの競合が防止され、セキュリティが向上します。
|
アプリ | アプリは、ワークスペース内でデータソースを読み書きするための軽量なキャリアです。ワークスペースでアプリを表示または非表示にできます。アプリは通常、特定のシナリオに対するドメイン固有の可観測性の知識を表します。主な特徴:
|
エンティティ | エンティティは、コンテナークラスターや ECS インスタンスなど、観測可能なオブジェクトです。 |
モデル (Umodel) | UModel は、可観測性データモデルを定義するための仕様です。ログ、メトリック、トレース、エンティティ、およびそれらの関係のモデルを定義し、可観測データの統一された定義と管理を可能にします。 |
機能
機能 | 説明 |
フルスタックのデータ収集と監視 |
|
インテリジェントな分析と診断 |
|
可視化とレポート |
|
アラートと通知管理 |
|
オープン性と統合 |
|
セキュリティと高可用性 |
|
コスト最適化 |
|
クロスリージョン統合管理 | 複数のリージョンにまたがるリソースを 1 か所から監視・管理します。O&M ワークフローを簡素化します。 |
シナリオ
シナリオ | 説明 | メリット |
シナリオ 1:統一されたフルスタック監視とリアルタイム可観測性グラフ | 企業は、ハイブリッドクラウド環境全体で物理サーバー、コンテナークラスター、マイクロサービスアプリケーション、データベースを監視する必要があります。断片化されたツールは O&M の効率を低下させます。CloudMonitor 2.0 は、CPU やメモリ使用量などのメトリック、API 呼び出しチェーンなどのトレース、エラーログなどのログ、設定変更などのイベントを 1 か所に収集します。グローバルで、リソース横断、サービス横断の可視性のためのエンドツーエンドの可観測性グラフを構築します。 |
|
シナリオ 2:インテリジェントな異常検知と障害予測 | トラフィックの急増時や複雑なアーキテクチャでは、隠れた障害を手動で特定することは困難です。CloudMonitor 2.0 は機械学習モデルを使用して過去のデータを分析します。容量のボトルネックやサービスのレイテンシなどのリスクを予測し、早期警告をトリガーします。 |
|
シナリオ 3:クライアントからサーバーまでのエンドツーエンドのフルスタックトレーシング (APM) | マイクロサービスアーキテクチャでは、単一のユーザーリクエストが数十のサービス呼び出しとフロントエンドまたはバックエンドのインタラクションを伴う場合があります。パフォーマンスボトルネックを特定することは困難です。CloudMonitor 2.0 は、フルスタックトレーシングとコードレベルの診断を組み合わせます。上流ではユーザーエクスペリエンスに、下流ではインフラストラクチャにリンクし、フルスタックの可観測性グラフを構築して、低速クエリやデッドロックを正確に分析します。 |
|
シナリオ 4:セキュリティコンプライアンスと脅威インサイト | 企業は、異常なログインやデータ侵害などのセキュリティイベントをリアルタイムで監視し、コンプライアンス監査要件を満たす必要があります。CloudMonitor 2.0 は、リアルタイムのログ分析と行動パターン認識を使用して、脅威を迅速に検出します。 |
|
シナリオ 5:リソース最適化とコスト管理 | 不透明なクラウドリソースの使用は無駄につながります。CloudMonitor 2.0 はリソース使用率を分析し、弾性スケーリングポリシーとアイドルリソースの解放計画を推奨します。 |
|
シナリオ 6:インテリジェントなアラートと自動 O&M | 従来のアラートは、しばしば誤検知や情報過多を引き起こします。CloudMonitor 2.0 は、アラートノイズリダクション、動的しきい値、階層型通知を使用して精度を向上させ、自動修復アクションをサポートします。 |
|
シナリオ 7:マネージドオープンソース可観測性コンポーネントとインテリジェント O&M | 企業は、ハイブリッドまたはマルチクラウド環境で、Prometheus、Grafana、OpenTelemetry などのオープンソースの可観測性ツールを広く使用しています。しかし、3 つの課題に直面しています:
|
|
可観測性アプリ
アプリタイプ | アプリ名 | 説明 |
永続 | アラートセンター | すべてのアラート情報を 1 か所で管理 |
永続 | すべての機能 | すべてのアプリと関連サービスを 1 か所で管理 |
永続 | 統合センター | 可観測性オブジェクトとデータを統合・管理 |
常駐 | エンティティエクスプローラー | 監視対象のステータスとパフォーマンスを探索 |
永続 | クラウドサービス監視 | Alibaba Cloud サービスの基本監視メトリックのクエリとアラート |
アプリケーション可観測性 | アプリケーション監視 | アプリケーションのパフォーマンスを監視し、障害をリアルタイムで診断 |
アプリケーション可観測性 | リアルユーザーモニタリング | Web、モバイルアプリ、ミニプログラムを監視 |
アプリケーション可観測性 | AI アプリケーション可観測性 | AI アプリケーション向けのフルスタック統合可観測性を提供 |
O&M 監視 | Prometheus サービス | パフォーマンス専有型の監視のためのフルマネージド Prometheus クラウドサービス |
O&M 監視 | インシデントレスポンス | アラートイベントをインシデントにグループ化して管理 |
O&M 監視 | Synthetic Monitoring | ユーザーリクエストをシミュレートして、ネットワーク品質、サービスの可用性、ユーザーエクスペリエンスをプロアクティブに監視 |
O&M 監視 | データベース可観測性 | データベースサービスのワンストップ可観測性を提供 |
O&M 監視 | ログ監査 | 操作ログの記録とレビュー |
クラウドサービスインサイト | PAI インサイト | Platform for AI (PAI) 向けのフルスタック、ワンストップの可観測性を提供 |
クラウドサービスインサイト | Container Insights | Kubernetes クラスターの運用状況を詳細に分析 |
クラウドサービスインサイト | ECS インサイト | Elastic Compute Service (ECS) の高度な監視 |
インテリジェントな探索と分析 | UModel エクスプローラー | エンティティと UModel のデバッグツール |
インテリジェントな探索と分析 | データエクスプローラー | 監視メトリックとデータを探索・分析 |
インテリジェントな探索と分析 | イベントハブ | すべてのタイプのイベント情報を 1 か所で管理 |
インテリジェントな探索と分析 | ダッシュボード | 主要なメトリックを表示するダッシュボード |
インテリジェントな探索と分析 | ログエクスプローラー | ログデータの探索・分析サービスを提供 |