Container Service for Kubernetes (ACK) は、CloudMonitor や Managed Service for Prometheus などの Alibaba Cloud の可観測性製品と互換性があり、モニタリングアドオンを提供して、クラスターの正常性を監視し、問題を事前に特定して対応するのに役立ちます。このトピックでは、ACK クラスターのフルスタックモニタリングソリューションについて説明します。これには、基本的なリソース、アプリケーション、クラスター、イベント、コントロールプレーンコンポーネント、ネットワーク、カーネルレベルのコンテナが含まれます。
クラスターの可観測性
ACK は、以下のモニタリングモジュールを提供します。
|
モジュール |
説明 |
参照 |
アドオン |
|
基本的なリソースモニタリング |
CloudMonitor または Prometheus を使用して、CPU、メモリ、ネットワークなどの基本的なクラスターリソースの使用状況と正常性を監視します。主要なメトリックにアラート通知を有効にして、安定性を向上させます。 |
||
|
ack-prometheus-operator |
|||
|
アプリケーションモニタリング |
Application Real-Time Monitoring Service (ARMS) と ack-onepilot を使用して、コンテナ化されたアプリケーションのトポロジー分析、API とイベントのモニタリング、トレース、パフォーマンスのボトルネック検出を実行します。 |
||
|
クラスターモニタリング |
Application Monitoring eBPF Edition を使用して、コード侵入なしにコンテナのパフォーマンスデータを収集し、Pod の問題を特定し、関連する Service とコントローラーのワークロードを突き止め、検出までの時間を短縮します。 |
||
|
イベントモニタリング |
Node Problem Detector (NPD) と Log Service (SLS) の Kubernetes イベントセンターを使用して、システムステータスをリアルタイムで監視および通知し、ノードの例外を診断してイベントに変換し、クローズドループとオフライン通知でアラートを管理します。 |
||
|
コントロールプレーンコンポーネントのモニタリング |
Prometheus と Grafana を使用して、API server、etcd、kube-scheduler、kube-controller-manager などのコントロールプレーンコンポーネントをリアルタイムで監視します。コンポーネントアクセスを最適化し、セルフマネージド Prometheus を設定します。 |
||
|
etcd |
|||
|
ネットワークモニタリング |
Ingress ログサービスを統合し、Ingress Dashboard を ARMS と併用して Ingress のトラブルシューティングを共同で行います。CoreDNS を監視してトラブルシューティングを行います。Terway ベースのクラスターでネットワークトラフィックとサービストポロジーを可視化して、コンテナネットワークとサービスの可観測性を実現します。 |
||
|
カーネルレベルのコンテナモニタリング |
System Observer Monitoring (SysOM) を使用して、OS カーネルレベルでコンテナを監視し、コンテナ化されたアプリケーションのデプロイと移行を容易にします。 |