Integrasikan dengan Managed Service for Prometheus untuk mengumpulkan metrik lapisan kontrol, node, dan aplikasi dari kluster ACK secara komprehensif, serta tingkatkan efisiensi manajemen performa kluster melalui dasbor visual dan peringatan real-time.
Pilih edisi
Managed Service for Prometheus terintegrasi penuh dengan ekosistem Prometheus open-source dan menyediakan layanan pemantauan yang sepenuhnya dikelola. Anda tidak perlu mengelola penyimpanan data, visualisasi data, atau O&M di lapisan bawah.
-
Pro Edition (Direkomendasikan): Menyediakan periode retensi metrik selama 90 hari, collector yang sepenuhnya dikelola, dan SLA produksi sebesar 99,95%. Edisi ini menawarkan dasbor Grafana yang dapat dikustomisasi dan aturan peringatan pra-konfigurasi untuk komponen Container Service for Kubernetes (ACK). Untuk informasi lebih lanjut, lihat Gunakan Edisi Pro Pemantauan Kontainer.
-
Basic Edition: Menyediakan periode retensi metrik selama 7 hari. Anda harus memelihara collector sendiri, dan hanya dasbor dasar yang disediakan.
Aktifkan pemantauan Prometheus
Kluster yang sudah ada
-
(Opsional) Untuk kluster khusus ACK, pertama-tama berikan izin pemantauan kepada kluster.
-
Pada halaman Clusters, klik nama kluster target. Di panel navigasi sebelah kiri pada halaman detail kluster, pilih .
-
Pada halaman Prometheus Monitoring, pilih edisi pemantauan kontainer dan klik Install.
Setelah Anda mengaktifkan pemantauan, metrik dasar default akan dikumpulkan secara otomatis. Untuk mengumpulkan metrik kustom, lihat Kumpulkan metrik kustom. Anda dapat melihat beberapa dasbor pra-konfigurasi pada halaman ini, seperti Cluster Overview, Node Monitoring, Application Monitoring, Network Monitoring, dan Storage Monitoring.
Kluster baru
-
ACK managed cluster (Pro Edition):
Pada langkah Component Configurations wizard pembuatan kluster, di bagian Container Monitoring, pilih Container Cluster Monitoring Pro Edition atau Container Cluster Monitoring Basic Edition. Untuk informasi lebih lanjut, lihat Buat kluster ACK yang dikelola.
Mode Auto secara default menggunakan Container Cluster Monitoring Basic Edition.
-
ACK managed cluster (Basic Edition), kluster ACS, dan kluster ACK Serverless:
Pada langkah Component Configurations wizard pembuatan kluster, di bagian Container Monitoring, pilih Enable Managed Service for Prometheus. Ini akan menginstal Container Cluster Monitoring Basic Edition.
Setelah Anda mengaktifkan pemantauan, metrik dasar default akan dikumpulkan secara otomatis. Untuk mengumpulkan metrik kustom, lihat Kumpulkan metrik kustom. Anda dapat melihat beberapa dasbor pra-konfigurasi, seperti Cluster Overview, Node Monitoring, Application Monitoring, Network Monitoring, dan Storage Monitoring, dengan memilih di panel navigasi sebelah kiri pada halaman detail kluster.
Konfigurasi notifikasi peringatan
Konfigurasikan aturan peringatan untuk metrik utama agar secara otomatis mengirimkan notifikasi melalui saluran seperti email, SMS, atau DingTalk ketika terjadi anomali.
-
Masuk ke ARMS console. Di panel navigasi sebelah kiri, pilih .
-
Pada halaman Notification Objects, pilih metode notifikasi dan buat kebijakan notifikasi.
-
Di panel navigasi sebelah kiri ARMS console, pilih .
-
Pada halaman Prometheus alert rules, klik Create Prometheus Alert Rule.
Untuk petunjuk konfigurasi lengkap, lihat Buat aturan peringatan Prometheus.
Kumpulkan metrik kustom
Managed Service for Prometheus mendukung berbagai metode untuk mengumpulkan metrik kustom, seperti permintaan per detik (QPS) dan latensi pemrosesan. Untuk informasi lebih lanjut, lihat Kelola aturan pengumpulan kustom untuk lingkungan kontainer.
Nonaktifkan pemantauan Prometheus
-
Di panel navigasi sebelah kiri pada halaman detail kluster, klik Add-ons.
-
Pada halaman Add-ons, klik tab Logs and Monitoring, temukan komponen ack-arms-prometheus, lalu klik Uninstall. Pada kotak dialog konfirmasi, klik OK.
Penagihan
-
Biaya pemantauan kluster: Edisi Basic gratis. Edisi Pro ditagih berdasarkan skema bayar sesuai penggunaan berdasarkan jumlah node dalam kluster.
-
Biaya instans Prometheus: Pengumpulan metrik dasar gratis secara default. Pengumpulan metrik kustom ditagih berdasarkan skema bayar sesuai penggunaan berdasarkan faktor seperti volume tulis, volume laporan, volume penyimpanan, dan periode retensi.
Untuk aturan penagihan dan harga lengkap, lihat Penagihan Pemantauan Kontainer.
Metrik dasar default
Setelah Anda mengaktifkan pemantauan Prometheus, metrik dasar untuk pemantauan kontainer akan dikumpulkan secara otomatis. Untuk deskripsi lengkap metrik tersebut, lihat Metrik.
-
Metrik sumber daya dasar untuk kontainer dari kubelet.
-
Metrik status aplikasi untuk kluster dari kube-state-metrics.
-
Metrik sumber daya dasar untuk node kluster dari node-exporter.
-
Metrik GPU untuk node kluster dari ack-gpu-exporter.
-
Metrik untuk komponen lapisan kontrol kluster yang dikelola, termasuk API server, etcd, kube-scheduler, kube-controller-manager, dan cloud-controller-manager.
-
Metrik pemantauan dasar untuk CoreDNS di kluster.
-
Metrik pemantauan dasar untuk pengontrol Ingress di kluster.
-
Metrik dasar berikut dilaporkan secara otomatis setelah Anda mengaktifkan fitur terkait:
-
Setelah Anda mengaktifkan Container Storage Monitoring, komponen csi-plugin mulai melaporkan metrik.
Setelah Anda mengaktifkan Cost Insight, komponen ack-cost-exporter mulai melaporkan metrik.
-
Setelah Anda mengaktifkan pemantauan co-location beban kerja dan Resource Profiling, komponen ack-koordinator mulai melaporkan metrik.
-
FAQ
Halaman Prometheus Monitoring tidak menampilkan dasbor
Jika Anda melihat prompt No related monitoring dashboard found pada halaman setelah Anda mengaktifkan pemantauan Prometheus, ikuti langkah-langkah berikut untuk menyelesaikan masalah tersebut.
-
Instal ulang komponen pemantauan Prometheus.
-
Instal ulang komponen:
-
Setelah Anda memastikan komponen telah di-uninstal, klik Install. Pada kotak dialog konfirmasi, klik OK.
-
Setelah instalasi selesai, kembali ke halaman Prometheus Monitoring untuk memeriksa apakah masalah telah terselesaikan.
Jika masalah masih berlanjut, lanjutkan ke langkah berikutnya.
-
-
Periksa integrasi instans Prometheus.
-
Di panel navigasi sebelah kiri ARMS console, klik Integration Management.
-
Pada tab Integrations, periksa daftar Container Service untuk mencari lingkungan kontainer dengan nama yang sama dengan kluster Anda.
-
Jika tidak ada lingkungan kontainer semacam itu, lihat Integrasikan layanan di konsol ARMS atau Prometheus.
-
Jika lingkungan kontainer tersebut ada, klik Settings di kolom Actions pada lingkungan kontainer target untuk membuka halaman Settings.
Periksa apakah agen yang diinstal berjalan sebagaimana mestinya.
-
-
Cara menyesuaikan periode retensi metrik
Untuk informasi lebih lanjut, lihat Sesuaikan periode retensi metrik.
Cara melihat versi komponen ack-arms-prometheus
-
Pada halaman Clusters, klik nama kluster target. Di panel navigasi sebelah kiri, klik Add-ons.
-
Pada halaman Add-ons, klik tab Logs and Monitoring dan temukan komponen ack-arms-prometheus.
Versi saat ini ditampilkan di bawah nama komponen. Jika tersedia versi yang lebih baru dan Anda ingin meningkatkan komponen tersebut, klik Upgrade di sebelah nomor versi.
CatatanOpsi Upgrade hanya ditampilkan jika versi yang diinstal bukan versi terbaru.
Mengapa penerapan pemantauan GPU gagal?
Penerapan pemantauan GPU dapat gagal jika node GPU memiliki taint. Untuk menyelesaikan masalah ini, pertama-tama periksa taint pada node tersebut.
Jalankan perintah berikut untuk memeriksa taint pada node GPU target.
Jika node GPU memiliki taint kustom, Anda akan menemukan entri terkait. Contoh ini menggunakan taint dengan
keybernilaitest-key,valuebernilaitest-value, daneffectbernilaiNoSchedule:kubectl describe node cn-beijing.47.100.***.***Output yang diharapkan:
Taints:test-key=test-value:NoScheduleTangani taint pada node GPU dengan salah satu dari dua cara berikut:
Jalankan perintah berikut untuk menghapus taint dari node GPU.
kubectl taint node cn-beijing.47.100.***.*** test-key=test-value:NoSchedule-Deklarasikan toleransi terhadap taint agar Pod dapat dijadwalkan ke node tersebut.
# 1. Jalankan perintah berikut untuk mengedit DaemonSet ack-prometheus-gpu-exporter. kubectl edit daemonset -n arms-prom ack-prometheus-gpu-exporter # 2. Tambahkan bidang berikut ke file YAML untuk mendeklarasikan toleransi terhadap taint. # Bidang lainnya dihilangkan. # Bidang `tolerations` ditambahkan di atas bidang `containers` dan berada pada level yang sama. tolerations: - key: "test-key" operator: "Equal" value: "test-value" effect: "NoSchedule" containers: # Bidang lainnya dihilangkan.
Cara meng-uninstal ARMS Prometheus secara lengkap
Hanya menghapus namespace Managed Service for Prometheus akan menyisakan konfigurasi sisa setelah sumber daya dihapus. Hal ini memengaruhi instalasi ulang. Anda dapat melakukan operasi berikut untuk menghapus konfigurasi sisa ARMS-Prometheus secara lengkap dan manual.
Hapus namespace arms-prom.
kubectl delete namespace arms-promHapus ClusterRole.
kubectl delete ClusterRole arms-kube-state-metrics kubectl delete ClusterRole arms-node-exporter kubectl delete ClusterRole arms-prom-ack-arms-prometheus-role kubectl delete ClusterRole arms-prometheus-oper3 kubectl delete ClusterRole arms-prometheus-ack-arms-prometheus-role kubectl delete ClusterRole arms-pilot-prom-k8s kubectl delete ClusterRole gpu-prometheus-exporter kubectl delete ClusterRole o11y:addon-controller:role kubectl delete ClusterRole arms-aliyunserviceroleforarms-clusterroleHapus ClusterRoleBinding.
kubectl delete ClusterRoleBinding arms-node-exporter kubectl delete ClusterRoleBinding arms-prom-ack-arms-prometheus-role-binding kubectl delete ClusterRoleBinding arms-prometheus-oper-bind2 kubectl delete ClusterRoleBinding arms-kube-state-metrics kubectl delete ClusterRoleBinding arms-pilot-prom-k8s kubectl delete ClusterRoleBinding arms-prometheus-ack-arms-prometheus-role-binding kubectl delete ClusterRoleBinding gpu-prometheus-exporter kubectl delete ClusterRoleBinding o11y:addon-controller:rolebinding kubectl delete ClusterRoleBinding arms-kube-state-metrics-agent kubectl delete ClusterRoleBinding arms-node-exporter-agent kubectl delete ClusterRoleBinding arms-aliyunserviceroleforarms-clusterrolebindingHapus Role dan RoleBinding.
kubectl delete Role arms-pilot-prom-spec-ns-k8s kubectl delete Role arms-pilot-prom-spec-ns-k8s -n kube-system kubectl delete RoleBinding arms-pilot-prom-spec-ns-k8s kubectl delete RoleBinding arms-pilot-prom-spec-ns-k8s -n kube-system
Cara meng-uninstal menggunakan Helm
Gunakan metode ini untuk meng-uninstal layanan jika Anda menerapkannya secara manual menggunakan Helm, atau jika sumber daya sisa tetap ada karena masalah lingkungan atau versi Helm.
-
Pada halaman Clusters, klik nama kluster target. Di panel navigasi sebelah kiri, pilih .
-
Pada halaman Helm, temukan rilis ack-arms-prometheus, klik Delete di kolom Actions, pilih Clear Release Records, lalu hapus aplikasi sesuai petunjuk.
Galat "xxx in use" saat instalasi
-
Pada halaman Clusters, klik nama kluster target. Di panel navigasi sebelah kiri, pilih .
-
Pada halaman Helm, periksa apakah ack-arms-prometheus ada.
-
Jika ada, hapus ack-arms-prometheus dari halaman Helm dan instal ulang di halaman Add-ons. Untuk informasi lebih lanjut tentang cara menginstal ack-arms-prometheus, lihat Kelola add-on.
-
Jika tidak ada:
-
Rilis Helm ack-arms-prometheus mungkin memiliki sumber daya sisa. Uninstal ARMS Prometheus secara lengkap secara manual.
-
-
Galat "Component Not Installed" saat instalasi
-
Periksa apakah komponen ack-arms-prometheus telah diinstal.
-
Pada halaman Clusters, klik nama kluster target. Di panel navigasi sebelah kiri, pilih .
-
Pada halaman Helm, periksa apakah ack-arms-prometheus ada.
-
Jika ada, hapus ack-arms-prometheus dari halaman Helm dan instal ulang di halaman Add-ons. Untuk informasi lebih lanjut tentang cara menginstal ack-arms-prometheus, lihat Kelola add-on.
-
Jika tidak ada:
-
Rilis Helm ack-arms-prometheus mungkin memiliki sumber daya sisa. Uninstal ARMS Prometheus secara lengkap secara manual.
-
-
-
-
Periksa log ack-arms-prometheus untuk mencari kesalahan.
-
Di panel navigasi sebelah kiri pada halaman detail kluster, pilih .
-
Di bagian atas halaman Deployments, atur Namespace ke arms-prom, lalu klik arms-prometheus-ack-arms-prometheus.
-
Klik tab Logs untuk memeriksa kesalahan dalam log.
-
-
Periksa apakah terjadi kesalahan selama instalasi agen.
-
Masuk ke ARMS console. Di panel navigasi sebelah kiri, klik Integration Management.
-
Pada tab Integrations, periksa daftar Container Service. Di kolom Actions pada lingkungan kontainer target, klik Settings untuk membuka halaman Settings.
-
Cara memberikan izin pemantauan untuk kluster khusus ACK
-
Pada halaman Clusters, klik nama kluster target. Di panel navigasi sebelah kiri, klik Cluster Information.
-
Pada tab Basic Information, klik tautan KubernetesWorkerRole-*** di sebelah Worker RAM Role. Pada halaman peran RAM, di tab Permission Management, klik tautan k8sWorkerRole**** di kolom Policies.
-
Pada halaman detail kebijakan, klik tab Policy Content, lalu klik Edit Policy Document.
-
Di editor skrip, tambahkan aturan otorisasi berikut ke bidang Statement dan klik OK.
{ "Version": "1", "Statement": [ { "Action": [ "arms:Describe*", "arms:List*", "arms:Get*", "arms:Search*", "arms:Check*", "arms:Query*", "arms:ListEnvironments", "arms:DescribeAddonRelease", "arms:InstallAddon", "arms:DeleteAddonRelease", "arms:ListEnvironmentDashboards", "arms:ListAddonReleases", "arms:CreateEnvironment", "arms:UpdateEnvironment", "arms:InitEnvironment", "arms:DescribeEnvironment", "arms:InstallEnvironmentFeature", "arms:ListEnvironmentFeatures", "cms:CreateIntegrationPolicy", "cms:ListAddonReleases", "cms:UpdateAddonRelease", "cms:CreateAddonRelease", "cms:GetPrometheusInstance", "cms:ListIntegrationPolicyStorageRequirements" ], "Resource": "*", "Effect": "Allow" } ] }
Topik terkait
Tingkatkan Managed Service for Prometheus dari Edisi Basic ke Pro Edition