Integrasikan dengan Managed Service for Prometheus untuk mengumpulkan metrik lapisan kontrol, node, dan aplikasi dari kluster ACK secara komprehensif, serta tingkatkan efisiensi manajemen kinerja kluster melalui dasbor visual dan peringatan real time.
Pilih edisi
Managed Service for Prometheus terintegrasi penuh dengan ekosistem Prometheus open-source dan menyediakan layanan pemantauan yang sepenuhnya dikelola. Anda tidak perlu mengelola penyimpanan data, visualisasi data, atau O&M di lapisan bawah.
Edisi Pro (Direkomendasikan): Menyediakan periode retensi metrik selama 90 hari, collector yang sepenuhnya dikelola, dan SLA produksi sebesar 99,95%. Menawarkan dasbor Grafana yang dapat dikustomisasi dan aturan peringatan pra-konfigurasi untuk komponen Container Service for Kubernetes (ACK). Untuk informasi lebih lanjut, lihat Gunakan Edisi Pro Pemantauan Kontainer.
Edisi Dasar: Menyediakan periode retensi metrik selama 7 hari. Anda harus memelihara collector sendiri, dan hanya dasbor dasar yang disediakan.
Aktifkan pemantauan Prometheus
Kluster yang sudah ada
(Opsional) Untuk kluster khusus ACK, pertama-tama berikan izin pemantauan ke kluster.
Di halaman Clusters, klik nama kluster target. Di panel navigasi sebelah kiri halaman detail kluster, pilih .
Di halaman Prometheus Monitoring, pilih edisi pemantauan kontainer dan klik Install.
Setelah Anda mengaktifkan pemantauan, metrik dasar default akan dikumpulkan secara otomatis. Untuk mengumpulkan metrik kustom, lihat Kumpulkan metrik kustom. Anda dapat melihat beberapa dasbor pra-konfigurasi pada halaman ini, seperti Cluster Overview, Node Monitoring, Application Monitoring, Network Monitoring, dan Storage Monitoring.
Kluster baru
ACK managed cluster (Edisi Pro):
Di langkah Component Configurations wizard pembuatan kluster, pada bagian Container Monitoring, pilih Container Cluster Monitoring Pro Edition atau Container Cluster Monitoring Basic Edition. Untuk informasi lebih lanjut, lihat Buat kluster ACK yang dikelola.
Mode Auto secara default menggunakan Container Cluster Monitoring Basic Edition.
ACK managed cluster (Edisi Dasar), kluster ACS, dan kluster ACK Serverless:
Di langkah Component Configurations wizard pembuatan kluster, pada bagian Container Monitoring, pilih Enable Managed Service for Prometheus. Ini akan menginstal Container Cluster Monitoring Basic Edition.
Setelah Anda mengaktifkan pemantauan, metrik dasar default akan dikumpulkan secara otomatis. Untuk mengumpulkan metrik kustom, lihat Kumpulkan metrik kustom. Anda dapat melihat beberapa dasbor pra-konfigurasi, seperti Cluster Overview, Node Monitoring, Application Monitoring, Network Monitoring, dan Storage Monitoring, dengan memilih di panel navigasi sebelah kiri halaman detail kluster.
Konfigurasikan notifikasi peringatan
Konfigurasikan aturan peringatan untuk metrik utama agar secara otomatis mengirim notifikasi melalui saluran seperti email, SMS, atau DingTalk saat terjadi anomali.
-
Masuk ke ARMS console. Di panel navigasi sebelah kiri, pilih .
Di halaman Notification Objects, pilih metode notifikasi dan buat kebijakan notifikasi.
Di panel navigasi sebelah kiri ARMS console, pilih .
Di halaman Prometheus alert rules, klik Create Prometheus Alert Rule.
Untuk petunjuk konfigurasi lengkap, lihat Buat aturan peringatan Prometheus.
Kumpulkan metrik kustom
Managed Service for Prometheus mendukung berbagai metode untuk mengumpulkan metrik kustom, seperti permintaan per detik (QPS) dan latensi pemrosesan. Untuk informasi lebih lanjut, lihat Kelola aturan pengumpulan kustom untuk lingkungan kontainer.
Nonaktifkan pemantauan Prometheus
Di panel navigasi sebelah kiri halaman detail kluster, klik Add-ons.
Di halaman Add-ons, temukan add-on ack-arms-prometheus, lalu klik . Di kotak dialog konfirmasi, klik OK.
Penagihan
Biaya pemantauan kluster: Edisi Dasar gratis. Edisi Pro ditagih berdasarkan skema bayar sesuai penggunaan berdasarkan jumlah node dalam kluster.
Biaya instans Prometheus: Pengumpulan metrik dasar gratis secara default. Pengumpulan metrik kustom ditagih berdasarkan skema bayar sesuai penggunaan berdasarkan faktor seperti volume penulisan, volume laporan, volume penyimpanan, dan periode retensi.
Untuk aturan dan harga penagihan lengkap, lihat Penagihan Pemantauan Kontainer.
Metrik dasar default
Setelah Anda mengaktifkan pemantauan Prometheus, metrik dasar untuk pemantauan kontainer akan dikumpulkan secara otomatis. Untuk deskripsi lengkap metrik tersebut, lihat Metrik.
Metrik sumber daya dasar untuk kontainer dari kubelet.
Metrik status aplikasi untuk kluster dari kube-state-metrics.
Metrik sumber daya dasar untuk node kluster dari node-exporter.
Metrik GPU untuk node kluster dari ack-gpu-exporter.
Metrik untuk komponen lapisan kontrol kluster yang dikelola, termasuk API server, etcd, kube-scheduler, kube-controller-manager, dan cloud-controller-manager.
Metrik pemantauan dasar untuk CoreDNS di kluster.
Metrik pemantauan dasar untuk controller Ingress di kluster.
Metrik dasar berikut dilaporkan secara otomatis setelah Anda mengaktifkan fitur terkait:
Setelah Anda mengaktifkan Container Storage Monitoring, add-on csi-plugin mulai melaporkan metrik.
Setelah Anda mengaktifkan Cost Insight, add-on ack-cost-exporter mulai melaporkan metrik.
Setelah Anda mengaktifkan pemantauan co-location beban kerja dan Resource Profiling, add-on ack-koordinator mulai melaporkan metrik.
FAQ
Halaman Prometheus Monitoring tidak menampilkan dasbor
Jika Anda melihat prompt No related monitoring dashboard found pada halaman setelah Anda mengaktifkan pemantauan Prometheus, ikuti langkah-langkah berikut untuk mengatasi masalah tersebut.
Instal ulang add-on pemantauan Prometheus.
Instal ulang komponen:
Setelah Anda memastikan bahwa komponen telah di-uninstal, klik Install. Di kotak dialog konfirmasi, klik OK.
Setelah instalasi selesai, kembali ke halaman Prometheus Monitoring untuk memeriksa apakah masalah telah terselesaikan.
Jika masalah masih berlanjut, lanjutkan ke langkah berikutnya.
Periksa integrasi instans Prometheus.
Di panel navigasi sebelah kiri ARMS console, klik Integration Management.
Di tab Integrations, periksa daftar Container Service untuk mencari lingkungan kontainer dengan nama yang sama dengan kluster Anda.
Jika tidak ada lingkungan kontainer semacam itu, lihat Integrasikan layanan di ARMS atau Prometheus console.
Jika lingkungan kontainer tersebut ada, klik Settings di kolom Actions lingkungan kontainer target untuk membuka halaman Settings.
Periksa apakah agen yang terinstal berjalan sebagaimana mestinya.
Cara menyesuaikan periode retensi metrik
Untuk informasi lebih lanjut, lihat Sesuaikan periode retensi metrik.
Cara melihat versi add-on ack-arms-prometheus
Di halaman Clusters, klik nama kluster target. Di panel navigasi sebelah kiri, klik Add-ons.
Di halaman Add-ons, temukan add-on ack-arms-prometheus.
Versi saat ini ditampilkan di bawah nama komponen. Jika tersedia versi yang lebih baru dan Anda ingin meningkatkan komponen, klik Upgrade di sebelah nomor versi.
CatatanOpsi Upgrade hanya ditampilkan jika versi yang terinstal bukan versi terbaru.
Mengapa penerapan pemantauan GPU gagal?
Penerapan pemantauan GPU dapat gagal jika node GPU memiliki taint. Untuk mengatasi masalah ini, pertama-tama periksa taint node tersebut.
Jalankan perintah berikut untuk memeriksa taint pada node GPU target.
Jika node GPU memiliki taint kustom, Anda akan menemukan entri terkait. Contoh ini menggunakan taint dengan
keybernilaitest-key,valuebernilaitest-value, daneffectbernilaiNoSchedule:kubectl describe node cn-beijing.47.100.***.***Output yang diharapkan:
Taints:test-key=test-value:NoScheduleTangani taint node GPU dengan salah satu dari dua cara berikut:
Jalankan perintah berikut untuk menghapus taint dari node GPU.
kubectl taint node cn-beijing.47.100.***.*** test-key=test-value:NoSchedule-Deklarasikan toleransi terhadap taint agar Pod dapat dijadwalkan ke node tersebut.
# 1. Jalankan perintah berikut untuk mengedit DaemonSet ack-prometheus-gpu-exporter. kubectl edit daemonset -n arms-prom ack-prometheus-gpu-exporter # 2. Tambahkan bidang berikut ke file YAML untuk mendeklarasikan toleransi terhadap taint. # Bidang lainnya dihilangkan. # Bidang `tolerations` ditambahkan di atas bidang `containers` dan berada pada level yang sama. tolerations: - key: "test-key" operator: "Equal" value: "test-value" effect: "NoSchedule" containers: # Bidang lainnya dihilangkan.
Cara meng-uninstal ARMS Prometheus secara lengkap
Menghapus hanya namespace Managed Service for Prometheus akan menyisakan konfigurasi residu setelah sumber daya dihapus. Hal ini memengaruhi instalasi ulang. Anda dapat melakukan operasi berikut untuk menghapus konfigurasi residu ARMS-Prometheus secara lengkap dan manual.
Hapus namespace arms-prom.
kubectl delete namespace arms-promHapus ClusterRole.
kubectl delete ClusterRole arms-kube-state-metrics kubectl delete ClusterRole arms-node-exporter kubectl delete ClusterRole arms-prom-ack-arms-prometheus-role kubectl delete ClusterRole arms-prometheus-oper3 kubectl delete ClusterRole arms-prometheus-ack-arms-prometheus-role kubectl delete ClusterRole arms-pilot-prom-k8s kubectl delete ClusterRole gpu-prometheus-exporter kubectl delete ClusterRole o11y:addon-controller:role kubectl delete ClusterRole arms-aliyunserviceroleforarms-clusterroleHapus ClusterRoleBinding.
kubectl delete ClusterRoleBinding arms-node-exporter kubectl delete ClusterRoleBinding arms-prom-ack-arms-prometheus-role-binding kubectl delete ClusterRoleBinding arms-prometheus-oper-bind2 kubectl delete ClusterRoleBinding arms-kube-state-metrics kubectl delete ClusterRoleBinding arms-pilot-prom-k8s kubectl delete ClusterRoleBinding arms-prometheus-ack-arms-prometheus-role-binding kubectl delete ClusterRoleBinding gpu-prometheus-exporter kubectl delete ClusterRoleBinding o11y:addon-controller:rolebinding kubectl delete ClusterRoleBinding arms-kube-state-metrics-agent kubectl delete ClusterRoleBinding arms-node-exporter-agent kubectl delete ClusterRoleBinding arms-aliyunserviceroleforarms-clusterrolebindingHapus Role dan RoleBinding.
kubectl delete Role arms-pilot-prom-spec-ns-k8s kubectl delete Role arms-pilot-prom-spec-ns-k8s -n kube-system kubectl delete RoleBinding arms-pilot-prom-spec-ns-k8s kubectl delete RoleBinding arms-pilot-prom-spec-ns-k8s -n kube-system
Cara meng-uninstal menggunakan Helm
Gunakan metode ini untuk meng-uninstal layanan jika Anda menerapkannya secara manual menggunakan Helm, atau jika terdapat sisa sumber daya akibat masalah lingkungan atau versi Helm.
Di halaman Clusters, klik nama kluster target. Di panel navigasi sebelah kiri, pilih .
Di halaman Helm, temukan rilis ack-arms-prometheus, klik Delete di kolom Actions, pilih Clear Release Records, lalu hapus aplikasi sesuai petunjuk.
Galat "xxx in use" saat instalasi
Di halaman Clusters, klik nama kluster target. Di panel navigasi sebelah kiri, pilih .
Di halaman Helm, periksa apakah ack-arms-prometheus ada.
Jika ada, hapus ack-arms-prometheus dari halaman Helm dan instal ulang di halaman Add-ons. Untuk informasi lebih lanjut tentang cara menginstal ack-arms-prometheus, lihat Kelola komponen.
Jika tidak ada:
Rilis Helm ack-arms-prometheus mungkin memiliki sisa sumber daya. Uninstal ARMS Prometheus secara lengkap secara manual.
Galat "Component Not Installed" saat instalasi
Periksa apakah add-on ack-arms-prometheus terinstal.
Di halaman Clusters, klik nama kluster target. Di panel navigasi sebelah kiri, pilih .
Di halaman Helm, periksa apakah ack-arms-prometheus ada.
Jika ada, hapus ack-arms-prometheus dari halaman Helm dan instal ulang di halaman Add-ons. Untuk informasi lebih lanjut tentang cara menginstal ack-arms-prometheus, lihat Kelola komponen.
Jika tidak ada:
Rilis Helm ack-arms-prometheus mungkin memiliki sisa sumber daya. Uninstal ARMS Prometheus secara lengkap secara manual.
Periksa log ack-arms-prometheus untuk mencari kesalahan.
Di panel navigasi sebelah kiri halaman detail kluster, pilih .
Di bagian atas halaman Deployments, atur Namespace menjadi arms-prom, lalu klik arms-prometheus-ack-arms-prometheus.
Klik tab Logs untuk memeriksa kesalahan dalam log.
Periksa apakah terjadi kesalahan selama instalasi agen.
Masuk ke ARMS console. Di panel navigasi sebelah kiri, klik Integration Management.
Di tab Integrations, periksa daftar Container Service. Di kolom Actions lingkungan kontainer target, klik Settings untuk membuka halaman Settings.
Cara memberikan izin pemantauan untuk kluster khusus ACK
Di halaman Clusters, klik nama kluster target. Di panel navigasi sebelah kiri, klik Cluster Information.
Di tab Basic Information, klik tautan KubernetesWorkerRole-*** di samping Worker RAM Role, lalu beralih ke tab Trust Policy pada halaman peran RAM.
Di tab Trust Policy, klik Edit Trust Policy.
Di editor skrip, tambahkan aturan otorisasi berikut ke bidang Statement dan klik OK.
{ "Statement": [ { "Action": [ "arms:Describe*", "arms:List*", "arms:Get*", "arms:Search*", "arms:Check*", "arms:Query*", "arms:ListEnvironments", "arms:DescribeAddonRelease", "arms:InstallAddon", "arms:DeleteAddonRelease", "arms:ListEnvironmentDashboards", "arms:ListAddonReleases", "arms:CreateEnvironment", "arms:UpdateEnvironment", "arms:InitEnvironment", "arms:DescribeEnvironment", "arms:InstallEnvironmentFeature", "arms:ListEnvironmentFeatures", "cms:GetIntegrationVersionForCS", "cms:CreateIntegrationPolicy", "cms:ListAddonReleases", "cms:UpdateAddonRelease", "cms:CreateAddonRelease", "cms:GetPrometheusInstance", "cms:ListIntegrationPolicyStorageRequirements", "log:PostLogStoreLogs" ], "Resource": "*", "Effect": "Allow" } ], "Version": "1" }
Topik terkait
Tingkatkan Managed Service for Prometheus dari Edisi Dasar ke Edisi Pro