全部产品
Search
文档中心

应用实时监控服务ARMS:组件监控升级说明

更新时间:May 25, 2026

本文介绍已接入组件的监控升级,包含升级操作,以及查看大盘、告警规则、指标采集等,涵盖监控大盘更新、告警规则优化、指标采集增强等升级内容。

前提条件

  • 已开通可观测监控 Prometheus 版。具体操作,请参见开通方式

  • 已接入相关组件监控。具体操作,请参见接入总览

组件监控升级流程

重要

组件升级过程中,数据不会中断且不影响老数据。

  1. 登录ARMS控制台,在左侧导航栏单击接入管理

  2. 已接入环境页签中可以查看所有已接入的资源,升级目标组件。

    接下来以容器环境为例,介绍具体的升级操作。

  3. 容器环境页签中单击目标环境名称,进入详情页。

  4. 组件管理页签中找到目标组件,单击升级,根据界面提示完成升级。

    页面提示升级成功(安装成功)即可。

查看大盘、告警规则、指标采集

查看大盘

您可以在大盘页签查看升级后的大盘。在应用实时监控服务ARMS控制台,选择接入管理,单击目标容器环境进入详情页。在组件管理页签下,选择组件类型为容器集群监控,然后单击大盘页签,即可查看可用的监控大盘列表,包括ACK Pro ApiServer、ACK Pro Cloud Controller Manager、ACK Pro Etcd等。可通过上方筛选标签(如ApiServer、Cluster、CoreDNS、CSI等)进行分类筛选。Grafana Cluster Overview 大盘展示集群整体监控数据:顶部指标面板显示 Node Count(节点数)、Pod Count(Pod 数)、Node Request Memory Average Percent(节点内存请求平均百分比)、Node Request CPU Average Percent(节点 CPU 请求平均百分比)以及 API Server Success Request Percent 折线图。中部 Namespace Overview 表格列出各命名空间的 Deployment、StatefulSet、DaemonSet、Job、Pod、Container、Service、ConfigMap 等资源数量。下方 Node Pool Overview 表格展示节点池的节点数、Pod 数、Memory Request Percent 和 CPU Request Percent。底部为 Top 10 排行表格,包括 Node Memory UsageNode CPU UsageNode Disk UsageNode Network InNode Network OutNode Sockets Count

查看告警规则

您可以在告警规则页签查看升级后的告警规则。

告警规则列表支持通过下拉框按告警分组筛选,表格包含等级、告警规则名称/ID、告警分组、状态和操作列。以APIServer Validating Admission Webhook RT 高规则为例,等级为P1,告警分组为cs-default-CS-控制面核心组件,状态为已停止,可执行编辑启动复制查看告警事件操作。

查看指标采集

您可以在指标采集页签查看升级后的指标。

指标采集页签,左侧导航包含默认服务发现Service MonitorPod Monitor自定义采集指标废弃。选择Service Monitor后,右侧表格展示各 Service Monitor 的名称、命名空间、所属组件、匹配 Service 数量、采集端口、采集路径、采集间隔、匹配 Target 数量等信息,操作列支持停用编辑配置删除

相关内容

ack-arms-prometheus组件的升级

如果您在容器环境中可能会涉及到ack-arms-prometheus组件升级,您可以登录容器服务管理控制台,在集群列表中单击对应的集群名称,单击运维管理 > 组件管理,在日志与监控页签中查看对应的组件状态,如果有新版本,单击升级即可。

托管探针的升级

如果您需要升级托管探针,请进入ARMS控制台接入管理页面,在 云服务区域环境 页签中,单击目标环境名称查看探针设置,如果当前探针版本有新版本,那么会出现升级入口,单击升级即可。