全部產品
Search
文件中心

Container Service for Kubernetes:ACK Pro 預設控制面可觀測性

更新時間:Aug 01, 2026

ACK Pro 預設控制面通過固化控制面基準資源,提供確定性高效能保障。本文介紹如何查看控制面核心容量指標監控,以及如何評估是否需要切換檔位。

容量規劃監控

核心容量指標說明

預設控制面的檔位規格通過以下三個核心容量指標進行定義,每個指標反映控制面不同維度處理能力。

指標名稱

度量單位

PromQL

說明

API 請求並發數

Seats(席位元)

sum(apiserver_flowcontrol_current_executing_seats)

檔位規格以 Seats(席位元)定義 API 請求的最大並發能力。預設控制面通過固化 API Server 基準資源,確保高並發情境下的請求處理能力。該監控指標基於 Kubernetes API Priority and Fairness(APF)機制,反映當前正在處理的並發請求數量。

Pod 調度速率

Pod/秒

rate(scheduler_schedule_attempts_total{result="scheduled"}[2m])

叢集調度器每秒將 Pod 調度至節點的速率。預設控制面通過固定資源配額保障調度速率的確定性,避免因控制面Auto Scaling導致的調度效能波動。

etcd 資料庫大小

GB

max(etcd_mvcc_db_total_size_in_use_in_bytes)

儲存叢集全量資料的容量。當資料庫使用量接近當前檔位上限時,應及時升檔或清理無用資源。

核心容量看板查看

在目的地組群的叢集資訊頁面,進入叢集監控頁簽,重點關注如下容量指標,並與預設控制面檔位規格進行對比選型:

image

  • API 請求並發數(API Request Concurrency):對應檔位中的 Seats 規格,反映 API Server 的並發處理壓力。

  • Pod 調度速率(Pod Scheduling Rate):觀察每秒處理的 Pod 調度請求數,判斷調度器是否存在瓶頸。

  • etcd 資料庫大小(Cluster Database Size):監控 etcd 儲存佔用,確保資料量在當前檔位的安全限制內。

檔位切換參考標準

當叢集出現以下任一情況時,建議評估是否需要升檔:

觀測維度

升檔參考條件

說明

API 請求並發數

當前並發 Seats 持續達到當前檔位上限的 80% 以上。

表明 API Server 並發處理能力接近飽和,可能出現請求排隊或 429 限流。

Pod 調度速率

調度速率持續接近當前檔位上限,且存在 Pending Pod 積壓。

表明調度器已成為瓶頸,工作負載擴容受限。

etcd 資料庫大小

資料庫使用量超過當前檔位容量的 80%。

儲存空間不足可能導致 etcd 拒絕寫入,影響叢集狀態變更。

控制面組件資源水位

任一控制面組件(kube-apiserver、etcd、kube-scheduler 等)的 CPU 或記憶體資源水位持續處於 high 狀態(利用率 ≥ 80%)。

表明當前檔位的資源配給緊張,存在無法支撐實際負載的風險,應升檔以擷取更大的資源配額。

以上條件為參考建議,具體升檔決策應結合業務情境、負載高峰時段和期間綜合判斷。建議觀察指標趨勢而非瞬時尖刺,並在負載高峰期提前規劃升檔。

資源水位監控與警示

資源水位查看

  1. 在目的地組群詳情頁左側導覽列,選擇營運管理 > Prometheus 監控

  2. 進入核心組件監控頁簽,然後切換下方的組件頁簽進行查看。建議重點關注 kube-apiserver、etcd、kube-scheduler 組件的記憶體及 CPU 資源水位。

    image

以 kube-apiserver 為例,資源水位通過以下指標進行度量:

資源類型

指標名稱

含義

記憶體水位

resource_utilization_level{resource="memory", container="kube-apiserver", utilization_level="high"}

值為 1 時表明記憶體利用率 ≥ 80%。

記憶體水位

resource_utilization_level{resource="memory", container="kube-apiserver", utilization_level="normal"}

值為 1 時表明記憶體利用率 < 80%。

CPU 水位

resource_utilization_level{resource="cpu", container="kube-apiserver", utilization_level="high"}

值為 1 時表明 CPU 利用率 ≥ 80%。

CPU 水位

resource_utilization_level{resource="cpu", container="kube-apiserver", utilization_level="normal"}

值為 1 時表明 CPU 利用率 < 80%。

當水位指標持續處於 high 狀態(即利用率 ≥ 80%)時,表明當前控制面資源緊張,請及時進行升檔操作。

上表以 kube-apiserver 為例,container 欄位同樣適用於 etcd、kube-scheduler、kube-controller-manager 等控制面組件。

控制面組件資源水位警示

ACK Pro 預設控制面預設配置控制面組件資源水位警示,當任一控制面組件的 CPU 或記憶體資源使用率持續超過閾值時,系統將自動觸發警示通知。

屬性

說明

警示名稱

叢集控制面託管組件記憶體水位高 / 叢集控制面託管組件 CPU 水位高。

觸發條件

控制面託管組件(kube-apiserver、etcd、kube-scheduler 等)的 CPU 或記憶體資源使用率持續 ≥ 80%。

通知方式

通過叢集配置的警示連絡人群組進行通知,支援簡訊、郵件、DingTalk等渠道。

建議處理

收到警示後,建議登入控制台確認資源水位狀態,並及時進行升檔操作,以避免控制面效能降級或服務不可用。

警示樣本如下:

警示名稱:叢集控制面託管組件記憶體水位高_<cluster-name>
警示層級:P1
叢集名稱:<cluster-name>
警示內容:叢集控制面託管組件記憶體水位高

相關文檔