全部產品
Search
文件中心

E-MapReduce:監控指標

更新時間:Jul 01, 2024

本文介紹FE與BE的相關監控項。

查看監控項

  • FE:通過http://fe_host:fe_http_port/metrics方式訪問;通過http://fe_host:fe_http_port/metrics?type=json介面可以擷取JSON格式的監控項。
  • BE:通過http://be_host:be_webserver_port/metrics方式訪問;通過http://be_host:be_webserver_port/metrics?type=json介面可以擷取JSON格式的監控項。
說明
  • 訪問方式預設顯示為Prometheus格式,更多內容,請參見Prometheus
  • Host為叢集裡,Master節點的IP地址。BE通常為內網IP;FE取決於您的網路環境,內網或者外網均可。
  • http_port預設為:8031;webserver_port預設為:8041。可以通過show frontends命令擷取。

FE監控項列表

doris_fe_snmp{name="tcp_in_errs"}

該監控項為/proc/net/snmp中的Tcp: InErrs欄位值。表示當前接收到的錯誤的TCP包的數量,結合採樣周期可以計算髮生率。通常用於排查網路問題。

doris_fe_snmp{name="tcp_retrans_segs"}

該監控項為/proc/net/snmp中的Tcp: RetransSegs欄位值。表示當前重傳的TCP包的數量,結合採樣周期可以計算髮生率。通常用於排查網路問題。

doris_fe_snmp{name="tcp_in_segs"}

該監控項為/proc/net/snmp中的Tcp: InSegs欄位值。表示當前接收到的所有TCP包的數量,通過(NEW_tcp_in_errs - OLD_tcp_in_errs) / (NEW_tcp_in_segs - OLD_tcp_in_segs)可以計算接收到的TCP包錯誤率。通常用於排查網路問題。

doris_fe_snmp{name="tcp_out_segs"}

該監控項為/proc/net/snmp中的Tcp: OutSegs欄位值。表示當前發送的所有帶RST標記的TCP包的數量,通過(NEW_tcp_tcp_retrans_segs - OLD_tcp_retrans_segs) / (NEW_tcp_out_segs - OLD_tcp_out_segs)可以計算TCP重傳率。通常用於排查網路問題。

doris_fe_meminfo{name="memory_total"}

該監控項為/proc/meminfo中的MemTotal欄位值。表示所有可用的記憶體大小,總的實體記憶體減去預留空間和核心大小。通常用於排查記憶體問題。

doris_fe_meminfo{name="memory_free"}

該監控項為/proc/meminfo中的MemFree欄位值。表示系統尚未使用的記憶體,通常用於排查記憶體問題。

doris_fe_meminfo{name="memory_available"}

該監控項為/proc/meminfo中的MemAvailable欄位值。真正的系統可用記憶體,系統中有些記憶體雖然已被使用但是可以回收的,所以這部分可回收的記憶體加上MemFree才是系統可用的記憶體。通常用於排查記憶體問題。

doris_fe_meminfo{name="buffers"}

該監控項為/proc/meminfo中的Buffers欄位值。表示用來給塊裝置做緩衝的記憶體(檔案系統的Metadata、Pages),通常用於排查記憶體問題。

doris_fe_meminfo{name="cached"}

該監控項為/proc/meminfo中的Cached欄位值。表示分配給檔案緩衝區的記憶體,通常用於排查記憶體問題。

jvm_thread{type="count"}

該監控項表示FE節點當前JVM總的線程數量,包含Daemon線程和非Daemon線程,通常用於排查FE節點的JVM線程運行問題。

jvm_thread{type="peak_count"}

該監控項表示FE節點從JVM啟動以來的最大峰值線程數量,通常用於排查FE節點的JVM線程運行問題。

jvm_thread{type="new_count"}

該監控項表示FE節點JVM中處於NEW狀態的線程數量,通常用於排查FE節點的JVM線程運行問題。

jvm_thread{type="runnable_count"}

該監控項表示FE節點JVM中處於RUNNABLE狀態的線程數量,通常用於排查FE節點的JVM線程運行問題。

jvm_thread{type="blocked_count"}

該監控項表示FE節點JVM中處於BLOCKED狀態的線程數量,通常用於排查FE節點的JVM線程運行問題。

jvm_thread{type="waiting_count"}

該監控項表示FE節點JVM中處於WAITING狀態的線程數量,通常用於排查FE節點的JVM線程運行問題。

jvm_thread{type="timed_waiting_count"}

該監控項表示FE節點JVM中處於TIMED_WAITING狀態的線程數量,通常用於排查FE節點的JVM線程運行問題。

jvm_thread{type="terminated_count"}

該監控項表示FE節點JVM中處於TERMINATED狀態的線程數量,通常用於排查FE節點的JVM線程運行問題。

BE監控項列表

doris_be_snmp{name="tcp_in_errs"}

該監控項為/proc/net/snmp中的Tcp: InErrs欄位值。表示當前接收到的錯誤的TCP包的數量。結合採樣周期可以計算髮生率。通常用於排查網路問題。

doris_be_snmp{name="tcp_retrans_segs"}

該監控項為/proc/net/snmp中的Tcp: RetransSegs欄位值。表示當前重傳的TCP包的數量。結合採樣周期可以計算髮生率。通常用於排查網路問題。

doris_be_snmp{name="tcp_in_segs"}

該監控項為/proc/net/snmp中的Tcp: InSegs欄位值。表示當前接收到的所有TCP包的數量。通過(NEW_tcp_in_errs - OLD_tcp_in_errs) / (NEW_tcp_in_segs - OLD_tcp_in_segs) 可以計算接收到的TCP包錯誤率。通常用於排查網路問題。

doris_be_snmp{name="tcp_out_segs"}

該監控項為/proc/net/snmp中的Tcp: OutSegs欄位值。表示當前發送的所有帶RST標記的TCP包的數量。通過(NEW_tcp_tcp_retrans_segs - OLD_tcp_retrans_segs) / (NEW_tcp_out_segs - OLD_tcp_out_segs)可以計算TCP重傳率。通常用於排查網路問題。

doris_be_compaction_mem_current_consumption

該監控項為Compaction使用的MemPool總和(所有Compaction線程)。通過該值,可以迅速判斷Compaction是否佔用過多記憶體,引起高記憶體佔用甚至OOM等問題。通常用於排查記憶體使用量問題。