Para monitorar seus clusters do ApsaraDB for ClickHouse em tempo real, detectar problemas antecipadamente, localizar falhas rapidamente e otimizar o desempenho, o ApsaraDB for ClickHouse oferece um conjunto abrangente de métricas. Este tópico descreve as métricas disponíveis para clusters do ApsaraDB for ClickHouse.
Métricas de cluster do ClickHouse
As métricas a seguir aplicam-se a clusters adquiridos após 1º de dezembro de 2021.
Para clusters adquiridos antes de 1º de dezembro de 2021, consulte Métricas de clusters de versão antiga.
Community edition
|
Métrica |
Unidade |
Descrição |
|
TairPDBShardingIOBandwidth |
Bytes/s |
Throughput de leitura e gravação no disco. |
|
Disk IOPS |
count/s |
Operações de leitura e gravação por segundo no disco. |
|
Disk Usage |
Bytes |
Espaço em disco utilizado. |
|
disk usage per node |
Bytes |
Uso total de disco em um único nó (soma do uso em todos os discos). |
|
Disk usage |
Porcentagem (%) |
Percentual de espaço em disco utilizado. |
|
disk utilization per node |
Porcentagem (%) |
Percentual de espaço em disco usado em cada nó. |
|
CPU Usage |
Porcentagem (%) |
Utilização média de CPU em todos os nós do cluster. |
|
Inode Usage |
Porcentagem (%) |
Percentual de inodes utilizados. Nota
Inodes são estruturas de dados no Linux que armazenam informações sobre arquivos e diretórios. |
|
Memory Usage |
Bytes |
Memória total usada por todos os nós do cluster. |
|
Memory Usage |
Porcentagem (%) |
Utilização média de memória em todos os nós do cluster. |
|
DatapartCount |
Contagem |
Número total de partes de dados. |
|
InactiveDatapartCount |
Contagem |
Partes de dados inativas. |
|
ZooKeeper CPU utilization |
Porcentagem (%) |
Utilização média de CPU nos nós do ZooKeeper no cluster. |
|
ZooKeeper memory utilization |
Porcentagem (%) |
Utilização média de memória nos nós do ZooKeeper no cluster. |
|
Size of Data Written Per Second |
Bytes/s |
Dados gravados por segundo em todos os nós do cluster. |
|
Rows Written Per Second |
rows/s |
Linhas gravadas por segundo em todos os nós do cluster. |
|
QPS |
queries/s |
Consultas processadas por segundo. |
|
TPS |
transactions/s |
Transações processadas por segundo. |
|
Network throughput |
Bytes/s |
Taxa de tráfego de rede de entrada e saída. |
|
clickhouse_tcp_conn_usage_count |
Contagem |
Conexões TCP no cluster. |
|
HTTPConnUsageCount |
Contagem |
Conexões HTTP no cluster. |
|
clickhouse_init_query_cc |
Contagem |
Instruções de consulta não encaminhadas em execução. |
|
clickhouse_query_cc |
Contagem |
Consultas atualmente em execução. |
|
FailedQuery |
Contagem |
Consultas com falha na execução. |
|
FailedInsertQuery |
Contagem |
Instruções INSERT com falha. |
|
DelayedInsertsCount |
Contagem |
Instruções INSERT atrasadas. |
|
clickhouse_failed_select_query |
Contagem |
Instruções SELECT com falha. |
|
MergeCount |
Contagem |
Tarefas de mesclagem em execução. |
|
PartMutationCount |
Contagem |
Tarefas de mutação de dados em andamento. |
|
Number of temporary files for distributed tables |
Contagem |
Arquivos temporários para tabelas distribuídas. |
|
Number of MaterializeMySQL databases |
Contagem |
Bancos de dados sincronizados criados com o mecanismo MaterializeMySQL. |
|
clickhouse_cold_storage_data |
Bytes |
Dados frios armazenados. |
|
Number of MaterializeMySQL synchronization failures |
Contagem |
Falhas de sincronização em bancos de dados criados com o mecanismo MaterializeMySQL. |
|
Number of Kafka external table consumption errors |
Contagem |
Erros de consumo em tabelas externas do Kafka. |
|
ZooKeeper leader |
- |
Identifica o líder do cluster ZooKeeper. O valor 1 indica que o nó atual é o líder. |
|
Number of Kafka external tables |
Contagem |
Total de tabelas externas do Kafka. |
|
node queue backlog |
Contagem |
Pacotes de dados de um nó do ApsaraDB for ClickHouse na fila de envio do ZooKeeper. |
|
ZooKeeper average latency |
Milissegundos |
Latência média de requisições dos nós do ZooKeeper. |
|
Number of ZooKeeper znodes |
Contagem |
Total de znodes no cluster ZooKeeper. |
|
ZooKeeper TPS |
transactions/s |
Transações por segundo (TPS) do ZooKeeper. |
|
zxid utilization |
Porcentagem (%) |
Utilização de IDs de transação do ZooKeeper (zxids). Se a utilização de zxid atingir 100%, uma nova eleição de líder será acionada. |
Enterprise Edition
|
Métrica |
Unidade |
Descrição |
|
CPU Usage |
Porcentagem (%) |
Utilização média de CPU em todos os nós do cluster. |
|
CCU |
Contagem |
Recursos de computação consumidos pelo cluster. |
|
Memory Usage |
Bytes |
Uso total de memória em todos os nós do cluster. |
|
Memory Usage |
Porcentagem (%) |
Utilização média de memória em todos os nós do cluster. |
|
OssUsedSpace |
Bytes |
Armazenamento total do OSS usado pelo cluster. |
|
DatapartCount |
Contagem |
Partes de dados no cluster. |
|
InactiveDatapartCount |
Contagem |
Partes de dados inativas no cluster. |
|
KeeperCPUUtilization |
Porcentagem (%) |
Utilização de CPU do ClickHouse-Keeper. |
|
KeeperMemoryUsage |
Bytes |
Memória usada pelo ClickHouse-Keeper. |
|
KeeperMemoryUtilization |
Porcentagem (%) |
Utilização de memória do ClickHouse-Keeper. |
|
Size of Data Written Per Second |
Bytes/s |
Dados gravados por segundo em todos os nós do cluster. |
|
Rows Written Per Second |
rows/s |
Linhas gravadas por segundo em todos os nós do cluster. |
|
Network throughput |
Bytes/s |
Throughput combinado de leitura e gravação das interfaces de rede do cluster. |
|
OSS network throughput |
Bytes/s |
Throughput combinado de leitura e gravação entre o cluster e o OSS. |
|
OSS IOPS |
ops/s |
Operações de leitura e gravação por segundo entre o cluster e o OSS. |
|
TPS |
transactions/s |
Transações processadas por segundo pelo cluster. |
|
QPS |
queries/s |
Consultas processadas por segundo pelo cluster. |
|
clickhouse_init_query_cc |
Contagem |
Instruções de consulta não encaminhadas em execução no cluster. |
|
clickhouse_query_cc |
Contagem |
Consultas atualmente em execução no cluster. |
|
FailedQuery |
Contagem |
Consultas com falha no cluster. |
|
FailedInsertQuery |
Contagem |
Instruções de inserção com falha no cluster. |
|
DelayedInsertsCount |
Contagem |
Instruções de inserção atrasadas no cluster. |
|
clickhouse_failed_select_query |
Contagem |
Consultas select com falha no cluster. |
|
PartMutationCount |
Contagem |
Tarefas ativas de mutação de dados no cluster. |
|
MergeCount |
Contagem |
Tarefas ativas de mesclagem no cluster. |
|
clickhouse_tcp_conn_usage_count |
Contagem |
Conexões TCP ativas com o cluster. |
|
HTTPConnUsageCount |
Contagem |
Conexões HTTP ativas com o cluster. |
|
number of failed MV refreshes |
Contagem |
Atualizações de visualizações materializadas com falha no cluster. |
|
average MV refresh duration |
s |
Duração média das atualizações de visualizações materializadas no cluster. |
|
maximum MV refresh duration |
s |
Duração máxima das atualizações de visualizações materializadas no cluster. |
Métricas para clusters de versão antiga
Clusters de versão antiga são clusters da ApsaraDB for ClickHouse Community-compatible Edition adquiridos antes de 1º de dezembro de 2021.
|
Métrica |
Unidade |
Descrição |
|
CPU Usage |
% |
Utilização de CPU de cada nó no cluster. |
|
Memory Usage |
% |
Utilização de memória de cada nó no cluster. |
|
Memory Usage |
Bytes |
Memória usada por cada nó no cluster. |
|
Disk Usage Ratio |
% |
Percentual do espaço total em disco utilizado. |
|
Disk Usage |
Bytes |
Espaço em disco usado. |
|
Disk IOPS |
counts/s |
Operações de I/O de leitura e gravação por segundo. |
|
Disk IOPS |
Bytes/s |
Dados lidos ou gravados no disco por segundo. |
|
Database Connection Usage Ratio |
% |
Percentual de conexões de banco de dados usadas em relação ao máximo disponível. |
|
Database Connections |
count |
Conexões ativas com o banco de dados. |
|
TPS |
transactions/s |
Transações processadas por segundo. |
|
Rows Written Per Second |
rows/s |
Linhas gravadas em cada nó por segundo. |
|
Size of Data Written Per Second |
Bytes/s |
Dados gravados em cada nó por segundo. |
|
QPS |
queries/s |
Consultas processadas por segundo. |
|
Average Wait Time for ZK |
ms |
Latência média das requisições ao ZooKeeper. |
|
Average I/O Wait Time |
ms |
Tempo médio de espera para operações de I/O. |
|
Average CPU Wait Time |
ms |
Tempo médio que as tarefas aguardam recursos de CPU. |