Esta página define os principais termos do ApsaraDB for ClickHouse. Revise estes conceitos antes de configurar seu cluster.
Termos comuns
Região
Uma região é a localização física onde os servidores do ApsaraDB for ClickHouse estão hospedados. Selecione uma região ao adquirir o serviço. Não é possível alterar a região após a compra.
Zona
Uma zona é uma área física dentro de uma região com fornecimento de energia e rede independentes. As zonas na mesma região se conectam por meio de uma rede interna de baixa latência.
Banco de dados
O banco de dados é o objeto de nível mais alto em um cluster do ApsaraDB for ClickHouse. Ele contém objetos como tabelas, colunas, visualizações, funções e tipos de dados.
Edição compatível com a comunidade
Cluster do ApsaraDB for ClickHouse
Um cluster do ApsaraDB for ClickHouse é um banco de dados distribuído composto por várias instâncias do ClickHouse Server. Dependendo das especificações adquiridas, o cluster pode conter um ou mais shards e uma ou mais réplicas. Logicamente, um cluster pode conter vários objetos de banco de dados.
Edição
A Edição determina o número de réplicas por shard e afeta a disponibilidade e o custo.
-
Edição de réplica dupla: Cada shard contém duas réplicas. Se uma réplica ficar indisponível, a outra continuará a atender ao tráfego. Os dados são replicados entre ambas as réplicas para garantir a consistência.
ImportanteAo criar tabelas em um cluster da Edição de réplica dupla, utilize mecanismos de tabela Replicated da família MergeTree. Mecanismos de tabela não replicados não copiam dados entre réplicas, o que pode causar inconsistência de dados.
Edição de réplica única: Cada shard possui uma réplica. Caso essa réplica fique indisponível, o cluster também ficará indisponível até que a restauração completa ocorra.
Um cluster da Edição de réplica dupla utiliza o dobro de recursos e custa o dobro de um cluster da Edição de réplica única. Como os discos subjacentes oferecem alta confiabilidade, um cluster da Edição de réplica única ainda previne a perda de dados.
Shard
Um shard é um servidor que armazena e processa uma parte do total de dados em um cluster. Quando a capacidade de armazenamento ou computação de um único servidor se torna um gargalo, o ApsaraDB for ClickHouse distribui os dados entre vários shards para melhorar a eficiência.
Réplica
Uma réplica é uma cópia redundante de dados armazenada em dois ou mais servidores. O ApsaraDB for ClickHouse usa replicação para proteger contra falhas de servidor e manter a alta disponibilidade.
Tabela
A tabela é a estrutura básica para armazenamento de dados. Ela consiste em linhas e colunas, onde cada coluna representa um campo e cada linha representa um registro.
Por distribuição de dados:
| Tipo de tabela | Descrição | Diferenças |
|---|---|---|
|
Tabela local |
Os dados são armazenados apenas no nó onde foram gravados. Não há distribuição entre vários servidores. |
|
|
Tabela distribuída |
Uma coleção de tabelas locais. Ela abstrai várias tabelas locais em uma única tabela unificada que fornece capacidades de gravação e consulta. Ao gravar dados, eles são automaticamente distribuídos para as tabelas locais da coleção. Ao consultar dados, cada tabela local na coleção é consultada separadamente, e os resultados finais são agregados e retornados. |
Por mecanismo de armazenamento:
| Tipo de tabela | Descrição | Diferenças |
|---|---|---|
|
Tabela não replicada |
Os dados residem apenas no servidor atual e não são replicados para outros servidores. Existe apenas uma réplica. |
|
|
Tabela replicada |
Os dados são replicados automaticamente para vários servidores, formando múltiplas réplicas. |
Parte de dados
Uma parte de dados é um fragmento autônomo de dados armazenado em disco. Trata-se da unidade básica de armazenamento para uma tabela do ClickHouse. Sempre que dados são gravados em uma tabela do ClickHouse, uma nova parte de dados é gerada. Cada parte inclui todas as colunas e índices referentes à sua porção de dados e mantém a ordenação dos dados. Esse design permite operações eficientes de mesclagem e compressão para processamento de consultas de alto desempenho.
Enterprise Edition
Cluster do ApsaraDB for ClickHouse
Um cluster do ApsaraDB for ClickHouse na Enterprise Edition é composto por unidades de recursos de computação e armazenamento. Ele fornece uma Plataforma como Serviço (PaaS) para armazenamento e análise de dados baseada no mecanismo ClickHouse.
Nó worker
Um nó worker é um nó de réplica dentro de um cluster do ApsaraDB for ClickHouse. É o recurso físico que participa das computações do mecanismo.
CCU
A ClickHouse Compute Unit (CCU) é a unidade de medição e faturamento de recursos de computação em um cluster do ApsaraDB for ClickHouse. Uma CCU equivale a 1 vCPU e 4 GiB de memória. A unidade padrão de faturamento é CCU por minuto.
Dimensionamento automático de recursos de computação
O dimensionamento automático de recursos de computação ajusta automaticamente o número de CCUs em um cluster com base no uso de CPU e memória.
Intervalo de dimensionamento automático
O intervalo de dimensionamento automático define o número mínimo e máximo de CCUs para um cluster. O recurso de dimensionamento automático mantém a contagem de CCUs dentro desse intervalo.
Recursos de armazenamento
Recursos de armazenamento consulte à solução de armazenamento compartilhado utilizada pela Enterprise Edition. O faturamento ocorre na modalidade pagamento conforme o uso.