Este tópico descreve os modos de dimensionamento de recursos (vertical e horizontal) compatíveis com instâncias de grupo de computação do Hologres para ajudar você a escolher o melhor método para as necessidades do seu negócio.
Modos de dimensionamento
O Hologres permite dividir uma instância em vários grupos de computação. Dimensione os recursos de cada grupo sob demanda usando um dos seguintes métodos:
Dimensionamento vertical (scale up/down): disponível desde o Hologres V2.0. Aumenta ou diminui os recursos de computação de um grupo de computação. É ideal para tarefas médias e grandes, além de pequenas tarefas com alta concorrência.
Dimensionamento horizontal (scale out/in): disponível desde o Hologres V4.0. Aumenta ou reduz o número de clusters em um grupo de computação. Oferece throughput mais flexível e isolamento de carga de trabalho, sendo indicado para cenários de pequenas tarefas com alta concorrência.
Métodos de dimensionamento de recursos
Dimensione recursos das seguintes formas:
Dimensione recursos manualmente de forma vertical ou ajuste o número de clusters horizontalmente. Para obter mais informações, consulte Gerencie grupos de computação.
Dimensionamento baseado em tempo (vertical): configure uma tarefa agendada para dimensionar verticalmente os recursos de computação em horários específicos. Para obter mais informações, consulte Time-based scaling (Beta).
Auto Scaling (horizontal): defina um limite de dimensionamento para que o sistema faça automaticamente o scale out com base na carga de trabalho atual. Para obter mais informações, consulte Multi-cluster and auto scaling (Beta).
Conceitos principais
Os termos a seguir aplicam-se ao dimensionamento baseado em tempo:
Recursos reservados para um grupo de computação: recursos de computação definidos durante a criação de um grupo de computação. Você pode modificar esse valor posteriormente. Esses recursos são alocados a partir dos recursos reservados da instância.
Recursos elásticos para um grupo de computação: recursos adicionais de computação provisionados além dos recursos reservados por meio do dimensionamento baseado em tempo.
Total de recursos de computação para um grupo de computação: soma dos recursos reservados e elásticos utilizados por um grupo de computação.
Os termos abaixo referem-se ao dimensionamento multicluster e ao Auto Scaling:
Contagem de clusters reservados: número de clusters definido para um grupo de computação no momento da criação. Você pode alterar esse valor posteriormente. Os recursos de computação desses clusters reservados são alocados a partir dos recursos reservados da instância.
Especificação por cluster: parcela dos recursos reservados de computação da instância alocada para cada cluster reservado. Defina essa especificação ao criar um grupo de computação; é possível modificá-la depois.
Recursos reservados para um grupo de computação: resultado da multiplicação de
Per-cluster specificationporReserved cluster count.-
Recursos elásticos para um grupo de computação:
Recursos adicionais de computação provisionados via Auto Scaling além dos recursos reservados.
Produto de
Per-cluster specificationpela diferença entreCurrent cluster counteReserved cluster count.
Total de recursos de computação para um grupo de computação: soma dos recursos reservados e elásticos utilizados por um grupo de computação.
Os seguintes recursos de computação são definidos no nível da instância:
-
Recursos reservados para uma instância: total de recursos de computação reservados para uma instância. Estão disponíveis tanto nos modelos de faturamento por assinatura quanto no pagamento conforme o uso. Classificam-se em alocados ou não alocados:
Recursos alocados da instância: parte dos recursos reservados da instância destinada aos recursos reservados de todos os grupos de computação.
Recursos não alocados da instância: parcela dos recursos reservados da instância ainda não atribuída a nenhum grupo de computação.
Recursos elásticos para uma instância: total de recursos adicionais de computação provisionados por todos os grupos de computação de uma instância por meio de dimensionamento baseado em tempo ou Auto Scaling.
Total de recursos de computação para uma instância: soma dos recursos reservados e elásticos utilizados por uma instância.