Todos os produtos
Search
Central de documentação

PolarDB:Configure auto scaling for a serverless cluster

Última atualização: Jun 28, 2026

Um cluster serverless permite definir políticas personalizadas para controlar os limites superior e inferior do Auto Scaling. Também é possível configurar políticas agendadas para aumentar recursos durante picos de tráfego previsíveis, como promoções, e reduzi-los em períodos de baixa demanda.

Auto Scaling

Gatilhos de scale-up e scale-out

  • Dimensionamento vertical (scale-up)

    O PolarDB monitora a utilização de CPU, o uso de memória e outras métricas no nível do kernel dos nós primários e somente leitura. Durante um período de monitoramento, o sistema geralmente aciona um scale-up para um nó quando qualquer uma das seguintes condições é atendida:

    • A utilização de CPU está acima do limiar predefinido (padrão: 80%).

    • O uso de memória está acima de um limiar específico:

      Serverless format

      Limiar de scale-up

      Serverless cluster

      90%

      Recurso Serverless para clusters com especificações definidas

      Menor ou igual a 32 GB

      90%

      64 GB

      92%

      128 GB

      96%

      256 GB a 512 GB

      98%

      Outras especificações de memória

      Não há suporte para dimensionamento vertical.

    • As especificações de um nó somente leitura são inferiores à metade das do nó primário.

      Por exemplo, se um nó somente leitura tiver especificações de 4 PCU e o nó primário tiver 10 PCU, o nó somente leitura será escalado para pelo menos 5 PCU.

  • Dimensionamento horizontal (scale-out)

    Se um nó somente leitura em um cluster atingir o limite máximo configurado e ainda atender às condições de gatilho de scale-up (por exemplo, utilização de CPU acima do limiar personalizado), um scale-out horizontal será acionado.

Gatilhos de scale-down e scale-in

  • Dimensionamento vertical (scale-down)

    Um scale-down é acionado para um nó quando sua utilização de CPU cai abaixo do limiar personalizado (padrão: 50%) e seu uso de memória está abaixo de um limiar específico. Os limiares de uso de memória são os seguintes:

    Serverless format

    Limiar de scale-down

    Serverless cluster

    80%

    Recurso Serverless para clusters com especificações definidas

    Menor ou igual a 32 GB

    80%

    64 GB

    86%

    128 GB

    90%

    256 GB a 512 GB

    94%

    Outras especificações de memória

    Não há suporte para dimensionamento vertical; portanto, nenhum limiar de scale-down se aplica.

  • Dimensionamento horizontal (scale-in)

    Um scale-in é acionado para um nó somente leitura se sua utilização de CPU permanecer abaixo de 15% e a utilização de CPU de todos os outros nós somente leitura permanecer abaixo de 60% por um período contínuo de 15 a 30 minutos.

    Nota
    • Para evitar oscilações nos nós, apenas um nó somente leitura passa por scale-in por vez. O período de resfriamento entre eventos consecutivos de scale-in é de 15 a 30 minutos.

    • Para executar imediatamente o scale-in de todos os nós somente leitura, modifique a Serverless Configuration. Definir tanto o Maximum Number of Read-only Nodes quanto o Minimum Number of Read-only Nodes como 0 aciona instantaneamente o scale-in de todos os nós somente leitura.

Nota
  • As métricas para acionar o dimensionamento variam conforme as configurações de parâmetros do cluster e as configurações serverless. É possível especificar limiares para dimensionamento de CPU, mas não é possível alterar limiares para outras métricas.

  • Quando as cargas de trabalho de um cluster serverless aumentam repentinamente, os nós do cluster são dimensionados passo a passo para se aproximarem das especificações esperadas, em vez de um passo por vez. O tamanho mínimo do passo de dimensionamento do nó é 0,5 PCUs. Para se adaptar rapidamente às cargas de trabalho atuais, o tamanho do próximo passo de dimensionamento aumenta com base no número atual de PCUs por nó.

  • Para receber notificações quando um nó sofrer scale-down, configure regras de alerta na seção Performance Monitoring do console. Para mais detalhes, consulte Configurar monitoramento elástico.

Observações importantes

  • O número máximo de conexões para um cluster serverless é 100.000, e o IOPS máximo é 84.000.

  • Um cluster serverless utiliza PCU (PolarDB Capacity Unit) como unidade tanto para faturamento por segundo quanto para gerenciamento de recursos de Auto Scaling. Uma PCU equivale a aproximadamente 1 núcleo de CPU e 2 GB de memória. A PCU de um nó é ajustada dinamicamente com base na carga de trabalho, dentro do intervalo definido por você. O incremento mínimo de dimensionamento é 0,5 PCU.

Configurar parâmetros serverless

Faça login no console do PolarDB, clique em Clusters no painel de navegação à esquerda, selecione a region de destino e clique no ID do cluster. Na página Basic Information, na seção Database Nodes, clique em Serverless Configuration.

Configurar parâmetros atuais

Na caixa de diálogo Configure Serverless-related Parameters, clique em Edit para configurar os seguintes parâmetros.

  • Current Parameters

    • Minimum Read-only Nodes: O número mínimo de nós somente leitura. O valor pode variar de 0 a 15.

    • Maximum Read-only Nodes: O número máximo de nós somente leitura. O valor pode variar de 0 a 15.

    Nota
    • A quantidade de nós somente leitura aumenta ou diminui automaticamente com base na carga de trabalho real, respeitando os limites mínimo e máximo especificados. Para mais informações sobre a lógica de dimensionamento, consulte Auto Scaling.

    • Para garantir alta disponibilidade do cluster serverless, recomendamos definir Minimum Read-only Nodes como 1.

    • Minimum Resources for Single Node: A PCU mínima para cada nó no cluster. O valor pode variar de 0,25 PCU a 32 PCU.

    • Maximum Resources for Single Node: A PCU máxima para cada nó no cluster. O valor pode variar de 1 PCU a 32 PCU.

    Nota

    Exemplo: Se você definir Minimum Resources for Single Node como 2 PCU e Maximum Resources for Single Node como 16 PCU, as especificações padrão do nó primário e dos nós somente leitura no cluster serverless serão de 2 PCU (aproximadamente 2 núcleos de CPU e 4 GB de memória). Quando o sistema detectar aumento nas cargas de trabalho, ele aumentará automaticamente o número de PCUs para o nó primário ou para os nós somente leitura. Com base nas suas configurações, o máximo é 16 PCU (aproximadamente 16 núcleos de CPU e 32 GB de memória).

    • Read-only Column Store Nodes: O número de nós column store somente leitura. O valor pode variar de 0 a 15.

      Nota
      • Para adicionar um nó column store somente leitura, o cluster deve ter pelo menos um nó somente leitura. Isso significa que você deve primeiro definir Minimum Read-only Nodes como 1 ou superior.

      • Para mais informações sobre nós column store somente leitura, consulte índices colunares (IMCI).

    • Enable No-activity Suspension: Ative este recurso para suspender automaticamente o cluster durante períodos de inatividade. Quando ativado, o cluster é suspenso se nenhuma conexão estiver ativa durante o Detection Period for No-activity Suspension especificado. Durante o período de suspensão, você ainda é cobrado pelo armazenamento no modelo pagamento conforme o uso. O cluster retoma automaticamente assim que uma nova solicitação de conexão é recebida.

    • Detection Period for No-activity Suspension: O período de detecção pode ser definido de 5 minutos a 24 horas e deve ser um múltiplo de 5 minutos.

  • Advanced Settings

    É possível ajustar os parâmetros avançados com base na pressão de recursos no seu cluster serverless.

    • Standard: Utiliza uma janela de observação de 10s e um resfriamento de 5s.

    • Sensitive: Utiliza uma janela de observação de 3s e um resfriamento de 1s para respostas mais rápidas.

    No modo Sensitive, o cluster realiza scale-up imediatamente ao detectar um pico de CPU. Isso pode causar dimensionamentos frequentes em resposta a picos breves e desnecessários para algumas cargas de trabalho.

    • Scan Interval: Esta configuração determina a rapidez com que o cluster responde a mudanças na carga de trabalho. Selecione Standard ou Sensitive.

    • Maximum CPU Resources for Elastic Upgrade (Máximo): O limiar de utilização de CPU que aciona uma ação de scale-up. O valor pode variar de 40% a 100%.

    • Minimum CPU Resources for Elastic Upgrade (Mínimo): O limiar de utilização de CPU que aciona uma ação de scale-down. O valor pode variar de 10% a 70%.

    Nota
    • O limiar de scale-down de CPU deve ser inferior ao limiar de scale-up de CPU. A diferença entre os dois limiares deve ser de pelo menos 30 pontos percentuais.

    • O modo Sensitive é adequado para cargas de trabalho sensíveis a flutuações transitórias de carga (por exemplo, picos curtos de CPU) que precisam de uma resposta mais rápida. No entanto, o cluster pode realizar scale-up e scale-down com mais frequência conforme a carga muda.

Configurar uma política agendada

Uma política agendada dimensiona recursos com base em um cronograma predefinido. Isso permite aumentar recursos para picos de tráfego previsíveis, como promoções, e reduzi-los durante períodos de baixa demanda.

Aviso

Prossiga com cautela:

  • Ao excluir uma política agendada, suas tarefas em execução não podem ser canceladas, mas suas tarefas pendentes serão canceladas.

  • Se você desativar o recurso serverless, todas as políticas agendadas associadas e suas tarefas programadas serão excluídas.

  1. Na caixa de diálogo Configure Serverless-related Parameters, clique em + Add Scheduled Policy. Os parâmetros são descritos da seguinte forma:

    Parâmetro

    Valor

    Maximum Resources for Single Node (Máximo)

    1 a 32 PCU.

    Minimum Resources for Single Node (Mínimo)

    1 a 32 PCU. O valor mínimo deve ser menor ou igual ao valor máximo.

    Maximum Read-only Nodes

    Um valor de 0 a 15.

    Minimum Read-only Nodes

    Um valor de 0 a 15. O valor não pode ser maior que o valor de Maximum Read-only Nodes.

    Read-only Column Store Nodes

    Um valor de 0 a 15.

    Start/End Time

    O intervalo de tempo efetivo para a política agendada.

    Policy Scheduling

    As configurações de agendamento para a política.

    1. Positive: Selecione dias específicos do mês e um horário para a execução da política. Você pode contar a partir do início do mês (Last) ou do fim (Last). Separe vários dias com uma vírgula (,), por exemplo, 1,3,5.

    2. Weekly: Selecione dias específicos da semana (segunda a domingo) e um horário para a execução da política.

    3. Daily: Selecione um horário específico do dia para a execução da política.

    Nota

    Após configurar uma política agendada, o sistema ajusta os parâmetros de configuração Serverless do cluster de acordo com o horário agendado da política dentro do Start/End Time especificado. Após a conclusão do ajuste, os parâmetros de configuração Serverless do cluster não serão restaurados automaticamente. Se precisar restaurar os parâmetros de configuração originais em um horário específico, configure outra política agendada. Para um exemplo detalhado, consulte Exemplo.

  2. Visualize tarefas agendadas. É possível visualizar as tarefas de duas maneiras:

    Nota

    Políticas agendadas geram as tarefas agendadas subjacentes que executam as ações de dimensionamento.

    • Após a criação de uma política agendada, visualize suas tarefas na página de detalhes do cluster.

      Na página de detalhes do cluster, na seção Pending Scheduled and Failed Tasks, visualize as tarefas geradas pela política. Isso inclui o ID da tarefa, status, ação (como ModifyDBClusterServerlessConf), hora de início planejada e hora de término planejada. É possível Cancel a tarefa ou Modify the scheduled time.

    • Acesse Task Management > Scheduled Tasks no console.

      Na lista de tarefas desta página, visualize o status de cada tarefa agendada (como Pending ou Canceled) e Cancel quaisquer tarefas que estejam no estado Pending.

Exemplo

Cenário: Aumentar recursos para 5 PCU às 09:30 e reduzir para 1 PCU às 22:00 em dias úteis, de 1º de agosto a 30 de setembro. Isso requer duas políticas separadas:

Para a política de scale-up (executada às 09:30), defina tanto Maximum Resources for Single Node quanto Minimum Resources for Single Node como 5 PCU. Defina tanto Maximum Read-only Nodes quanto Minimum Read-only Nodes como 5.

Para a política de scale-down (executada às 22:00), defina Maximum Resources for Single Node e Minimum Resources for Single Node como 1 PCU, e defina Maximum Read-only Nodes e Minimum Read-only Nodes como 1.