Todos os produtos
Search
Central de documentação

Container Service for Kubernetes:Node scaling overview

Última atualização: Sep 20, 2026

Os clusters do Container Service for Kubernetes (ACK) Edge gerencie diversos recursos de nós, online e offline, incluindo nós do Elastic Compute Service (ECS) em várias regiões, nós de data centers, nós de outros provedores de service em nuvem e nós de servidores localizados em ambientes como fábricas, pontos de venda, veículos automotores e navios. Em cenários onde os recursos de nós offline são insuficientes, o recurso de Auto Scaling expande de forma transparente os nós na nuvem para os clusters do ACK Edge, aprimorando a capacidade de agendamento. Esse dimensionamento dinâmico conserva recursos e, consequentemente, reduz significativamente os custos.

Antes de começar

Leia este tópico para entender as soluções de dimensionamento de nós do ACK e escolha a solução mais adequada para sua carga de trabalho antes de ative o dimensionamento de nós.

Familiarize-se com o dimensionamento manual, o Auto Scaling, o dimensionamento horizontal e o dimensionamento vertical na documentação oficial do Kubernetes.

Como funciona

O dimensionamento de nós do Kubernetes difere do modelo tradicional baseado em limiares de utilização de recursos. É importante considerar essa diferença ao migrar de data centers ou de outros sistemas de orquestração para o Kubernetes.

Como os limiares de dimensionamento são determinados?

Os nós com alta carga geralmente apresentam maior utilização de recursos do que os outros nós.

  • Se o dimensionamento for acionado pela utilização média, a demanda dos nós com alta carga é mascarada pelos nós subutilizados, impedindo o scale-out no momento adequado.

  • Se o dimensionamento for acionado pela utilização de pico, geralmente há desperdício de recursos em todo o cluster.

Como as cargas são reduzidas após a adição de nós?

No Kubernetes, os pods são as menores unidades implantáveis. A adição de nós não redistribui as cargas dos pods existentes: a contagem de pods e os limites de recursos permanecem inalterados, portanto, os novos nós não recebem tráfego dos pods sobrecarregados.

Como o dimensionamento de nós é acionado e executado?

O dimensionamento baseado em utilização pode evictar pods com altas solicitações de recursos, mas com uso real baixo. Se houver muitos pods nessa condição, os recursos agendáveis se esgotam e alguns pods tornam-se não agendáveis.

Como as atividades de scale-out são acionadas?

O modelo de dimensionamento de nós monitora os pods não agendáveis. Quando os pods não são agendados por falta de recursos, o modelo simula o agendamento, seleciona um node pool adequado com Auto Scaling ativado e adiciona nós ao cluster.

Nota

A simulação abstrai cada node pool com Auto Scaling ativado como um nó virtual com a capacidade de CPU, memória e GPU de seus tipos de instância configurados, além dos rótulos e taints do node pool. O scheduler adiciona esse nó virtual à lista de nós agendáveis, calcula a quantidade necessária de nós e provisiona os nós de acordo.

Como as atividades de scale-in são acionadas?

O scale-in aplica-se apenas aos nós em node pools com Auto Scaling ativado; os nós estáticos não são gerenciados. Quando a utilização de um nó cai abaixo do limiar de scale-in, o modelo simula a evicção de pods para verifique se o nó pode ser drenado. Os pods que não pertencem a um DaemonSet no namespace kube-system e os pods protegidos por PodDisruptionBudget são ignorados. Após a evicção de todos os pods elegíveis para outros nós, o nó é removido.

Como melhorar a taxa de sucesso do Auto Scaling?

A taxa de sucesso do Auto Scaling depende dos seguintes fatores:

  • Se as condições de agendamento são atendidas

    Ao criar um node pool com Auto Scaling ativado, confirme a política de agendamento de pods para o node pool. Em caso de dúvida, configure o nodeSelector com o rótulo do node pool e execute uma simulação de agendamento.

  • Se os recursos são suficientes

    Após a simulação, o sistema seleciona um node pool com Auto Scaling ativado e adiciona nós. No entanto, a disponibilidade de tipos de instância do ECS na configuração do node pool afeta a taxa de sucesso do scale-out. especifique vários tipos de instância em diferentes zonas para melhorar a taxa de sucesso.

Como acelerar o Auto Scaling?

  • Método 1: Use o modo rápido. Após um node pool com Auto Scaling ativado concluir um ciclo de scale-out e scale-in, ele entra no modo rápido. Consulte Enable node autoscaling.

  • Método 2: Use uma imagem personalizada baseada no Alibaba Cloud Linux 3 para melhorar a eficiência de provisionamento de recursos de IaaS em 50%. Consulte Optimize scaling with custom images.

Solução de dimensionamento de nós

O modelo de dimensionamento de nós escala recursos na camada de recursos. Quando o tamanho de um cluster não atende aos requisitos de agendamento de pods, esse modelo dimensiona automaticamente os recursos dos nós para fornecer capacidade adicional de agendamento. O componente cluster-autoscaler gerencie o dimensionamento de nós, consultando periodicamente e mantendo o estado do cluster para identificar condições que atendam aos requisitos de dimensionamento, e ajusta automaticamente o número de nós do cluster.

Velocidade e eficiência do dimensionamento

  • Uma atividade de dimensionamento leva 60 segundos no modo padrão e 50 segundos no modo rápido.

  • Quando a duração de uma atividade de dimensionamento atinge 1 minuto, o Auto Scaling encontra um gargalo de desempenho. A eficiência do Auto Scaling varia de acordo com o número de node pools e os cenários de dimensionamento. Por exemplo, se o número de node pools exceder 100, a duração de uma atividade de dimensionamento aumenta para 100 a 150 segundos.

  • Com o uso de um modelo de polling e restrito pela dependência da manutenção do estado do cluster, a latência mínima é de 5 segundos.

Notas de uso

Cotas e limites

  • Uma tabela de rotas de VPC aceita até 200 entradas de rotas personalizadas. Para aumentar esse limite, envie uma solicitação no console do Quota Center. Para outras cotas de recursos, consulte Underlying Cloud Product Quotas.

  • Configure com cuidado o número máximo de nós em um node pool com Auto Scaling ativado. verifique se os recursos e as cotas dependentes são suficientes, como blocos CIDR de VPC e vSwitches, caso contrário, as atividades de scale-out poderão falhar. Para limites de node pools, consulte Enable node autoscaling. Para planejamento de rede, consulte ACK managed cluster network planning.

  • O dimensionamento de nós não aceita nós por assinatura. Não defina o método de faturamento como assinatura ao criar um node pool com Auto Scaling ativado. Para node pools existentes, verifique se não há nós por assinatura antes de ative o Auto Scaling.

  • O recurso de dimensionamento de nós é incompatível com os SideCar Containers. Implante cargas de trabalho de Sidecar Container em node pools com o Auto Scaling desativado.

Manutenção de recursos dependentes

Se houver endereços IP elásticos (EIPs) associados aos nós do ECS adicionados pelo dimensionamento de nós, não exclua esses nós diretamente do console do ECS. Os EIPs não serão liberados automaticamente.

Leitura complementar

Se você encontrar problemas ao usar o dimensionamento de nós, consulte FAQs of node scaling para solução de problemas.