Os clusters do Container Service for Kubernetes (ACK) Edge gerencie diversos recursos de nós, online e offline, incluindo nós do Elastic Compute Service (ECS) em várias regiões, nós de data centers, nós de outros provedores de service em nuvem e nós de servidores localizados em ambientes como fábricas, pontos de venda, veículos automotores e navios. Em cenários onde os recursos de nós offline são insuficientes, o recurso de Auto Scaling expande de forma transparente os nós na nuvem para os clusters do ACK Edge, aprimorando a capacidade de agendamento. Esse dimensionamento dinâmico conserva recursos e, consequentemente, reduz significativamente os custos.
Antes de começar
Leia este tópico para entender as soluções de dimensionamento de nós do ACK e escolha a solução mais adequada para sua carga de trabalho antes de ative o dimensionamento de nós.
Familiarize-se com o dimensionamento manual, o Auto Scaling, o dimensionamento horizontal e o dimensionamento vertical na documentação oficial do Kubernetes.
Como funciona
O dimensionamento de nós do Kubernetes difere do modelo tradicional baseado em limiares de utilização de recursos. É importante considerar essa diferença ao migrar de data centers ou de outros sistemas de orquestração para o Kubernetes.
Solução de dimensionamento de nós
O modelo de dimensionamento de nós escala recursos na camada de recursos. Quando o tamanho de um cluster não atende aos requisitos de agendamento de pods, esse modelo dimensiona automaticamente os recursos dos nós para fornecer capacidade adicional de agendamento. O componente cluster-autoscaler gerencie o dimensionamento de nós, consultando periodicamente e mantendo o estado do cluster para identificar condições que atendam aos requisitos de dimensionamento, e ajusta automaticamente o número de nós do cluster.
Velocidade e eficiência do dimensionamento
Uma atividade de dimensionamento leva 60 segundos no modo padrão e 50 segundos no modo rápido.
Quando a duração de uma atividade de dimensionamento atinge 1 minuto, o Auto Scaling encontra um gargalo de desempenho. A eficiência do Auto Scaling varia de acordo com o número de node pools e os cenários de dimensionamento. Por exemplo, se o número de node pools exceder 100, a duração de uma atividade de dimensionamento aumenta para 100 a 150 segundos.
Com o uso de um modelo de polling e restrito pela dependência da manutenção do estado do cluster, a latência mínima é de 5 segundos.
Notas de uso
Cotas e limites
Uma tabela de rotas de VPC aceita até 200 entradas de rotas personalizadas. Para aumentar esse limite, envie uma solicitação no console do Quota Center. Para outras cotas de recursos, consulte Underlying Cloud Product Quotas.
Configure com cuidado o número máximo de nós em um node pool com Auto Scaling ativado. verifique se os recursos e as cotas dependentes são suficientes, como blocos CIDR de VPC e vSwitches, caso contrário, as atividades de scale-out poderão falhar. Para limites de node pools, consulte Enable node autoscaling. Para planejamento de rede, consulte ACK managed cluster network planning.
O dimensionamento de nós não aceita nós por assinatura. Não defina o método de faturamento como assinatura ao criar um node pool com Auto Scaling ativado. Para node pools existentes, verifique se não há nós por assinatura antes de ative o Auto Scaling.
O recurso de dimensionamento de nós é incompatível com os SideCar Containers. Implante cargas de trabalho de Sidecar Container em node pools com o Auto Scaling desativado.
Manutenção de recursos dependentes
Se houver endereços IP elásticos (EIPs) associados aos nós do ECS adicionados pelo dimensionamento de nós, não exclua esses nós diretamente do console do ECS. Os EIPs não serão liberados automaticamente.
Leitura complementar
Se você encontrar problemas ao usar o dimensionamento de nós, consulte FAQs of node scaling para solução de problemas.