Um node pool é um grupo lógico de nós que compartilham as mesmas propriedades. Os node pools permitem o gerenciamento unificado de nós e de operações e manutenção (O&M), como atualizações de nós e dimensionamento elástico. O ACK também oferece diversos recursos automatizados de O&M para node pools, como correção automática de vulnerabilidades CVE do sistema operacional e recuperação automática de nós com falha, para ajudar a reduzir os custos de O&M.
Introdução aos node pools
Um node pool funciona como um modelo de configuração. Os nós adicionados por dimensionamento em um node pool adotam essa configuração. É possível criar vários node pools com diferentes configurações e tipos em um cluster. A configuração de um node pool inclui propriedades do nó, como tipos de instância, métodos de faturamento, zonas (vSwitches), imagens de sistema operacional, arquiteturas de CPU, rótulos e taints. Especifique essas propriedades ao criar um node pool ou editá-las após a criação do node pool.
Clusters mais antigos, criados antes da introdução do recurso de node pool, podem conter worker nodes não gerenciados. Recomendamos adicionar esses nós a um node pool para facilitar o gerenciamento. Para obter mais informações, consulte Migrar nós não gerenciados para um node pool .
Use um único node pool para reduzir a complexidade de gerenciamento e configuração. Alternativamente, use múltiplos node pools para implementar isolamento granular de recursos e gerenciar implantações híbridas de diferentes tipos de nós.
Node pool único | Múltiplos node pools |
Gerencie recursos de computação para várias equipes ou cargas de trabalho por meio de um único node pool para simplificar as operações e a manutenção. Um node pool único oferece suporte aos seguintes recursos.
Não é possível misturar instâncias com sistemas operacionais e arquiteturas de CPU diferentes (ARM e x86). | Crie vários node pools para fornecer recursos de computação independentes para diferentes cargas de trabalho ou equipes. Isso ajuda a evitar contenção de recursos e possíveis riscos de segurança. Essa abordagem é adequada para os seguintes cenários.
|
Ao utilizar múltiplos node pools, aplique políticas de agendamento para definir a prioridade entre eles e otimizar o gerenciamento de recursos e custos. Por exemplo:
Controle a prioridade de provisionamento de recursos de computação com custos diferentes, como spot instances e instâncias por assinatura, para reduzir os custos gerais.
Aloque diferentes tipos de instância com base nos requisitos da carga de trabalho, como a proporção necessária entre arquiteturas x86 e ARM.
Recursos dos node pools
O ACK fornece diversos recursos de gerenciamento de nós no nível do node pool. Para reduzir a carga de trabalho de O&M dos worker nodes e focar mais no desenvolvimento de aplicações, ative o recurso de node pool gerenciado e utilize várias capacidades automatizadas de O&M.
Recursos básicos
Recurso | Descrição | Referências |
Criar, editar, excluir e visualizar |
| |
Dimensionamento manual ou automático |
| |
Adicionar nós existentes | Use o recurso Adicionar Nós Existentes para adicionar uma instância ECS adquirida a um cluster ACK como worker node ou para readicionar um worker node a um node pool após sua remoção. Este recurso possui algumas limitações e considerações importantes. Para obter mais informações, consulte o documento referenciado. | |
Remover nós | Se determinados nós não forem mais necessários, remova-os do cluster ou do node pool. Siga os procedimentos padrão para evitar comportamentos inesperados. | |
Atualizar a versão do kubelet | Atualize as versões do kubelet e do containerd dos nós em um node pool. Também é possível usar o recurso upgrade automático de cluster para atualizar automaticamente o kubelet e o runtime de contêiner. | |
Alterar o sistema operacional | Atualize a versão do sistema operacional ou altere o tipo de sistema operacional. Por exemplo, migre de um sistema operacional em fim de vida (EOL) para ContainerOS ou Alibaba Cloud Linux. | |
Correção de vulnerabilidades CVE | Verifique manualmente vulnerabilidades CVE e corrija falhas de segurança no sistema operacional do nó. Algumas correções de vulnerabilidades CVE exigem a reinicialização do nó. Para obter mais informações sobre este recurso e suas considerações, consulte o documento referenciado. Ative as capacidades automatizadas de O&M para que o ACK corrija automaticamente as vulnerabilidades CVE do SO. | |
Personalizar parâmetros do kubelet para um node pool | Personalize os parâmetros do kubelet para nós no nível do node pool para ajustar o comportamento do nó. Por exemplo, ajuste as reservas de recursos do cluster para gerenciar a alocação de recursos. | |
Personalizar parâmetros do SO para um node pool | Personalize os parâmetros do SO para nós no nível do node pool para ajustar o desempenho do sistema. | |
Análise de custos | Analise o uso de recursos e a distribuição de custos no nível do node pool para otimizar despesas e melhorar a utilização dos recursos do cluster. |
Capacidades automatizadas de O&M
Ativar capacidades automatizadas de O&M para um node pool reduz a carga de trabalho de O&M dos worker nodes. Isso permite que o ACK execute automaticamente certas operações de O&M, como correção automática de vulnerabilidades CVE do sistema operacional (SO), atualizações automáticas do kubelet e recuperação automática de falhas em nós. No entanto, essa abordagem não é recomendada se seus services forem sensíveis a alterações nos nós subjacentes e não tolerarem reinicializações de nós ou migrações de pods de aplicação.
Preparações
-
Certifique-se de que o sistema operacional seja Alibaba Cloud Linux 3 Container-Optimized Edition, ContainerOS, Alibaba Cloud Linux, Red Hat ou Ubuntu.
Para obter mais informações sobre as imagens de sistema operacional suportadas pelos clusters ACK e suas limitações, consulte Sistemas operacionais.
-
Antes de usar as capacidades automatizadas de O&M de um node pool, conclua as seguintes operações na página Node Pool no Container Service Management Console. Modifique essas configurações a qualquer momento.
Para obter mais informações sobre como criar e editar um node pool, consulte Criar e gerenciar um node pool .
Introdução aos recursos
Recurso | Descrição |
Autocorreção de nós | O ACK monitora automaticamente o status do nó e executa tarefas de autocorreção quando um nó apresenta anomalias. Isso corrige problemas no sistema, componentes do K8s e instâncias de nó. Para obter mais informações, consulte Ativar autocorreção de nós. |
Correção automática de vulnerabilidades CVE do SO | O ACK verifica vulnerabilidades de segurança nos nós, agenda e executa um plano de correção de vulnerabilidades CVE com base na janela de O&M do cluster. Isso melhora a estabilidade, a segurança e a conformidade do cluster. Para obter mais informações sobre as observações, consulte Corrigir vulnerabilidades CVE do SO para um node pool. |
Resposta automática a eventos de sistema do ECS | Oferece suporte à resposta automática a eventos de sistema do ECS. Atualmente, há suporte para os seguintes tipos de eventos de sistema.
|
A partir de 31 de janeiro de 2026, as entradas de configuração para atualizações automáticas do kubelet e runtimes de contêiner em node pools gerenciados serão removidas. Configure o upgrade automático de cluster para atualizar automaticamente os node pools. Para obter mais informações, consulte Alteração de product | Aviso sobre alterações na correção de vulnerabilidades de segurança e upgrades automáticos para node pools gerenciados .
Ciclo de vida do node pool
O ciclo de vida de um node pool de cluster ACK envolve vários estágios e estados, desde a criação e implantação, passando pela execução e manutenção (incluindo dimensionamento, atualização e remoção de nós), até a exclusão final. A seção a seguir descreve os diferentes estados e suas transições.
Estado do node pool | Descrição |
Inicializando (initial) | O node pool está sendo criado. |
Ativo (active) | O node pool foi criado com sucesso e está em execução. |
Falhou (failed) | Falha na criação do node pool. |
Dimensionando (scaling) | O node pool está dimensionando para fora ou adicionando nós. |
Atualizando (updating) | A configuração do node pool está sendo atualizada. |
Removendo nós (removing_nodes) | Nós estão sendo removidos do node pool. |
Fazendo upgrade (upgrading) | O node pool está passando por um upgrade. |
Reparando (repairing) | O node pool está sendo reparado, por exemplo, reparando nós ou corrigindo vulnerabilidades CVE no node pool. |
Excluindo (deleting) | O node pool está sendo excluído. |
Excluído (deleted, este estado não é visível para você) | O node pool foi excluído com sucesso. |
Falha na exclusão (deleted_failed) | Falha ao excluir o node pool. Tente excluí-lo novamente. Se a exclusão ainda falhar, abra um ticket. |
Faturamento de node pools
O uso de node pools e suas capacidades automatizadas de O&M é gratuito. No entanto, os recursos de cloud dentro do node pool, como instâncias ECS, são cobrados pelos respectivos services de cloud.
-
Para obter mais informações sobre o faturamento de instâncias ECS, consulte Visão geral do faturamento.
Para alterar o método de faturamento de nós existentes em um node pool, consulte Alterar o método de faturamento de uma instância de pay-as-you-go para assinatura. Alterar o método de faturamento de um node pool afeta apenas novos nós adicionados por dimensionamento. Isso não altera o método de faturamento dos nós existentes no node pool.
Para obter mais informações sobre o faturamento de grupos de dimensionamento, consulte Faturamento do Auto Scaling.
Glossário
Antes de usar node pools, recomendamos familiarizar-se com os seguintes conceitos e termos.
Grupo de dimensionamento: Ao dimensionar um node pool para dentro ou para fora, o ACK executa operações de expansão e remoção de nós usando o service Auto Scaling (ESS). Cada node pool tem uma relação um para um com um grupo de dimensionamento do Auto Scaling. Um grupo de dimensionamento é uma coleção de uma ou mais instâncias ECS (worker nodes).
Configuração de dimensionamento: Um node pool usa uma configuração de dimensionamento para gerenciar configurações de nós. Uma configuração de dimensionamento é um modelo usado para criar instâncias ECS durante o dimensionamento elástico. Quando uma atividade de dimensionamento é acionada, o Auto Scaling usa a configuração de dimensionamento especificada para criar automaticamente instâncias ECS.
Atividade de dimensionamento: Cada redução, expansão, adição de nó ou remoção de nó em um node pool aciona uma atividade de dimensionamento. Após o acionamento de uma atividade de dimensionamento, todas as ações de dimensionamento são executadas automaticamente pelo sistema e os registros relevantes são salvos. É possível visualizar o histórico de atividades de dimensionamento de um node pool.
-
Substituir o disco do sistema: Algumas operações em um node pool, como adicionar automaticamente nós existentes e alterar o runtime de contêiner, inicializam o nó substituindo seu disco do sistema. As propriedades da instância do nó, como nome do nó, ID da instância e endereço IP, não mudam, mas os dados no disco do sistema do nó são excluídos. Discos de dados anexados ao nó não são afetados.
Quando o ACK substitui um disco do sistema, ele drena o nó. Esse processo remove os pods do nó para outros nós disponíveis e segue o Pod Disruption Budget (PDB). Para garantir alta disponibilidade do service, recomendamos usar uma implantação com múltiplas réplicas para distribuir cargas de trabalho em vários nós e configurar PDBs para services críticos. Isso ajuda a controlar o número de pods que podem ser interrompidos simultaneamente.
Upgrade in-place: Um método de upgrade que serve como alternativa à substituição do disco do sistema. Este método atualiza e substitui diretamente os componentes necessários no nó. Um upgrade in-place não substitui o disco do sistema nem reinicializa o nó, e os dados no nó não são afetados.
Referências
Para obter mais informações sobre os limites de capacidade de recursos Kubernetes suportados por um cluster, como o número máximo de nós e pods, consulte Cotas.
O ACK oferece suporte a upgrades automáticos de cluster.
Clusters que executam Kubernetes 1.24 ou posterior não oferecem mais suporte ao Docker como runtime de contêiner. Migre para containerd. Para obter mais informações, consulte Migrar do Docker para o containerd.
À medida que a carga do cluster aumenta, ative uma solução de dimensionamento elástico para ajustar dinamicamente os recursos de nó. Para obter mais informações, consulte Auto Scaling.
Para especificar o node pool para pods de aplicação, consulte Agendar pods para um node pool específico.
O ACK managed cluster Basic Edition suporta no máximo 10 nós. Recomendamos realizar uma migração a quente para o ACK managed cluster Pro Edition para obter uma cota de recursos maior. Para obter mais informações, consulte Migrar a quente um cluster gerenciado ACK da Basic Edition para a Pro Edition.
Se encontrar problemas ao usar nós ou node pools, consulte FAQ sobre nós e node pools para solução de problemas.
O ACK fornece uma solução de gerenciamento de custos de cluster. Para obter mais informações, consulte Suíte de gerenciamento de custos.
Para práticas recomendadas relacionadas a node pools, consulte Práticas recomendadas para nós e node pools.