Tous les produits
Search
Centre de documentation

Container Service for Kubernetes:Overview of node pools

Dernière mise à jour :Aug 29, 2026

Un node pool est un groupe logique de nœuds partageant les mêmes propriétés. Les node pools permettent une gestion et des opérations de maintenance (O&M) unifiées des nœuds, telles que les mises à niveau et la mise à l'échelle élastique. ACK propose également diverses capacités d'O&M automatisées pour les node pools, comme la correction automatique des vulnérabilités CVE du système d'exploitation et la récupération automatique des nœuds défaillants, afin de réduire les coûts d'exploitation et de maintenance.

Introduction aux node pools

Un node pool est un modèle de configuration. Les nœuds ajoutés lors d'une mise à l'échelle dans un node pool adoptent sa configuration. Vous pouvez créer plusieurs node pools avec des configurations et des types différents au sein d'un cluster. La configuration d'un node pool inclut les propriétés des nœuds, telles que les types d'instance, les méthodes de facturation, les zones (vSwitches), images du système d'exploitation, les architectures CPU, les libellés et les taints. Spécifiez ces propriétés lorsque vous créez un node pool ou modifiez-les après sa création.

Les clusters plus anciens créés avant l'introduction de la fonctionnalité de node pool peuvent contenir des nœuds de travail non gérés. Nous vous recommandons d'ajouter ces nœuds à un node pool pour faciliter leur gestion. Pour plus d'informations, consultez Migration des nœuds non gérés vers un node pool .

Utilisez un seul node pool pour réduire la complexité de la gestion et de la configuration. Utilisez également plusieurs node pools pour mettre en œuvre une isolation fine des ressources et gérer un déploiement hybride de différents types de nœuds.

Node pool unique

Plusieurs node pools

Gérez les ressources de calcul pour plusieurs équipes ou charges de travail via un seul node pool afin de simplifier les opérations et la maintenance. Un node pool unique prend en charge les fonctionnalités suivantes.

  • Gestion des ressources de calcul pour plusieurs équipes.

  • Configuration de plusieurs types d'instance, tels que les instances ECS standard, les instances accélérées par GPU, les instances ECS Bare Metal et les instances optimisées pour le calcul haute performance (HPC), afin de répondre aux besoins des différentes charges de travail.

  • Répartition des nœuds sur plusieurs zones pour améliorer la haute disponibilité.

Le mélange d'instances ayant des systèmes d'exploitation et des architectures CPU (Arm et x86) différents n'est pas pris en charge.

Créez plusieurs node pools pour fournir des ressources de calcul indépendantes à différentes charges de travail ou équipes. Cela permet d'éviter la contention des ressources et les risques potentiels pour la sécurité. Cette approche convient aux scénarios suivants.

  • Isolation des locataires et fourniture de ressources de calcul indépendantes pour différentes équipes. Cela simplifie également la gestion de la facturation.

  • Isolation des machines avec des spécifications matérielles différentes, telles que l'architecture CPU, le GPU et le FPGA, pour garantir une allocation rationnelle des ressources matérielles.

  • Renforcement de l'isolation de sécurité pour les applications sensibles.

  • Déploiement de différents systèmes d'exploitation.

Lorsque vous utilisez plusieurs node pools, définissez la priorité de chacun grâce à des politiques de planification afin d'optimiser la gestion des ressources et des coûts. Par exemple :

  • Contrôlez la priorité de provisionnement des ressources de calcul ayant des coûts différents, comme les instances Spot et les instances par abonnement, pour réduire les coûts globaux.

  • Allouez différents types d'instance en fonction des exigences des charges de travail, comme le ratio requis entre les architectures x86 et Arm.

Fonctionnalités des node pools

ACK propose diverses capacités de gestion des nœuds au niveau du node pool. Pour réduire la charge d'O&M des nœuds de travail et vous concentrer davantage sur le développement d'applications, activez la fonctionnalité de node pool géré pour bénéficier de capacités d'O&M automatisées.

Fonctionnalités de base

Fonctionnalité

Description

Références

Création, modification, suppression et consultation

  • Créez des node pools dans la console et configurez les informations de base, les paramètres réseau, les spécifications d'instance, les configurations de stockage et le nombre souhaité de nœuds.

  • Ajustez les configurations des node pools existants. Pour plus d'informations sur les éléments configurables et les considérations importantes, consultez le document de référence.

  • Supprimez les node pools lorsqu'ils ne sont plus nécessaires. Le comportement de libération des nœuds dépend de l'activation du nombre souhaité de nœuds pour le node pool et de la méthode de facturation des nœuds.

  • Consultez les détails d'un node pool, y compris les informations de configuration de base, les tableaux de bord de surveillance des ressources, les listes de nœuds et les activités de mise à l'échelle.

Création et gestion d'un node pool

Mise à l'échelle manuelle ou automatique

  • Ajustez manuellement le nombre souhaité de nœuds dans un node pool pour effectuer une mise à l'échelle horizontale (scale-in/scale-out). Cela permet de maintenir le nombre de nœuds au niveau désiré et de réaliser des économies sur les coûts des ressources.

    Certaines opérations de suppression, de modification et de libération non standard peuvent empêcher la mise à l'échelle du node pool comme prévu. Pour plus d'informations, consultez le document de référence.

  • Configurez une solution de mise à l'échelle automatique des nœuds pour ajuster automatiquement les ressources des nœuds lorsque la capacité du cluster ne peut pas satisfaire les exigences de planification des pods d'application.

Ajout de nœuds existants

Utilisez la fonctionnalité Ajouter des nœuds existants pour ajouter une instance ECS achetée à un cluster ACK en tant que nœud de travail, ou pour réintégrer un nœud de travail dans un node pool après sa suppression. Cette fonctionnalité présente certaines limites et considérations importantes. Pour plus d'informations, consultez le document de référence.

Ajout de nœuds existants

Suppression de nœuds

Si certains nœuds ne sont plus nécessaires, supprimez-les du cluster ou du node pool. Suivez les procédures standard pour éviter tout comportement inattendu.

Suppression de nœuds

Mise à niveau de la version kubelet

Mettez à niveau les versions de kubelet et de containerd des nœuds d'un node pool.

Vous pouvez également utiliser la fonctionnalité de mise à niveau automatique du cluster pour mettre à jour automatiquement kubelet et le runtime de conteneur.

Mise à niveau d'un node pool

Changement du système d'exploitation

Mettez à niveau la version du système d'exploitation ou changez son type. Par exemple, passez d'un système d'exploitation en fin de vie (EOL) à ContainerOS ou Alibaba Cloud Linux.

Changement du système d'exploitation des nœuds d'un node pool

Correction des vulnérabilités CVE

Analysez manuellement les vulnérabilités CVE et corrigez les failles de sécurité du système d'exploitation des nœuds. Certaines corrections de vulnérabilités CVE nécessitent un redémarrage du nœud. Pour plus d'informations sur cette fonctionnalité et ses implications, consultez le document de référence.

Vous pouvez également activer les capacités d'O&M automatisées afin qu'ACK corrige automatiquement les vulnérabilités CVE du système d'exploitation.

Correction manuelle des vulnérabilités CVE du système d'exploitation

Personnalisation des paramètres kubelet pour un node pool

Personnalisez les paramètres kubelet des nœuds au niveau du node pool pour ajuster leur comportement. Par exemple, ajustez les réservations de ressources du cluster pour gérer l'allocation des ressources.

Personnalisation des configurations kubelet pour un node pool

Personnalisation des paramètres du système d'exploitation pour un node pool

Personnalisez les paramètres du système d'exploitation des nœuds au niveau du node pool pour optimiser les performances du système.

Gestion des paramètres du système d'exploitation pour un node pool

Analyses des coûts

Analysez l'utilisation des ressources et la répartition des coûts au niveau du node pool pour optimiser les dépenses et améliorer l'utilisation des ressources du cluster.

Analyses des coûts

Capacités d'O&M automatisées

L'activation des capacités d'O&M automatisées pour un node pool réduit la charge de travail liée à la maintenance des nœuds de travail. Cela permet à ACK d'exécuter automatiquement certaines opérations d'O&M, telles que la correction automatique des vulnérabilités CVE du système d'exploitation (OS), les mises à niveau automatiques de kubelet et la récupération automatique des pannes de nœuds. Toutefois, cette approche n'est pas recommandée si vos services sont sensibles aux modifications des nœuds sous-jacents et ne tolèrent pas les redémarrages de nœuds ou les migrations de pods d'application.

Prérequis

  • Assurez-vous que le système d'exploitation est Alibaba Cloud Linux 3 Container-Optimized Edition, ContainerOS, Alibaba Cloud Linux, Red Hat ou Ubuntu.

    Pour plus d'informations sur les images de système d'exploitation prises en charge par les clusters ACK et leurs limitations, consultez Systèmes d'exploitation.

  • Avant d'utiliser les capacités d'O&M automatisées d'un node pool, effectuez les opérations suivantes sur la page Node Pool de la Console de gestion Container Service. Vous pouvez modifier ces configurations à tout moment.

    Pour plus d'informations sur la création et la modification d'un node pool, consultez Création et gestion d'un node pool .

    Développer pour afficher la procédure

    • Activez la fonctionnalité gérée pour le node pool.

      • Nouveau node pool : Sélectionnez Managed Node Pool.

      • Node pool existant : Dans la colonne Actions du node pool souhaité, choisissez More > Enable Managed Feature.

    • Activez les capacités d'O&M automatisées requises pour le node pool.

      Cela inclut l'activation de la réparation automatique des nœuds, des mises à niveau automatiques de kubelet, du runtime et des versions du système d'exploitation, ainsi que de la correction automatique des vulnérabilités CVE du système d'exploitation.

    • Configurez une fenêtre de maintenance pour le cluster.

      Les capacités d'O&M automatisées d'un node pool nécessitent une fenêtre de maintenance du cluster. Le node pool exécute les tâches d'O&M automatisées durant cette fenêtre.

      • Nouveau node pool : Configurez la Cluster Maintenance Window pour le Managed Node Pool lors de la création.

      • Node pool existant : Dans la liste des node pools, repérez le node pool géré et, dans la colonne Actions , choisissez More > Managed Configurations pour configurer la fenêtre de maintenance.

Présentation des fonctionnalités

Fonctionnalité

Description

Réparation automatique des nœuds

ACK surveille automatiquement l'état des nœuds et effectue des tâches de réparation automatique lorsqu'un nœud devient anormal. Cela permet de résoudre les problèmes liés au système, aux composants K8s et aux instances de nœuds. Pour plus d'informations, consultez Activation de la réparation automatique des nœuds.

Correction automatique des vulnérabilités CVE du système d'exploitation

ACK analyse les vulnérabilités de sécurité sur les nœuds, planifie et exécute un plan de correction des vulnérabilités CVE en fonction de la fenêtre d'O&M du cluster. Cela améliore la stabilité, la sécurité et la conformité du cluster. Pour plus d'informations sur les remarques, consultez Correction des vulnérabilités CVE du système d'exploitation pour un node pool.

Réponse automatique aux événements système ECS

Prend en charge la réponse automatique aux événements système ECS. Les types d'événements système suivants sont actuellement pris en charge.

  • Redémarrage de l'instance dû à la maintenance du système (SystemMaintenance.Reboot)

    Processus de réponse automatique

    1. Après réception de l'événement, ACK envoie une notification par SMS ou message interne. Suivez rapidement les instructions des notifications.

    2. Avant d'effectuer l'opération, ACK prend des dispositions en fonction de l'heure d'exécution planifiée d'ECS :

      • Si le node pool dispose d'une fenêtre de maintenance disponible avant l'heure d'exécution planifiée, ACK exécutera le processus de réponse automatique durant cette fenêtre.

      • Sinon, ACK exécutera le processus une heure avant l'heure d'exécution planifiée d'ECS.

    3. Une fois le processus démarré, ACK effectue une vidange du nœud sur l'instance ECS concernée. Il tente de migrer les pods du nœud vers d'autres nœuds disponibles, puis redémarre l'instance ECS.

    Règles de vidange des nœuds

    Lors de la vidange d'un nœud, ACK expulse d'abord tous les pods du nœud qui peuvent être vidangés en toute sécurité. Pour les pods qui ne peuvent pas être vidangés en toute sécurité, un message d'erreur est renvoyé et le processus de réponse automatique est interrompu.

    Les pods dans les situations suivantes sont considérés comme non sûrs à vidanger :

    • Le pod possède l'annotation goatscaler.io/safe-to-evict=false.

    • Le pod n'est pas géré par un contrôleur (c'est-à-dire un pod autonome sans OwnerReference).

    • Le pod utilise un volume de type emptyDir.

    Étant donné que l'opération de vidange expulse les pods du nœud, pour éviter que la maintenance des nœuds n'affecte la disponibilité globale de vos services, nous vous recommandons vivement de :

    • Veiller à ce que le backend de l'application de service soit déployé avec plusieurs réplicas sur différents nœuds.

    • Configurer un PodDisruptionBudget (PDB) pour les applications importantes afin d'éviter d'affecter la disponibilité globale du service après l'expulsion des pods du nœud.

À partir du 31 janvier 2026, les entrées de configuration pour les mises à niveau automatiques de kubelet et des runtimes de conteneurs dans les node pools gérés seront supprimées. Configurez les mises à niveau automatiques du cluster pour mettre à niveau automatiquement les node pools. Pour plus d'informations, consultez Modification du produit | Annonce concernant les changements relatifs à la correction des vulnérabilités de sécurité et aux mises à niveau automatiques pour les node pools gérés .

Cycle de vie des node pools

Le cycle de vie d'un node pool de cluster ACK comprend plusieurs étapes et états, de la création et du déploiement à l'exécution et à la maintenance (y compris la mise à l'échelle, la mise à jour et la suppression de nœuds), jusqu'à la suppression finale. La section suivante décrit les différents états et leurs transitions.

image

État du node pool

Description

Initialisation (initial)

Le node pool est en cours de création.

Actif (active)

Le node pool a été créé avec succès et est en cours d'exécution.

Échec (failed)

La création du node pool a échoué.

Mise à l'échelle (scaling)

Le node pool est en cours de mise à l'échelle horizontale ou d'ajout de nœuds.

Mise à jour (updating)

La configuration du node pool est en cours de mise à jour.

Suppression de nœuds (removing_nodes)

Des nœuds sont en cours de suppression du node pool.

Mise à niveau (upgrading)

Le node pool est en cours de mise à niveau.

Réparation (repairing)

Le node pool est en cours de réparation, par exemple réparation de nœuds ou correction de vulnérabilités CVE dans le node pool.

Suppression (deleting)

Le node pool est en cours de suppression.

Supprimé (deleted, cet état n'est pas visible pour vous)

Le node pool a été supprimé avec succès.

Échec de la suppression (deleted_failed)

La suppression du node pool a échoué. Essayez de le supprimer à nouveau.

Si la suppression échoue toujours, soumettez un ticket.

Facturation des node pools

L'utilisation des node pools et de leurs capacités d'O&M automatisées est gratuite. Cependant, vous êtes facturé pour les ressources cloud au sein du node pool, telles que les instances ECS, par les services cloud correspondants.

Glossaire

Avant d'utiliser les node pools, familiarisez-vous avec les concepts et termes suivants.

  • Groupe de mise à l'échelle : Lorsque vous mettez à l'échelle un node pool, ACK effectue les opérations de mise à l'échelle et de suppression de nœuds à l'aide du service Auto Scaling (ESS). Chaque node pool entretient une relation un-à-un avec un groupe de mise à l'échelle Auto Scaling. Un groupe de mise à l'échelle est une collection d'une ou plusieurs instances ECS (nœuds de travail).

  • Configuration de mise à l'échelle : Un node pool utilise une configuration de mise à l'échelle pour gérer les configurations des nœuds. Une configuration de mise à l'échelle est un modèle utilisé pour créer des instances ECS lors d'une mise à l'échelle élastique. Lorsqu'une activité de mise à l'échelle est déclenchée, Auto Scaling utilise la configuration de mise à l'échelle spécifiée pour créer automatiquement des instances ECS.

  • Activité de mise à l'échelle : Chaque réduction, augmentation, ajout ou suppression de nœud dans un node pool déclenche une activité de mise à l'échelle. Une fois l'activité déclenchée, toutes les actions de mise à l'échelle sont effectuées automatiquement par le système et les enregistrements pertinents sont sauvegardés. Consultez l'historique des activités de mise à l'échelle d'un node pool.

  • Remplacement du disque système : Certaines opérations dans un node pool, telles que l'ajout automatique de nœuds existants et le changement du runtime de conteneur, initialisent le nœud en remplaçant son disque système. Les propriétés de l'instance du nœud, telles que le nom du nœud, l'ID d'instance et l'adresse IP, ne changent pas, mais les données sur le disque système du nœud sont supprimées. Les disques de données attachés au nœud ne sont pas affectés.

    Lorsqu'ACK remplace un disque système, il vide le nœud. Ce processus expulse les pods du nœud vers d'autres nœuds disponibles et respecte le Pod Disruption Budget (PDB). Pour garantir une haute disponibilité des services, nous vous recommandons d'utiliser un déploiement multi-réplicas pour distribuer les charges de travail sur plusieurs nœuds et de configurer des PDB pour les services critiques. Cela permet de contrôler le nombre de pods pouvant être perturbés simultanément.

  • Mise à niveau sur place : Méthode de mise à niveau alternative au remplacement du disque système. Cette méthode met directement à jour et remplace les composants requis sur le nœud. Une mise à niveau sur place ne remplace pas le disque système ni ne réinitialise le nœud, et les données du nœud ne sont pas affectées.

Références