Un node pool est un groupe logique de nœuds partageant les mêmes propriétés. Les node pools permettent une gestion et des opérations de maintenance (O&M) unifiées des nœuds, telles que les mises à niveau et la mise à l'échelle élastique. ACK propose également diverses capacités d'O&M automatisées pour les node pools, comme la correction automatique des vulnérabilités CVE du système d'exploitation et la récupération automatique des nœuds défaillants, afin de réduire les coûts d'exploitation et de maintenance.
Introduction aux node pools
Un node pool est un modèle de configuration. Les nœuds ajoutés lors d'une mise à l'échelle dans un node pool adoptent sa configuration. Vous pouvez créer plusieurs node pools avec des configurations et des types différents au sein d'un cluster. La configuration d'un node pool inclut les propriétés des nœuds, telles que les types d'instance, les méthodes de facturation, les zones (vSwitches), images du système d'exploitation, les architectures CPU, les libellés et les taints. Spécifiez ces propriétés lorsque vous créez un node pool ou modifiez-les après sa création.
Les clusters plus anciens créés avant l'introduction de la fonctionnalité de node pool peuvent contenir des nœuds de travail non gérés. Nous vous recommandons d'ajouter ces nœuds à un node pool pour faciliter leur gestion. Pour plus d'informations, consultez Migration des nœuds non gérés vers un node pool .
Utilisez un seul node pool pour réduire la complexité de la gestion et de la configuration. Utilisez également plusieurs node pools pour mettre en œuvre une isolation fine des ressources et gérer un déploiement hybride de différents types de nœuds.
Node pool unique | Plusieurs node pools |
Gérez les ressources de calcul pour plusieurs équipes ou charges de travail via un seul node pool afin de simplifier les opérations et la maintenance. Un node pool unique prend en charge les fonctionnalités suivantes.
Le mélange d'instances ayant des systèmes d'exploitation et des architectures CPU (Arm et x86) différents n'est pas pris en charge. | Créez plusieurs node pools pour fournir des ressources de calcul indépendantes à différentes charges de travail ou équipes. Cela permet d'éviter la contention des ressources et les risques potentiels pour la sécurité. Cette approche convient aux scénarios suivants.
|
Lorsque vous utilisez plusieurs node pools, définissez la priorité de chacun grâce à des politiques de planification afin d'optimiser la gestion des ressources et des coûts. Par exemple :
Contrôlez la priorité de provisionnement des ressources de calcul ayant des coûts différents, comme les instances Spot et les instances par abonnement, pour réduire les coûts globaux.
Allouez différents types d'instance en fonction des exigences des charges de travail, comme le ratio requis entre les architectures x86 et Arm.
Fonctionnalités des node pools
ACK propose diverses capacités de gestion des nœuds au niveau du node pool. Pour réduire la charge d'O&M des nœuds de travail et vous concentrer davantage sur le développement d'applications, activez la fonctionnalité de node pool géré pour bénéficier de capacités d'O&M automatisées.
Fonctionnalités de base
Fonctionnalité | Description | Références |
Création, modification, suppression et consultation |
| |
Mise à l'échelle manuelle ou automatique |
| |
Ajout de nœuds existants | Utilisez la fonctionnalité Ajouter des nœuds existants pour ajouter une instance ECS achetée à un cluster ACK en tant que nœud de travail, ou pour réintégrer un nœud de travail dans un node pool après sa suppression. Cette fonctionnalité présente certaines limites et considérations importantes. Pour plus d'informations, consultez le document de référence. | |
Suppression de nœuds | Si certains nœuds ne sont plus nécessaires, supprimez-les du cluster ou du node pool. Suivez les procédures standard pour éviter tout comportement inattendu. | |
Mise à niveau de la version kubelet | Mettez à niveau les versions de kubelet et de containerd des nœuds d'un node pool. Vous pouvez également utiliser la fonctionnalité de mise à niveau automatique du cluster pour mettre à jour automatiquement kubelet et le runtime de conteneur. | |
Changement du système d'exploitation | Mettez à niveau la version du système d'exploitation ou changez son type. Par exemple, passez d'un système d'exploitation en fin de vie (EOL) à ContainerOS ou Alibaba Cloud Linux. | Changement du système d'exploitation des nœuds d'un node pool |
Correction des vulnérabilités CVE | Analysez manuellement les vulnérabilités CVE et corrigez les failles de sécurité du système d'exploitation des nœuds. Certaines corrections de vulnérabilités CVE nécessitent un redémarrage du nœud. Pour plus d'informations sur cette fonctionnalité et ses implications, consultez le document de référence. Vous pouvez également activer les capacités d'O&M automatisées afin qu'ACK corrige automatiquement les vulnérabilités CVE du système d'exploitation. | Correction manuelle des vulnérabilités CVE du système d'exploitation |
Personnalisation des paramètres kubelet pour un node pool | Personnalisez les paramètres kubelet des nœuds au niveau du node pool pour ajuster leur comportement. Par exemple, ajustez les réservations de ressources du cluster pour gérer l'allocation des ressources. | Personnalisation des configurations kubelet pour un node pool |
Personnalisation des paramètres du système d'exploitation pour un node pool | Personnalisez les paramètres du système d'exploitation des nœuds au niveau du node pool pour optimiser les performances du système. | Gestion des paramètres du système d'exploitation pour un node pool |
Analyses des coûts | Analysez l'utilisation des ressources et la répartition des coûts au niveau du node pool pour optimiser les dépenses et améliorer l'utilisation des ressources du cluster. |
Capacités d'O&M automatisées
L'activation des capacités d'O&M automatisées pour un node pool réduit la charge de travail liée à la maintenance des nœuds de travail. Cela permet à ACK d'exécuter automatiquement certaines opérations d'O&M, telles que la correction automatique des vulnérabilités CVE du système d'exploitation (OS), les mises à niveau automatiques de kubelet et la récupération automatique des pannes de nœuds. Toutefois, cette approche n'est pas recommandée si vos services sont sensibles aux modifications des nœuds sous-jacents et ne tolèrent pas les redémarrages de nœuds ou les migrations de pods d'application.
Prérequis
-
Assurez-vous que le système d'exploitation est Alibaba Cloud Linux 3 Container-Optimized Edition, ContainerOS, Alibaba Cloud Linux, Red Hat ou Ubuntu.
Pour plus d'informations sur les images de système d'exploitation prises en charge par les clusters ACK et leurs limitations, consultez Systèmes d'exploitation.
-
Avant d'utiliser les capacités d'O&M automatisées d'un node pool, effectuez les opérations suivantes sur la page Node Pool de la Console de gestion Container Service. Vous pouvez modifier ces configurations à tout moment.
Pour plus d'informations sur la création et la modification d'un node pool, consultez Création et gestion d'un node pool .
Présentation des fonctionnalités
Fonctionnalité | Description |
Réparation automatique des nœuds | ACK surveille automatiquement l'état des nœuds et effectue des tâches de réparation automatique lorsqu'un nœud devient anormal. Cela permet de résoudre les problèmes liés au système, aux composants K8s et aux instances de nœuds. Pour plus d'informations, consultez Activation de la réparation automatique des nœuds. |
Correction automatique des vulnérabilités CVE du système d'exploitation | ACK analyse les vulnérabilités de sécurité sur les nœuds, planifie et exécute un plan de correction des vulnérabilités CVE en fonction de la fenêtre d'O&M du cluster. Cela améliore la stabilité, la sécurité et la conformité du cluster. Pour plus d'informations sur les remarques, consultez Correction des vulnérabilités CVE du système d'exploitation pour un node pool. |
Réponse automatique aux événements système ECS | Prend en charge la réponse automatique aux événements système ECS. Les types d'événements système suivants sont actuellement pris en charge.
|
À partir du 31 janvier 2026, les entrées de configuration pour les mises à niveau automatiques de kubelet et des runtimes de conteneurs dans les node pools gérés seront supprimées. Configurez les mises à niveau automatiques du cluster pour mettre à niveau automatiquement les node pools. Pour plus d'informations, consultez Modification du produit | Annonce concernant les changements relatifs à la correction des vulnérabilités de sécurité et aux mises à niveau automatiques pour les node pools gérés .
Cycle de vie des node pools
Le cycle de vie d'un node pool de cluster ACK comprend plusieurs étapes et états, de la création et du déploiement à l'exécution et à la maintenance (y compris la mise à l'échelle, la mise à jour et la suppression de nœuds), jusqu'à la suppression finale. La section suivante décrit les différents états et leurs transitions.
État du node pool | Description |
Initialisation (initial) | Le node pool est en cours de création. |
Actif (active) | Le node pool a été créé avec succès et est en cours d'exécution. |
Échec (failed) | La création du node pool a échoué. |
Mise à l'échelle (scaling) | Le node pool est en cours de mise à l'échelle horizontale ou d'ajout de nœuds. |
Mise à jour (updating) | La configuration du node pool est en cours de mise à jour. |
Suppression de nœuds (removing_nodes) | Des nœuds sont en cours de suppression du node pool. |
Mise à niveau (upgrading) | Le node pool est en cours de mise à niveau. |
Réparation (repairing) | Le node pool est en cours de réparation, par exemple réparation de nœuds ou correction de vulnérabilités CVE dans le node pool. |
Suppression (deleting) | Le node pool est en cours de suppression. |
Supprimé (deleted, cet état n'est pas visible pour vous) | Le node pool a été supprimé avec succès. |
Échec de la suppression (deleted_failed) | La suppression du node pool a échoué. Essayez de le supprimer à nouveau. Si la suppression échoue toujours, soumettez un ticket. |
Facturation des node pools
L'utilisation des node pools et de leurs capacités d'O&M automatisées est gratuite. Cependant, vous êtes facturé pour les ressources cloud au sein du node pool, telles que les instances ECS, par les services cloud correspondants.
-
Pour plus d'informations sur la facturation des instances ECS, consultez Présentation de la facturation.
Pour modifier la méthode de facturation des nœuds existants dans un node pool, consultez Modification de la méthode de facturation d'une instance de paiement à l'utilisation vers abonnement. La modification de la méthode de facturation d'un node pool affecte uniquement les nouveaux nœuds ajoutés lors d'une mise à l'échelle. Elle ne modifie pas la méthode de facturation des nœuds existants dans le node pool.
Pour plus d'informations sur la facturation des groupes de mise à l'échelle, consultez Facturation Auto Scaling.
Glossaire
Avant d'utiliser les node pools, familiarisez-vous avec les concepts et termes suivants.
Groupe de mise à l'échelle : Lorsque vous mettez à l'échelle un node pool, ACK effectue les opérations de mise à l'échelle et de suppression de nœuds à l'aide du service Auto Scaling (ESS). Chaque node pool entretient une relation un-à-un avec un groupe de mise à l'échelle Auto Scaling. Un groupe de mise à l'échelle est une collection d'une ou plusieurs instances ECS (nœuds de travail).
Configuration de mise à l'échelle : Un node pool utilise une configuration de mise à l'échelle pour gérer les configurations des nœuds. Une configuration de mise à l'échelle est un modèle utilisé pour créer des instances ECS lors d'une mise à l'échelle élastique. Lorsqu'une activité de mise à l'échelle est déclenchée, Auto Scaling utilise la configuration de mise à l'échelle spécifiée pour créer automatiquement des instances ECS.
Activité de mise à l'échelle : Chaque réduction, augmentation, ajout ou suppression de nœud dans un node pool déclenche une activité de mise à l'échelle. Une fois l'activité déclenchée, toutes les actions de mise à l'échelle sont effectuées automatiquement par le système et les enregistrements pertinents sont sauvegardés. Consultez l'historique des activités de mise à l'échelle d'un node pool.
-
Remplacement du disque système : Certaines opérations dans un node pool, telles que l'ajout automatique de nœuds existants et le changement du runtime de conteneur, initialisent le nœud en remplaçant son disque système. Les propriétés de l'instance du nœud, telles que le nom du nœud, l'ID d'instance et l'adresse IP, ne changent pas, mais les données sur le disque système du nœud sont supprimées. Les disques de données attachés au nœud ne sont pas affectés.
Lorsqu'ACK remplace un disque système, il vide le nœud. Ce processus expulse les pods du nœud vers d'autres nœuds disponibles et respecte le Pod Disruption Budget (PDB). Pour garantir une haute disponibilité des services, nous vous recommandons d'utiliser un déploiement multi-réplicas pour distribuer les charges de travail sur plusieurs nœuds et de configurer des PDB pour les services critiques. Cela permet de contrôler le nombre de pods pouvant être perturbés simultanément.
Mise à niveau sur place : Méthode de mise à niveau alternative au remplacement du disque système. Cette méthode met directement à jour et remplace les composants requis sur le nœud. Une mise à niveau sur place ne remplace pas le disque système ni ne réinitialise le nœud, et les données du nœud ne sont pas affectées.
Références
Pour plus d'informations sur les limites de capacité des ressources Kubernetes prises en charge par un cluster, telles que le nombre maximal de nœuds et de pods, consultez Quotas.
ACK prend en charge les mises à niveau automatiques du cluster.
Les clusters exécutant Kubernetes 1.24 ou une version ultérieure ne prennent plus en charge Docker comme runtime de conteneur. Migrez vers containerd. Pour plus d'informations, consultez Migration de Docker vers containerd.
À mesure que la charge du cluster augmente, activez une solution de mise à l'échelle élastique pour ajuster dynamiquement les ressources des nœuds. Pour plus d'informations, consultez Auto Scaling.
Pour spécifier le node pool pour les pods d'application, consultez Planification des pods vers un node pool spécifique.
ACK managed cluster Basic Edition prend en charge un maximum de 10 nœuds. Nous vous recommandons d'effectuer une migration à chaud vers ACK managed cluster Pro Edition pour obtenir un quota de ressources plus élevé. Pour plus d'informations, consultez Migration à chaud d'un ACK managed cluster Basic Edition vers Pro Edition.
Si vous rencontrez des problèmes lors de l'utilisation des nœuds ou des node pools, consultez la FAQ sur les nœuds et les node pools pour le dépannage.
ACK propose une solution de gestion des coûts du cluster. Pour plus d'informations, consultez la Suite de gestion des coûts.
Pour les bonnes pratiques relatives aux node pools, consultez les Bonnes pratiques pour les nœuds et les node pools.