Tous les produits
Search
Centre de documentation

Container Service for Kubernetes:Troubleshoot ACK storage issues

Dernière mise à jour :Aug 11, 2026

Résolvez les échecs de démarrage des pods et les problèmes de liaison des PVC pour les volumes de disque, NAS et OSS dans les clusters ACK.

Procédure de diagnostic

workflow

Effectuez ces vérifications avant de dépanner par type de stockage.

Étape 1 : Confirmez que l'échec est lié au stockage.

Exécutez kubectl describe pods <pod-name> et inspectez la section Events.

Si le pod affiche l'état ci-dessous, le volume a été monté avec succès. Les codes de sortie CrashLoopBackOff ou similaires à ce stade indiquent une erreur d'application, et non un problème de stockage.

pod

Étape 2 : Vérifiez que le plug-in CSI est en cours d'exécution.

kubectl get pod -n kube-system | grep csi

Sortie attendue :

NAME                       READY   STATUS    RESTARTS   AGE
csi-plugin-***             4/4     Running   0          23d
csi-provisioner-***        7/7     Running   0          14d

Si l'un des pods n'est pas dans l'état Running, exécutez kubectl describe pods <pod-name> -n kube-system pour vérifier la raison de l'arrêt et les événements.

Étape 3 : Vérifiez que le plug-in CSI est à jour.

kubectl get ds csi-plugin -n kube-system -oyaml | grep image

Sortie attendue :

image: registry.cn-****.aliyuncs.com/acs/csi-plugin:v*****-aliyun

Comparez le tag de l'image avec l'historique des versions de csi-plugin et l'historique des versions de csi-provisioner.

Si la version est obsolète, mettez à niveau le plug-in CSI. En cas d'échec de la mise à niveau, consultez Dépannage des échecs de mise à jour des composants.

Étape 4 : Dépannez les problèmes de pods en attente.

Étape 5 : Dépannez les problèmes de PVC non liés.

Dépannage des échecs de mise à jour des composants

csi-provisioner

csi-provisioner est un Deployment à 2 réplicas avec anti-affinité de pod entre les nœuds.

  • Si la mise à niveau échoue, vérifiez que le cluster dispose d'au moins deux nœuds planifiables (requis pour 2 réplicas).

  • Les versions 1.14 et antérieures de csi-provisioner utilisaient un StatefulSet. Si un StatefulSet nommé csi-provisioner existe toujours, supprimez-le et réinstallez-le :

    kubectl delete sts csi-provisioner

    Connectez-vous ensuite à la console Container Service et réinstallez csi-provisioner depuis Add-ons. Consultez Gestion des composants.

csi-plugin

csi-plugin est un DaemonSet déployé sur chaque nœud.

  • Vérifiez la présence de nœuds NotReady, qui bloquent les mises à niveau du DaemonSet.

  • Si la mise à niveau échoue mais que tous les plug-ins fonctionnent normalement, le centre de composants a peut-être expiré et effectué un rollback.

Dépannage des disques

Important

Le nœud et le disque doivent se trouver dans la même région et la même zone. Différents types d'instance ECS prennent en charge différents types de disque — consultez Familles d'instances.

Pod non en cours d'exécution (disque)

Symptôme

L'état du PVC est Bound, mais le pod n'est pas en cours d'exécution.

Causes possibles et résolution

Symptôme dans les événements de kubectl describe pods <pod-name>

Cause

Résolution

0/N nodes are available: N node(s) didn't match Pod's node affinity/selector

Aucun nœud planifiable où le disque est disponible

Planifiez le pod sur un nœud où le disque est disponible. Consultez Planification des applications sur des nœuds spécifiés.

MountVolume.SetUp failed for volume "..."

Erreur de montage du disque

Vérifiez les événements du pod pour l'erreur spécifique. Pour les erreurs de montage, consultez FAQ sur les volumes de disque. Pour les erreurs de démontage, consultez FAQ sur les volumes de disque.

InvalidDiskCategory.NotSupported ou erreur API ECS similaire

L'instance ECS ne prend pas en charge le type de disque

Utilisez un type de disque pris en charge par votre instance ECS. Consultez Familles d'instances. Pour les erreurs API ECS, consultez Codes d'erreur ECS.

PVC non lié (disque)

Symptôme

Le PVC et le pod ne sont pas en cours d'exécution.

Localisation de la panne

Exécutez kubectl describe pvc <pvc-name> -n <namespace> et inspectez les événements pour déterminer s'il s'agit d'un problème de provisionnement statique ou dynamique.

Provisionnement statique

Les sélecteurs du PVC et du PV ne correspondent pas. Incompatibilités courantes :

  • Le sélecteur du PVC diffère de celui du PV.

  • Ils font référence à des noms de StorageClass différents.

  • L'état du PV est Released.

Vérifiez la configuration YAML du PVC et du PV. Consultez Utilisation de volumes de disque statiques.

Un PV Released fait toujours référence à sa claim précédente et ne peut pas être relié. Créez un nouveau PV pour lier le disque à un nouveau PVC.

Provisionnement dynamique

csi-provisioner n'a pas réussi à créer le disque. Vérifiez les événements du PVC pour l'erreur :

Type d'erreur

Référence

Erreurs de création de disque

FAQ sur les volumes de disque

Erreurs d'extension de disque

FAQ sur les volumes de disque

Erreurs API ECS lors de la création du disque

Centre d'erreurs ECS

Dépannage NAS

Important
  • Le nœud et la cible de montage NAS doivent se trouver dans le même Virtual Private Cloud (VPC). S'ils se trouvent dans des VPC différents, connectez-les via Cloud Enterprise Network (CEN).

  • Le montage inter-zones est pris en charge au sein du même VPC.

  • Le répertoire de montage pour Extreme NAS et CPFS 2.0 doit commencer par /share.

Pod non en cours d'exécution (NAS)

Symptôme

L'état du PVC est Bound, mais le pod n'est pas en cours d'exécution.

Causes possibles et résolution

Symptôme dans les événements de kubectl describe pods <pod-name>

Cause

Localisation de la panne

Résolution

Le pod reste longtemps dans l'état Init ; aucun message d'erreur explicite

securityContext.fsGroup est défini et le volume contient de nombreux fichiers, ce qui ralentit l'exécution de chmod

Vérifiez si securityContext.fsGroup est défini dans la spécification du pod

Supprimez fsGroup de la spécification du pod, supprimez le pod et laissez-le redémarrer pour remonter le volume

MountVolume.SetUp failed for volume "..." avec un délai d'attente réseau

Le port 2049 (NFS) est bloqué dans le groupe de sécurité

Vérifiez les règles du groupe de sécurité pour le nœud

Ajoutez une règle entrante pour le port TCP 2049. Consultez Ajout de règles de groupe de sécurité.

Cible de montage inaccessible ; délai d'attente de connexion dans les événements

Nœud et NAS dans des VPC différents

Vérifiez si le VPC du nœud et le VPC de la cible de montage NAS correspondent

Déplacez la cible de montage NAS vers le même VPC que le nœud, ou utilisez CEN pour connecter les deux VPC

Autres événements

Autres erreurs

Vérifiez les événements du pod avec kubectl describe pods <pod-name>

Consultez FAQ sur les volumes NAS.

PVC non lié (NAS)

Symptôme

Le PVC n'est pas lié et le pod n'est pas en cours d'exécution.

Localisation de la panne

Exécutez kubectl describe pvc <pvc-name> -n <namespace> et inspectez les événements pour déterminer s'il s'agit d'un problème de provisionnement statique ou dynamique.

Provisionnement statique

Les sélecteurs du PVC et du PV ne correspondent pas. Incompatibilités courantes :

  • La configuration du sélecteur diffère entre le PVC et le PV.

  • Ils font référence à des noms de StorageClass différents.

  • L'état du PV est Released.

Vérifiez la configuration YAML du PVC et du PV. Consultez Utilisation de volumes NAS statiques.

Un PV Released ne peut pas être réutilisé. Créez un nouveau PV pointant vers le système de fichiers NAS.

Provisionnement dynamique

csi-provisioner n'a pas réussi à provisionner le volume NAS. Vérifiez les événements du PVC pour l'erreur. Consultez FAQ sur les volumes NAS.

Dépannage OSS

Important
  • Le montage d'un bucket OSS nécessite des identifiants AccessKey dans le PV, fournis via un Secret Kubernetes.

  • Utilisez l'endpoint public pour l'accès interrégional ; utilisez l'endpoint interne pour l'accès intrarégional.

Pod non en cours d'exécution (OSS)

Symptôme

L'état du PVC est Bound, mais le pod n'est pas en cours d'exécution.

Causes possibles et résolution

Symptôme dans les événements de kubectl describe pods <pod-name>

Cause

Localisation de la panne

Résolution

Le pod reste longtemps dans l'état Init ; lenteur de l'exécution de chmod sur le contenu du bucket

securityContext.fsGroup est défini et le bucket contient de nombreux fichiers

Vérifiez si securityContext.fsGroup est défini dans la spécification du pod

Supprimez fsGroup de la spécification du pod, supprimez le pod et laissez-le redémarrer pour remonter le volume

MountVolume.SetUp failed for volume "..." avec une erreur de connexion

Accès interrégional utilisant l'endpoint interne (privé)

Vérifiez si l'endpoint du bucket dans le PV est une adresse privée alors que le nœud se trouve dans une région différente

Basculez l'endpoint vers l'adresse publique du bucket OSS

Autres événements

Autres erreurs

Vérifiez les événements du pod avec kubectl describe pods <pod-name>

Consultez FAQ sur les volumes OSS.

PVC non lié (OSS)

Symptôme

Le PVC n'est pas lié et le pod n'est pas en cours d'exécution.

Localisation de la panne

Exécutez kubectl describe pvc <pvc-name> -n <namespace> et inspectez les événements pour déterminer s'il s'agit d'un problème de provisionnement statique ou dynamique.

Provisionnement statique

Les sélecteurs du PVC et du PV ne correspondent pas. Incompatibilités courantes :

  • La configuration du sélecteur diffère entre le PVC et le PV.

  • Ils font référence à des noms de StorageClass différents.

  • L'état du PV est Released.

Vérifiez la configuration YAML du PVC et du PV. Consultez Utilisation de volumes OSS statiques.

Un PV Released ne peut pas être réutilisé. Extrayez l'adresse du bucket et créez un nouveau PV.

Provisionnement dynamique

csi-provisioner n'a pas réussi à monter le bucket OSS. Vérifiez les événements du PVC pour l'erreur. Consultez FAQ sur les volumes OSS.