Todos os produtos
Search
Central de documentação

Container Compute Service:Troubleshoot pod issues

Última atualização: Sep 20, 2026

Diagnostique e resolva problemas comuns de pods, incluindo estados anormais, falhas na obtenção de imagens e erros de OOM.

Neste tópico

Categoria

Conteúdo

Processo de diagnóstico

Processo de diagnóstico

Métodos comuns de solução de problemas

Problemas e soluções comuns

Processo de diagnóstico

诊断流程2

  1. Verifique se os pods estão em estados anormais. Para mais informações, consulte Verificar o status do pod.

    1. Se um pod estiver em um estado anormal, verifique seus eventos, logs e configuração para identificar a causa. Para mais informações, consulte Métodos comuns de solução de problemas. Para informações sobre estados anormais de pods e como tratá-los, consulte Estados anormais comuns de pods e soluções.

    2. Se o pod estiver no estado Running, mas não funcionar conforme o esperado, consulte Um pod está no estado Running, mas não funciona conforme o esperado.

  2. Caso confirme um problema de OOM no pod, consulte Solucionar problemas de OOM de pod.

  3. Caso o problema persista, envie um ticket.

Estados anormais comuns de pods e soluções

Status do pod

Descrição

Solução

Pending

O pod não foi agendado.

Um pod está no estado Pending

Init:N/M

O pod tem M contêineres de inicialização, e N deles foram iniciados com êxito.

Um pod está no estado Init:N/M, Init:Error ou Init:CrashLoopBackOff

Init:Error

A inicialização de um contêiner de init falhou.

Um pod está no estado Init:N/M, Init:Error ou Init:CrashLoopBackOff

Init:CrashLoopBackOff

A inicialização de um contêiner de init falhou e ele está reiniciando repetidamente.

Um pod está no estado Init:N/M, Init:Error ou Init:CrashLoopBackOff

Completed

O pod concluiu a execução do seu comando de inicialização.

Um pod está no estado Completed

CrashLoopBackOff

O pod falhou ao iniciar e está reiniciando repetidamente.

Um pod está no estado CrashLoopBackOff

ImagePullBackOff

O pod não conseguiu baixar a imagem.

Um pod está no estado ImagePullBackOff

Running

  1. O pod está em execução normal.

  2. O pod está no estado Running, mas não funciona conforme o esperado.

  1. Nenhuma ação é necessária.

  2. Um pod está no estado Running, mas não funciona conforme o esperado

Terminating

O pod está em processo de encerramento.

Um pod está no estado Terminating

Métodos comuns de solução de problemas

Verificar o status do pod

  1. Acesse o console do ACS. No painel de navegação à esquerda, clique em Clusters.

  2. Na página Clusters, clique no nome do cluster de destino. No painel de navegação à esquerda, escolha Workloads > Pods.

  3. No canto superior esquerdo da página Pods, selecione o Namespace do pod e verifique seu status.

Verificar os detalhes do pod

  1. Acesse o console do ACS. No painel de navegação à esquerda, clique em Clusters.

  2. Na página Clusters, clique no nome do cluster de destino. No painel de navegação à esquerda, escolha Workloads > Pods.

  3. No canto superior esquerdo da página Pods, selecione o Namespace do pod. Em seguida, clique no nome do pod de destino ou clique em Details na coluna Actions e visualize os detalhes, como nome, imagem e endereço IP.

Verificar a configuração do pod

  1. Acesse o console do ACS. No painel de navegação à esquerda, clique em Clusters.

  2. Na página Clusters, clique no nome do cluster de destino. No painel de navegação à esquerda, escolha Workloads > Pods.

  3. No canto superior esquerdo da página Pods, selecione o Namespace do pod. Em seguida, clique no nome do pod de destino ou clique em Details na coluna Actions.

  4. Na página de detalhes do pod, no canto superior direito, edite e visualize o arquivo YAML e a configuração detalhada do pod.

Verificar eventos do pod

  1. Acesse o console do ACS. No painel de navegação à esquerda, clique em Edit.

  2. Na página Clusters, clique no nome do cluster de destino. No painel de navegação à esquerda, escolha Workloads > Workloads.

  3. No canto superior esquerdo da página Pods, selecione o Namespace do pod. Em seguida, clique no nome do pod de destino ou clique em Details na coluna Actions.

  4. No canto superior direito da página de detalhes do pod, edite e visualize o arquivo YAML e a configuração detalhada do pod.

  5. Na página de detalhes do pod, clique na aba Events.

    Nota

    Por padrão, o Kubernetes retém eventos da última hora. Para armazenar eventos por um período maior, consulte Crie e use um centro de eventos do Kubernetes.

Verificar os logs do pod

  1. Acesse o console do ACS. No painel de navegação à esquerda, clique em Clusters.

  2. Na página Clusters, clique no nome do cluster de destino. No painel de navegação à esquerda, escolha Workloads > Pods.

  3. No canto superior esquerdo da página Workloads, selecione o Namespace do pod. Em seguida, clique no nome do pod de destino ou clique em Details na coluna Actions.

  4. Na página de detalhes do pod, clique na aba Pods.

    Nota

    Os clusters do Alibaba Cloud Container Service for Kubernetes (ACK) são integrados ao Simple Log Service. Ative o Simple Log Service ao criar um cluster para coletar logs de contêineres, incluindo saída padrão e arquivos de texto dentro dos contêineres. Para mais informações, consulte Configure a coleta de logs de aplicação usando variáveis de ambiente de pod.

Verificar dados de monitoramento do pod

  1. Acesse o console do ACS. No painel de navegação à esquerda, clique em Clusters.

  2. Na página Logs, clique no nome do cluster de destino. No painel de navegação à esquerda, escolha Workloads > Prometheus Monitoring.

  3. Na página Workloads, clique na aba Cluster Overview e visualize painéis de monitoramento de CPU, memória e E/S de rede do pod.

Conectar-se a um contêiner via terminal

  1. Acesse o console do ACS. No painel de navegação à esquerda, clique em Clusters.

  2. Na página Clusters, clique no nome do cluster de destino. No painel de navegação à esquerda, escolha Workloads > Pods.

  3. Na página Workloads, encontre o pod de destino e clique em Terminal na coluna Pods.

    Nota

    Use o terminal para inspecionar arquivos locais e outras informações dentro do contêiner.

Diagnosticar falhas de pod

  1. Acesse o console do ACS. No painel de navegação à esquerda, clique em Clusters.

  2. Na página Clusters, clique no nome do cluster de destino. No painel de navegação à esquerda, escolha Clusters > Pods.

  3. No canto superior esquerdo da página Workloads, selecione o Pods do pod. Em seguida, clique no nome do pod de destino ou clique em Details na coluna Actions.

  4. Na página Pods, encontre o pod de destino e clique em Namespace na coluna Pods.

    Nota

    Execute diagnósticos no pod e resolva o problema com base nos resultados. Para mais informações, consulte Usar diagnósticos de cluster.

Um pod está no estado Pending

Causa

O sistema não pode agendar um pod no estado Pending, geralmente devido a dependências de recursos ou cotas mal configuradas.

Sintoma

O status do pod é Pending.

Solução

Examine os eventos do pod para identificar por que o sistema não o agendou. As principais causas incluem:

  • Dependências de recursos

    Um pod pode depender de outros recursos do cluster, como ConfigMaps ou persistent volume claims (PVCs). Por exemplo, um PVC precisa ter vínculo com um volume persistente antes que um pod possa usá-lo.

  • Cotas mal configuradas

    Verifique os eventos e logs de auditoria.

Estados do pod: Init, Error ou CrashLoopBackOff

Causa

  • Se um pod estiver travado no estado Init:N/M, ele tem M contêineres de inicialização, mas apenas N foram iniciados com êxito. Isso deixa M-N contêineres com falha na inicialização.

  • Se um pod estiver no estado Init:Error, houve falha na inicialização de um dos seus contêineres de init.

  • Se um pod estiver no estado Init:CrashLoopBackOff, a inicialização de um contêiner falhou e ele está reiniciando repetidamente.

Sintoma

  • O status do pod é Init:N/M.

  • O status do pod é Init:Error.

  • O status do pod é Init:CrashLoopBackOff.

Solução

  1. Verifique os eventos do pod para identificar problemas nos contêineres de inicialização pendentes. Para mais informações, consulte Verificar eventos do pod.

  2. Verifique os logs dos contêineres de inicialização pendentes para solucionar o problema. Para mais informações, consulte Verificar os logs do pod.

  3. Verifique a configuração do pod para garantir que os contêineres de inicialização pendentes estejam configurados corretamente. Para mais informações, consulte Verificar a configuração do pod. Para mais detalhes sobre contêineres de inicialização, consulte Depurar contêineres de inicialização.

Um pod está no estado ImagePullBackOff

Causa

O sistema agendou um pod no estado ImagePullBackOff, mas houve falha ao obter a imagem do contêiner.

Sintoma

O status do pod é ImagePullBackOff.

Solução

Verifique a descrição do evento do pod para identificar o nome da imagem com falha no download.

  1. Verifique se o nome da imagem do contêiner está correto.

  2. Caso utilize um repositório de imagens privado, consulte Usar uma imagem de um repositório para criar uma carga de trabalho do ACK para obter a solução.

Um pod está no estado CrashLoopBackOff

Causa

O estado CrashLoopBackOff indica um problema na aplicação dentro do contêiner.

Sintoma

O status do pod é CrashLoopBackOff.

Solução

  1. Verifique os eventos do pod e confirme a existência de problemas. Para mais informações, consulte Verificar eventos do pod.

  2. Verifique os logs do pod para solucionar o problema. Para mais informações, consulte Verificar os logs do pod.

  3. Verifique a configuração do pod para garantir que as sondas de integridade do contêiner estejam configuradas corretamente. Para mais informações, consulte Verificar a configuração do pod. Para mais detalhes sobre sondas de integridade de pods, consulte Configure sondas de Liveness, Readiness e Startup.

Um pod está no estado Completed

Causa

Um pod entra no estado Completed após o encerramento de todos os processos do seu contêiner.

Sintoma

O status do pod é Completed.

Solução

  1. Verifique a configuração do pod para identificar o comando de inicialização do contêiner no pod. Para mais informações, consulte Verificar a configuração do pod.

  2. Verifique os logs do pod para solucionar o problema. Para mais informações, consulte Verificar os logs do pod.

Pod no estado Running não está funcionando

Causa

O arquivo YAML usado na implantação contém um erro.

Sintoma

O pod está no estado Running, mas não funciona conforme o esperado.

Solução

  1. Verifique a configuração do pod para determinar se o contêiner está configurado conforme o esperado. Para mais informações, consulte Verificar a configuração do pod.

  2. Use os seguintes métodos para verificar se há erros de ortografia nas chaves das variáveis de ambiente.

    O exemplo a seguir mostra como identificar um erro de ortografia caso command seja grafado incorretamente como commnd.

    Nota

    Ao criar um pod, o cluster ignora erros de ortografia nas chaves das variáveis de ambiente. Por exemplo, se você grafar Command incorretamente como Commnd, ainda poderá usar o arquivo YAML para criar o recurso. No entanto, durante a execução, o contêiner ignora o comando com erro de ortografia e executa o comando padrão da imagem.

    1. Antes de executar o comando kubectl apply -f, inclua --validate e, em seguida, execute o comando kubectl apply --validate -f XXX.yaml.

      Se você grafar command incorretamente como commnd, verá a mensagem de erro XXX] unknown field: commnd XXX] this may be a false alarm, see https://gXXXb.XXX/6842pods/test.

    2. Execute o seguinte comando e compare o arquivo de saída pod.yaml com o arquivo original que você usou para criar o pod.

        kubectl get pods [$Pod] -o yaml > pod.yaml
      Nota

      [$Pod] é o nome do pod com problema. Execute o comando kubectl get pods para visualizar o nome do pod.

      • Se o arquivo pod.yaml tiver algumas linhas a mais em comparação ao arquivo usado para criar o pod, o pod criado atende ao esperado.

      • Se uma linha de código do seu arquivo original estiver ausente no arquivo pod.yaml, há um erro de ortografia no arquivo original.

  3. Verifique os logs do pod para solucionar o problema. Para mais informações, consulte Verificar os logs do pod.

  4. Acesse o contêiner pelo terminal para verificar se os arquivos locais internos estão conforme o esperado. Para mais informações, consulte Conectar-se a um contêiner usando o terminal.

Um pod está no estado Terminating

Causa

O pod está em processo de desligamento.

Sintoma

O status do pod é Terminating.

Solução

O sistema exclui automaticamente um pod no estado Terminating após um período de carência. Se ele permanecer travado, exclua o pod forçadamente com o seguinte comando:

kubectl delete pod [$Pod] -n [$namespace] --grace-period=0 --force

Solucionar problemas de OOM de pod

Causa

Quando um contêiner excede seu limite de memória, o sistema o encerra com um evento OOM (Out of Memory), o que causa uma saída inesperada. Para mais informações sobre eventos OOM, consulte Atribuir recursos de memória a contêineres e pods.

Sintoma

  • Se o processo encerrado for um processo de bloqueio, o contêiner poderá reiniciar de forma inesperada.

  • Se ocorrer um problema de OOM, a aba Diagnose na página de detalhes do pod no console exibirá o evento OOM pod was OOM killed.

Solução

  1. Revise a curva de crescimento de memória nos dados de monitoramento do pod para determinar quando o problema ocorreu. Para mais informações, consulte Verificar dados de monitoramento do pod.

  2. Com base nos dados de monitoramento, na linha do tempo de crescimento de memória, nos logs e nos nomes dos processos, verifique se o processo correspondente apresenta vazamento de memória.

    • Se o OOM for causado por um vazamento de memória do processo, solucione a causa raiz com base na sua aplicação.

    • Se o processo estiver em execução normal, aumente o limite de memória do pod com base nas necessidades da sua carga de trabalho. Recomendamos que o uso real de memória de um pod não exceda 80% do seu limite. Para mais informações, consulte Gerencie pods.