Este tópico descreve problemas comuns e soluções para falhas na montagem de sistemas de arquivos CPFS em sistemas operacionais Linux com clientes CPFS-POSIX ou CPFS-NFS.
Visão geral
Ponto de montagem do cliente POSIX
Montagem com cliente CPFS-POSIX
O CPFS só pode ser montado e acessado usando o cliente POSIX?
Quantos sistemas de arquivos CPFS podem ser montados em uma única instância ECS?
O que fazer se o erro "not active on:" for retornado ao montar um sistema de arquivos CPFS?
O que fazer se o erro "Command failed" for retornado ao montar um sistema de arquivos CPFS?
Como limpar configurações residuais de uma instância ECS desmontada?
Montagem com cliente CPFS-NFS
Expansão do CPFS
O que fazer se o erro "insufficient inventory" for retornado ao criar um ponto de montagem de cliente POSIX?
-
Sintoma:
Ao criar um ponto de montagem de cliente POSIX para um sistema de arquivos no console cloud Parallel File Storage (CPFS), o seguinte erro é relatado: estoque insuficiente na zona especificada.
-
Causa:
Ao criar um ponto de montagem POSIX, o CPFS cria automaticamente três instâncias ECS de pagamento conforme o uso (ecs.g*.large) na sua conta Alibaba Cloud. Essas instâncias gerenciam o cluster de clientes CPFS-POSIX. Certifique-se de que sua conta Alibaba Cloud esteja regularizada e apta a comprar instâncias ECS antes de criar o ponto de montagem.
-
Solução:
Acesse o console ECS e vá para Página de criação de instância para verificar o estoque dos tipos de instância ECS necessários. Essa verificação evita falhas na criação do ponto de montagem causadas por estoque insuficiente do tipo de instância especificado.
O que fazer se o erro "insufficient vSwitch IPs" for retornado ao criar um ponto de montagem de cliente POSIX?
-
Sintoma:
Ao criar um ponto de montagem de cliente POSIX para um sistema de arquivos no console CPFS, o seguinte erro é retornado: IPs insuficientes no vSwitch.
-
Causa:
Os nós de armazenamento de um sistema de arquivos CPFS precisam usar IPs alocados do vSwitch especificado pelo ponto de montagem do cliente POSIX. Cada nó de armazenamento ocupa um IP. O limite máximo de IPs ocupados pelos nós de armazenamento de um sistema de arquivos CPFS é 160.
-
Solução:
Acesse o console VPC para consultar o número de IPs disponíveis no vSwitch da VPC de destino. Certifique-se de que o vSwitch tenha IPs disponíveis suficientes.
Por que não consigo criar um ponto de montagem de cliente POSIX?
Se você não encontrar um ponto de montagem recém-criado no console CPFS, verifique se há pagamentos pendentes na sua conta Alibaba Cloud. Contas com pagamentos pendentes não podem criar pontos de montagem de sistemas de arquivos CPFS. Recarregue sua conta e tente criar o ponto de montagem novamente.
Quantos sistemas de arquivos CPFS podem ser montados em uma única instância ECS?
Uma única instância ECS pode montar no máximo um sistema de arquivos CPFS.
O que fazer se o erro "unsupported OS for 'X86_64' architecture" for retornado ao montar um sistema de arquivos CPFS?
Se o seguinte erro for retornado durante a montagem de um sistema de arquivos CPFS, isso indica que o sistema operacional do nó de computação não é suportado. Altere as especificações do nó de computação. Para ver os sistemas operacionais suportados pelo cliente CPFS, consulte Limites.
[ FATAL ] You cannot add cpfs-client-001 node because it has an unsupported OS for 'X86_64' architecture.
O que fazer se o erro "make sure kernel-devel version is consistent with kernel" for retornado ao montar um sistema de arquivos CPFS?
Se o seguinte erro for retornado durante a montagem de um sistema de arquivos CPFS, isso indica que o pacote kernel-devel ou kernel-headers não está instalado na instância ECS ou que a versão instalada é incompatível.
No package kernel-devel-3.10.0-957.21.3.el7.x86_64 available.
Error: Nothing to do
please make sure kernel-devel version is consistent with kernel
Execute os seguintes comandos para verificar a instalação dos pacotes na instância ECS.
rpm -qa | grep kernel-devel-`uname -r`
Se a saída estiver vazia, os pacotes na instância ECS não foram instalados corretamente. Reinstale-os na instância ECS. Para mais informações, consulte Etapa 1: Preparar o ambiente.
O que fazer se o erro "ssh: connect to host A port 22: Connection timed out" for retornado ao montar um sistema de arquivos CPFS?
Se o seguinte erro for retornado durante a montagem de um sistema de arquivos CPFS, isso indica que a rede entre a instância ECS e o sistema de arquivos está desconectada.
====> start check ssh
try ssh root@a.b.c.d by /root/.ssh/id_rsa.pub
ssh: connect to host a.b.c.d port 22: Connection timed out
Verifique as possíveis causas abaixo e tente corrigir o problema:
|
Possível causa |
Solução |
|
A rede entre a instância ECS (a.b.c.d) e o nó de administração do cliente POSIX (qr-001) está desconectada |
Verifique a conectividade de rede e execute o comando de montagem novamente. |
|
A instância ECS (a.b.c.d) não foi adicionada ao grupo de segurança qr-sg |
Verifique a configuração do grupo de segurança e tente novamente. Para mais informações, consulte Configurar um grupo de segurança. |
|
A instância ECS (a.b.c.d) e o ponto de montagem CPFS não estão na mesma VPC |
Selecione uma instância ECS na mesma VPC do ponto de montagem para realizar a operação de montagem. |
|
O IP da instância ECS (a.b.c.d) não existe |
Verifique o status da instância ECS. |
O que fazer se o erro "not active on:<hostname>" for retornado ao montar um sistema de arquivos CPFS?
Se o seguinte erro for retornado durante a montagem de um sistema de arquivos CPFS, isso indica que o sistema de arquivos CPFS não pôde ser iniciado na instância ECS.
[ WARN ] GPFS is not active on: hostname. Consult the install toolkit logs for possible errors
during install. The GPFS service can also be started manually by running GPFS command
'mmstartup -N Node[,Node...]'
[ FATAL ] GPFS NOT ACTIVE
Analise as possíveis causas a seguir e tente resolver o problema:
O grupo de segurança da instância ECS está configurado incorretamente ou a instância não foi adicionada ao grupo de segurança qr-sg. Para mais informações, consulte Configurar um grupo de segurança.
O sistema de arquivos CPFS exige que a instância ECS tenha mais de 4 GB de memória. Se a memória for insuficiente, um erro será retornado. Verifique a memória da instância ECS.
O que fazer se o erro "Command failed" for retornado ao montar um sistema de arquivos CPFS?
Se o seguinte erro for retornado durante a montagem de um sistema de arquivos CPFS, isso indica que a memória disponível da instância ECS é inferior a 4 GB. Atualize a memória da instância ECS e execute o comando cpfs add ip novamente para montar o sistema de arquivos.
[ WARN ] GPFS is not active on: hostname. Consult the install toolkit logs for possible errors
during install. The GPFS service can also be started manually by running GPFS command
'mmstartup -N Node[,Node...]'
[ FATAL ] GPFS NOT ACTIVE
O que fazer se o erro "cpfs.sh is running already" for retornado ao montar um sistema de arquivos CPFS?
Se o seguinte erro for retornado durante a montagem de um sistema de arquivos CPFS, isso indica que uma tarefa de montagem ou desmontagem já está em execução. Aguarde um momento e tente novamente.
cpfs.sh is running already, pid: xyz
O que fazer se o erro "connect to host B port 22: Connection timed out" for retornado ao montar um sistema de arquivos CPFS?
Se a instância ECS A retornar o seguinte erro ao tentar montar um sistema de arquivos CPFS, isso indica que existe uma instância ECS B com status anormal no cluster atual do sistema de arquivos CPFS.
# cpfs add A
connect to host B port 22: Connection timed out
B hostname is invalid
Failed to add node.
Solucione o problema da instância ECS B seguindo os métodos abaixo e tente a operação de montagem novamente.
Execute mmgetstate -a no nó de administração qr-001 para verificar se a instância ECS B está com status normal (active indica status normal).
Se a instância B estiver com status normal, envie um ticket para entrar em contato com a equipe do CPFS e prosseguir com a solução de problemas.
-
Se a instância B estiver com status anormal, decida se deseja continuar usando a instância.
Para continuar usando esta instância, envie um ticket para solicitar à equipe do CPFS o reparo do status da instância.
-
Caso não precise mais da instância, execute o comando
mmdelnode -N <id> --forcepara limpar as informações do nó.mmdelnode -N iZuf61mhwoc9flkufs0**** --force Do you want to continue? (yes/no) yes mmdelnode: [W] Could not cleanup the following unreached nodes: iZuf61mhwoc9flkufs0**** mmdelnode: Command successfully completed mmdelnode: Propagating the cluster configuration data to all affected nodes. This is an asynchronous process.Após a limpeza, exclua as informações de host da instância B do arquivo /etc/hosts. No comando,
iZuf61mhwoc9flkufs0****representa o ID da instância ECS de destino.
O que fazer se o erro "[FATAL] B: Could not connect to B via ssh" for retornado ao montar um sistema de arquivos CPFS?
Se a instância ECS A retornar o seguinte erro ao tentar montar um sistema de arquivos CPFS, isso indica que existe uma instância ECS B com instalação interrompida no cluster atual do sistema de arquivos CPFS, contendo configurações residuais.
[ FATAL ] ssh: connect to host B port 22: Connection timed out
[ FATAL ] B: Could not connect to B via ssh.
-
Versões anteriores à 2.2.0
Exclua as informações de configuração residual da instância ECS B do arquivo /usr/lpp/mmfs/5.0.5.0/installer/configuration/clusterdefinition.txt.
[node4] fqdn = B os = rhel7 arch = x86_64 ip_address = 192.168.6.37 is_admin_node = False is_object_store = False is_nfs = False is_smb = False is_hdfs = False is_protocol_node = False is_nsd_server = False access_ips = is_quorum_node = False is_manager_node = False is_gui_server = False is_ems_node = False is_callhome_node = False is_broker_node = False is_node_offline = False is_node_reachable = True is_node_excluded = False is_mestor_node = False -
Versão 2.2.0 e posteriores
Exclua as informações de configuração residual da instância ECS B do arquivo /usr/lpp/mmfs/5.1.2.0/ansible-toolkit/ansible/ibm-spectrum-scale-install-infra/vars/scale_clusterdefinition.json.
{ "fqdn": "iZuf6hn0blj1g377w4xxxxZ", "os": "rhel7", "arch": "x86_64", "ip_address": "172.19.0.100", "is_admin_node": false, "is_object_store": false, "is_nfs": false, "is_smb": false, "is_hdfs": false, "is_protocol_node": false, "is_nsd_server": false, "is_quorum_node": false, "is_manager_node": false, "is_gui_server": false, "is_ems_node": false, "is_callhome_node": false, "is_broker_node": false, "is_node_offline": false, "is_node_reachable": true, "is_node_excluded": false, "is_mestor_node": false, "scale_daemon_nodename": "iZuf6hn0blj1g377w4xxxxZ" }
O que fazer se o erro [ FATAL ] No GPFS admin node specified. specify an admin node using 'spectrumscale node add <node name or IP> -a'. for retornado ao montar um sistema de arquivos CPFS?
Se o seguinte erro for retornado durante a montagem de um sistema de arquivos CPFS, isso indica que o comando foi executado no nó errado.
[ FATAL ] No GPFS admin node specified. specify an admin node using 'spectrumscale node add <node name or IP> -a'.
Verifique se você executou o comando CPFS no nó qr-001.
[root@cpfs-08cd3xxx-000001-qr-001 ~]#
O que fazer se o erro "Failed to resolve domain: file-system-id.region.cpfs.aliyuncs.com" for retornado ao montar um sistema de arquivos CPFS?
-
Causa
O parâmetro
file-system-id.region.cpfs.aliyuncs.comno comando de montagem não foi substituído pelo endereço de montagem do diretório exportado. -
Solução
Acesse o console NAS. Na coluna Actions do sistema de arquivos CPFS desejado, clique em Manage para ir à página Protocol Service. Na coluna Actions, clique em Export Directory para abrir o painel Export Directory e obter o endereço de montagem. Em seguida, substitua o parâmetro
file-system-id.region.cpfs.aliyuncs.comno comando de montagem pelo endereço obtido. Execute o comando de montagem novamente para montar o sistema de arquivos.
O que fazer se ocorrer um erro de repositório yum ao usar o comando cpfs add para montar um sistema de arquivos CPFS?
Se o seguinte erro for retornado durante a montagem de um sistema de arquivos CPFS, isso indica que a configuração do repositório yum para CentOS 8 tornou-se inválida.
Errors during downloading metadata for repository 'appstream':
Status code: 404 for http://mirrors.cloud.aliyuncs.com/centos/8/AppStream/x86_64/os/repodata/repomd.xml (IP: 100.100.XX.XX)
Error: Failed to download metadata for repo 'appstream': Cannot download repomd.xml: Cannot download repodata/repomd.xml: All mirrors were tried
O CentOS 8 atingiu o fim de vida útil (EOL) e a comunidade Linux não mantém mais esta versão do sistema operacional. Recomendamos alterar o repositório yum.
O que fazer se o cliente CPFS falhar ao iniciar?
-
Sintoma:
Ao executar
mmgetstate -ano nó de administração qr-001 para verificar o status da instância ECS, o status da instância é exibido como down.-
Ao executar o comando
/usr/lpp/mmfs/bin/mmstartup, a seguinte informação é retornada.… mmfslinux.ko kernel extension does not exist. Use mmbuildgpl command to create the needed kernel extension for your kernel …
-
Causa:
O kernel da instância ECS atual foi atualizado.
-
Solução:
-
Execute o comando
/usr/lpp/mmfs/bin/mmbuildgplpara recompilar a extensão do kernel.A seguinte saída é retornada:
mmbuildgpl: Building GPL (5.1.X.X) module begins at Fri Dec 3 16:05:33 CST 2021. -------------------------------------------------------- Verifying Kernel Header... kernel version = 41800305 (418000305012001, 4.18.0-305.12.1.el8_4.x86_64, 4.18.0-305.12.1) module include dir = /lib/modules/4.18.0-305.12.1.el8_4.x86_64/build/include module build dir = /lib/modules/4.18.0-305.12.1.el8_4.x86_64/build kernel source dir = /usr/src/linux-4.18.0-305.12.1.el8_4.x86_64/include Found valid kernel header file under /usr/src/kernels/4.18.0-305.12.1.el8_4.x86_64/include Getting Kernel Cipher mode... Will use skcipher routines Verifying Compiler... make is present at /bin/make cpp is present at /bin/cpp gcc is present at /bin/gcc g++ is present at /bin/g++ ld is present at /bin/ld Verifying libelf devel package... Verifying elfutils-libelf-devel is installed ... Command: /bin/rpm -q elfutils-libelf-devel The required package elfutils-libelf-devel is installed Verifying Additional System Headers... Verifying kernel-headers is installed ... Command: /bin/rpm -q kernel-headers The required package kernel-headers is installed make World ... make InstallImages ... -------------------------------------------------------- mmbuildgpl: Building GPL module completed successfully at Fri Dec 3 16:05:54 CST 2021. -------------------------------------------------------- Execute o comando
/usr/lpp/mmfs/bin/mmstartuppara reiniciar a instância ECS.Execute o comando
/usr/lpp/mmfs/bin/mmmount allpara remontar o sistema de arquivos.
-
Como limpar configurações residuais de uma instância ECS desmontada?
Primeiro, confirme que o sistema de arquivos CPFS foi desmontado da instância ECS. Para mais informações, consulte Desmontar um sistema de arquivos. Em seguida, execute o comando mmdelnode -N <id> --force para limpar as configurações residuais da instância ECS desmontada. Veja o exemplo abaixo:
mmdelnode -N iZuf61mhwoc9flkufs0**** --force
Do you want to continue? (yes/no) yes
mmdelnode: [W] Could not cleanup the following unreached nodes:
iZuf61mhwoc9flkufs0****
mmdelnode: Command successfully completed
mmdelnode: Propagating the cluster configuration data to all affected nodes. This is an
asynchronous process.
No comando, iZuf61mhwoc9flkufs0**** corresponde ao ID da instância ECS de destino.
O que fazer se o erro "insufficient inventory" for retornado durante uma operação de expansão?
A expansão do sistema de arquivos CPFS depende do estoque de nós de armazenamento CPFS e do número de IPs disponíveis no vSwitch do ponto de montagem. Acesse o console VPC para verificar o número de IPs atualmente disponíveis. Um sistema de arquivos CPFS requer no máximo 164 IPs disponíveis. Certifique-se de que o vSwitch possua IPs disponíveis suficientes.
Os dados são rebalanceados automaticamente após a expansão de um sistema de arquivos CPFS?
Após a expansão de um sistema de arquivos CPFS, o rebalanceamento de dados não ocorre por padrão. Os dados existentes permanecem nos nós de armazenamento originais e não migram automaticamente para os novos nós adicionados.
O rebalanceamento de dados consome largura de banda de rede e disco dos nós de armazenamento, o que degrada o desempenho de I/O de frontend do sistema de arquivos. Além disso, quanto maior o volume de dados existentes, maior será o tempo necessário para o rebalanceamento. Como a maioria das cargas de trabalho não exige rebalanceamento automático após uma expansão, os sistemas de arquivos CPFS não realizam essa tarefa automaticamente.
O CPFS só pode ser montado e acessado usando o cliente POSIX?
O CPFS suporta a montagem e o acesso a sistemas de arquivos tanto pelo cliente CPFS-POSIX quanto pelo cliente CPFS-NFS. O CPFS também permite acesso cruzado entre os clientes CPFS-POSIX e CPFS-NFS. Por exemplo, arquivos criados pelo cliente CPFS-POSIX e suas modificações ficam visíveis para o cliente CPFS-NFS, e vice-versa. Para mais informações, consulte Instruções do cliente.