Em cenários de computação de uso geral ou aceleração gráfica, você pode instalar ou carregar automaticamente o driver Tesla ao criar uma instância GPU. Também é possível instalar o driver manualmente após a criação da instância. A instalação do driver em uma instância GPU melhora o desempenho de computação e os recursos de renderização gráfica. Este tópico descreve como instalar ou carregar automaticamente o driver Tesla durante a criação de uma instância GPU.
Métodos de instalação do driver
Escolha um método de instalação automática do driver Tesla com base nos requisitos de desempenho da sua carga de trabalho.
|
Método de instalação |
Descrição |
Link relacionado |
|
Imagem pública |
Ao criar uma instância GPU, selecione uma imagem pública e a opção Auto-install GPU Driver. |
|
|
Script de instalação |
Em vez de selecionar a opção Auto-install GPU Driver, forneça um script de instalação na seção User Data para instalar o driver NVIDIA Tesla durante a criação da instância. |
Instalar um driver com uma imagem pública
Sistemas operacionais Linux específicos na Public Image oferecem suporte à opção Auto-install GPU Driver. Se você selecionar uma imagem pública e também marcar a opção Auto-install GPU Driver, o driver Tesla será instalado automaticamente após a criação da instância GPU.
Acesse a página de compra de instâncias.
Clique em Custom Launch.
-
Configure o método de faturamento, região, rede, zona, tipo de instância e imagem conforme necessário.
Para obter mais informações sobre outros parâmetros de configuração, consulte Descrição dos parâmetros. A tabela a seguir descreve os tipos de instância, imagens e versões de driver que suportam a instalação automática do driver ao criar uma instância GPU.
NotaO driver NVIDIA Tesla opera a GPU física. Quando utilizado com as bibliotecas CUDA e cuDNN, ele permite o uso eficiente da GPU. Essas bibliotecas são instaladas juntamente com o driver. Para novos sistemas, recomenda-se usar as versões mais recentes do driver Tesla, CUDA e cuDNN.
Tipos de instância suportados
Versões de imagem pública
Versão do driver Tesla
Versão do CUDA
Versão do cuDNN
gn7e, gn7s, gn7i, gn6v, gn6i, gn6e, gn5 e gn5i
ebmgn7e, ebmgn7i, ebmgn6v, ebmgn6i e ebmgn6e
ebmgn7ix e ebmgn7ex
gn8is, ebmgn8is, gn8ia, ebmgn8ia, gn8v e ebmgn8v
ebmgn9g e ebmgn9ge
Alibaba Cloud Linux 3
Ubuntu 24.04 e 22,04
Notaebmgn9g e ebmgn9ge não suportam Ubuntu 22,04.
580.126.09
13.0.2
9.19.1.2
gn7e, gn7s, gn7i, gn6v, gn6i, gn6e, gn5 e gn5i
ebmgn7e, ebmgn7i, ebmgn6v, ebmgn6i e ebmgn6e
ebmgn7ix e ebmgn7ex
gn8is, ebmgn8is, gn8ia, ebmgn8ia, gn8v e ebmgn8v
Alibaba Cloud Linux 3
Ubuntu 24.04, 22,04 e 20,04
580.126.09
12.8.1
9.19.1.2
gn7e, gn7s, gn7i, gn6v, gn6i, gn6e, gn5 e gn5i
ebmgn7e, ebmgn7i, ebmgn6v, ebmgn6i e ebmgn6e
gn8is, ebmgn8is, gn8v, ebmgn8v e gn8ia
Alibaba Cloud Linux 3
Ubuntu 24.04, 22,04 e 20,04
Notaebmgn8v, ebmgn7e, não suportam imagens Ubuntu 20,04.
570.195.03
12.8.1
9.8.0.87
gn7e, gn7s, gn7i, gn6v, gn6i, gn6e, gn5 e gn5i
ebmgn7e, ebmgn7i, ebmgn6v, ebmgn6i e ebmgn6e
gn8is, ebmgn8is, gn8v, ebmgn8v e gn8ia
Alibaba Cloud Linux 3
Ubuntu 22,04, 20,04 e 18,04
Notaebmgn8v, ebmgn7e, não suportam imagens Ubuntu 18,04.
570.195.03
12.4.1
9.2.0.82
gn7e, gn7s, gn7i, gn6v, gn6i, gn6e, gn5 e gn5i
ebmgn7e, ebmgn7i, ebmgn6v, ebmgn6i e ebmgn6e
gn8is, ebmgn8is e gn8ia
Alibaba Cloud Linux 2 e Alibaba Cloud Linux 3
Ubuntu 20,04 e 18,04
CentOS 8.x e 7.x
Notaebmgn7e não suportam imagens Ubuntu 18,04.
535.216.03
12.1.1
8.9.7.29
gn7i, gn7e, gn7s, gn6v, gn6i, gn6e, gn5 e gn5i
ebmgn7, ebmgn7i, ebmgn7e, ebmgn6v, ebmgn6i e ebmgn6e
Alibaba Cloud Linux 2 e Alibaba Cloud Linux 3
Ubuntu 20,04, 18,04 e 16,04
CentOS 8.x e 7.x
Debian 10.10
Notaebmgn7e não suportam imagens Ubuntu 18,04 ou 20,04.
470.256.02
11.4.1
8.2.4
gn7, gn7i, gn7e, gn6v, gn6i, gn6e, gn5 e gn5i
ebmgn7, ebmgn7i, ebmgn7e, ebmgn6v, ebmgn6i e ebmgn6e
Alibaba Cloud Linux 2
Ubuntu 20,04, 18,04 e 16,04
CentOS 8.x e 7.x
460.91.03
11.2.2
8.1.1
gn7, gn7e, gn6v, gn6i, gn6e, gn5 e gn5i
ebmgn7, ebmgn7e, ebmgn6v, ebmgn6i e ebmgn6e
Alibaba Cloud Linux 2
Ubuntu 20,04, 18,04 e 16,04
CentOS 8.x e 7.x
460.91.03
11.0.2
8.1.1
8.0.4
gn6v, gn6i, gn6e, gn5 e gn5i
ebmgn6v, ebmgn6i e ebmgn6e
Alibaba Cloud Linux 2
Ubuntu 18,04 e 16,04
CentOS 8.x e 7.x
460.91.03
10.2.89
8.1.1
8.0.4
7.6.5
gn6v, gn6i, gn6e, gn5 e gn5i
ebmgn6v, ebmgn6i e ebmgn6e
Ubuntu 18,04 e 16,04
CentOS 7.x
450.80.02
440.64.00
10.1.168
8.0.4
7.6.5
7.5.0
gn6v, gn6i, gn6e, gn5 e gn5i
ebmgn6v, ebmgn6i e ebmgn6e
Ubuntu 18,04 e 16,04
CentOS 7.x
450.80.02
440.64.00
10.0.130
7.6.5
7.5.0
7.4.2
7.3.1
ImportanteAo alterar o sistema operacional, utilize uma imagem pública que ofereça suporte à instalação automática do driver Tesla. Caso escolha uma imagem sem suporte, desative esse recurso previamente. Para mais detalhes, consulte Como desativo a instalação automática do driver Tesla ao alterar o sistema operacional?.
Se você instalar o PyTorch 2.1.2 executando o comando
pip3 install torch, instale o CUDA 12.1. Caso contrário, podem ocorrer erros durante o uso do PyTorch. Para mais informações, consulte O erro "undefined symbol: __nvJitLinkAddData_12_1, version libnvJitLink.so.12" ocorre ao usar o PyTorch.
Por exemplo, para configurar uma instância gn7i, na seção Image, clique em Public Image. Selecione um sistema operacional Linux e sua versão, como Alibaba Cloud Linux 3.2104 LTS 64-bit. Em seguida, marque Auto-install GPU Driver e escolha as versões do CUDA, driver e cuDNN. Após a criação da instância, o driver NVIDIA Tesla será instalado automaticamente.
Após a criação ou inicialização da instância, aplicam-se as seguintes informações sobre o driver Tesla:
A instalação automática leva de 10 a 20 minutos, dependendo da largura de banda da rede interna da instância e do número de vCPUs. Conecte-se à instância para monitorar o progresso da instalação. Após a conclusão, visualize o log de instalação no arquivo /root/auto_install/auto_install.log.
Estado da instalação
Exibição
Instalando
Uma barra de progresso é exibida.
Instalação bem-sucedida
A mensagem ALL INSTALL OK é exibida.
Falha na instalação
A mensagem INSTALL FAIL é exibida.
ImportanteDurante a instalação, a GPU fica indisponível. Não execute nenhuma operação na instância. Se você instalar outro software relacionado à GPU, a instalação automática poderá falhar e a instância poderá ficar indisponível.
Siga as instruções na tela para concluir o pagamento.
Instalar um driver com um script de instalação
Ao criar uma instância GPU, caso não selecione a opção Auto-install GPU Driver na seção Image, insira um script de instalação na seção User Data para instalar o driver NVIDIA Tesla.
Configurações de parâmetros do script
Ao utilizar um script de instalação, modifique os seguintes parâmetros conforme os requisitos do seu negócio.
Modifique as versões do driver Tesla, CUDA e da biblioteca cuDNN com base no tipo de instância e na imagem da instância criada. Para informações sobre versões suportadas, consulte os tipos de instância e versões de imagem compatíveis com o driver Tesla ao selecionar uma Public Image em Instalar um driver usando uma imagem pública.
O exemplo a seguir mostra como definir a versão do driver Tesla para 550.127.08, a versão do CUDA para 12.4.1 e a versão do cuDNN para 9.2.0.82:
DRIVER_VERSION="550.127.08"
CUDA_VERSION="12.4.1"
CUDNN_VERSION="9.2.0.82"
Procedimento
Acesse a página de compra de instâncias.
Clique em Custom Launch.
-
Configure o método de faturamento, região, rede, zona, tipo de instância, imagem e User Data conforme necessário.
Para obter mais informações sobre outros parâmetros de configuração, consulte Descrição dos parâmetros.
-
Na seção Advanced Options (Optional), cole o script preparado na caixa de texto User Data.
Prepare um script de instalação por conta própria. Para mais informações sobre os parâmetros do script de instalação, consulte Configurações de parâmetros do script.
Este script utiliza o pacote de instalação .run para instalar o driver Tesla e outros módulos. O código a seguir fornece um exemplo de script:
#!/bin/sh # Specify the versions to install. DRIVER_VERSION="550.127.08" CUDA_VERSION="12.4.1" CUDNN_VERSION="9.2.0.82" IS_INSTALL_eRDMA="FALSE" IS_INSTALL_RDMA="FALSE" INSTALL_DIR="/root/auto_install" # Use the .run file to install the driver and CUDA. auto_install_script="auto_install_v4.0.sh" script_download_url=$(curl http://100.100.100.200/latest/meta-data/source-address | head -1)"/opsx/ecs/linux/binary/script/${auto_install_script}" echo $script_download_url rm -rf $INSTALL_DIR mkdir -p $INSTALL_DIR cd $INSTALL_DIR && wget -t 10 --timeout=10 $script_download_url && bash ${INSTALL_DIR}/${auto_install_script} $DRIVER_VERSION $CUDA_VERSION $CUDNN_VERSION $IS_INSTALL_RDMA $IS_INSTALL_eRDMA -
Siga as instruções na tela para concluir o pagamento.
NotaSe você chamar a operação de API RunInstances para criar uma instância GPU, use apenas o parâmetro User Data para passar o script de instalação do driver NVIDIA Tesla. Para mais informações, consulte RunInstances.
Caso não tenha instalado o driver automaticamente durante a criação da instância, instale-o manualmente posteriormente. Conecte-se à instância via SSH, cole o conteúdo do script em um novo arquivo e execute-o como um script shell. Para saber como se conectar a uma instância, consulte Métodos de conexão.
Documentos relacionados
Se você não instalou automaticamente o driver Tesla ao criar uma instância otimizada para computação acelerada por GPU, instale-o manualmente.