Para executar cargas de trabalho como computação científica ou processamento paralelo em grande escala em uma instância acelerada por GPU, instale o ambiente de desenvolvimento e runtime do CUDA. O CUDA oferece um conjunto completo de ferramentas e bibliotecas para desenvolver programas acelerados por GPU, permitindo aproveitar todo o poder de computação das GPUs NVIDIA, melhorar o desempenho e acelerar suas cargas de trabalho. Este tópico descreve como instalar o CUDA manualmente.
Contexto
O CUDA (Compute Unified Device Architecture) é uma arquitetura de computação paralela de uso geral desenvolvida pela NVIDIA. Ela utiliza o poder de processamento de uma unidade de processamento gráfico (GPU) para resolver problemas computacionais complexos. A arquitetura inclui o conjunto de instruções do CUDA (ISA) e um mecanismo de computação paralela dentro da GPU. Use o CUDA com C, C++ e Fortran para desenvolver programas de alto desempenho executados em processadores compatíveis com CUDA. O CUDA também fornece interfaces para várias linguagens, como Java e Python.
Pré-requisitos
Crie uma instância acelerada por GPU. Para mais informações, consulte Criar uma instância acelerada por GPU.
Verifique se a versão do driver na instância acelerada por GPU é compatível com a versão do CUDA que você deseja instalar. Para mais informações, consulte CUDA Toolkit and Corresponding Driver Versions.
Procedimento
O CUDA suporta os sistemas operacionais Windows e Linux. Este tópico usa o CUDA Toolkit 12.1.1 como exemplo para demonstrar como instalar o CUDA em instâncias aceleradas por GPU que executam Linux e Windows.
Linux
-
Obtenha o pacote de instalação do CUDA.
Acesse a página CUDA Toolkit Archive.
-
Selecione a versão do CUDA correspondente ao seu driver.
Este tópico utiliza o CUDA Toolkit 12.1.1 como exemplo.
Na página oficial CUDA Toolkit Archive do NVIDIA Developer, localize a versão desejada, como CUDA Toolkit 12.1.1 (April 2023), e clique no link de download correspondente.
-
Obtenha a URL de download do pacote de instalação do CUDA.
-
Selecione os parâmetros necessários, como sistema operacional, arquitetura e versão.
Parâmetro
Valor de exemplo
Operating system
Linux
Architecture
x86_64
Distribution
Ubuntu
Version
20.04
Installer type
runfile (local)
-
Copie os comandos do instalador base disponíveis na página.
$ wget https://developer.download.nvidia.com/compute/cuda/12.1.1/local_installers/cuda_12.1.1_530.30.02_linux.run $ sudo sh cuda_12.1.1_530.30.02_linux.run
-
-
Instale o pacote do CUDA.
-
Conecte-se à instância acelerada por GPU usando um dos métodos a seguir.
Método de conexão
Instruções
Workbench
VNC
-
Use o comando
wgete cole o endereço de download obtido na Etapa 1 para baixar o pacote de instalação do CUDA.wget https://developer.download.nvidia.com/compute/cuda/12.1.1/local_installers/cuda_12.1.1_530.30.02_linux.runImportanteO download pode levar de 5 a 10 minutos.
-
Execute os comandos a seguir para instalar o pacote do CUDA.
NotaPara uma instância otimizada para computação acelerada por GPU, instale o driver Tesla manualmente ou use o driver incluído no pacote.
Para uma instância acelerada por vGPU, não é possível instalar o driver incluído durante a instalação do CUDA. Instale manualmente o driver NVIDIA GRID. Para mais informações, consulte Instalar um driver NVIDIA GRID.
-
Instalação interativa
sudo chmod +x cuda_12.1.1_530.30.02_linux.runsudo ./cuda_12.1.1_530.30.02_linux.runApós inserir accept no prompt, escolha se deseja instalar o driver incluído com base no seu cenário:
-
Se você possui uma instância otimizada para computação acelerada por GPU com um driver já existente, pressione a tecla Enter para desmarcar a opção Driver, conforme mostrado no exemplo a seguir. Em seguida, selecione Install para continuar.
ImportanteSe você não desmarcar a opção Driver, o driver incluído substituirá o driver existente na instância.
CUDA Installer - [ ] Driver [ ] 530.30.02 + [X] CUDA Toolkit 12.1 [X] CUDA Demo Suite 12.1 [X] CUDA Documentation 12.1 - [ ] Kernel Objects [ ] nvidia-fs Options Install Up/Down: Move | Left/Right: Expand | 'Enter': Select | 'A': Advanced options Caso tenha uma instância otimizada para computação acelerada por GPU e queira usar o driver incluído, verifique primeiro sua compatibilidade com o modelo de GPU da instância. Para mais informações, consulte Baixar um driver Tesla (Linux). Se o driver for compatível, mantenha a seleção padrão (a opção Driver marcada) e selecione Install para continuar.
Para instâncias aceleradas por vGPU, é necessário um driver NVIDIA GRID. Verifique primeiro se já existe um driver compatível instalado. Para mais informações, consulte Instalar um driver NVIDIA GRID. Caso contrário, instale o driver antes de prosseguir. Durante a instalação do CUDA, desmarque a opção Driver pressionando a tecla Enter e selecione Install para continuar.
-
-
Instalação silenciosa
sudo chmod +x cuda_12.1.1_530.30.02_linux.runsudo ./cuda_12.1.1_530.30.02_linux.run --toolkit --samples --silentImportanteAo usar a instalação silenciosa, o driver incluído não é instalado automaticamente. Instale manualmente o driver necessário para sua instância acelerada por GPU.
-
(Opcional) Reinicie a instância acelerada por GPU:
reboot -
Configure as variáveis de ambiente do CUDA:
echo 'export PATH=/usr/local/cuda/bin:$PATH' | sudo tee /etc/profile.d/cuda.shsource /etc/profile
-
-
Verifique a instalação do CUDA.
-
Execute o comando
nvcc -Vpara verificar se o CUDA foi instalado corretamente.root@iZxxxZ:~# nvcc -V nvcc: NVIDIA (R) Cuda compiler driver Copyright (c) 2005-2023 NVIDIA Corporation Built on Mon Apr__3_17:16:06_PDT_2023 Cuda compilation tools, release 12.1, V12.1.105 Build cuda_12.1.r12.1/compiler.32688072_0 -
Teste os CUDA Samples para validar a instalação:
cd /usr/local/cuda-12.1/extras/demo_suite./deviceQuerySe a saída for
Result=PASS, a instalação do CUDA foi bem-sucedida.deviceQuery, CUDA Driver = CUDART, CUDA Driver Version = 12.1, CUDA Runtime Version = 12.1, NumDevs = 1, Device0 = Tesla T4 Result = PASS
-
Windows
-
Faça logon em uma instância otimizada para computação acelerada por GPU que execute Windows.
Conecte-se à instância acelerada por GPU usando um dos métodos a seguir:
Método de conexão
Instruções
Workbench
VNC
-
Selecione a versão do CUDA a ser instalada.
Acesse a página CUDA Toolkit Archive.
-
Escolha a versão do CUDA correspondente ao seu driver.
Primeiro, verifique se o driver incluído no pacote CUDA é compatível com o modelo de GPU da sua instância. Para mais informações, consulte Baixar um driver Tesla (Windows). Este tópico usa o CUDA Toolkit 12.1.1 como exemplo.
-
Defina os parâmetros necessários, como sistema operacional, arquitetura e versão.
Parâmetro
Valor de exemplo
Operating system
Windows
Architecture
x86_64
Version
Server 2022
Installer type
exe (local)
-
Clique em Download para baixar o pacote CUDA correspondente.
O arquivo baixado,
cuda_12.1.1_531.14_windows.exe, tem aproximadamente 3,2 GB.
-
Instale o pacote do CUDA.
Após concluir o download, abra a pasta que contém o pacote. Clique duas vezes no arquivo executável e siga as instruções na tela para concluir a instalação.
Quando a caixa de diálogo NVIDIA Installer has finished aparecer, a instalação estará concluída.
Documentos relacionados
Após criar uma instância acelerada por GPU, talvez seja necessário instalar manualmente um driver Tesla ou um driver NVIDIA GRID para habilitar a aceleração de computação e a renderização gráfica. Para mais informações, consulte Instalar um driver Tesla ou Instalar um driver NVIDIA GRID.
Caso deseje instalar automaticamente o driver Tesla e as ferramentas do CUDA durante a criação da instância, consulte Configurar o driver Tesla.