Todos os produtos
Search
Central de documentação

Elastic GPU Service:Instalar manualmente o driver Tesla em uma instância GPU (Linux)

Última atualização: Jun 27, 2026

Para computação de alto desempenho ou aceleração gráfica em cargas de trabalho como deep learning, IA, OpenGL, Direct3D e cloud gaming, a GPU precisa do driver Tesla instalado para oferecer desempenho máximo e renderização gráfica fluida. Caso não tenha instalado o driver Tesla ao criar sua instância otimizada para computação acelerada por GPU com Linux, instale-o manualmente depois. Este tópico descreve como instalar manualmente o driver Tesla em uma instância otimizada para computação acelerada por GPU que executa Linux.

Procedimento

Este tópico aplica-se a todas as instâncias otimizadas para computação acelerada por GPU que executam Linux. Para mais informações, consulte Instâncias otimizadas para computação acelerada por GPU (séries gn/ebm/scc). Instale apenas um driver Tesla compatível com o sistema operacional da instância. Por exemplo, uma instância GPU com Linux suporta somente o driver Tesla para Linux.

Etapa 1: Baixar o driver NVIDIA Tesla

  1. Acesse a página de download de drivers da NVIDIA.

    Nota

    Para mais informações sobre como instalar e configurar drivers NVIDIA, consulte o Guia de início rápido de instalação de drivers NVIDIA.

  2. Defina os critérios de busca e clique em Search.

    A tabela a seguir descreve os critérios de busca.

    Critério

    Descrição

    Exemplo

    • Tipo de produto

    • Série do produto

    • Família do produto

    Selecione o tipo, a série e a família do produto com base na GPU da sua instância.

    Nota

    Para visualizar os detalhes de uma instância GPU, como ID da instância, tipo de instância e sistema operacional, consulte Visualizar informações da instância.

    • Data Center / Tesla

    • A-Series

    • NVIDIA A10

    Sistema operacional

    Selecione a versão do sistema operacional Linux com base na imagem usada pela sua instância.

    Linux 64-bit

    CUDA Toolkit

    Selecione uma versão do CUDA Toolkit.

    11,4

    Idioma

    Selecione um idioma para o driver.

    Chinese (Simplified)

    Informações da GPU, versões de driver suportadas e versões do CUDA Toolkit para alguns tipos de instância otimizada para computação acelerada por GPU

    Item

    gn8v

    gn8is

    gn7e

    gn7i

    gn7

    gn6e

    gn6i

    gn6v

    gn5i

    gn5

    Product Type

    Data Center / Tesla

    Data Center / Tesla

    Data Center / Tesla

    Data Center / Tesla

    Data Center / Tesla

    Data Center / Tesla

    Data Center / Tesla

    Data Center / Tesla

    Data Center / Tesla

    Data Center / Tesla

    Product series

    H-Series

    L-Series

    A-Series

    A-Series

    A-Series

    V-Series

    T-Series

    V-Series

    P-Series

    P-Series

    Versão recomendada do driver Tesla

    570.133.20 ou posterior

    450.80.02 ou posterior

    460.73.01 ou posterior

    450.80.02 ou posterior

    410,79 ou posterior

    Versão recomendada do CUDA Toolkit

    CUDA Toolkit 12.4 Update 1

    CUDA Toolkit 11.0 Update 1

    CUDA Toolkit 11.2

    CUDA Toolkit 11.0 Update 1

    CUDA Toolkit 10.1 Update 2

    Nota
    • A tabela anterior lista informações de GPU apenas para alguns tipos comuns de instâncias otimizadas para computação acelerada por GPU. Instâncias com o mesmo modelo de GPU compartilham as mesmas informações (tipo, série e família do produto). Por exemplo, tanto as instâncias ebmgn7i quanto as gn7i usam a GPU NVIDIA A10 e, portanto, possuem o mesmo tipo, série e família de produto.

    • Ao instalar manualmente um driver Tesla e um pacote CUDA, garanta que a versão do driver seja compatível com a versão do pacote CUDA. Para mais informações, consulte Compatibilidade do CUDA.

  3. Na página de resultados da busca, clique em Beta, Older Drivers, and More.

  4. Localize o driver desejado e clique em View.

    Por exemplo, selecione Data Center Driver for Linux x64 com a versão do driver 470.161.03 e versão do CUDA Toolkit 11,4.

  5. Na página de detalhes do driver, clique com o botão direito em Download e selecione Copy Link Address.

  6. Conecte-se à instância GPU Linux.

    Para mais informações, consulte Conectar-se a uma instância Linux usando senha ou chave.

  7. Execute o comando a seguir para baixar o pacote de instalação do driver.

    A URL de download do driver no comando de exemplo é o link copiado na Etapa 5.

    wget https://us.download.nvidia.com/tesla/470.161.03/NVIDIA-Linux-x86_64-470.161.03.run

Etapa 2: Instalar o driver NVIDIA Tesla

O método de instalação do driver Tesla depende do sistema operacional.

CentOS

  1. Execute o comando a seguir para verificar se os pacotes kernel-devel e kernel-headers estão instalados.

    sudo rpm  -qa | grep $(uname -r)
    • Se a saída incluir informações de versão para os pacotes kernel-devel e kernel-headers, eles já estão instalados.

      kernel-3.10.0-1062.18.1.el7.x86_64
      kernel-devel-3.10.0-1062.18.1.el7.x86_64
      kernel-headers-3.10.0-1062.18.1.el7.x86_64
    • Caso não encontre kernel-devel- e kernel-headers- na saída, baixe e instale os pacotes kernel-devel e kernel-headers correspondentes à versão do seu kernel.

      Importante

      Se a versão do kernel-devel não corresponder à versão do kernel, a compilação do driver falhará durante a instalação do RPM do driver. Por isso, confirme o número da versão de *kernel-** na saída e baixe a versão correspondente do kernel-devel. Na saída de exemplo, a versão do kernel é 3.10.0-1062.18.1.el7.x86_64.

  2. Conceda permissões e instale o driver Tesla.

    Para sistemas operacionais Linux de 64 bits, recomendamos usar o driver Tesla no formato .run, como NVIDIA-Linux-x86_64-xxxx.run. Execute os comandos a seguir para conceder permissões e instalar o driver Tesla.

    Nota

    Se estiver usando um driver Tesla em outro formato, como .deb ou .rpm, consulte o Guia de instalação do NVIDIA CUDA para Linux para obter instruções de instalação.

    sudo chmod +x NVIDIA-Linux-x86_64-xxxx.run
    sudo sh NVIDIA-Linux-x86_64-xxxx.run
  3. Execute o comando a seguir para verificar a instalação.

    nvidia-smi

    Se a saída for semelhante à seguinte, o driver Tesla está instalado.

    [ecs-use xxx 9sgg1tZ ~]$ nvidia-smi
    Tue Sep 10 13:58:31 2024
    +-----------------------------------------------------------------------------+
    | NVIDIA-SMI 470.161.03    Driver Version: 470.161.03    CUDA Version: 11.4  |
    |-------------------------------+----------------------+----------------------+
    | GPU  Name        Persistence-M| Bus-Id        Disp.A | Volatile Uncorr. ECC |
    | Fan  Temp  Perf  Pwr:Usage/Cap|         Memory-Usage | GPU-Util  Compute M. |
    |                               |                      |               MIG M. |
    |===============================+======================+======================|
    |   0  NVIDIA A10          Off  | 00000000:00:07.0 Off |                    0 |
    |  0%   34C    P0    62W / 150W |      0MiB / 22731MiB |      0%      Default |
    |                               |                      |                  N/A |
    +-------------------------------+----------------------+----------------------+
    +-----------------------------------------------------------------------------+
    | Processes:                                                                  |
    |  GPU   GI   CI        PID   Type   Process name                  GPU Memory |
    |        ID   ID                                                   Usage      |
    |=============================================================================|
    |  No running processes found                                                 |
    +-----------------------------------------------------------------------------+
  4. (Opcional) Ative o Persistence Mode usando o NVIDIA Persistence Daemon.

    Após a instalação do driver Tesla, o Persistence Mode vem desativado (off) por padrão. O driver Tesla apresenta maior estabilidade quando o Persistence Mode está ativado. Para garantir a estabilidade do serviço, recomendamos ativar o Persistence Mode por meio do NVIDIA Persistence Daemon. Para mais informações, consulte Persistence Daemon.

    Nota
    1. Execute o comando a seguir para iniciar o NVIDIA Persistence Daemon.

      sudo nvidia-persistenced --user username 
      # Replace username with your username.
    2. Execute o comando a seguir para verificar o status do Persistence Mode.

      nvidia-smi

      A mensagem retornada indica que o Persistence-M está no estado ativado (on).

      [ecs-usexxx2q9sgg1tZ ~]$ sudo nvidia-persistenced --user ecs-user
      [ecs-usexxx2q9sgg1tZ ~]$ nvidia-smi
      Tue Sep 10 14:02:16 2024
      +-------------------------------+----------------------+----------------------+
      | NVIDIA-SMI 470.161.03   Driver Version: 470.161.03   CUDA Version: 11.4     |
      |-------------------------------+----------------------+----------------------+
      | GPU  Name        Persistence-M| Bus-Id        Disp.A | Volatile Uncorr. ECC |
      | Fan  Temp  Perf  Pwr:Usage/Cap|         Memory-Usage | GPU-Util  Compute M. |
      |                               |                      |               MIG M. |
      |===============================+======================+======================|
      |   0  NVIDIA A10          On   | 00000000:00:07.0 Off |                    0 |
      |  0%   33C    P8     8W / 150W |      0MiB / 22731MiB |      0%      Default |
      |                               |                      |                  N/A |
      +-------------------------------+----------------------+----------------------+
      +-----------------------------------------------------------------------------+
      | Processes:                                                                  |
      |  GPU   GI   CI        PID   Type   Process name                  GPU Memory |
      |        ID   ID                                                   Usage      |
      |=============================================================================|
      |  No running processes found                                                 |
      +-----------------------------------------------------------------------------+
  5. (Opcional) Configure o Persistence Mode para ativar na reinicialização do sistema.

    Se o sistema for reiniciado, o estado ativado (on) do Persistence Mode será perdido. Execute as operações a seguir para reativar o Persistence Mode.

    O pacote de instalação do driver Tesla instala scripts da NVIDIA, como scripts de exemplo e de instalação, em /usr/share/doc/NVIDIA_GLX-1.0/samples/nvidia-persistenced-init.tar.bz2.

    1. Execute os comandos a seguir para descompactar e instalar os scripts da NVIDIA.

      cd  /usr/share/doc/NVIDIA_GLX-1.0/samples/
      sudo tar xf nvidia-persistenced-init.tar.bz2
      cd  nvidia-persistenced-init
      sudo sh install.sh
    2. Execute o comando a seguir para verificar se o NVIDIA Persistence Daemon está em execução.

      sudo systemctl status nvidia-persistenced

      Se a saída for semelhante à seguinte, o NVIDIA Persistence Daemon está em execução.

      [ecs-user@xxx nvidia-persistenced-init]$ sudo systemctl status nvidia-persistenced
      ● nvidia-persistenced.service - NVIDIA Persistence Daemon
         Loaded: loaded (/usr/lib/systemd/system/nvidia-persistenced.service; enabled; vendor preset: disabled)
         Active: active (running) since Tue 2024-09-10 14:13:20 CST; 40s ago
        Process: 13882 ExecStart=/usr/bin/nvidia-persistenced --user nvidia-persistenced (code=exited, status=0/SUCCESS)
       Main PID: 13883 (nvidia-persiste)
          Tasks: 1 (limit: 383833)
         Memory: 196.0K
         CGroup: /system.slice/nvidia-persistenced.service
                 └─13883 /usr/bin/nvidia-persistenced --user nvidia-persistenced
      Sep 10 14:13:19 iZbp13orbqqx6m2q9sgg1tZ systemd[1]: Starting NVIDIA Persistence Daemon...
      Sep 10 14:13:19 iZbp13orbqqx6m2q9sgg1tZ nvidia-persistenced[13883]: Started (13883)
      Sep 10 14:13:20 iZbp13orbqqx6m2q9sgg1tZ systemd[1]: Started NVIDIA Persistence Daemon.
      Nota

      Adapte o script de instalação do NVIDIA Persistence Daemon ao seu sistema operacional para garantir o funcionamento correto.

    3. Execute o comando a seguir para verificar se o Persistence Mode está definido como on.

      nvidia-smi
    4. (Opcional) Execute os comandos a seguir para parar o NVIDIA Persistence Daemon.

      Desative o NVIDIA Persistence Daemon caso não seja mais necessário.

      sudo systemctl stop nvidia-persistenced
      sudo systemctl disable nvidia-persistenced
  6. (Condicionalmente obrigatório) Se sua instância pertencer à família ebmgn8v, ebmgn7 ou ebmgn7e , instale o serviço nvidia-fabricmanager correspondente à versão do seu driver.

    Importante
    • Se a instância pertencer à família ebmgn8v, ebmgn7 ou ebmgn7e , não será possível usar a instância GPU sem instalar o serviço nvidia-fabricmanager compatível com a versão do driver.

    • Caso sua instância GPU não pertença à família ebmgn8v, ebmgn7 ou ebmgn7e , ignore esta etapa.

    1. Instale o serviço nvidia-fabricmanager.

      Instale o serviço nvidia-fabricmanager a partir do código-fonte ou de um pacote de instalação. Os comandos de exemplo a seguir usam CentOS 7.x e CentOS 8.x como sistemas operacionais e a versão do driver 460.91.03 como exemplo. Nos comandos, substitua driver_version pelo número da versão do driver baixado na Etapa 1: Baixar o driver NVIDIA Tesla.

      • Source code

        • CentOS 7.x

          driver_version=460.91.03
          sudo yum -y install yum-utils
          sudo yum-config-manager --add-repo https://developer.download.nvidia.com/compute/cuda/repos/rhel7/x86_64/cuda-rhel7.repo
          sudo yum install -y nvidia-fabric-manager-${driver_version}-1
        • CentOS 8.x

          driver_version=460.91.03
          driver_version_main=$(echo $driver_version | awk -F '.' '{print $1}')
          distribution=rhel8
          ARCH=$( /bin/arch )
          sudo dnf config-manager --add-repo https://developer.download.nvidia.com/compute/cuda/repos/$distribution/${ARCH}/cuda-$distribution.repo
          sudo dnf module enable -y nvidia-driver:${driver_version_main}
          sudo dnf install -y nvidia-fabric-manager-0:${driver_version}-1
      • Installation package

        • CentOS 7.x

          driver_version=460.91.03
          sudo wget https://developer.download.nvidia.com/compute/cuda/repos/rhel7/x86_64/nvidia-fabric-manager-${driver_version}-1.x86_64.rpm
          sudo rpm -ivh nvidia-fabric-manager-${driver_version}-1.x86_64.rpm
        • CentOS 8.x

          driver_version=460.91.03
          sudo wget https://developer.download.nvidia.com/compute/cuda/repos/rhel8/x86_64/nvidia-fabric-manager-${driver_version}-1.x86_64.rpm
          sudo rpm -ivh nvidia-fabric-manager-${driver_version}-1.x86_64.rpm
      • Execute os comandos a seguir para iniciar o serviço nvidia-fabricmanager.

        sudo systemctl enable nvidia-fabricmanager
        sudo systemctl start nvidia-fabricmanager
      • Execute o comando a seguir para verificar o status do serviço nvidia-fabricmanager.

        systemctl status nvidia-fabricmanager

        Se a saída a seguir for retornada, o serviço nvidia-fabricmanager está em execução.

        nvidia-fabricmanager.service - NVIDIA fabric manager service
           Loaded: loaded (/lib/systemd/system/nvidia-fabricmanager.service; enabled; vendor preset: enabled)
           Active: active (running) since Mon 2021-09-13 19:14:45 CST; 1 weeks 1 days ago
          Process: 1928 ExecStart=/usr/bin/nv-fabricmanager -c /usr/share/nvidia/nvswitch/fabricmanager.cfg (code=exited, status=0/SUCCESS)
         Main PID: 2140 (nv-fabricmanage)
            Tasks: 18 (limit: 19660)
           CGroup: /system.slice/nvidia-fabricmanager.service
                   └─2140 /usr/bin/nv-fabricmanager -c /usr/share/nvidia/nvswitch/fabricmanager.cfg
        Sep 13 19:14:26 xxx systemd[1]: Starting NVIDIA fabric manager service...
        Sep 13 19:14:45 xxx nv-fabricmanager[2140]: Successfully configured all the available GPUs and NVSwitches.
        Sep 13 19:14:45 xxx systemd[1]: Started NVIDIA fabric manager service.
      • Ubuntu e outros

        1. Conceda permissões e instale o driver Tesla.

          Para sistemas operacionais Linux de 64 bits, recomendamos usar o driver Tesla no formato .run, como NVIDIA-Linux-x86_64-xxxx.run. Execute os comandos a seguir para conceder permissões e instalar o driver Tesla.

          Nota

          Se estiver usando um driver Tesla em outro formato, como .deb ou .rpm, consulte o Guia de instalação do NVIDIA CUDA para Linux para obter instruções de instalação.

          sudo chmod +x NVIDIA-Linux-x86_64-xxxx.run
          sudo sh NVIDIA-Linux-x86_64-xxxx.run
        2. Execute o comando a seguir para verificar a instalação.

          nvidia-smi

          Se a saída for semelhante à seguinte, o driver Tesla está instalado.

          [ecs-use xxx 9sgg1tZ ~]$ nvidia-smi
          Tue Sep 10 13:58:31 2024
          +-----------------------------------------------------------------------------+
          | NVIDIA-SMI 470.161.03    Driver Version: 470.161.03    CUDA Version: 11.4  |
          |-------------------------------+----------------------+----------------------+
          | GPU  Name        Persistence-M| Bus-Id        Disp.A | Volatile Uncorr. ECC |
          | Fan  Temp  Perf  Pwr:Usage/Cap|         Memory-Usage | GPU-Util  Compute M. |
          |                               |                      |               MIG M. |
          |===============================+======================+======================|
          |   0  NVIDIA A10          Off  | 00000000:00:07.0 Off |                    0 |
          |  0%   34C    P0    62W / 150W |      0MiB / 22731MiB |      0%      Default |
          |                               |                      |                  N/A |
          +-------------------------------+----------------------+----------------------+
          +-----------------------------------------------------------------------------+
          | Processes:                                                                  |
          |  GPU   GI   CI        PID   Type   Process name                  GPU Memory |
          |        ID   ID                                                   Usage      |
          |=============================================================================|
          |  No running processes found                                                 |
          +-----------------------------------------------------------------------------+
        3. (Opcional) Ative o Persistence Mode usando o NVIDIA Persistence Daemon.

          Após a instalação do driver Tesla, o Persistence Mode vem desativado (off) por padrão. O driver Tesla apresenta maior estabilidade quando o Persistence Mode está ativado. Para garantir a estabilidade do serviço, recomendamos ativar o Persistence Mode por meio do NVIDIA Persistence Daemon. Para mais informações, consulte Persistence Daemon.

          Nota
          1. Execute o comando a seguir para iniciar o NVIDIA Persistence Daemon.

            sudo nvidia-persistenced --user username 
            # Replace username with your username.
          2. Execute o comando a seguir para verificar o status do Persistence Mode.

            nvidia-smi

            A mensagem retornada indica que o Persistence-M está no estado ativado (on).

            [ecs-usexxx2q9sgg1tZ ~]$ sudo nvidia-persistenced --user ecs-user
            [ecs-usexxx2q9sgg1tZ ~]$ nvidia-smi
            Tue Sep 10 14:02:16 2024
            +-------------------------------+----------------------+----------------------+
            | NVIDIA-SMI 470.161.03   Driver Version: 470.161.03   CUDA Version: 11.4     |
            |-------------------------------+----------------------+----------------------+
            | GPU  Name        Persistence-M| Bus-Id        Disp.A | Volatile Uncorr. ECC |
            | Fan  Temp  Perf  Pwr:Usage/Cap|         Memory-Usage | GPU-Util  Compute M. |
            |                               |                      |               MIG M. |
            |===============================+======================+======================|
            |   0  NVIDIA A10          On   | 00000000:00:07.0 Off |                    0 |
            |  0%   33C    P8     8W / 150W |      0MiB / 22731MiB |      0%      Default |
            |                               |                      |                  N/A |
            +-------------------------------+----------------------+----------------------+
            +-----------------------------------------------------------------------------+
            | Processes:                                                                  |
            |  GPU   GI   CI        PID   Type   Process name                  GPU Memory |
            |        ID   ID                                                   Usage      |
            |=============================================================================|
            |  No running processes found                                                 |
            +-----------------------------------------------------------------------------+
        4. (Opcional) Configure o Persistence Mode para ativar na reinicialização do sistema.

          Se o sistema for reiniciado, o estado ativado (on) do Persistence Mode será perdido. Execute as operações a seguir para reativar o Persistence Mode.

          O pacote de instalação do driver Tesla instala scripts da NVIDIA, como scripts de exemplo e de instalação, em /usr/share/doc/NVIDIA_GLX-1.0/samples/nvidia-persistenced-init.tar.bz2.

          1. Execute os comandos a seguir para descompactar e instalar os scripts da NVIDIA.

            cd  /usr/share/doc/NVIDIA_GLX-1.0/samples/
            sudo tar xf nvidia-persistenced-init.tar.bz2
            cd  nvidia-persistenced-init
            sudo sh install.sh
          2. Execute o comando a seguir para verificar se o NVIDIA Persistence Daemon está em execução.

            sudo systemctl status nvidia-persistenced

            Se a saída for semelhante à seguinte, o NVIDIA Persistence Daemon está em execução.

            [ecs-user@xxx nvidia-persistenced-init]$ sudo systemctl status nvidia-persistenced
            ● nvidia-persistenced.service - NVIDIA Persistence Daemon
               Loaded: loaded (/usr/lib/systemd/system/nvidia-persistenced.service; enabled; vendor preset: disabled)
               Active: active (running) since Tue 2024-09-10 14:13:20 CST; 40s ago
              Process: 13882 ExecStart=/usr/bin/nvidia-persistenced --user nvidia-persistenced (code=exited, status=0/SUCCESS)
             Main PID: 13883 (nvidia-persiste)
                Tasks: 1 (limit: 383833)
               Memory: 196.0K
               CGroup: /system.slice/nvidia-persistenced.service
                       └─13883 /usr/bin/nvidia-persistenced --user nvidia-persistenced
            Sep 10 14:13:19 iZbp13orbqqx6m2q9sgg1tZ systemd[1]: Starting NVIDIA Persistence Daemon...
            Sep 10 14:13:19 iZbp13orbqqx6m2q9sgg1tZ nvidia-persistenced[13883]: Started (13883)
            Sep 10 14:13:20 iZbp13orbqqx6m2q9sgg1tZ systemd[1]: Started NVIDIA Persistence Daemon.
            Nota

            Adapte o script de instalação do NVIDIA Persistence Daemon ao seu sistema operacional para garantir o funcionamento correto.

          3. Execute o comando a seguir para verificar se o Persistence Mode está definido como on.

            nvidia-smi
          4. (Opcional) Execute os comandos a seguir para parar o NVIDIA Persistence Daemon.

            Desative o NVIDIA Persistence Daemon caso não seja mais necessário.

            sudo systemctl stop nvidia-persistenced
            sudo systemctl disable nvidia-persistenced
        5. (Condicionalmente obrigatório) Se sua instância pertencer à família ebmgn8v, ebmgn7 ou ebmgn7e , instale o serviço nvidia-fabricmanager correspondente à versão do seu driver.

          Importante
          • Se a instância pertencer à família ebmgn8v, ebmgn7 ou ebmgn7e , não será possível usar a instância GPU sem instalar o serviço nvidia-fabricmanager compatível com a versão do driver.

          • Caso sua instância GPU não pertença à família ebmgn8v, ebmgn7 ou ebmgn7e , ignore esta etapa.

          1. Instale o serviço nvidia-fabricmanager.

            Instale o serviço nvidia-fabricmanager a partir do código-fonte ou de um pacote de instalação. Os exemplos de comando a seguir destinam-se aos sistemas operacionais Ubuntu 16.04, Ubuntu 18.04, Ubuntu 20.04, Ubuntu 22.04 ou Ubuntu 24.04. Nos comandos, substitua driver_version pela versão do driver baixada na Etapa 1: Baixar o driver NVIDIA Tesla.

            Importante
            • No Ubuntu 22.04, o serviço nvidia-fabricmanager requer uma versão do driver Tesla posterior a 515.48.07. O exemplo a seguir para Ubuntu 22.04 usa a versão do driver 535.154.05.

            • No Ubuntu 24.04, o serviço nvidia-fabricmanager requer uma versão do driver Tesla posterior a 550.90.07. O exemplo a seguir para Ubuntu 24.04 usa a versão do driver 570.133.20.

            • Source code

              Ubuntu 16.04, Ubuntu 18.04 ou Ubuntu 20.04

              driver_version=460.91.03
              driver_version_main=$(echo $driver_version | awk -F '.' '{print $1}')
              distribution=$(. /etc/os-release;echo $ID$VERSION_ID | sed -e 's/\.//g')
              sudo wget https://developer.download.nvidia.com/compute/cuda/repos/$distribution/x86_64/cuda-$distribution.pin
              sudo mv cuda-$distribution.pin /etc/apt/preferences.d/cuda-repository-pin-600
              sudo wget -qO - https://developer.download.nvidia.com/compute/cuda/repos/$distribution/x86_64/3bf863cc.pub | sudo apt-key add -
              sudo echo "deb https://developer.download.nvidia.com/compute/cuda/repos/$distribution/x86_64 /" | tee /etc/apt/sources.list.d/cuda.list
              sudo apt-get update
              sudo apt-get -y install nvidia-fabricmanager-${driver_version_main}=${driver_version}-*

              Ubuntu 22.04

              driver_version=535.154.05
              driver_version_main=$(echo $driver_version | awk -F '.' '{print $1}')
              distribution=$(. /etc/os-release;echo $ID$VERSION_ID | sed -e 's/\.//g')
              sudo wget https://developer.download.nvidia.com/compute/cuda/repos/$distribution/x86_64/cuda-$distribution.pin
              sudo mv cuda-$distribution.pin /etc/apt/preferences.d/cuda-repository-pin-600
              sudo wget -qO - https://developer.download.nvidia.com/compute/cuda/repos/$distribution/x86_64/3bf863cc.pub | sudo apt-key add -
              sudo echo "deb https://developer.download.nvidia.com/compute/cuda/repos/$distribution/x86_64 /" | tee /etc/apt/sources.list.d/cuda.list
              sudo apt-get update
              sudo apt-get -y install nvidia-fabricmanager-${driver_version_main}=${driver_version}-*

              Ubuntu 24.04

              driver_version=570.133.20
              driver_version_main=$(echo $driver_version | awk -F '.' '{print $1}')
              distribution=$(. /etc/os-release;echo $ID$VERSION_ID | sed -e 's/\.//g')
              sudo wget https://developer.download.nvidia.com/compute/cuda/repos/$distribution/x86_64/cuda-$distribution.pin
              sudo mv cuda-$distribution.pin /etc/apt/preferences.d/cuda-repository-pin-600
              sudo wget -qO - https://developer.download.nvidia.com/compute/cuda/repos/$distribution/x86_64/3bf863cc.pub | sudo apt-key add -
              sudo echo "deb https://developer.download.nvidia.com/compute/cuda/repos/$distribution/x86_64 /" | tee /etc/apt/sources.list.d/cuda.list
              sudo apt-get update
              sudo apt-get -y install nvidia-fabricmanager-${driver_version_main}=${driver_version}-*
            • Installation package

              • Ubuntu 16.04

                driver_version=460.91.03
                driver_version_main=$(echo $driver_version | awk -F '.' '{print $1}')
                sudo wget https://developer.download.nvidia.com/compute/cuda/repos/ubuntu1604/x86_64/nvidia-fabricmanager-${driver_version_main}_${driver_version}-1_amd64.deb
                sudo dpkg -i nvidia-fabricmanager-${driver_version_main}_${driver_version}-1_amd64.deb
              • Ubuntu 18.04

                driver_version=460.91.03
                driver_version_main=$(echo $driver_version | awk -F '.' '{print $1}')
                sudo wget https://developer.download.nvidia.com/compute/cuda/repos/ubuntu1804/x86_64/nvidia-fabricmanager-${driver_version_main}_${driver_version}-1_amd64.deb
                sudo dpkg -i nvidia-fabricmanager-${driver_version_main}_${driver_version}-1_amd64.deb
              • Ubuntu 20.04

                driver_version=460.91.03
                driver_version_main=$(echo $driver_version | awk -F '.' '{print $1}')
                sudo wget https://developer.download.nvidia.com/compute/cuda/repos/ubuntu2004/x86_64/nvidia-fabricmanager-${driver_version_main}_${driver_version}-1_amd64.deb
                sudo dpkg -i nvidia-fabricmanager-${driver_version_main}_${driver_version}-1_amd64.deb
              • Ubuntu 22.04

                driver_version=535.154.05 
                driver_version_main=$(echo $driver_version | awk -F '.' '{print $1}')
                sudo wget https://developer.download.nvidia.com/compute/cuda/repos/ubuntu2204/x86_64/nvidia-fabricmanager-${driver_version_main}_${driver_version}-1_amd64.deb
                sudo dpkg -i nvidia-fabricmanager-${driver_version_main}_${driver_version}-1_amd64.deb
              • Ubuntu 24.04

                driver_version=570.133.20 
                driver_version_main=$(echo $driver_version | awk -F '.' '{print $1}')
                sudo wget https://developer.download.nvidia.com/compute/cuda/repos/ubuntu2404/x86_64/nvidia-fabricmanager-${driver_version_main}_${driver_version}-1_amd64.deb
                sudo dpkg -i nvidia-fabricmanager-${driver_version_main}_${driver_version}-1_amd64.deb
          2. Execute os comandos a seguir para iniciar o serviço nvidia-fabricmanager.

            sudo systemctl enable nvidia-fabricmanager
            sudo systemctl start nvidia-fabricmanager
          3. Execute o comando a seguir para verificar o status do serviço nvidia-fabricmanager.

            systemctl status nvidia-fabricmanager

            Se a saída a seguir for retornada, o serviço nvidia-fabricmanager está em execução.

            nvidia-fabricmanager.service - NVIDIA fabric manager service
               Loaded: loaded (/lib/systemd/system/nvidia-fabricmanager.service; enabled; vendor preset: enabled)
               Active: active (running) since Mon 2021-09-13 19:14:45 CST; 1 weeks 1 days ago
              Process: 1928 ExecStart=/usr/bin/nv-fabricmanager -c /usr/share/nvidia/nvswitch/fabricmanager.cfg (code=exited, status=0/SUCCESS)
             Main PID: 2140 (nv-fabricmanage)
                Tasks: 18 (limit: 19660)
               CGroup: /system.slice/nvidia-fabricmanager.service
                       └─2140 /usr/bin/nv-fabricmanager -c /usr/share/nvidia/nvswitch/fabricmanager.cfg
            Sep 13 19:14:26 xxx systemd[1]: Starting NVIDIA fabric manager service...
            Sep 13 19:14:45 xxx nv-fabricmanager[2140]: Successfully configured all the available GPUs and NVSwitches.
            Sep 13 19:14:45 xxx systemd[1]: Started NVIDIA fabric manager service.
            Nota

            A versão do pacote nvidia-fabricmanager deve corresponder à versão do driver Tesla para garantir o funcionamento correto da GPU. No Ubuntu, se você instalar o serviço nvidia-fabricmanager usando um pacote de instalação, o serviço apt-daily pode atualizar automaticamente o pacote nvidia-fabricmanager. Isso pode causar incompatibilidade de versão com o driver Tesla, impedindo a inicialização do serviço nvidia-fabricmanager e tornando a GPU inutilizável. Para resolver esse problema, consulte A GPU não funciona conforme esperado porque a versão do nvidia-fabricmanager difere da versão do driver Tesla.

        Referências