Todos os produtos
Search
Central de documentação

Elastic Container Instance:Crie um pod ECI acelerado por GPU

Última atualização: Jun 28, 2026

Especifique um tipo de instância ECS acelerada por GPU para seu pod ECI e substitua a versão padrão do driver de GPU.

Tipos de instância suportados

Os tipos de instância acelerados por GPU são adequados para cenários como deep learning e edição de imagens. É possível executar imagens Docker para GPUs diretamente em instâncias ECI aceleradas por GPU. Cada instância possui um driver de placa gráfica NVIDIA pré-instalado. As versões de driver e CUDA suportadas variam conforme o tipo de instância GPU.

Nota

As famílias de instâncias gn8ia e gn8is na tabela a seguir estão disponíveis apenas em algumas regiões fora da China. Para utilizar essas famílias de instâncias, entre em contato com a equipe de vendas da Alibaba Cloud.

Categoria

Família de instâncias GPU

Versões de driver e CUDA

Família de instâncias aceleradas por vGPU

sgn7i-vws

GRID 470, CUDA 11.4 (padrão)

vgn7i-vws

vgn6i-vws

Família de instâncias otimizadas para computação aceleradas por GPU

gn7e

  • Tesla 470, CUDA 11.4 (padrão)

  • Tesla 535, CUDA 12.2

  • Tesla 550, CUDA 12.4

gn7i

gn7s

gn7

gn6v

gn6e

gn6i

gn5i

gn5

gn8ia

  • Tesla 535, CUDA 12.2 (padrão)

  • Tesla 550, CUDA 12.2

gn8is

Importante

A partir de 17 de março de 2025, especifique apenas o número principal da versão para drivers de GPU, como 535, em vez do número completo da versão, como 535.161.08. A instância criada usará um driver com a versão principal especificada, mas a versão secundária poderá ser atualizada. Quando um driver mais antigo for descontinuado, uma versão mais recente será usada automaticamente para criar a instância. O período de suporte de uma versão de driver segue o suporte oficial da NVIDIA. Para obter mais informações, consulte Documentação de Drivers NVIDIA.

Histórico de atualizações de drivers GPU

Data da atualização

Descrição da atualização

Março de 2025

  • O driver GRID 470 foi atualizado para 470.239.06.

  • O driver Tesla 470 foi atualizado para 470.256.02, o driver Tesla 535 para 535.230.02 e o driver Tesla 550 para 550.127.08.

  • O driver Tesla 525 não é mais suportado. Caso você especifique este driver, o sistema reverterá para a versão 535.

Para obter mais informações sobre os tipos de instância ECS, consulte os seguintes tópicos:

Configure um pod GPU

Adicione a anotação k8s.aliyun.com/eci-use-specs aos metadados do pod para especificar um tipo de instância GPU. Cada contêiner também deve declarar o campo nvidia.com/gpu em sua seção de resources.

Importante
  • O campo nvidia.com/gpu define a quantidade necessária de GPUs por contêiner. Sem ele, a criação do pod falha.

  • Por padrão, os contêineres compartilham GPUs. A quantidade de GPUs de um único contêiner não deve exceder o total disponível no tipo de instância.

Exemplo de YAML:

apiVersion: apps/v1
kind: Deployment
metadata:
  name: test
  labels:
    app: test
spec:
  replicas: 2
  selector:
    matchLabels:
      app: nginx
  template:
    metadata:
      name: nginx-test
      labels:
        app: nginx
        alibabacloud.com/eci: "true" 
      annotations:
        # Specify up to five GPU-accelerated ECS instance types at a time, separated by commas. 
        # The system selects the first available type from the list.
        k8s.aliyun.com/eci-use-specs: "ecs.gn6i-c4g1.xlarge,ecs.gn6i-c8g1.2xlarge"
    spec:
      containers:
      - name: nginx
        image: registry-us-east-1.aliyuncs.com/eci_open/nginx:1.14.2
        resources:
            limits:
              nvidia.com/gpu: "1"    # Request 1 GPU for this container (GPUs are shared by default).
        ports:
        - containerPort: 80
      - name: busybox
        image: registry-us-east-1.aliyuncs.com/eci_open/busybox:1.30
        command: ["sleep"]
        args: ["999999"]
        resources:
            limits:
              nvidia.com/gpu: "1"    # Request 1 GPU for this container (GPUs are shared by default).

O ECI instala uma versão padrão de driver de GPU e CUDA para cada tipo de instância. Para substituir essa configuração, adicione a anotação k8s.aliyun.com/eci-gpu-driver-version.

Por exemplo, o tipo ecs.gn6i-c4g1.xlarge usa por padrão Tesla 550 / CUDA 12.4. Ao adicionar k8s.aliyun.com/eci-gpu-driver-version: tesla=535, a configuração muda para Tesla 535 / CUDA 12.2:

apiVersion: apps/v1
kind: Deployment
metadata:
  name: test
  labels:
    app: test
spec:
  replicas: 1
  selector:
    matchLabels:
      app: nginx
  template:
    metadata:
      name: nginx-test
      labels:
        app: nginx
        alibabacloud.com/eci: "true" 
      annotations:
        # Specify a supported GPU instance type that allows you to change the driver version.
        k8s.aliyun.com/eci-use-specs: ecs.gn6i-c4g1.xlarge
        # Override the default driver version (Tesla 550) with Tesla 535.
        k8s.aliyun.com/eci-gpu-driver-version: tesla=535
    spec:
      containers:
      - name: nginx
        image: registry-us-east-1.aliyuncs.com/eci_open/nginx:1.14.2
        resources:
            limits:
              nvidia.com/gpu: "1"    # Request 1 GPU for this container.

Instruções

  1. Leia o conteúdo em inglês para compreender O QUE precisa ser comunicado

  2. Escreva o português brasileiro DO ZERO — esqueça a estrutura das frases em inglês

  3. Preserve toda a formatação markdown, blocos de código, links e imagens exatamente como estão

  4. Tags xref (<a data-tag="xref" ...>texto</a>) — preserve a tag INTEIRA com todos os atributos na ordem e caixa originais, traduza APENAS o texto visível entre > e

  5. Aplique todas as regras específicas do idioma rigorosamente

  6. Aplique as regras de stopwords com tolerância zero

  7. Use o modo imperativo em passos numerados e listas de procedimentos

  8. Garanta a consistência terminológica — mesmo termo = mesma tradução em todo o documento

  9. Varie os inícios de frase em listas/tabelas — nenhum início repetido mais de 3 vezes

  10. Retorne APENAS o documento markdown em português brasileiro, sem explicações