Tous les produits
Search
Centre de documentation

Elastic Container Instance:Créer un pod ECI accéléré par GPU

Dernière mise à jour :Aug 11, 2026

Spécifiez un type d'instance ECS accéléré par GPU pour votre pod ECI et remplacez la version par défaut du pilote GPU.

Types d'instances pris en charge

Les types d'instances accélérés par GPU conviennent à des scénarios tels que l'apprentissage profond et le traitement d'images. Vous pouvez exécuter directement des images Docker pour GPU sur des instances ECI accélérées par GPU. Un pilote de carte graphique NVIDIA est préinstallé sur chaque instance. Les versions de pilote et de CUDA prises en charge varient selon le type d'instance GPU.

Remarque

Les familles d'instances gn8ia et gn8is répertoriées dans le tableau suivant sont disponibles uniquement dans certaines régions hors de Chine. Pour utiliser ces familles d'instances, contactez l'équipe commerciale d'Alibaba Cloud.

Catégorie

Famille d'instances GPU

Versions du pilote et de CUDA

Famille d'instances accélérées par vGPU

sgn7i-vws

GRID 470, CUDA 11.4 (par défaut)

vgn7i-vws

vgn6i-vws

Famille d'instances optimisées pour le calcul GPU

gn7e

  • Tesla 470, CUDA 11.4 (par défaut)

  • Tesla 535, CUDA 12.2

  • Tesla 550, CUDA 12.4

gn7i

gn7s

gn7

gn6v

gn6e

gn6i

gn5i

gn5

gn8ia

  • Tesla 535, CUDA 12.2 (par défaut)

  • Tesla 550, CUDA 12.2

gn8is

Important

À partir du 17 mars 2025, spécifiez uniquement le numéro de version majeure des pilotes GPU, par exemple 535, au lieu du numéro de version complet, tel que 535.161.08. L'instance créée utilisera un pilote correspondant à la version majeure spécifiée, mais la version mineure pourra être mise à jour. Lorsqu'une ancienne version de pilote n'est plus publiée, une version plus récente est automatiquement utilisée pour créer l'instance. La période de prise en charge d'une version de pilote correspond à la prise en charge officielle de NVIDIA. Pour plus d'informations, consultez la documentation des pilotes NVIDIA.

Historique des mises à jour des pilotes GPU

Date de mise à jour

Description de la mise à jour

Mars 2025

  • Le pilote GRID 470 a été mis à jour vers la version 470.239.06.

  • Le pilote Tesla 470 a été mis à jour vers la version 470.256.02, le pilote Tesla 535 vers la version 535.230.02 et le pilote Tesla 550 vers la version 550.127.08.

  • Le pilote Tesla 525 n'est plus pris en charge. Si vous spécifiez ce pilote, le système revient automatiquement à la version 535.

Pour plus d'informations sur les types d'instances ECS, consultez les rubriques suivantes :

Configurer un pod GPU

Ajoutez l'annotation k8s.aliyun.com/eci-use-specs aux métadonnées du pod pour spécifier un type d'instance GPU. Chaque conteneur doit également déclarer le champ nvidia.com/gpu dans sa section resources.

Important
  • Le champ nvidia.com/gpu spécifie le nombre de GPU requis par conteneur. La création du pod échoue si ce champ est absent.

  • Par défaut, les conteneurs partagent les GPU. Le nombre de GPU alloués à un seul conteneur ne doit pas dépasser le total disponible pour le type d'instance.

Exemple de fichier YAML :

apiVersion: apps/v1
kind: Deployment
metadata:
  name: test
  labels:
    app: test
spec:
  replicas: 2
  selector:
    matchLabels:
      app: nginx
  template:
    metadata:
      name: nginx-test
      labels:
        app: nginx
        alibabacloud.com/eci: "true" 
      annotations:
        # Specify up to five GPU-accelerated ECS instance types at a time, separated by commas. 
        # The system selects the first available type from the list.
        k8s.aliyun.com/eci-use-specs: "ecs.gn6i-c4g1.xlarge,ecs.gn6i-c8g1.2xlarge"
    spec:
      containers:
      - name: nginx
        image: registry-us-east-1.aliyuncs.com/eci_open/nginx:1.14.2
        resources:
            limits:
              nvidia.com/gpu: "1"    # Request 1 GPU for this container (GPUs are shared by default).
        ports:
        - containerPort: 80
      - name: busybox
        image: registry-us-east-1.aliyuncs.com/eci_open/busybox:1.30
        command: ["sleep"]
        args: ["999999"]
        resources:
            limits:
              nvidia.com/gpu: "1"    # Request 1 GPU for this container (GPUs are shared by default).

ECI installe un pilote GPU et une version CUDA par défaut selon le type d'instance. Pour remplacer cette configuration, ajoutez l'annotation k8s.aliyun.com/eci-gpu-driver-version.

Par exemple, ecs.gn6i-c4g1.xlarge utilise par défaut Tesla 550 / CUDA 12.4. L'ajout de k8s.aliyun.com/eci-gpu-driver-version: tesla=535 permet de basculer vers Tesla 535 / CUDA 12.2 :

apiVersion: apps/v1
kind: Deployment
metadata:
  name: test
  labels:
    app: test
spec:
  replicas: 1
  selector:
    matchLabels:
      app: nginx
  template:
    metadata:
      name: nginx-test
      labels:
        app: nginx
        alibabacloud.com/eci: "true" 
      annotations:
        # Specify a supported GPU instance type that allows you to change the driver version.
        k8s.aliyun.com/eci-use-specs: ecs.gn6i-c4g1.xlarge
        # Override the default driver version (Tesla 550) with Tesla 535.
        k8s.aliyun.com/eci-gpu-driver-version: tesla=535
    spec:
      containers:
      - name: nginx
        image: registry-us-east-1.aliyuncs.com/eci_open/nginx:1.14.2
        resources:
            limits:
              nvidia.com/gpu: "1"    # Request 1 GPU for this container.