Tous les produits
Search
Centre de documentation

Elastic GPU Service:Guide des opérations courantes pour les instances GPU

Dernière mise à jour :Aug 10, 2026

Les instances accélérées par GPU sont un type d'instance Elastic Compute Service (ECS) et se gèrent comme les instances ECS standard. Parmi les opérations courantes figurent la connexion à distance, le changement de système d'exploitation, l'extension des disques cloud, la mise à niveau ou la rétrogradation des configurations d'instance, ainsi que l'utilisation de snapshots ou d'images.

Achat et utilisation d'une instance ECS

Suivez ces étapes pour comprendre le cycle de vie complet d'une instance, de sa sélection et de son achat à son utilisation, sa maintenance (O&M) et sa libération.

  1. Comprendre les familles d'instances :

    Avant d'acheter une instance ECS, familiarisez-vous avec les fonctionnalités, les types disponibles et les scénarios d'utilisation des différentes familles d'instances ECS. Vous choisirez ainsi la famille adaptée à vos besoins métier. Pour plus d'informations, consultez la rubrique Familles d'instances.

  2. Comprendre les méthodes de facturation :

    Chaque méthode de facturation convient à des scénarios métier spécifiques. Par exemple, l'abonnement s'applique généralement aux services fonctionnant 24 h/24 et 7 j/7. Le paiement à l'utilisation convient aux applications ou services connaissant des pics de trafic. Pour plus d'informations, consultez la rubrique Présentation des méthodes de facturation.

  3. Acheter une instance ECS :

    • Acheter rapidement une instance par abonnement : Achetez une instance ECS en quelques minutes grâce à la méthode la plus simple. Toutefois, seuls certains types d'instances et images sont pris en charge, et la plupart des configurations ne peuvent pas être personnalisées.

    • Personnaliser l'achat de votre instance : Sélectionnez librement les configurations telles que le type d'image, le type d'instance, le stockage, la bande passante et le groupe de sécurité, en fonction de votre scénario métier.

    Pour plus d'informations sur l'achat d'une instance, consultez la rubrique Créer une instance.

  4. Se connecter à une instance à distance :

  5. Utiliser ECS pour déployer des environnements, sites web et applications courants :

  6. Gérer l'état d'une instance ECS :

    • Démarrer une instance : Une instance arrêtée ne peut pas fournir de services. Démarrez l'instance avant de l'utiliser.

    • Arrêter une instance : Arrêtez l'instance avant d'effectuer certaines opérations, telles que le changement de système d'exploitation, la modification de l'adresse IP privée ou le changement du type d'instance d'une instance facturée à l'utilisation.

    • Redémarrer une instance : Le redémarrage permet de maintenir une instance ECS, par exemple après une mise à jour du système ou pour appliquer des modifications de configuration.

  7. Libérer une instance :

    Lorsque vous n'avez plus besoin d'une ressource ECS, libérez l'instance rapidement pour éviter des frais supplémentaires. Pour plus d'informations, consultez la rubrique Libérer une instance.

Modifier les configurations d'instance

Si la configuration actuelle de votre instance ECS ne répond pas à vos besoins métier, modifiez le type d'instance (vCPU et mémoire), la configuration de la bande passante publique, la taille du disque ou le système d'exploitation.

Modifier le type d'instance

Modifier la configuration de la bande passante

Étendre un disque

Augmentez la capacité d'un disque existant pour répondre à des besoins de stockage de données plus importants. Pour plus d'informations, consultez le Guide d'extension de disque.

Changer le système d'exploitation de l'instance

  • Changer le système d'exploitation (remplacer le disque système) : Cette opération remplace le disque système et son image. L'ancien disque système est libéré et toutes ses données sont effacées. Avant d'effectuer cette opération, créez un snapshot du disque système pour sauvegarder ses données.

  • Migrer le système d'exploitation : Lorsqu'un système d'exploitation n'est plus pris en charge en raison de son cycle de vie, de changements dans le support tiers ou de l'évolution des projets open source, migrez l'instance ECS vers un nouveau système d'exploitation. Cette opération conserve les données sur le disque système de l'instance.

Gérer les données

Utilisez le stockage par blocs pour stocker le système d'exploitation et les données métier de vos instances. Utilisez également des snapshots pour sauvegarder les données périodiquement et améliorer leur fiabilité.

Stockage par blocs

Elastic Block Storage est un produit de périphérique de bloc fourni par Alibaba Cloud pour ECS. Il comprend trois types : disques, disques locaux et disques éphémères élastiques. Formatez et créez un système de fichiers sur un dispositif de stockage par blocs attaché à une instance ECS, comme vous le feriez avec un disque dur physique. Pour plus d'informations, consultez la Présentation du stockage par blocs. Voici les opérations courantes pour le stockage par blocs :

  • Création et utilisation de disques

    Un disque peut être attaché à une instance ECS en tant que disque système (pour stocker les données du système d'exploitation) ou disque de données (pour stocker les données métier). Créez et utilisez des disques pour fournir un stockage persistant à vos instances ECS. Pour plus d'informations, consultez la rubrique Créer et utiliser un disque.

  • Réinitialiser un disque

    Réinitialisez un disque pour effacer ses données et le restaurer à son état initial. Pour plus d'informations, consultez la rubrique Réinitialiser un disque.

  • Étendre un disque

    Augmentez la capacité d'un disque existant pour répondre à des besoins de stockage de données plus importants et prévenir des problèmes tels que la perte de données due à un espace de stockage insuffisant. Pour plus d'informations, consultez le Guide d'extension de disque.

Snapshots

Un snapshot est une copie complète des données d'un disque à un instant donné. C'est un outil important de reprise après sinistre. Utilisez des snapshots pour sauvegarder périodiquement les données métier de vos disques afin d'atténuer le risque de perte de données dû à des opérations accidentelles, des attaques ou des virus. Pour plus d'informations, consultez la Présentation.

  • Créer un snapshot manuel

    Avant d'effectuer des opérations majeures telles que la restauration d'un disque, la modification de fichiers système critiques ou le changement de système d'exploitation, créez un snapshot du disque (disque système ou disque de données). Si l'opération cause des problèmes imprévus ou une perte de données, utilisez le snapshot pour récupérer les données et assurer la continuité de l'activité.

    Pour plus d'informations sur la création manuelle d'un snapshot pour un seul disque, consultez la rubrique Créer un snapshot.

  • Créer un snapshot automatique

    Créez une politique de snapshot automatique et appliquez-la à vos disques. Une fois la politique appliquée, Alibaba Cloud crée automatiquement des snapshots pour les disques aux moments spécifiés. Pour plus d'informations, consultez les rubriques Créer une politique et Appliquer une politique de snapshot automatique à un disque.

Gérer les réseaux

La construction d'un réseau privé évolutif dans le cloud et la mise en œuvre d'un contrôle d'accès strict sont des éléments importants de la sécurité réseau.

Construire un réseau VPC

Un cloud privé virtuel (VPC) est un réseau privé personnalisé que vous créez sur Alibaba Cloud. Personnalisez la plage d'adresses IP, les sous-réseaux, les tables de routage et les politiques de sécurité réseau. Différents VPC sont isolés logiquement au niveau de la couche 2. Un VPC vous offre un meilleur contrôle sur l'accès aux ressources et améliore la sécurité et la flexibilité des données. Découvrez les composants d'un VPC, puis planifiez, créez et gérez vos VPC. Pour plus d'informations, consultez la rubrique Cloud privé virtuel (VPC).

Activer l'accès Internet

Une fois l'accès Internet activé pour une instance, l'instance ECS peut communiquer avec Internet. Activez l'accès Internet pour une instance en attribuant une adresse IP publique statique ou une adresse IP élastique (EIP). Pour plus d'informations, consultez la rubrique Activer l'accès Internet.

Accéder aux ressources au sein d'un VPC

Par rapport à l'accès via le réseau public, l'accès via le réseau privé est complètement isolé de l'extérieur. Il convient à la communication interne nécessitant une sécurité élevée et une vitesse de transmission rapide. Utilisez des adresses IP privées ou des endpoints privés pour l'accès au réseau privé. Pour plus d'informations, consultez la rubrique Accéder aux ressources au sein d'un VPC.

Améliorer les performances réseau

Utilisez l'accès direct à la mémoire à distance élastique (eRDMA) pour améliorer les performances réseau. eRDMA est un réseau RDMA élastique propriétaire développé par Alibaba Cloud. Il présente les avantages des cartes d'interface réseau RDMA traditionnelles et applique la technologie RDMA traditionnelle aux réseaux VPC. La latence ultra-faible vous permet de bénéficier des performances supérieures de RDMA dans un réseau cloud. Utilisez eRDMA comme suit :

Améliorer l'efficacité de la gestion des adresses IP

Utilisez des listes de préfixes pour gérer les adresses IP plus efficacement. Une liste de préfixes est une collection de préfixes réseau (blocs CIDR). Référenciez une liste de préfixes lors de la configuration des règles réseau pour d'autres ressources. Ajoutez des blocs CIDR fréquemment utilisés à une liste de préfixes. Cela vous évite d'ajouter répétitivement plusieurs règles pour différents blocs CIDR lors de la configuration des règles réseau et améliore l'efficacité des opérations et de la maintenance.

Les listes de préfixes peuvent être référencées lors de la configuration des règles de groupe de sécurité. Pour plus d'informations, consultez la rubrique Utiliser des listes de préfixes et des listes de ports pour gérer efficacement les règles de groupe de sécurité.

Utiliser plusieurs adresses IP pour plusieurs applications

Utilisez des interfaces réseau élastiques (ENI) pour utiliser plusieurs adresses IP pour plusieurs applications. Une ENI est une interface réseau virtuelle qui fournit des interfaces réseau et des adresses IP pour les instances ECS dans un VPC. Attachez une ou plusieurs ENI à chaque instance ECS. Les ENI prennent en charge plusieurs adresses IP. Cela permet à une seule instance de fournir des services au public ou d'accéder à des ressources externes via plusieurs adresses IP. Pour plus d'informations, consultez la rubrique Créer et utiliser une ENI.

Protection de la sécurité

Utilisez les fonctionnalités suivantes pour améliorer la sécurité de vos instances sous différents angles. Pour plus d'informations sur l'amélioration de la sécurité, consultez la rubrique Sécurité ECS.

Groupes de sécurité

Un groupe de sécurité est un pare-feu virtuel qui contrôle le trafic entrant et sortant pour les instances ECS en fonction des règles de groupe de sécurité configurées. Il empêche l'accès non autorisé et les intrusions malveillantes. Les composants et les opérations courantes pour les règles de groupe de sécurité sont les suivants :

  • Composants de règle : Une règle de groupe de sécurité se compose d'un objet d'autorisation, d'une plage de ports, d'un type de protocole, d'une politique d'autorisation (autoriser ou refuser) et d'une priorité. Pour plus d'informations, consultez la rubrique Règles de groupe de sécurité.

  • Créer et utiliser un groupe de sécurité : Créez un groupe de sécurité et associez-le à une instance ECS pour contrôler le trafic entrant et sortant de l'instance. Cela permet d'assurer l'isolation et la communication réseau. Pour plus d'informations, consultez les rubriques Créer un groupe de sécurité et Associer un groupe de sécurité à une instance (ENI principale).

  • Gérer les règles de groupe de sécurité : Ajoutez, modifiez ou supprimez des règles pour un groupe de sécurité. Ces modifications s'appliquent automatiquement à toutes les instances ECS du groupe de sécurité. Pour plus d'informations, consultez la rubrique Gérer les règles de groupe de sécurité.

Cas d'utilisation des groupes de sécurité

Nous proposons plusieurs cas d'utilisation pour les groupes de sécurité dans des scénarios courants. Ces cas montrent comment configurer les règles de groupe de sécurité pour répondre à vos besoins de gestion du trafic réseau. Pour plus d'informations, consultez le Guide d'application et cas d'utilisation des groupes de sécurité.

Paires de clés

Une paire de clés est un identifiant de connexion utilisé pour se connecter à une instance via le protocole Secure Shell (SSH). Elle est beaucoup plus sécurisée qu'un mot de passe utilisateur classique et peut prévenir les attaques par force brute. Associez une paire de clés à une instance pour activer la connexion sans mot de passe. Pour plus d'informations, consultez la rubrique Associer manuellement une paire de clés pour activer la connexion SSH sans mot de passe.

Déploiement et élasticité

Mise à l'échelle des ressources

Créez des instances ECS rapidement et automatiquement pour gérer les pics soudains de trafic Internet.

  • Modèles de lancement

    Un modèle de lancement est un outil permettant de créer rapidement des instances. Il peut stocker des informations de configuration personnalisées pour la création d'instances ECS. Chaque modèle peut avoir plusieurs versions, et chaque version peut avoir des paramètres différents. Utilisez une version spécifique d'un modèle pour créer rapidement une instance.

    Pour plus d'informations sur la création d'un modèle de lancement et son utilisation pour créer une instance ECS, consultez les rubriques Créer un modèle de lancement et Utiliser un modèle de lancement pour créer une instance.

  • Groupes de mise à l'échelle

    Pour augmenter ou diminuer automatiquement le nombre d'instances ECS lorsque la demande de votre activité fluctue, configurez un groupe de mise à l'échelle pour ajuster automatiquement votre capacité de calcul (le nombre d'instances). Créez un groupe de mise à l'échelle basé sur une instance ECS existante. Pour plus d'informations, consultez la rubrique Créer un groupe de mise à l'échelle basé sur une instance ECS.

Atteindre une haute disponibilité avec des ensembles de déploiement

Un ensemble de déploiement est une politique de placement pour les instances ECS sur des serveurs physiques. Une politique appropriée peut vous aider à éviter les points de défaillance uniques et à réduire la latence de communication réseau. Sélectionnez une politique de déploiement selon vos besoins en matière de haute disponibilité, de latence réseau et d'échelle de déploiement. Ensuite, créez un ensemble de déploiement basé sur la politique et créez ou ajoutez des instances ECS à l'ensemble de déploiement. Pour plus d'informations, consultez la rubrique Ensembles de déploiement.

Outils IaC

Utilisez des outils d'infrastructure as code (IaC) pour créer et gérer les ressources ECS plus simplement.

  • Resource Orchestration Service (ROS) : Un service de déploiement automatisé fourni par Alibaba Cloud qui simplifie la gestion des ressources de cloud computing et adopte la philosophie de conception IaC. Définissez uniquement les ressources cloud requises dans un modèle ROS. Le moteur d'orchestration ROS crée et configure ensuite automatiquement toutes les ressources en fonction du modèle, réalisant ainsi un déploiement et une maintenance automatisés.

    Utilisez la console ROS ou appelez une API pour créer un modèle de pile afin de créer et gérer rapidement des ressources. Pour plus d'informations, consultez les rubriques Créer une pile ou Présentation de l'API. Voici des exemples de modèles pour les instances ECS courantes et les ressources associées :

  • Terraform

    Terraform est un outil IaC open source. Il permet aux développeurs de définir et de gérer les configurations d'infrastructure à l'aide d'un langage déclaratif. Il offre un moyen simple de créer, modifier ou supprimer des ressources ECS, réduisant la complexité et les erreurs des opérations manuelles et améliorant la gérabilité et la maintenabilité de l'infrastructure.

    Installez et configurez Terraform, puis utilisez-le pour gérer les instances ECS. Pour plus d'informations, consultez la Référence Terraform.

Opérations, maintenance et surveillance

Configurer des alertes pour une instance

Activez les alertes en un clic ou définissez des règles d'alerte personnalisées pour vos instances ECS. Cela vous aide à détecter rapidement les anomalies des instances et à traiter les risques potentiels. Pour plus d'informations, consultez la rubrique Configurer des règles d'alerte pour une instance ECS.

Événements système

Alibaba Cloud définit les événements système pour enregistrer et vous notifier des informations concernant vos ressources cloud. Cela vous aide à comprendre les risques et les anomalies et à réaliser une maintenance automatisée. Pour plus d'informations, consultez la Présentation des événements système ECS.

Outils de maintenance automatisée

  • Cloud Assistant

    Cloud Assistant est un outil natif de maintenance automatisée conçu pour ECS. Il vous permet d'exécuter des commandes (telles que Shell, PowerShell et Bat) par lots sans mot de passe, connexion ou serveur de rebond. Utilisez-le pour effectuer des tâches telles que l'exécution de scripts de maintenance automatisés, l'interrogation de processus, l'installation ou la désinstallation de logiciels, le démarrage ou l'arrêt de services, et l'installation de correctifs ou de mises à jour de sécurité.

  • CloudOps Orchestration Service (OOS)

    OOS est un service de maintenance automatisée fourni par Alibaba Cloud qui peut gérer et exécuter automatiquement des tâches. Utilisez des modèles pour définir les tâches à exécuter, l'ordre d'exécution, ainsi que les entrées et sorties. Ensuite, exécutez les modèles pour automatiser les tâches.

Services de migration

Maintenant que vous connaissez les capacités d'ECS, il est temps de migrer vos services sur site vers le cloud.

Migration vers le cloud

Migrez des machines physiques sur site, des machines virtuelles sur site ou des serveurs cloud d'autres fournisseurs de services cloud vers Alibaba Cloud. Effectuez la migration en important des images personnalisées ou en utilisant Server Migration Center, une plateforme de migration fournie par Alibaba Cloud. Pour plus d'informations, consultez la rubrique Migration vers le cloud.

Migration au sein du cloud

Pour migrer une instance ECS Alibaba Cloud d'un compte ou d'une région vers un autre en raison d'un inventaire de ressources insuffisant, d'une optimisation des coûts, d'une reprise après sinistre ou d'une réduction de l'échelle du disque, migrez des ressources. Vous pouvez également migrer une instance Simple Application Server vers une instance ECS, ou un Dedicated Host (DDH) vers une instance ECS. Sélectionnez une méthode de migration adaptée en fonction du scénario. Pour plus d'informations, consultez la rubrique Migration au sein du cloud.

Développement

Intégrez programmatiquement les capacités ECS dans vos systèmes métier. Ces capacités incluent, mais ne sont pas limitées à, la création, la modification et la maintenance des instances. Cela simplifie les opérations et gère les coûts. Pour plus d'informations, consultez la Présentation de l'intégration.

  • ECS OpenAPI : L'OpenAPI fournie par ECS.

  • Méthodes d'intégration : ECS prend en charge la gestion des ressources via des méthodes telles que les kits de développement logiciel (SDK) et l'interface de ligne de commande (CLI).