Tous les produits
Search
Centre de documentation

E-MapReduce:Create a StarRocks cluster

Dernière mise à jour :Aug 09, 2026

Créez un cluster StarRocks sur E-MapReduce et configurez ses paramètres logiciels, matériels et de base.

Prérequis

Vous avez créé un VPC et un vSwitch dans la région cible. Pour plus d'informations, consultez les rubriques Créer et gérer un VPC et Créer et gérer un vSwitch.

Procédure

  1. Accédez à la page de création du cluster.

    1. Connectez-vous à la console E-MapReduce.

    2. Facultatif : Dans la barre de navigation supérieure, sélectionnez une région et, le cas échéant, un groupe de ressources.

      • Région : Le cluster est créé dans la région sélectionnée. Ce paramètre ne peut pas être modifié après la création.

      • Groupe de ressources : Par défaut, toutes les ressources de votre compte sont affichées.

    3. En haut de la page, cliquez sur CREATE_CLUSTER.

  2. Configurez le cluster.

    Configurez les paramètres logiciels, matériels et de base du cluster.

    Important

    Une fois le cluster créé, vous ne pourrez modifier que son nom. Assurez-vous que tous les autres paramètres sont corrects avant de poursuivre.

    1. Configurez les paramètres logiciels.

      Paramètre

      Exemple

      Description

      Region

      China (Hangzhou)

      Région dans laquelle créer le cluster. Ce paramètre ne peut pas être modifié après la création.

      Business Scenario

      Data Analytics

      Sélectionnez Data Analytics.

      Product Version

      EMR-5.19.0

      Version d'E-MapReduce. La dernière version est sélectionnée par défaut.

      High Service Availability

      Off

      Lorsque cette option est activée, le cluster déploie trois nœuds master pour assurer la haute disponibilité de ResourceManager et NameNode. Vous pouvez ajuster le nombre de nœuds.

      Optional Services

      StarRocks 3

      Sélectionnez des composants supplémentaires selon vos besoins. Les processus de service associés démarrent automatiquement pour les composants sélectionnés.

      Collect Service Operational Logs

      On

      Activé par défaut. Collecte les journaux opérationnels de tous les services à des fins de diagnostic.

      Après la création du cluster, vous pouvez modifier le Collection Status of Service Operational Logs sur la page Basic Information.

      Important

      Si vous désactivez la collecte des journaux, les vérifications d'état et l'assistance technique pour E-MapReduce seront limitées. Les autres fonctionnalités ne sont pas affectées. Pour plus d'informations sur la désactivation de cette fonctionnalité et ses effets, consultez la rubrique Comment arrêter la collecte des journaux de service ?.

      StarRocks Architecture

      Shared-nothing

      Ce paramètre n'est disponible que pour StarRocks 3.x.

      StarRocks prend en charge les architectures shared-nothing et shared-data.

      • Shared-nothing (Par défaut) : Les ressources de calcul et de stockage sont étroitement couplées. Les données sont stockées sur les disques locaux des nœuds de calcul.

        Adapté aux scénarios OLAP nécessitant un traitement en temps réel et des requêtes rapides, tels que l'analyse de données et la génération de rapports BI.

      • Shared-data architecture : Les ressources de calcul et de stockage sont entièrement découplées. Les nœuds de calcul exécutent les tâches de requête, tandis que les données sont stockées dans un système de stockage distribué externe. Cela améliore la flexibilité et la fiabilité du système.

        Convient aux cas d'utilisation impliquant un stockage de données à grande échelle et nécessitant une mise à l'échelle élastique des ressources de calcul.

      DLF Unified Metadata

      Selected

      Sélectionné par défaut. Lorsque cette option est activée, les métadonnées sont stockées dans Data Lake Formation (DLF).

      Après avoir activé DLF, le système sélectionne un DLF Catalog par défaut pour vous, qui correspond à votre ID utilisateur (UID). Si vous souhaitez utiliser différents catalogues de données pour différents clusters, créez un nouveau catalogue :

      1. Cliquez sur Create Catalog. Dans la boîte de dialogue qui s'affiche, saisissez un ID de catalogue et cliquez sur OK.

      2. Dans la liste déroulante DLF Catalog, sélectionnez le catalogue que vous avez créé.

      Advanced Settings

      Off

      Custom Software Configuration : Spécifiez un fichier JSON pour configurer les logiciels sous-jacents tels que Hadoop, Spark et Hive. Désactivé par défaut.

    2. Configurez les paramètres matériels.

      Paramètre

      Exemple

      Description

      Billing Method

      pay-as-you-go

      Méthodes de facturation prises en charge :

      • Pay-as-you-go : Vous payez les ressources après leur utilisation, facturées à l'heure en fonction de l'utilisation réelle. Idéal pour les tests à court terme ou les tâches dynamiques.

      • Subscription : Vous payez les ressources à l'avance avant de les utiliser.

        Remarque

        Nous vous recommandons d'utiliser la méthode Pay-as-you-go pour les tests. Une fois vos tests concluants, créez un nouveau cluster Subscription pour la production.

      Zone

      China (Hangzhou) Zone I

      Les zones sont des emplacements physiques distincts au sein d'une région, connectés par un réseau interne à faible latence. Vous pouvez utiliser la zone par défaut dans la plupart des cas.

      VPC

      starrocks_test/vpc-bp1f4epmkvncimpgs****

      Un VPC existant est sélectionné par défaut.

      Pour créer un nouveau VPC, accédez à la console VPC. Pour plus d'informations, consultez la rubrique Créer et gérer un VPC.

      vSwitch

      vsw_test/vsw-bp1e2f5fhaplp0g6p****

      Sélectionnez un vSwitch dans la zone et le VPC choisis. Si aucun vSwitch n'est disponible dans la zone, accédez à la console VPC pour en créer un. Pour plus d'informations, consultez la rubrique VPCs et vSwitches.

      Default Security Group

      sg-bp1ddw7sm2risw**/sg-bp1ddw7sm2risw**

      Un groupe de sécurité existant est sélectionné par défaut. Pour plus d'informations, consultez la rubrique Présentation des groupes de sécurité.

      Vous pouvez également cliquer sur create a new security group. pour créer un groupe de sécurité dans la console ECS. Pour plus d'informations, consultez la rubrique Créer un groupe de sécurité.

      Important

      N'utilisez pas de groupes de sécurité avancés créés dans la console ECS.

      Node Group

      Use default values

      Sélectionnez les types d'instance en fonction de vos besoins. Pour plus d'informations, consultez la rubrique Familles d'instances.

      • Master : Exécute les services du plan de contrôle tels que ResourceManager et NameNode.

      • Core : Stocke les données dans le système de fichiers distribué (HDFS) du cluster. Vous pouvez également ajouter des nœuds Core à la demande après la création du cluster.

      • Task : Fournit une capacité de calcul supplémentaire sans stocker de données. Ce groupe de nœuds est facultatif et peut être ajouté pour augmenter les ressources de calcul.

        Important

        Les groupes de nœuds Task prennent en charge les méthodes de facturation pay-as-you-go, preemptible instance et subscription.

      • Add to Deployment Set : Lorsque la haute disponibilité est activée, les nœuds Master sont ajoutés à un ensemble de déploiement par défaut. Un ensemble de déploiement contrôle la distribution des instances. Pour plus d'informations, consultez la rubrique Ensembles de déploiement.

      • System Disk : Sélectionnez un SSD standard, un SSD amélioré (ESSD) ou un disque ultra selon vos besoins. Ajustez la taille du disque système si nécessaire.

      • Data Disk : Sélectionnez un SSD standard, un SSD amélioré (ESSD) ou un disque ultra selon vos besoins. Ajustez la taille du disque de données si nécessaire.

        Remarque

        Lorsque vous sélectionnez un SSD amélioré (ESSD), vous pouvez définir différents niveaux de performance (PL) en fonction de la capacité du disque pour répondre aux divers besoins de performance du cluster. Le niveau de performance par défaut est PL1. Selon la capacité du disque, les disques système prennent en charge PL0, PL1 et PL2, tandis que les disques de données prennent en charge PL0, PL1, PL2 et PL3. Pour plus d'informations sur les disques cloud, consultez la rubrique Présentation des disques cloud.

      • Instances : Le groupe de nœuds Master comporte une instance par défaut. Si la haute disponibilité est activée, vous pouvez avoir plusieurs instances Master.

        Le groupe de nœuds Core comporte deux instances par défaut. Vous pouvez ajuster ce nombre selon vos besoins.

      • Additional Security Group : Permet un contrôle d'accès flexible entre différentes ressources ou applications externes. Vous pouvez associer jusqu'à deux groupes de sécurité supplémentaires à ce groupe de nœuds.

      • Assign Public Network IP : Contrôle l'attribution d'une adresse IP élastique (EIP) au cluster. Désactivé par défaut. Seuls les clusters DataLake permettent d'attribuer des adresses IP publiques au niveau du groupe de nœuds.

        Remarque

        Si vous n'activez pas cette fonctionnalité mais souhaitez utiliser une adresse IP publique pour accéder au cluster après sa création, vous devez en faire la demande via la console ECS. Pour plus d'informations, consultez la rubrique Demander une EIP.

    3. Configurez les paramètres de base.

      Configurez les paramètres suivants dans la section Basic Information.

      Paramètre

      Exemple

      Description

      Cluster Name

      Emr-StarRocks

      Nom du cluster. Le nom doit comporter entre 1 et 64 caractères et ne peut contenir que des caractères chinois, des lettres, des chiffres, des traits d'union (-) et des traits de soulignement (_).

      Identity Credentials

      Password

      Key Pair (Par défaut) : Utilise une paire de clés SSH pour se connecter au nœud master.

      Pour plus d'informations sur les paires de clés, consultez la rubrique Paires de clés SSH.

      Password : Définit le mot de passe de connexion pour le nœud master. Le mot de passe doit comporter entre 8 et 30 caractères et contenir des lettres majuscules, des lettres minuscules, des chiffres et des caractères spéciaux.

      Les caractères spéciaux incluent : ! @ # $ % ^ & *.

      Les caractères spéciaux incluent le point d'exclamation (!), l'arobase (@), le dièse (#), le signe dollar ($), le signe pourcentage (%), l'accent circonflexe (^), l'esperluette (&) et l'astérisque (*).

      Paramètres avancés (facultatifs)

      Paramètre

      Description

      ECS Application Role

      Lorsque votre programme s'exécute sur un nœud de calcul EMR, vous n'avez pas besoin de spécifier un AccessKey Alibaba Cloud pour accéder aux services cloud tels qu'OSS. EMR obtient automatiquement un AccessKey temporaire, et les autorisations de cette clé sont contrôlées par un ECS Application Role.

      Bootstrap Actions

      Scripts qui s'exécutent sur les nœuds du cluster avant le démarrage des services. Utilisez-les pour installer des logiciels ou personnaliser l'environnement. Pour plus d'informations, consultez la rubrique Actions Bootstrap.

      Release Protection

      Empêche la suppression accidentelle des clusters pay-as-you-go. Si cette option est activée, vous devez la désactiver avant de pouvoir libérer le cluster. Pour plus d'informations, consultez la rubrique Activer et désactiver la protection contre la libération.

      Tags

      Ajoutez des tags lors de la création d'un cluster ou après sa création pour identifier et gérer vos ressources de cluster. Pour plus d'informations, consultez la rubrique Gérer les tags.

      Resource Group

      Regroupez vos ressources cloud par objectif, autorisations ou propriété. Pour plus d'informations, consultez la rubrique Utiliser les groupes de ressources.

      Data Disk Encryption

      Ne peut être activé que lors de la création d'un cluster. Lorsqu'elle est activée, les données au repos sur le disque de données sont chiffrées. Pour plus d'informations, consultez la rubrique Activer le chiffrement des disques de données.

      System Disk Encryption

      Ne peut être activé que lors de la création d'un cluster. Lorsqu'elle est activée, le système d'exploitation, les fichiers de programme et autres données au repos sur le disque système sont chiffrés. Pour plus d'informations, consultez la rubrique Activer le chiffrement des disques système.

      Remarks

      Enregistre des informations importantes sur le cluster. Vous pouvez ajouter ou modifier des remarques sur la page Basic Information après la création du cluster.

  3. (Facultatif) Save as Cluster Template : Si vous sélectionnez Key Pair comme identifiants de connexion, vous pouvez cliquer sur Save as Cluster Template pour enregistrer la configuration actuelle du cluster en tant que modèle de cluster.

    1. Dans la boîte de dialogue Save as Cluster Template, saisissez un Cluster Template Name et sélectionnez un Cluster Template Resource Group.

      Paramètre

      Description

      Cluster Template Name

      Saisissez un nom pour le modèle de cluster afin de faciliter la gestion. Le nom doit comporter entre 1 et 64 caractères et ne peut contenir que des caractères chinois, des lettres, des chiffres, des traits d'union (-) et des traits de soulignement (_).

      Cluster Template Resource Group

      Sélectionnez un groupe de ressources existant pour organiser vos modèles.

      Si vous devez créer un nouveau groupe de ressources, vous pouvez cliquer sur Create Resource Group. ci-dessous. Pour plus d'informations, consultez la rubrique Créer un groupe de ressources.

    2. Cliquez sur OK.

      Un nouveau modèle de cluster est ajouté au panneau Manage Cluster Templates. Pour plus d'informations sur les modèles de cluster, consultez la rubrique Créer un modèle de cluster.

  4. Cliquez sur Confirm.

    Actualisez la page pour afficher la progression de la création. Le cluster est prêt lorsque son Status passe à Running.

FAQ

Quelle est la relation entre les nœuds master, les nœuds core et les nœuds frontend (FE) et backend (BE) de StarRocks ?

Le Frontend (FE) de StarRocks est déployé sur les nœuds master. Par défaut, un seul nœud est utilisé. En mode haute disponibilité, trois nœuds master sont déployés, chacun exécutant un processus FE. L'activation de l'option High Service Availability crée un cluster haute disponibilité avec tolérance aux pannes et équilibrage de charge.

Les nœuds Backend (BE) de StarRocks sont déployés sur les nœuds core d'E-MapReduce. Chaque nœud core exécute un processus BE. Sélectionnez le nombre de nœuds core en fonction de vos besoins métier.