Tous les produits
Search
Centre de documentation

DataWorks:Gestion des données Hive

Dernière mise à jour :Aug 10, 2026

Le catalogue de données offre une interface unifiée pour gérer les métadonnées Hive. Cette rubrique décrit comment créer et gérer des tables dans le catalogue de données.

Accéder au catalogue de données Hive

  1. Accédez à la page Workspaces de la console DataWorks. Dans la barre de navigation supérieure, sélectionnez la région souhaitée. Localisez l'espace de travail concerné et choisissez Shortcuts > Data Studio dans la colonne Actions.

  2. Dans le volet de navigation de gauche, cliquez sur l'icône image. Dans l'arborescence Data Directory, cliquez sur Hive pour ouvrir la page de gestion du catalogue de données Hive.

Créer un catalogue de données Hive

Sur la page de gestion du catalogue de données Hive, ajoutez des sources de données Hive existantes à la liste du catalogue de données.

  1. À droite du catalogue de données Hive, cliquez sur l'icône image pour accéder à la page Add Instance.

  2. Dans l'onglet DataWorks Data Source, ajoutez une source de données Hive à la liste du catalogue de données.

    1. Pour gérer les ressources de calcul EMR associées au nouveau Data Studio dans l'espace de travail actuel, localisez la source de données du cluster EMR correspondante dans l'onglet DataWorks Data Source et cliquez sur Add dans la colonne Operation.

    2. Sélectionnez également plusieurs sources de données Hive dans l'onglet DataWorks Data Source et cliquez sur le bouton Batch Add en bas de la liste pour les ajouter en masse.

Gérer un catalogue de données Hive

Ajoutez et gérez des tables Hive dans le catalogue de données Hive.

Créer une table

  1. Cliquez sur l'icône image à gauche du catalogue de données Hive pour développer l'arborescence, puis localisez Table sous la base de données.

  2. Cliquez sur l'icône image à droite de Table pour accéder à la page Create Table.

  3. Générez les informations de base de la table et les informations de colonne en utilisant l'une des méthodes suivantes :

    • Créer une table à l'aide de Copilot :

      1. Dans la barre d'outils en haut de la page, cliquez sur Copilot table creation pour ouvrir l'interface Copilot Chat.

      2. Saisissez une instruction de création de table en langage naturel (par exemple, Create a user table).

      3. Cliquez sur Generate and Replace. Le système génère un nom de table par défaut et les informations de colonne basées sur votre instruction.

      4. Si le nom de la table et les colonnes correspondent à vos attentes, cliquez sur Accept.

        Remarque

        Si vous devez modifier certaines informations de la table, cliquez d'abord sur Accept, puis modifiez manuellement les informations de table générées par le système.

    • Créer une table manuellement :

      Créez une table en suivant les descriptions des paramètres.

      Parameter

      Description

      Informations de base

      Spécifiez le Table Name, la description de la table et d'autres informations.

      Informations de colonne

      Modifiez les noms des colonnes et les commentaires des colonnes.

      • Modification manuelle : Cliquez sur le bouton Insert au-dessus de la liste des informations de colonne, spécifiez le nombre de lignes à insérer, puis modifiez le Field Name, le Data Type et d'autres informations.

      • Modification intelligente par Copilot : Cliquez sur Generate Field ou Generate field descriptions au-dessus de la liste des informations de colonne. Le système génère les colonnes pertinentes et les descriptions en fonction du nom de la table et de la description de la table que vous avez spécifiés.

  4. (Facultatif) Configurez les informations de partition.

    Pour créer une table partitionnée, spécifiez le nombre de lignes de colonne de partition (plusieurs partitions sont prises en charge) dans la section Partition Field et cliquez sur Insert. Définissez le Field Name de partition, le Data Type et d'autres informations dans la liste des colonnes de partition selon vos besoins métier.

  5. (Facultatif) Configurez les paramètres avancés.

    Parameter

    Description

    Type de table

    Seule l'Internal Table est prise en charge.

    Emplacement de stockage

    Vous pouvez spécifier un répertoire de stockage personnalisé pour la table. Par exemple, /user/hive/warehouse/hive_work.

    Format de stockage

    Les formats de stockage suivants sont pris en charge : CSV, PARQUET, ORC, AVRO, JSON et SELE_DEFINE. Le système définit automatiquement le format d'entrée, le format de sortie et la méthode de sérialisation/désérialisation en fonction du format de stockage sélectionné.

    • CSV : Un format de fichier texte séparé par des virgules, adapté aux structures de données simples.

    • PARQUET : Un format de stockage colonnaire avec des taux de compression élevés, adapté à l'analyse des big data.

    • ORC : Un format de stockage colonnaire optimisé offrant d'excellentes performances et prenant en charge les types de données complexes.

    • AVRO : Un format binaire qui prend en charge l'évolution du schéma, adapté aux structures de données dynamiques.

    • JSON : Un format qui prend en charge les structures imbriquées, adapté aux données semi-structurées.

    • SELE_DEFINE : Vous permet de définir une logique de sérialisation et de désérialisation personnalisée.

  6. Une fois la configuration terminée, cliquez sur Publish dans la barre d'outils en haut pour créer la table.

Gérer les tables

Après avoir créé une table dans le catalogue de données Hive, cliquez sur l'icône image à gauche du catalogue de données Hive, puis cliquez sur Table pour accéder à la page Table.

  1. Consultez les tables.

    Sur la page Table, consultez les informations de base de toutes les tables. Vous pouvez également cliquer sur un nom de table spécifique pour consulter les Details, les Basic information et les informations DDL de la table.

  2. Supprimez des tables.

    Sur la page Table, localisez la table que vous souhaitez supprimer et cliquez sur Delete dans la colonne Operation.

    Important

    Les tables supprimées ne peuvent pas être récupérées. Agissez avec prudence.

Consulter et supprimer un catalogue de données Hive

Si vous n'avez plus besoin d'un catalogue de données Hive, consultez ou supprimez le catalogue de données Hive correspondant.

  1. Consultez un catalogue de données.

    1. Après avoir ajouté une source de données Hive au catalogue de données Hive, cliquez sur l'icône image à gauche du catalogue de données Hive pour consulter les sources de données Hive ajoutées.

    2. Cliquez sur la source de données Hive correspondante pour consulter toutes les informations Database dans l'instance Hive.

  2. Dissociez un projet.

    Si vous n'avez plus besoin de gérer un catalogue de données Hive, faites un clic droit sur le catalogue de données Hive correspondant et sélectionnez Disassociate Data Catalog dans le menu contextuel.