Data Catalog centralise les métadonnées issues de MaxCompute, Hologres, DLF et d'autres sources. Il vous permet de créer des tables, de gérer des vues et de préparer vos données sans quitter DataWorks.
Fonctionnalités clés
Gestion unifiée : Gérez et recherchez de manière centralisée les tables, vues, fonctions et ressources provenant de plusieurs sources de données.
-
Création rapide de tables : Créez directement des schémas de table dans DataWorks, sans changer de console.
Création par DDL : Utilisez des instructions DDL natives pour un contrôle précis et flexible.
Création visuelle : Créez des tables via une interface basée sur des formulaires.
Création assistée par Copilot : Décrivez vos besoins en langage naturel et laissez l'IA générer le schéma de la table.
Synchronisation en un clic : Lancez des tâches de synchronisation de données entre des sources telles que MaxCompute et Hologres.
Exploration rapide : Prévisualisez les schémas de table pour comprendre vos données en un coup d'œil.
Catalogues de données pris en charge
Le tableau suivant répertorie les types de sources de données pris en charge et la méthode pour les ajouter.
|
Catalogue de données |
Depuis l'espace de travail |
Depuis le compte |
|
MaxCompute (projets internes et externes) |
|
|
|
Hologres (bases de données internes et externes) |
|
|
|
Catalogue DLF (DLF 1.0, DLF 2.0, DLF 2.5 et versions ultérieures) |
|
|
|
Hive (EMR Hive) |
|
|
|
Lindorm |
|
|
|
AnalyticDB MySQL |
|
|
|
AnalyticDB PostgreSQL |
|
|
|
StarRocks |
|
|
|
Catalogue IA (jeux de données IA et modèles IA) |
Lecture automatique depuis l'espace de travail IA portant le même nom que l'espace de travail DataWorks actuel. |
|
Authentification et autorisation
La manière dont Data Catalog accède à une source de données dépend de la méthode d'ajout de cette source :
Pour les sources de données associées à un espace de travail, Data Catalog utilise l'identité configurée dans la source de données pour accéder aux métadonnées.
Pour les sources de données au niveau du compte, Data Catalog utilise votre identité personnelle pour accéder aux métadonnées.
-
Pour afficher les données MaxCompute dans Data Catalog avec un utilisateur RAM ou un rôle RAM, obtenez d'abord les autorisations MaxCompute requises. Si le modèle à trois niveaux est activé pour la source de données ou le projet MaxCompute, accordez également à l'utilisateur RAM ou au rôle RAM l'autorisation d'afficher les métadonnées du schéma.
RemarqueSi un projet MaxCompute contient plusieurs schémas, accordez les autorisations de métadonnées pour tous les schémas afin d'afficher la liste complète des schémas sur la page des détails du projet.
-
Accorder des autorisations à un utilisateur RAM :
GRANT DESCRIBE ON SCHEMA <schema_name> TO USER RAM$<alibaba_cloud_account_name>:<ram_user_name>; -
Accorder des autorisations à un rôle RAM :
GRANT DESCRIBE ON SCHEMA <schema_name> TO USER `RAM$<alibaba_cloud_account_name>:role/<ram_role_name>`;
-
Accéder à Data Catalog
Cette fonctionnalité est disponible uniquement dans les espaces de travail qui utilisent Use Data Studio (New Version).
Accédez à la page Espaces de travail de la console DataWorks. Dans la barre de navigation supérieure, sélectionnez la région souhaitée. Localisez l'espace de travail concerné et choisissez dans la colonne Actions.
Dans le volet de navigation de gauche, cliquez sur
pour ouvrir Data Catalog.
Ajouter un catalogue de données
Pour ajouter un catalogue de données :
Dans Data Catalog, localisez le type de source de données à ajouter et cliquez sur
à côté de son nom.Sur la page Ajouter un catalogue de données, localisez l'instance cible et cliquez sur Add dans la colonne Operation.
Un catalogue de données au niveau de l'espace de travail est visible par tous les membres de l'espace de travail.
Un catalogue de données au niveau du compte est visible uniquement par vous.
Lors de l'ajout depuis votre compte, seules les instances situées dans la même région que l'espace de travail DataWorks et auxquelles vous avez accès sont répertoriées.
Gérer les catalogues de données
Masquer un catalogue de données
Pour masquer les catalogues de données non pertinents :
Dans l'arborescence de répertoires de gauche, localisez le catalogue de données et cliquez sur
dans le coin supérieur droit.-
Dans la fenêtre contextuelle, cliquez sur
à côté d'un nom de moteur pour masquer ses catalogues de données.RemarquePour annuler le masquage, cliquez sur l'espace vide à côté du nom du moteur dans la fenêtre contextuelle.
Supprimer un catalogue de données
Pour supprimer un catalogue de données dont vous n'avez plus besoin :
Dans l'arborescence de répertoires de gauche, localisez le catalogue de données cible et cliquez sur Remove ou Disassociate Data Catalog dans la colonne Operation.
Créer et gérer des objets de données
Développez un catalogue pour créer ou gérer ses objets de données. Le tableau suivant fournit des liens vers la documentation connexe.
|
Catalogue de données |
Description |
Références |
|
MaxCompute |
Créez et gérez des objets de données tels que des tables, des vues, des tables externes, des ressources et des fonctions. |
|
|
Hologres |
Créez et gérez des objets de données tels que des tables et des vues. |
|
|
Catalogue DLF |
Créez et gérez les métadonnées de table dans la base de données. |
|
|
Hive |
Créez et gérez des objets de données de table. |
|
|
AnalyticDB MySQL |
Créez et gérez des objets de données de table. |
|
|
AnalyticDB PostgreSQL |
Créez et gérez des objets de données de table. |
|
|
StarRocks |
Créez et gérez des objets de données de table et de vue. |
|
|
Catalogue IA |
Gérez les métadonnées des jeux de données et des modèles dans le catalogue IA. |