Un projet est l'unité organisationnelle de base de MaxCompute, semblable à une base de données ou à un schéma dans un système de gestion de base de données traditionnel. Les projets isolent les utilisateurs et gèrent les demandes d'accès. Chaque projet contient des tables, des ressources, des fonctions et des instances. Il vous offre un espace dédié pour créer des tables, charger des données, développer des tâches et allouer des ressources de calcul.
MaxCompute prend en charge le modèle Schema (à trois couches). Un projet correspond à un Catalog dans les moteurs de lac de données ou à une Database dans les bases de données traditionnelles. Un Schema correspond à une Database sous un Catalog ou à un Schema sous une instance de base de données. Pour les opérations liées aux schémas, consultez Opérations liées aux schémas.
Types de projets
MaxCompute prend en charge deux types de projets : les projets gérés (internes) et les projets externes.
Projets gérés
Le projet géré est le type de projet standard. Après l'activation de MaxCompute, créez un projet géré avant d'effectuer tout travail de développement, d'analyse ou d'exploitation et de maintenance (O&M).
Par défaut, les données d'un projet géré sont isolées : l'accès aux objets d'un autre projet nécessite une autorisation de sécurité explicite. Pour partager des ressources entre plusieurs projets, utilisez l'accès aux ressources interprojets basé sur les packages.
Si vous utilisez DataWorks pour créer un projet MaxCompute, commencez par créer un espace de travail DataWorks. Le nom de l'espace de travail peut différer de celui du projet MaxCompute associé ; spécifiez toujours le nom du projet lors du développement des données. Pour connaître les modes d'espace de travail, consultez la rubrique Mode basique et mode standard.
Projets externes
Les projets externes offrent un accès en lecture aux données contenues dans les bases de données Hive des clusters Hadoop ou aux tables de Data Lake Formation (DLF).
Cas d'utilisation des projets externes :
Accéder aux données des tables Hive et les interroger dans des clusters Hadoop existants
Interroger les tables gérées par DLF sans migrer les données
Contraintes principales :
Vous ne pouvez pas créer ni utiliser des projets externes de manière indépendante. Utilisez-les depuis la page Lake and Warehouse Integration (Data Lakehouse) de la console DataWorks. Pour plus d'informations, consultez la rubrique Lakehouse de MaxCompute.
L'exécution de tâches n'est pas possible dans les projets externes. Associez un projet externe à un projet géré et utilisez la syntaxe
<external_project_name>.<table_name>pour accéder à ses données. Pour plus d'informations, consultez la rubrique Gérer un projet externe à l'aide d'instructions SQL.Les projets externes sont gratuits. Les coûts liés aux requêtes sont facturés au projet MaxCompute associé.
Étapes suivantes
Créer un projet : Créer un projet MaxCompute
Gérer un projet : Opérations sur les projets
Sécuriser vos données : Opérations de sécurité
Contrôler l'utilisation des ressources : Définissez un quota pour empêcher un utilisateur ou un projet unique de consommer des ressources excessives. Consultez la page Quota.