Après avoir enregistré un cluster E-MapReduce (EMR) dans DataWorks, personnalisez ses informations de connexion Kyuubi. Vous pourrez ainsi utiliser un nom d'utilisateur et un mot de passe personnalisés pour accéder à Kyuubi et exécuter des tâches.
Informations générales
Apache Kyuubi est une passerelle distribuée et multi-locataire qui fournit des services de requête, tels que SQL, pour les moteurs de requête de data lake comme Spark, Flink et Trino. Pour plus d'informations, consultez la rubrique Kyuubi.
Prérequis
Le service Kyuubi est activé dans le cluster EMR.
-
Le cluster EMR est lié en tant que ressource de calcul DataWorks. Pour plus d'informations, consultez la rubrique Développement de données (nouvelle version) : Lier une ressource de calcul EMR.
RemarqueLors de la liaison de la ressource de calcul EMR, vous devez procéder à l'initialisation du groupe de ressources. Sans cette étape, la page de configuration Kyuubi ne sera pas accessible.
Configurer les informations de connexion Kyuubi
-
Accédez à la page de configuration Kyuubi.
-
Connectez-vous à la console DataWorks. Dans la région cible, cliquez sur dans le volet de navigation de gauche. Sélectionnez un espace de travail dans la liste déroulante, puis cliquez sur Go to Management Center.
Dans le volet de navigation de gauche, cliquez sur Computing Resources.
Recherchez le cluster EMR cible, puis cliquez sur .
-
-
Configurez les informations de connexion Kyuubi.
Sélectionnez un mode de connexion selon vos besoins :
Connection Information of Alibaba Cloud EMR Cluster : Connectez-vous directement à Kyuubi en utilisant l'Default Access Identity configurée lors de l'enregistrement du cluster EMR. Ce mode est sélectionné par défaut.
-
Custom Connection Information : Sélectionnez ce mode si vous souhaitez utiliser un nom d'utilisateur et un mot de passe personnalisés pour vous connecter à Kyuubi. Le format est le suivant :
jdbc:hive2://host:port/;user=<username>;password=<password>.RemarqueLors de la première sélection de l'option Custom Connection Information, la plateforme remplit automatiquement l'URL JDBC en fonction des détails d'enregistrement de votre cluster EMR. Vous pouvez ensuite modifier cette URL si nécessaire.
-
Si vous avez choisi de transmettre les informations d'utilisateur proxy lors de l'enregistrement du cluster, DataWorks ajoute la configuration
hive.server2.proxy.userà l'URL JDBC lors de l'exécution d'une tâche EMR. Les règles sont les suivantes :Si l'URL JDBC dans les Custom Connection Information ne contient pas l'espace réservé
DATAWORKS_PROXY_USER, la plateforme ajoute par défaut les informations de configurationhive.server2.proxy.userà la fin de l'URL JDBC lors de l'exécution d'une tâche.Si l'URL JDBC dans les Custom Connection Information contient l'espace réservé
DATAWORKS_PROXY_USER, la plateforme remplace dynamiquement l'espace réservé par la valeur de la configurationhive.server2.proxy.userlors de l'exécution d'une tâche.
Étapes suivantes
Suivez le guide du processus de développement de données pour configurer les composants de développement de données dans DataWorks.