Ajoutez une source de données Spark SQL pour connecter Quick BI à une base de données Spark SQL (version 3.1.2) via le réseau public ou un VPC Alibaba Cloud, puis analysez et visualisez les données dans Quick BI.
Prérequis
-
Vérifiez la connectivité réseau :
Pour connecter Quick BI à la base de données Spark SQL (version 3.1.2) via le réseau public, ajoutez l'adresse IP de Quick BI à la liste d'autorisation de la base de données. Pour plus d'informations, consultez la section Groupes de sécurité.
-
Pour les connexions au réseau interne, utilisez l'une des méthodes suivantes :
Si la base de données Spark SQL est hébergée sur ECS Alibaba Cloud, établissez la connexion via un VPC Alibaba Cloud.
Sinon, déployez un serveur de rebond et créez un tunnel SSH pour accéder à la base de données.
Récupérez le nom d'utilisateur et le mot de passe de la base de données Spark SQL auto-hébergée (version 3.1.2).
Limites
La base de données Spark SQL doit être en version 3.1.2. Le Hive MetaStore utilisé pour le stockage sous-jacent doit être en version Hive 2.0 ou supérieure.
Procédure
Connectez-vous à la console Quick BI.
-
Ajoutez une source de données Spark SQL auto-hébergée en suivant les étapes ci-dessous.
Accédez à l'interface de création de source de données via le point d'entrée de création de source de données.
Dans l'onglet User-created Data Source, sélectionnez la source de données Spark SQL.

-
Dans la boîte de dialogue Configure Connection, configurez la connexion selon vos besoins.

Nom
Description
Display Name
Le nom affiché dans la liste des sources de données.
Utilisez un nom standard sans caractères spéciaux ni espaces au début ou à la fin.
Database Address
L'adresse IP ou le nom de domaine de la base de données Spark SQL.
Port
Le numéro de port de la base de données.
Database
Le nom de la base de données spécifié lors du déploiement de la base de données Spark SQL.
Username et Password
Le nom d'utilisateur et le mot de passe de la base de données Spark SQL. Le nom d'utilisateur doit disposer des autorisations CREATE, INSERT, UPDATE et DELETE sur les tables de la base de données.
VPC Data Source
Activez cette option si la base de données utilise un VPC Alibaba Cloud.
Sélectionnez « Instance » si la base de données est déployée sur ECS Alibaba Cloud, ou « CLB » si l'accès s'effectue via Classic Load Balancer (CLB).
Instance
Purchaser Accessid : l'AccessKey ID de l'acheteur de cette instance.
Pour plus d'informations, consultez la section Créer une AccessKey.
RemarqueAssurez-vous que l'AccessKey ID dispose de l'autorisation de lecture sur l'instance de destination. Si vous disposez également de l'autorisation d'écriture sur le groupe de sécurité correspondant, le système ajoute automatiquement la liste d'autorisation. Sinon, ajoutez-la manuellement. Pour plus d'informations, consultez la section créer une politique personnalisée.
Purchaser Accesskey : l'AccessKey Secret de l'acheteur de cette instance.
Pour plus d'informations, consultez la section Créer une AccessKey.
Instance ID : l'ID de l'instance ECS. Connectez-vous à la console ECS et récupérez l'ID de l'instance dans l'onglet des instances.
Pour plus d'informations, consultez la section afficher les informations de l'instance.
Area : la zone où se trouve l'instance ECS. Connectez-vous à la console ECS et récupérez la zone dans le coin supérieur gauche.
Pour plus d'informations, consultez la section afficher les informations de l'instance.
CLB
Purchaser Accessid : l'AccessKey ID de l'acheteur du CLB. Assurez-vous que le compte dispose de l'autorisation de lecture sur le CLB. Connectez-vous à la console RAM pour récupérer l'AccessKey ID.
Pour plus d'informations, consultez la section afficher les informations AccessKey de l'utilisateur RAM.
Purchaser Accesskey : l'AccessKey Secret correspondant à l'AccessKey ID. Connectez-vous à la console RAM pour récupérer l'AccessKey Secret.
Pour plus d'informations, consultez la section afficher les informations AccessKey de l'utilisateur RAM.
Instance ID : l'ID de l'instance du CLB. Connectez-vous à la console Server Load Balancer et récupérez l'ID de l'instance dans la liste de gestion des instances.
Area : la zone où se trouve l'instance. Connectez-vous à la console Server Load Balancer et récupérez la zone dans le coin supérieur gauche de la page de gestion des instances.
SSH
Si vous sélectionnez SSH, configurez les paramètres suivants :
Déployez un serveur de rebond et accédez à la base de données via un tunnel SSH. Obtenez les détails du serveur de rebond auprès du personnel d'exploitation et de maintenance ou des administrateurs système.
SSH Host : saisissez l'adresse IP du serveur de rebond.
SSH Username : le nom d'utilisateur pour se connecter au serveur de rebond.
SSH Password : le mot de passe du nom d'utilisateur du serveur de rebond.
SSH Port : le port du serveur de rebond. Valeur par défaut : 22.
Pour plus d'informations, consultez la section Utiliser OpenSSH ou Xshell.
Initialize SQL
Lorsqu'elle est activée, l'instruction SQL spécifiée s'exécute après l'initialisation de chaque connexion à la source de données.
Seules les instructions SET sont prises en charge, séparées par des points-virgules.
-
Cliquez sur Connection Test pour vérifier la connectivité de la source de données.

-
Une fois le test réussi, cliquez sur OK pour ajouter la source de données.
La nouvelle source de données apparaît dans la liste des sources de données.
Étapes suivantes
Une fois la source de données ajoutée, créez des ensembles de données et analysez les données.
Pour ajouter des tables de données depuis la base de données Spark SQL ou du SQL personnalisé à Quick BI, consultez la section créer et gérer des ensembles de données.
Pour ajouter des graphiques de visualisation et analyser les données, consultez les sections créer un tableau de bord et présentation des graphiques de visualisation.
Pour une analyse avancée des données, consultez la section paramètres et affichage de l'exploration détaillée.