Data Integration est un service de distribution assurant la transmission, la conversion et la synchronisation des données. Il repose sur une architecture de distribution avancée intégrant plusieurs modules (tels que le traitement des données erronées et le contrôle de flux). Data Integration prend en charge de nombreuses fonctionnalités, notamment la prise en charge de multiples sources de données, la transmission rapide, une haute fiabilité, l'extensibilité et la synchronisation en masse.
Avantages

-
Prise en charge de multiples sources de données disparates
Data Integration prend en charge la synchronisation des données entre plus de 400 paires de sources de données hétérogènes (bases de données RDS, stockage semi-structuré, stockage non structuré tel que l'audio, la vidéo et les images, bases de données NoSQL et stockage Big Data). Data Integration prend également en charge la lecture et l'écriture de données en temps réel entre des sources de données telles qu'Oracle, MySQL et DataHub.

-
Tâches planifiées
Data Integration vous permet de planifier des tâches hors ligne en définissant un horaire de déclenchement précis (année, mois, jour, heure et minute). Quelques étapes suffisent pour configurer une extraction incrémentielle périodique des données. Data Integration s'intègre parfaitement à la modélisation de données DataWorks. L'ensemble du workflow combine exploitation et maintenance.

-
Chargement en masse vers le cloud
Data Integration exploite la puissance de calcul des clusters Hadoop pour synchroniser les données HDFS vers MaxCompute. Ce processus est appelé chargement en masse vers le cloud. Data Integration peut transmettre jusqu'à 5 To de données par jour. Le débit de transmission maximal est de 2 Go/s.

-
Surveillance et alarmes
Grâce à ses 19 règles de surveillance intégrées, Data Integration couvre la plupart des scénarios de surveillance. Vous pouvez définir des règles d'alarme basées sur ces règles de surveillance. De plus, vous pouvez prédéfinir le mode de notification en cas d'échec de tâche pour Data Integration.
Fonctionnalités
-
Gestion des sources de données
En exploitant les sources de données et les jeux de données qui définissent l'origine et la destination des données, Data Integration fournit deux plug-ins de gestion des données. Le plug-in Reader permet de lire les données et le plug-in Writer permet d'écrire les données. Ce framework repose sur un ensemble de formats simplifiés de transmission intermédiaire des données, conçu pour échanger des données entre des sources de données structurées et semi-structurées.
-
Collecte de données locale
Data Integration prend en charge la synchronisation des données dans les réseaux classiques Alibaba Cloud et les VPC, ainsi que la collecte de données dans les IDC locaux.
-
Migration complète de base de données
La migration complète de base de données est un outil fourni par Data Integration. Il permet de créer plusieurs tâches de synchronisation des données et d'importer toutes les tables d'une base de données MySQL vers MaxCompute. Grâce à la migration complète de base de données, vous n'avez plus besoin de créer les tâches de synchronisation une par une.
-
Synchronisation incrémentielle
Grâce à la clause WHERE, Data Integration prend en charge le filtrage des données métier par date. Les données de dates différentes sont synchronisées dans les tables de partition MaxCompute correspondantes. En définissant l'intervalle de synchronisation sur 1 heure ou 10 minutes, Data Integration est en mesure d'effectuer une synchronisation incrémentielle quasi temps réel.
Assistance améliorée pour vous
Conseil de prévente individualisé, assistance technique 24 h/24, 7 j/7, réponse plus rapide et plus de tickets.
Conseil de prévente individualisé
Assistance technique 24 h/24, 7 j/7
6 tickets gratuits par trimestre
