Realtime Compute for Apache Flink est une plateforme entièrement gérée et sans serveur permettant de créer des pipelines de données en temps réel et des applications de traitement de flux sur Alibaba Cloud.
Vue d'ensemble
Realtime Compute for Apache Flink s'appuie sur Apache Flink et élimine la charge opérationnelle liée à la configuration du cluster, à la gestion des versions et au réglage des ressources. Vous bénéficiez des avantages suivants :
Aucune infrastructure à gérer — aucun cluster à approvisionner, à patcher ou à mettre à l'échelle manuellement.
Mise à l'échelle automatique toujours active — Autopilot surveille en continu vos jobs et ajuste l'allocation des ressources pour gérer automatiquement les variations de débit, la contre-pression et le gaspillage de ressources.
Tolérance aux pannes automatique — la récupération après incident de bout en bout et la haute disponibilité de JobManager sont intégrées, éliminant ainsi les points de défaillance uniques.
Le service offre une latence inférieure à la seconde et, grâce à l'optimisation des opérateurs SQL et au GeminiStateBackend développé en interne, affiche des performances deux fois supérieures à celles d'Apache Flink open source lors des tests de référence Nexmark.
Cas d'utilisation
Pipelines ETL et CDC en temps réel — synchronisez des bases de données entières vers des entrepôts de données ou des data lakes en utilisant Create Database As Select (CDAS) ou Create Table As Select (CTAS), avec une prise en charge native de l'évolution du schéma et de Change Data Capture (CDC).
Détection de fraude et d'anomalies — appliquez des règles de traitement complexe d'événements (CEP) sur des flux d'événements à fort volume pour identifier des modèles en temps réel.
Tableaux de bord analytiques en temps réel — écrivez du code Flink SQL pour agréger les données en flux continu et pousser les résultats vers Hologres, ClickHouse ou d'autres systèmes en aval avec une actualisation inférieure à la seconde.
Pipelines de données alimentés par l'IA — intégrez le prétraitement des données en flux continu aux workflows d'analyse intelligente des données et IA.
Surveillance des processus métier — suivez l'exécution des commandes, le statut de livraison ou l'activité client en traitant les flux d'événements avec des alertes basées sur des règles et des notifications via DingTalk ou e-mail.
Comparaison avec Apache Flink
Realtime Compute for Apache Flink est entièrement compatible avec les API et les connecteurs d'Apache Flink, ce qui permet de migrer les charges de travail existantes sans modifier le code. Le tableau ci-dessous résume les principales différences.
|
Domaine |
Apache Flink |
Realtime Compute for Apache Flink |
Avantages |
|
Performances et coûts |
|
|
|
|
Compatibilité et intégration |
|
|
|
|
Développement et débogage |
|
|
|
|
Opérations et gestion |
|
|
|
|
Stabilité et fiabilité |
|
|
Fiabilité de niveau entreprise pour les jobs de production à grande échelle. |
|
Support entreprise |
|
|
Résolution plus rapide des incidents et service fiable pour les déploiements en production. |
|
Sécurité et contrôle d'accès |
|
|
Gestion unifiée des identités et des accès pour la sécurité des données et la conformité. |
|
Extensibilité et écosystème |
|
|
Une plateforme flexible et extensible pour divers cas d'utilisation en temps réel. |
Facturation
Realtime Compute for Apache Flink comprend deux éléments facturables : les ressources de gestion et les ressources de calcul.
Trois méthodes de facturation sont disponibles :
Abonnement : réservez des ressources dédiées pour une période fixe.
Paiement à l'utilisation : payez uniquement ce que vous utilisez.
Facturation hybride : combinez des ressources d'abonnement réservées avec une capacité élastique de paiement à l'utilisation.
Pour plus de détails, consultez la rubrique Facturation.