Tous les produits
Search
Centre de documentation

DataWorks:Nœud Flink SQL Batch

Dernière mise à jour :Aug 10, 2026

Un nœud Flink SQL Batch vous permet de définir et d'exécuter des tâches de traitement de données à l'aide d'instructions SQL standard. Utilisez-le pour analyser et transformer de grands ensembles de données, par exemple pour le nettoyage ou l'agrégation des données. Ce nœud prend en charge la configuration visuelle et offre une solution efficace et flexible pour le traitement par lots à grande échelle. Cette rubrique explique comment utiliser un nœud Flink SQL Batch pour traiter les données par lots.

Prérequis

  • Créez un espace de travail et liez-y une ressource de calcul Realtime Compute for Apache Flink dans Administration. Pour plus d'informations, consultez Lier des ressources de calcul.

  • Créez un nœud Flink SQL Batch. Pour plus d'informations, consultez Créer un nœud pour un workflow de planification.

Étape 1 : Développer le nœud Flink SQL Batch

Sur la page de modification du nœud Flink SQL Batch, développez la tâche du nœud.

Développer le code SQL

Développez votre code de tâche dans la zone d'édition SQL. Dans votre code, vous pouvez définir des variables en utilisant le format ${nom_variable}. Ensuite, sur le côté droit de la page de modification du nœud, attribuez une valeur à la variable dans la section Scheduling Parameters du volet Scheduling Settings. Cela vous permet de transmettre dynamiquement des paramètres à votre code dans les scénarios de planification. Pour plus d'informations sur l'utilisation des paramètres de planification, consultez Sources des paramètres de planification et leurs expressions. Voici un exemple.

-- Créer une table source nommée datagen_source. CREATE TEMPORARY TABLE datagen_source_${var}( name VARCHAR ) WITH ( 'connector' = 'datagen', 'number-of-rows' = '1000' ); -- Créer une table de résultat nommée blackhole_sink. CREATE TEMPORARY TABLE blackhole_sink_${var}( name VARCHAR ) WITH ( 'connector' = 'blackhole' ); -- Insérer les données de la table source dans la table de résultat. INSERT INTO blackhole_sink_${var} SELECT name FROM datagen_source_${var};

Remarque

Dans cet exemple, le paramètre bizdate a pour valeur $[yyyymmdd], ce qui permet la synchronisation par lot des nouvelles données quotidiennes.

Étape 2 : Configurer le nœud Flink SQL Batch

Configurez les paramètres de tâche du nœud Flink SQL Batch en fonction de vos besoins métier.

Configurer les ressources Flink

Configurez les paramètres suivants sur le côté droit de la page de modification, dans la section Flink resource information sous Scheduling Settings. Pour plus d'informations, consultez Configurer les paramètres de planification.

|
**Paramètre**
|
**Description**
| | --- | --- | |
**Flink cluster**
|
Nom de la ressource de calcul Flink entièrement gérée liée dans **Administration**.
| |
**Flink engine version**
|
Sélectionnez une version du moteur en fonction de vos besoins.
| |
**Resource Group for Scheduling**
|
Sélectionnez un [groupe de ressources serverless](t2552556.xdita#) disposant d'une connectivité réseau avec Flink.
| |
**Job Manager CPU**
|
Selon les bonnes pratiques Flink, le JobManager nécessite au moins 0,5 cœur de processeur et 2 Go de mémoire pour un fonctionnement stable. Nous recommandons 1 cœur de processeur et 4 Go de mémoire, avec un maximum de 16 cœurs de processeur. Ajustez la configuration en fonction de l'échelle de votre cluster et de la complexité des tâches.
| |
**Job Manager Memory**
|
La configuration de la mémoire du JobManager affecte sa capacité à gérer les tâches de planification et de gestion. La plage recommandée est de 2 Go à 64 Go pour un fonctionnement stable et efficace. Ajustez la valeur en fonction de l'échelle de votre cluster et des exigences des tâches.
| |
**Task Manager CPU**
|
La configuration du processeur du TaskManager affecte sa capacité de traitement des tâches. Selon les bonnes pratiques Flink, nous recommandons au moins 0,5 cœur de processeur et 2 Go de mémoire, avec une configuration recommandée de 1 cœur de processeur et 4 Go de mémoire, jusqu'à un maximum de 16 cœurs de processeur. Ajustez la configuration en fonction de vos besoins.
| |
**Task Manager Memory**
|
La configuration de la mémoire du TaskManager détermine le volume de données et les performances du traitement des tâches. Pour garantir une exécution stable et efficace des tâches, la taille de la mémoire doit être d'au moins 2 Go et peut aller jusqu'à 64 Go.
| |
**Concurrency**
|
Ce paramètre détermine le nombre d'exécutions de tâches parallèles dans une tâche Flink. Une concurrence plus élevée peut améliorer la vitesse de traitement et l'utilisation des ressources. Définissez cette valeur en fonction des ressources de votre cluster et des caractéristiques de la tâche.
| |
**Maximum number of slots**
|
Un slot représente une unité de ressource de taille fixe sur un Task Manager qui peut être allouée aux tâches. Chaque slot peut exécuter une instance de tâche ou d'opérateur. Vous pouvez ajuster le nombre maximal de slots en fonction des ressources disponibles.
| |
**Number of slots per TaskManager**
|
Le nombre de slots par TaskManager détermine le nombre de tâches qu'il peut exécuter en parallèle. Vous pouvez ajuster la configuration des slots pour optimiser l'utilisation des ressources et la capacité de traitement parallèle.
|











































(Facultatif) Configurer les paramètres de planification

Sur le côté droit de la page de modification, dans la section Flink cluster sous Flink engine version, cliquez sur Resource Group for Scheduling, puis modifiez le Concurrency et la Maximum number of slots pour les utiliser dynamiquement dans votre code.

(Facultatif) Configurer les paramètres d'exécution Flink

Configurez les paramètres d'exécution sur le côté droit de la page de modification, dans la section Number of slots per TaskManager sous Scheduling Parameters. Pour plus d'informations, consultez Configurer les paramètres de planification.

Lors de la configuration des paramètres d'exécution Flink, la syntaxe est compatible avec VVP (Ververica Platform). Vous pouvez écrire les configurations directement au format YAML sans ajouter de points-virgules ni d'autres caractères spéciaux pour les sauts de ligne.

Remarque

Pour exécuter la tâche du nœud selon une planification périodique, configurez les informations de planification (Scheduling Settings, Add parameters, Parameter name et Parameter Value) en fonction de vos besoins métier. Pour plus d'informations, consultez Configurer les paramètres de planification.

Une fois la configuration de la tâche terminée, cliquez sur Flink running parameters.

Étape 4 : Déployer et gérer le nœud Flink SQL Batch

  1. Une fois la tâche du nœud configurée, vous devez déployer le nœud. Pour plus d'informations, consultez Déployer un nœud.

  2. Une fois la tâche déployée, cliquez sur Upload sous Deploy to Production pour afficher l'état d'exécution des tâches planifiées dans Operation Center. Pour plus d'informations, consultez Afficher les tâches planifiées.

Référence