Tous les produits
Search
Centre de documentation

:Créer un workflow

Dernière mise à jour :Aug 09, 2026

Découvrez comment créer un workflow, ajouter des nœuds et configurer leurs dépendances. Utilisez ensuite la fonctionnalité de développement de données pour analyser et traiter les données de votre espace de travail.

Prérequis

Avant de commencer, créez la table de données métier bank_data ainsi que la table de destination result_table dans votre espace de travail. La table de données métier doit contenir des données. Pour plus d'informations, consultez la rubrique Créer une table et importer des données.

Contexte

Dans DataWorks, vous pouvez configurer visuellement les dépendances entre les nœuds au sein d'un workflow. Les workflows permettent de traiter les données et de définir leurs dépendances. Vous pouvez créer plusieurs workflows dans un même espace de travail. Pour en savoir plus, reportez-vous à la section Créer un workflow.

Créer un workflow

  1. Connectez-vous à la console DataWorks. Dans la région cible, cliquez sur Data Development and O&M > Data Development dans le volet de navigation de gauche. Sélectionnez un espace de travail dans la liste déroulante, puis cliquez sur Go to Data Development.

  2. Sur la page Data Studio, placez le pointeur sur l'icône 新建, puis cliquez sur Create Workflow.

  3. Dans la boîte de dialogue Create Workflow, saisissez le Business Name et la Description.

  4. Cliquez sur Create.

Créer des nœuds et configurer les dépendances

Créez un nœud sans charge (start) et un nœud ODPS SQL (insert_data) dans le workflow. Configurez ensuite la dépendance de sorte que le nœud insert_data dépende du nœud start.

Important
  • Un nœud sans charge est un nœud de contrôle qui ne traite pas de données. Il se contente de gérer ses nœuds descendants.

  • Si vous définissez manuellement un nœud sans charge comme ayant échoué lors d'une tâche d'O&M, ses nœuds descendants non exécutés ne sont pas déclenchés. Cette fonctionnalité permet d'éviter la propagation de données incorrectes provenant des sources en amont.

  • Le nœud parent d'un nœud sans charge est généralement le nœud racine de l'espace de travail. Le nom du nœud racine de l'espace de travail suit le format WorkspaceName_root.

  • DataWorks ajoute automatiquement une sortie pour chaque nœud avec le nom WorkspaceName.NodeName. Si deux nœuds du même espace de travail portent le même nom, vous devez renommer la sortie de l'un des nœuds.

Nous vous recommandons de créer un nœud sans charge pour servir de nœud racine à votre workflow. Ce nœud peut contrôler l'exécution de l'ensemble du workflow. Pour concevoir le workflow, suivez ces étapes :

  1. Double-cliquez sur le nom du workflow pour ouvrir le panneau de développement. Cliquez sur General>Zero Load Node.

    Vous pouvez également faire glisser le nœud Zero Load Node vers le panneau de développement situé à droite.

  2. Dans la boîte de dialogue Create Node, sélectionnez un Path, saisissez start comme Node Name, puis cliquez sur OK.

  3. Répétez les étapes précédentes pour créer un nœud ODPS SQL nommé insert_data.

  4. Tracez une ligne du nœud start vers le nœud insert_data afin de définir start comme nœud parent de insert_data.

Configurer la dépendance en amont du nœud sans charge

Un nœud sans charge contrôle souvent l'ensemble du workflow, agissant comme le nœud parent ultime de tous les autres nœuds.

En règle générale, définissez l'option Add Root Node comme Parent Nodes pour le nœud sans charge :

  1. Double-cliquez sur le nom du nœud sans charge pour ouvrir son éditeur.

  2. Dans le volet de droite, cliquez sur Scheduling.

  3. Dans la section Scheduling Dependencies, cliquez sur Add Root Node pour définir le nœud racine de l'espace de travail comme nœud parent du nœud sans charge.

  4. Enregistrez et validez le nœud.

    Important

    Vous devez configurer les propriétés Rerun attribute et Parent Nodes avant de pouvoir valider le nœud.

    1. Dans la barre d'outils, cliquez sur l'icône 保存 pour enregistrer le nœud.

    2. Dans la barre d'outils, cliquez sur l'icône 提交.

    3. Dans la boîte de dialogue Submit, saisissez une Change Description.

    4. Cliquez sur OK.

Modifier et exécuter le nœud ODPS SQL

Cette section explique comment utiliser le code SQL dans le nœud ODPS SQL insert_data pour interroger le nombre de célibataires disposant d'un prêt immobilier, regroupés par niveau d'éducation, et sauvegarder les résultats pour une analyse ou une présentation ultérieure par les nœuds descendants.

  1. Ouvrez l'éditeur du nœud ODPS SQL et saisissez le code suivant.

    Pour plus d'informations sur la syntaxe, consultez la rubrique Présentation de SQL.

    INSERT OVERWRITE TABLE result_table  --Insert data into the result_table table.
    SELECT education
        , COUNT(marital) AS num
    FROM bank_data
    WHERE housing = 'yes'
        AND marital = 'single'
    GROUP BY education;
  2. Faites un clic droit sur bank_data dans le code et sélectionnez Delete Input.

    La table bank_data, créée dans la rubrique Créer une table et importer des données, n'est pas générée par un nœud planifié. Si un nœud lit depuis une telle table, vous pouvez cliquer avec le bouton droit sur le nom de la table dans l'éditeur de code pour supprimer la dépendance analysée automatiquement. Vous pouvez également ajouter un commentaire spécifique au début du code pour empêcher la création de la dépendance.

    Remarque

    Les dépendances de planification dans DataWorks garantissent que les nœuds descendants peuvent accéder de manière fiable aux données des nœuds en amont mis à jour selon un planning régulier. La plateforme ne peut pas surveiller les tables qui ne sont pas mises à jour par des nœuds planifiés dans DataWorks. Si un nœud sélectionne des données dans une table qui n'est pas générée par une tâche planifiée, vous devez supprimer manuellement la dépendance créée automatiquement par DataWorks.

  3. Cliquez sur l'icône 保存 dans la barre d'outils pour enregistrer votre code.

  4. Cliquez sur l'icône 运行 pour exécuter le code.

    Une fois l'exécution terminée, vous pouvez consulter le journal d'exécution et les résultats en bas de la page.

Valider le workflow

  1. Après avoir exécuté et débogué le nœud ODPS SQL insert_data, revenez au canevas du workflow.

  2. Cliquez sur l'icône 提交 dans la barre d'outils.

  3. Dans la boîte de dialogue Submit, sélectionnez les nœuds à valider, saisissez une Change Description, puis cochez l'option Ignore I/O Inconsistency Alerts .

  4. Cliquez sur OK.

    Une fois le workflow validé, vous pouvez vérifier l'état de validation de chaque nœud dans la liste des nœuds sous Workflow. Une icône image.png à gauche du nom d'un nœud indique que ce dernier contient des modifications non validées. Si cette icône image.png est absente, le nœud ne comporte aucune modification en attente de validation.

Étapes suivantes

Maintenant que vous avez créé et validé un workflow, passez au didacticiel suivant pour apprendre à créer une tâche de synchronisation afin d'écrire des données dans différents types de sources de données. Pour plus d'informations, consultez la rubrique Créer une tâche de synchronisation.