Tous les produits
Search
Centre de documentation

DataWorks:Images officielles de DataWorks

Dernière mise à jour :Aug 10, 2026

Les images officielles de DataWorks fournissent des environnements d'exécution courants pour les différents types de nœuds dans Data Studio. Utilisez directement ces images ou créez des images personnalisées à partir de celles-ci.

Présentation

Si aucune image d'environnement d'exécution n'est configurée pour un nœud dans Data Studio, l'image standard par défaut s'applique. Cette dernière ne fournit qu'un environnement d'exécution de base, qui peut ne pas répondre aux exigences de tâches spécifiques. Les images officielles sont des images de base préconfigurées offrant des environnements normalisés pour différents types de tâches. Vous pouvez créer des images personnalisées à partir de celles-ci afin d'étendre la prise en charge à davantage de scénarios d'environnement.

Liste des images

Important

Les versions et régions prises en charge dépendent de la console DataWorks. Plusieurs versions peuvent exister pour une même image. Le tableau ci-dessous décrit uniquement les fonctionnalités des dernières versions.

DataWorks met à disposition les images suivantes :

Nom de l'image

Description de l'image

Tâches applicables

dataworks_pyodps_py311_task_pod

Image officielle pour les nœuds PyODPS de DataWorks. Cette image utilise Python 3,11.

PyODPS 3

dataworks_pairec_task_pod

Image officielle PAI-Rec de DataWorks, utilisée pour exécuter les algorithmes générés par PAI-Rec. Pour connaître les versions du SDK feature_store et de pyfg, consultez la console.

dataworks_pyodps_task_pod

Image officielle pour les nœuds PyODPS de DataWorks. Cette image utilise Python 3,7.

PyODPS 2

PyODPS 3

dataworks_emr_base_task_pod

Image de base pour les clusters EMR. Elle prend en charge les types de cluster EMR Serverless Spark, EMR on ECS DataLake et EMR on ECS Custom.

  • Cette image inclut uniquement les composants de base nécessaires à la soumission de tâches EMR depuis DataWorks et ne contient pas l'environnement d'exécution des composants de base EMR. Pour les clusters semi-managés tels que DataLake et Custom, installez les composants correspondant à la version du cluster EMR via une image personnalisée.

  • Pour les types de cluster CUSTOM et DATALAKE, initialisez d'abord l'environnement EMR Gateway en saisissant le type de cluster et le numéro de version.

    sh /home/admin/init_emr_component.sh DATALAKE EMR-VERSION_NUMBER
    Remarque

    Si l'initialisation de l'environnement EMR Gateway échoue, cela est généralement dû au fait que certaines versions de cluster ne figurent pas dans le référentiel d'images. Soumettez un ticket pour contacter la plateforme et obtenir de l'aide.

dataworks_shell_jdk17_task_pod

Image officielle pour les nœuds Shell de DataWorks. Cette image utilise JDK 17.

Shell

dataworks_shell_task_pod

Image officielle pour les nœuds Shell de DataWorks. Cette image utilise JDK 7. Si vous devez personnaliser l'environnement d'exécution et nécessitez le passage de paramètres Subprocess, créez une image personnalisée basée sur cette image.

dataworks_python_task_pod

Image officielle pour les nœuds Python de DataWorks. Informations système : py3,11-ubuntu22,04.

Python

dataworks_cdh_custom_task_pod

Image de base pour les clusters CDH de DataWorks. Elle ne peut pas être utilisée directement. Installez le parcel CDH via une image personnalisée avant d'utiliser cette image dans Data Studio.

CDH

dataworks_controller_task_pod

Image officielle pour les nœuds d'assignation de DataWorks. Si vous devez personnaliser l'environnement d'exécution et utiliser le nœud d'assignation ou les paramètres d'assignation pour transmettre des paramètres aux nœuds en aval, créez une image personnalisée basée sur cette image.

Nœud d'assignation

dataworks-mcp

Utilisée pour le développement de tâches Agent DataWorks pour clients tiers. Informations système : py3,11-ubuntu22,04.

Environnement de développement personnel

dataworks-notebook

Utilisée pour le développement de tâches Développement notebook de base. Informations système : py3,11-ubuntu22,04.

dataworks_notebook_task_pod

Image officielle pour les nœuds Notebook de DataWorks. Informations système : py3,11-ubuntu22,04. Cette image est identique aux images dataworks-notebook et dataworks-mcp pour l'environnement Python et l'environnement de développement personnel.

dataworks-maxcompute

Utilisée pour Créer une image personnalisée MaxCompute. Informations système : py3,11-ubuntu20,04.

Utilisation des images

Dans Data Studio, utilisez les images officielles ou les images personnalisées associées à l'espace de travail.

  • Utiliser une image dans le nouveau DataStudio : Dans les sections Run Configuration et Scheduling Settings situées à droite de la page de développement du nœud, configurez le groupe de ressources et l'image pour les exécutions de test et les exécutions post-déploiement.

  • Utiliser une image dans l'ancien DataStudio : Dans la boîte de dialogue qui s'affiche après avoir cliqué sur Run with Parameters sur la page de développement du nœud, ou dans le panneau Scheduling Settings à droite de cette page, configurez le groupe de ressources et l'image pour l'exécution de test et l'exécution post-déploiement du nœud.

  • Utiliser une image dans l'environnement de développement personnel : Lors de la création d'une instance d'environnement de développement personnel, sélectionnez une autre image officielle dans la liste déroulante Image Configuration.

Remarque

Lors de la configuration du groupe de ressources et de l'image, tenez compte des points suivants :

  • Resource Group for Scheduling : Sélectionnez un groupe de ressources serverless.

  • Image : Sélectionnez une image officielle ou une image personnalisée déployée.