Tous les produits
Search
Centre de documentation

Alibaba Cloud Model Studio:Dify

Dernière mise à jour :Sep 07, 2026

Dify est une plateforme open source dédiée à la création d'applications d'IA. Elle permet de concevoir des applications en s'appuyant sur les API de modèles d'Alibaba Cloud Model Studio.

Prérequis

Vous devez obtenir une clé API et activer les services de modèles requis dans Model Studio.

ImportantDify étant une plateforme de workflow et d'automatisation, elle ne prend pas en charge le Token Plan Personal Edition, le Token Plan (Team Edition) ni le Coding Plan. Ces plans sont réservés aux outils de programmation IA et aux agents de type OpenClaw. Pour plus d'informations, reportez-vous à la section Types d'outils non pris en charge.

Utilisez une clé API en paiement à l'utilisation avec Dify. L'emploi d'une clé API associée à un plan pour des appels sortant du périmètre autorisé constitue une violation ou un abus. Cela peut entraîner la suspension de l'abonnement ou le bannissement de la clé API.

1. Configurer le modèle

1.1. Installer le fournisseur de modèles

Accédez au Marketplace Dify. Dans la section Model, recherchez Qwen et installez la dernière version du plugin.

Remarque

  • Le plugin TONGYI est maintenu par Dify, et non par Alibaba Cloud. Si une erreur survient lors de l'installation de la dernière version, essayez d'installer une version antérieure.
  • Pour utiliser les modèles DeepSeek depuis Model Studio, vous devez également recourir au plugin Qwen.

1.2. Configurer la clé API

Dans le coin supérieur droit de la page, cliquez sur votre photo de profil → Settings. Sous Model Providers, localisez la carte Qwen puis cliquez sur Settings.

  • Si vous utilisez un modèle de la région Singapour, allez dans la section API-KEY Settings, saisissez la clé API correspondante et définissez Use International Endpoint sur Yes.
  • Si vous utilisez un modèle de la région Pékin, allez dans la section API-KEY Settings, saisissez la clé API pour la région Pékin et définissez Use International Endpoint sur No.

Si vous recevez l'erreur Invalid API key provided lors de la configuration, tentez d'installer une version antérieure du plugin TONGYI.

20251127172111

1.3. Sélectionner un modèle

Sur la carte Qwen, cliquez pour afficher la liste des modèles, puis activez le commutateur correspondant aux modèles souhaités.

Si le plugin n'inclut pas le dernier modèle Qwen, vous pouvez installer le plugin OpenAI-API-compatible. Dans les paramètres du plugin, définissez l' API endpoint URL sur l'une des valeurs suivantes : https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1 (région Singapour) ou https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1 (région Pékin) . Remplacez WorkspaceId par votre véritable ID d'espace de travail .

2. Prise en main

Dify prend en charge plusieurs types d'applications. Choisissez le vôtre pour obtenir les instructions correspondantes.

Assistant de chat et agent

  1. Créer un assistant de chat ou un agent

    Dans l'espace de travail, cliquez sur Create blank app. Sous Beginner-Friendly, créez et ouvrez un assistant de chat ou un agent.

  2. Sélectionner un modèle

    Dans le coin supérieur droit de la page de l'application, sélectionnez un modèle. Par exemple, sous Qwen, choisissez qwen-plus-latest(Qwen3), puis activez le mode de réflexion.

  3. Tester la conversation

    Saisissez « Who are you? ». Le modèle répond une fois son processus de réflexion terminé.

    Il est également possible d'utiliser un modèle Qwen-VL ou QVQ pour poser des questions sur des images. Après avoir sélectionné un modèle visuel, un commutateur Vision apparaît sur la gauche. Activez-le pour télécharger des images dans la fenêtre de chat située à droite.

Chatflow et workflow

  1. Créer un Chatflow ou un workflow

    Dans l'espace de travail, créez et ouvrez un Chatflow ou un workflow.

  2. Ajouter un nœud LLM

    Ajoutez un nœud LLM au canevas. Sélectionnez ce nœud pour ouvrir son panneau d'édition, puis choisissez le modèle souhaité. Pour cet exemple, sélectionnez qwen-plus-2025-07-28(Qwen3) et activez le mode de réflexion.

    Si vous utilisez un modèle Qwen-VL ou QVQ, vous devez activer le commutateur Vision pour le nœud LLM :

    Au bas du panneau d'édition du nœud LLM, localisez et activez le commutateur Vision. Vous pouvez ensuite définir la Resolution sur High ou Low.

  3. Exécuter le nœud LLM

    Cliquez sur Add message. Dans le champ de message correspondant à USER, saisissez la question « Who are you? », puis cliquez sur le bouton d'exécution 20251127203142 situé dans le coin supérieur droit du nœud.

    Une fois l'exécution terminée, examinez le champ text dans la sortie. Le processus de réflexion est encadré par des balises ..., suivi de la réponse principale du modèle.

    Le champ text renvoyé par le nœud LLM contient à la fois le processus de réflexion et la réponse. Vous pouvez utiliser un nœud d'exécution de code Dify avec des expressions régulières pour les extraire séparément.

Base de connaissances

  1. Créer une base de connaissances

    Créez et ouvrez une base de connaissances.

  2. Sélectionner une source de données

    Téléchargez les fichiers de votre base de connaissances.

  3. Segmentation et nettoyage du texte

    Configurez les modèles d'embedding et de rerank depuis Model Studio. Cet exemple utilise text-embedding-v4 et gte-rerank-v2. Ajustez les autres paramètres selon vos besoins.

    Le modèle gte-rerank-v2 est uniquement pris en charge dans la région Pékin .

    Le modèle multimodal-embedding-v1 ne peut pas encore être sélectionné comme modèle d'embedding. Restez à l'écoute pour les futures mises à jour.

FAQ

Q1 : Erreur de clé API du plugin TONGYI

R : Causes fréquentes :

  • La dernière version du plugin peut être instable. Essayez d'installer une version antérieure.

  • Vous utilisez une clé API provenant d'un sous-espace de travail. La version 0.0.41 du plugin TONGYI valide les permissions d'invocation pour le modèle qwen-turbo. Vous devez accorder la permission d'invocation pour qwen-turbo.

    Le plugin TONGYI n'est pas maintenu par Alibaba Cloud, et ses politiques de validation peuvent évoluer dans les versions futures. Utilisez une clé API issue de l'espace de travail par défaut.

  • Le paramètre d'endpoint est incorrect. Définissez correctement Use International Endpoint en fonction de la région de votre clé API.

Q2 : Utilisation des modèles Qwen-Omni et Qwen-OCR

R : Ces modèles ne peuvent pas être configurés directement dans Dify. Vous pouvez les intégrer via un nœud HTTP dans un Chatflow ou un workflow. Pour les détails d'intégration, reportez-vous aux exemples de commandes cURL fournis dans la documentation du modèle.

Afin de réduire le risque de délais d'attente dans le nœud HTTP, privilégiez la sortie en streaming pour les appels API.

Q3 : Utilisation des modèles Wan

R : Dify ne propose pas de plugin dédié aux modèles Wan. Toutefois, vous pouvez réaliser de la génération texte-vers-image et texte-vers-vidéo à l'aide de nœuds dans un Chatflow ou un workflow Dify. Suivez ces étapes :

  1. Télécharger et importer un modèle de workflow

    Téléchargez l'un de nos modèles prédéfinis : Wan - Text-to-Image Demo.yml ou Wan - Text-to-Video Demo.yml. Dans l'espace de travail, cliquez sur Import DSL File et sélectionnez le modèle téléchargé.

  2. Configurer les variables d'environnement

    Sur la page du workflow, localisez l'icône des variables d'environnement image.png, puis remplacez la valeur de DASHSCOPE_API_KEY par votre clé API.

  3. Tester la sortie

    Cliquez sur le bouton Run pour générer la sortie. Par exemple, la saisie de « a small cat » dans le workflow texte-vers-image produit une image.

    Le workflow texte-vers-vidéo renvoie une URL pointant vers la vidéo générée.

    La génération texte-vers-vidéo nécessite généralement cinq minutes ou plus.

  4. Publier en tant qu'outil (facultatif)

    Pour exploiter ces capacités dans d'autres applications, cliquez sur Publish dans le coin supérieur droit et sélectionnez Publish as tool.

Les modèles utilisent des modèles de la région Singapour : wan2.2-t2i-flash (texte-vers-image) et wan2.1-t2v-turbo (texte-vers-vidéo). Vous pouvez modifier le modèle dans le nœud STEP1 et ajuster l'endpoint API spécifique à la région dans les nœuds STEP1 et STEP3.

Q4 : Déploiement privé de Dify

R : Le service cloud Dify présente certaines limites, notamment un maximum de cinq applications. Pour un déploiement privé, consultez la solution Alibaba Cloud pour le déploiement de Dify.