O Dify é uma plataforma open source para a criação de aplicações de IA. Você pode desenvolver aplicações utilizando as APIs de modelos do Alibaba Cloud Model Studio.
Pré-requisitos
É necessário obter uma chave de API e ativar os services de modelo necessários no Model Studio.
1. Configure o modelo
1.1. Instale o provedor de modelos
Acesse o Dify Marketplace. Em Model, localize Qwen e instale a versão mais recente do plugin.
O plugin TONGYI é mantido pelo Dify, não pela Alibaba Cloud. Caso ocorra um erro durante a instalação da versão mais recente, tente instalar uma versão anterior.
Para utilizar modelos DeepSeek do Model Studio, também é necessário usar o plugin Qwen.
1.2. Configure a chave de API
No canto superior direito da página, clique em sua foto de perfil → Settings. Em Model Providers, localize o cartão Qwen e clique em Settings.
Se você utilizar um modelo da região Singapore, vá até a seção API-KEY Settings, insira a chave de API dessa região e defina Use International Endpoint como Yes.
Se você utilizar um modelo da região Beijing, vá até a seção API-KEY Settings, insira a chave de API da região Beijing e defina Use International Endpoint como No.
Se você receber o erro Invalid API key provided durante a configuração, tente instalar uma versão anterior do plugin TONGYI.

1.3. Selecione um modelo
No cartão Qwen, clique em para exibir a lista de modelos e ative a opção correspondente aos modelos desejados.
Caso o plugin não inclua o modelo Qwen mais recente, instale o plugin OpenAI-API-compatible . Nas configurações do plugin, defina a API endpoint URL como uma das seguintes opções:https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/compatible-mode/v1(região Singapore) ouhttps://dashscope.aliyuncs.com/compatible-mode/v1(região Beijing) . SubstituaWorkspaceIdpelo seu Obter o Workspace ID real.
2. Primeiros passos
O Dify oferece suporte a diversos tipos de aplicação. Selecione o seu tipo para ver as instruções correspondentes.
Chat assistant and agent
-
Crie um chat assistant ou agent
No workspace, clique em Create blank app. Em Beginner-Friendly, crie e abra um chat assistant ou agent.
-
Selecione um modelo
No canto superior direito da página da aplicação, selecione um modelo. Por exemplo, em Qwen, selecione qwen-plus-latest(Qwen3) e ative o modo de raciocínio.
-
Testar a conversa
Insira "Who are you?". O modelo responderá após concluir o processo de raciocínio.
Também é possível utilizar um modelo Qwen-VL ou QVQ para fazer perguntas sobre imagens. Após selecionar um modelo de visão, a opção Vision aparecerá à esquerda. Ative-a para enviar imagens na janela de chat à direita.
Chatflow and workflow
-
Crie um Chatflow ou workflow
No workspace, crie e abra um Chatflow ou workflow.
-
Adicionar um nó LLM
Adicione um nó LLM ao canvas. Selecione o nó para abrir seu painel de edição e escolha o modelo desejado. Neste exemplo, selecione qwen-plus-2025-07-28(Qwen3) e ative o modo de raciocínio.
Se estiver utilizando um modelo Qwen-VL ou QVQ, será necessário ativar a opção Vision no nó LLM:
Na parte inferior do painel de edição do nó LLM, localize e ative a opção Vision. Em seguida, defina a Resolution como High ou Low.
-
Execute o nó LLM
Clique em Add message. No campo de mensagem correspondente a USER, insira a pergunta "Who are you?" e clique no botão de execução
no canto superior direito do nó.Após a conclusão da execução, inspecione o campo
textna saída. O processo de raciocínio aparece entre tags..., seguido pela resposta principal do modelo.O campo
textretornado pelo nó LLM contém tanto o processo de raciocínio quanto a resposta. Utilize um nó de execução de código do Dify com expressões regulares para extraí-los separadamente.
Knowledge base
-
Crie uma knowledge base
Crie e abra uma knowledge base.
-
Selecione uma fonte de dados
Faça upload dos arquivos da sua knowledge base.
-
Segmentação e limpeza de texto
Configure os modelos de embedding e rerank do Model Studio. Este exemplo utiliza text-embedding-v4 e gte-rerank-v2. Ajuste os demais parâmetros conforme necessário.
O modelo gte-rerank-v2 tem suporte apenas na região Beijing .
Atualmente, o modelo multimodal-embedding-v1 não pode ser selecionado como modelo de embedding. Fique atento às futuras atualizações.
FAQ
P1: Erro de chave de API no plugin TONGYI
R: Motivos comuns:
A versão mais recente do plugin pode apresentar instabilidade. Tente instalar uma versão anterior.
-
Você está utilizando uma chave de API de um sub-workspace. A versão
0.0.41do plugin TONGYI valida as permissões de invocação do modeloqwen-turbo. É necessário conceder permissão de invocação para o modeloqwen-turbo.O plugin TONGYI não é mantido pela Alibaba Cloud, e suas políticas de validação podem mudar em versões futuras. Utilize uma chave de API do workspace padrão.
A configuração do endpoint está incorreta. Defina Use International Endpoint corretamente com base na região da sua chave de API.
P2: Uso dos modelos Qwen-Omni e Qwen-OCR
R: Esses modelos não podem ser configurados diretamente no Dify. A integração deve ser feita por meio de um nó HTTP em um Chatflow ou workflow. Para detalhes sobre a integração, consulte os exemplos de comandos curl na documentação do modelo.
Para reduzir o risco de timeouts no nó HTTP, utilize saída em streaming nas chamadas de API.
P3: Uso de modelos Wan
R: O Dify não oferece um plugin dedicado para modelos Wan. No entanto, é possível realizar geração de texto para imagem e texto para vídeo utilizando nós em um Chatflow ou workflow do Dify. Siga estas etapas:
-
Baixe e importe um modelo de workflow
Baixe um de nossos modelos pré-construídos: Wan - Text-to-Image Demo.yml ou Wan - Text-to-Video Demo.yml. No workspace, clique em Import DSL File e selecione o modelo baixado.
-
Configure variáveis de ambiente
Na página do workflow, localize o ícone de variáveis de ambiente
e altere o valor de DASHSCOPE_API_KEYpara a sua chave de API. -
Testar a saída
Clique no botão Run para gerar a saída. Por exemplo, ao inserir "a small cat" no workflow de texto para imagem, uma imagem será produzida.
O workflow de texto para vídeo retorna uma URL para o vídeo gerado.
A geração de texto para vídeo geralmente leva cinco minutos ou mais.
-
Publicar como ferramenta (opcional)
Para utilizar esses recursos em outras aplicações, clique em Publish no canto superior direito e selecione Publish as tool.
Os modelos utilizam modelos da região Singapore :wan2.2-t2i-flash(texto para imagem) ewan2.1-t2v-turbo(texto para vídeo). É possível alterar o modelo no nó STEP1 e modifique o endpoint de API específico da região nos nós STEP1 e STEP3.
P4: Implantação privada do Dify
R: O service cloud do Dify possui algumas limitações, como o máximo de cinco aplicações. Para uma implantação privada, consulte a Solução da Alibaba Cloud para implantação do Dify.