O Alibaba Cloud Model Studio oferece modelos Qwen e de terceiros para texto, imagem, áudio e vídeo.
Geração de texto
Imagem e vídeo
Compreensão
Extraia descrições textuais ou dados estruturados de imagens e vídeos
Geração
Gere imagens e vídeos a partir de texto ou imagens, com suporte a edição, referência e saída em alta resolução
Áudio e fala
Texto para fala
Para leitura de audiolivros, transmissão de voz, avatares virtuais e muito mais
Reconhecimento de fala
Abordagens dedicadas de ASR e baseadas em LLM — escolha conforme precisão e flexibilidade
Fala para fala
Conversa de voz ponta a ponta sem chamadas separadas de ASR e TTS
Omni
Integra recursos de compreensão e geração nas modalidades de texto, imagem, áudio e vídeo
Embeddings e reranking
Converta texto ou conteúdo multimodal em vetores, combinado com reranking para melhorar a precisão da recuperação
Ver todos os modelos
Acesse o Model Plaza para navegar por todos os modelos Qwen, de terceiros, específicos de domínio e legados.