Alibaba Apresenta Modelo de Código Aberto para Criação e Edição de Vídeo

Alibaba Cloud 15 de maio de 2025

Modelo de IA completo, Wan2.1-VACE, projetado para transformar a indústria de criação de vídeo



Hangzhou, China, 15 de maio de 2025 – A Alibaba revelou o Wan 2.1-VACE (Video All-in-one Creation and Editing), seu mais recente modelo de código aberto para criação e edição de vídeo. Esta ferramenta inovadora combina várias funções de processamento de vídeo em um único modelo, para simplificar o processo de criação de vídeo, aumentando a eficiência e a produtividade.



Como parte do grande modelo de geração de vídeo da Alibaba – a série Wan2.1 – o VACE é o primeiro modelo de código aberto do setor a fornecer uma solução unificada para várias tarefas de geração e edição de vídeo.

O Wan2.1-VACE suporta geração de vídeo com entradas multimodais abrangendo texto, imagem e vídeo, ao mesmo tempo em que oferece aos criadores recursos abrangentes de edição de vídeo. Esses recursos de edição incluem referência de imagens ou quadros, repintura de vídeo, modificação de áreas selecionadas do vídeo e extensão espaço-temporal, as quais permitem a combinação flexível de várias tarefas para aprimorar a criatividade.

Com esta ferramenta avançada, os usuários podem gerar vídeos contendo sujeitos específicos interagindo com base em amostras de imagem e dar vida a imagens estáticas adicionando efeitos de movimento natural. Eles também podem aproveitar funções avançadas de repintura de vídeo, como transferência de pose, controle de movimento, controle de profundidade e recoloração.

O modelo também suporta adição, modificação ou exclusão de áreas específicas seletivas de um vídeo sem afetar os arredores. Ele também permite a extensão dos limites do vídeo enquanto preenche o conteúdo de forma inteligente para enriquecer a experiência visual.

Como um modelo de IA completo, o Wan2.1-VACE oferece versatilidade incomparável, permitindo que os usuários combinem várias funções de forma contínua e liberem potencial inovador. Os usuários podem transformar uma imagem estática em vídeo enquanto controlam o movimento dos objetos especificando a trajetória do movimento. Eles podem substituir personagens ou objetos de forma contínua com referências especificadas, animar personagens referenciados, controlar poses e expandir uma imagem vertical horizontalmente para criar um vídeo horizontal enquanto adicionam novos elementos por meio de referência.

Tecnologias Inovadoras



O Wan2.1-VACE aproveita várias tecnologias inovadoras para levar em consideração as necessidades de diferentes tarefas de edição de vídeo durante a construção e o design. Sua interface unificada, chamada Video Condition Unit (VCU), suporta processamento unificado de entradas multimodais, como texto, imagens, vídeo e máscaras.

O modelo emprega uma estrutura de Context Adapter que injeta vários conceitos de tarefas usando representações formalizadas de dimensões temporais e espaciais. Esse design inovador permite que ele gerencie de forma flexível uma ampla gama de tarefas de síntese de vídeo.

Graças aos avanços na arquitetura do modelo, o Wan2.1-VACE pode ser amplamente aplicado na produção rápida de vídeos curtos para mídias sociais, criação de conteúdo para publicidade e marketing, pós-produção e processamento de efeitos especiais em cinema e televisão, e para geração de vídeos de treinamento educacional.

Treinar modelos de fundação de vídeo requer imensos recursos de computação e grandes quantidades de dados de treinamento de alta qualidade. O acesso aberto ajuda a diminuir a barreira para que mais empresas aproveitem a IA, permitindo-lhes criar conteúdo visual de alta qualidade adaptado às suas necessidades, de forma rápida e econômica.

A Alibaba está disponibilizando o modelo Wan2.1-VACE em código aberto em duas versões; uma de 14 bilhões (B) de parâmetros e outra de 1,3 bilhão (B) de parâmetros. Os modelos estão disponíveis para download gratuito no Hugging Face e no GitHub, bem como na comunidade de código aberto da Alibaba Cloud, o ModelScope.

Como uma das primeiras grandes empresas globais de tecnologia a abrir o código de seus modelos de IA de grande escala desenvolvidos internamente, a Alibaba abriu o código de quatro modelos Wan2.1 em fevereiro de 2025 e, no mês passado, um modelo de geração de vídeo que suporta criação de vídeo com quadros iniciais e finais. Até o momento, os modelos atraíram mais de 3,3 milhões de downloads no Hugging Face e no ModelScope.

Sobre o Alibaba Group

A missão do Alibaba Group é facilitar a realização de negócios em qualquer lugar. A empresa visa construir a futura infraestrutura do comércio. Ela vislumbra que seus clientes se encontrarão, trabalharão e viverão na Alibaba, e que será uma boa empresa que durará 102 anos. www.alibabagroup.com

phone Fale Conosco
Oi, eu sou o assistente de IA da Alibaba Cloud!
Posso ajudar com perguntas e soluções.