Alibaba Memperkenalkan Model Open Source untuk Pembuatan dan Pengeditan Video
Alibaba Cloud 15 Mei 2025
Model AI all-in-one, Wan2.1-VACE, dirancang untuk mengubah industri pembuatan video
Hangzhou, Tiongkok, 15 Mei 2025 – Alibaba meluncurkan Wan 2.1-VACE (Video All-in-one Creation and Editing), model open source terbarunya untuk pembuatan dan pengeditan video. Alat inovatif ini menggabungkan berbagai fungsi pemrosesan video ke dalam satu model, untuk menyederhanakan proses pembuatan video, sehingga meningkatkan efisiensi dan produktivitas.
Sebagai bagian dari model besar generasi video Alibaba – seri Wan2.1 – VACE adalah model open source pertama di industri yang menyediakan solusi terunifikasi untuk berbagai tugas pembuatan dan pengeditan video.
Wan2.1-VACE mendukung pembuatan video dengan input multimodal yang mencakup teks, gambar, dan video, sekaligus menawarkan kemampuan pengeditan video lengkap bagi kreator. Fitur pengeditan ini meliputi referensi gambar atau frame, pengecatan ulang video, modifikasi area tertentu pada video, dan ekstensi spasial-temporal, yang semuanya memungkinkan kombinasi fleksibel dari berbagai tugas untuk meningkatkan kreativitas.
Dengan alat canggih ini, pengguna dapat menghasilkan video yang berisi subjek berinteraksi spesifik berdasarkan sampel gambar dan menghidupkan gambar statis dengan menambahkan efek gerakan alami. Mereka juga dapat menikmati fungsi pengecatan ulang video canggih seperti transfer pose, kontrol gerak, kontrol kedalaman, dan pewarnaan ulang.
Model ini juga mendukung penambahan, modifikasi, atau penghapusan pada area tertentu dalam video tanpa memengaruhi sekitarnya. Model ini juga memungkinkan perluasan batas video sambil mengisi konten secara cerdas untuk memperkaya pengalaman visual.
Sebagai model AI all-in-one, Wan2.1-VACE memberikan versatilitas tak tertandingi, memungkinkan pengguna menggabungkan beberapa fungsi dengan mulus dan membuka potensi inovatif. Pengguna dapat mengubah gambar statis menjadi video sambil mengontrol pergerakan objek dengan menentukan lintasan gerak. Mereka dapat mengganti karakter atau objek dengan referensi yang ditentukan secara mulus, menganimasikan karakter referensi, mengontrol pose, dan memperluas gambar vertikal secara horizontal untuk membuat video horizontal sambil menambahkan elemen baru melalui referensi.
Teknologi Inovatif

Wan2.1-VACE menggunakan beberapa teknologi inovatif untuk mempertimbangkan kebutuhan berbagai tugas pengeditan video selama konstruksi dan desain. Antarmuka terunifikasinya, yang disebut Video Condition Unit (VCU), mendukung pemrosesan terunifikasi dari input multimodal seperti teks, gambar, video, dan mask.
Model ini menggunakan struktur Context Adapter yang menyuntikkan berbagai konsep tugas menggunakan representasi formal dari dimensi temporal dan spasial. Desain inovatif ini memungkinkannya mengelola berbagai tugas sintesis video dengan fleksibel.
Berkat kemajuan dalam arsitektur model, Wan2.1-VACE dapat diterapkan secara luas dalam produksi cepat video pendek media sosial, pembuatan konten untuk periklanan dan pemasaran, pascaproduksi dan pemrosesan efek khusus dalam film dan televisi, serta untuk pembuatan video pelatihan pendidikan.
Pelatihan model fondasi video memerlukan sumber daya komputasi yang sangat besar dan jumlah data pelatihan berkualitas tinggi yang sangat banyak. Akses terbuka membantu menurunkan hambatan bagi lebih banyak bisnis untuk menggunakan AI, memungkinkan mereka membuat konten visual berkualitas tinggi yang disesuaikan dengan kebutuhan mereka, dengan cepat dan hemat biaya.
Alibaba merilis model Wan2.1-VACE sebagai open source dalam dua versi; parameter 14 miliar (B) dan 1,3 miliar (B). Model-model ini tersedia untuk diunduh secara gratis di Hugging Face dan GitHub, serta komunitas open source Alibaba Cloud, ModelScope.
Sebagai salah satu perusahaan teknologi global besar pertama yang merilis model AI skala besar buatan sendiri sebagai open source, Alibaba merilis empat model Wan2.1 pada Februari 2025 dan, bulan lalu, model pembuatan video yang mendukung pembuatan video dengan frame awal dan akhir. Hingga saat ini, model-model tersebut telah menarik lebih dari 3,3 juta unduhan di Hugging Face dan ModelScope.
Tentang Kami
Misi Alibaba Group adalah memudahkan bisnis di mana saja. Perusahaan ini bertujuan membangun infrastruktur perdagangan masa depan. Alibaba membayangkan para pelanggannya akan bertemu, bekerja, dan hidup di ekosistem Alibaba, serta menjadi perusahaan baik yang bertahan selama 102 tahun. www.alibabagroup.com
