All Products
Search
Document Center

Alibaba Cloud Model Studio:Wan - Pengeditan video (2.1)

Last Updated:Sep 02, 2026

Model terpadu Wan 2.1 untuk pengeditan video mendukung berbagai modalitas input, termasuk teks, gambar, dan video, untuk berbagai tugas pembuatan dan pengeditan video.

Dokumentasi Terkait: panduan pengguna

Cakupan

Untuk memastikan panggilan berhasil, model, URL titik akhir, dan Kunci API harus berada di wilayah yang sama. Panggilan lintas-wilayah akan gagal.

  • Pilih model: Konfirmasi wilayah model.
  • Pilih URL: Pilih URL titik akhir sesuai wilayah model. URL HTTP didukung.
  • Konfigurasikan Kunci API: Pilih wilayah, dapatkan Kunci API, dan konfigurasikan dalam Variabel lingkungan Anda.

CatatanKode contoh dalam topik ini ditujukan untuk wilayah Singapura.

PentingAlibaba Cloud Model Studio telah merilis domain khusus ruang kerja untuk wilayah China (Beijing) dan Singapura. Domain khusus baru ini memberikan performa lebih unggul dan stabilitas lebih tinggi untuk permintaan Inferensi. Kami merekomendasikan migrasi ke domain baru:

  • China (Beijing): dari https://dashscope.aliyuncs.com ke https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com
  • Singapura: dari https://dashscope-intl.aliyuncs.com ke https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com

{WorkspaceId} adalah ID ruang kerja Anda, yang dapat ditemukan pada halaman Detail Ruang Kerja di Konsol Alibaba Cloud Model Studio. Domain lama tetap berfungsi penuh.

Panggilan HTTP

Model pengeditan video terpadu memerlukan waktu pemrosesan 5–10 menit, sehingga API menggunakan proses asinkron dengan dua langkah inti: "buat task -> polling hasil".

Langkah 1: Buat task

Singapura

POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis

Ganti {WorkspaceId} dengan ID ruang kerja aktual Anda.

Beijing

POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis

Ganti {WorkspaceId} dengan ID ruang kerja aktual Anda.

Parameter permintaan

Header permintaan

Content-Type string (Wajib)

Tipe konten permintaan. Harus berupa application/json.

Authorization string (Wajib)

Mengotentikasi permintaan dengan Kunci API Model Studio. Contoh: Bearer sk-xxxx.

X-DashScope-Async string (Wajib)

Mengaktifkan pemrosesan asinkron. Permintaan HTTP hanya mendukung panggilan asinkron. Harus diatur ke enable.

PentingJika header permintaan ini tidak disertakan, kesalahan "current user api does not support synchronous calls" akan dikembalikan.

Body permintaan

Referensi multi-gambar

model string (Wajib)

Nama model. Contoh: wan2.1-vace-plus.

input object (Wajib)

Input dasar, seperti prompt.

Properti

promptstring(Wajib)

Menjelaskan elemen dan fitur visual yang ingin dimasukkan dalam video yang dihasilkan.

Mendukung bahasa Tiongkok dan Inggris. Panjang maksimum adalah 800 karakter, di mana setiap karakter Tiongkok atau huruf dihitung sebagai satu karakter. Teks yang melebihi batas ini akan dipotong secara otomatis.

Untuk teknik prompt, lihat Panduan Prompt Teks-ke-Video/Gambar-ke-Video.

functionstring(Wajib)

Nama fitur. Referensi multi-gambar diatur ke image_reference.

Referensi multi-gambar mendukung hingga 3 gambar referensi. Gambar-gambar tersebut dapat berisi entitas dan latar belakang, seperti manusia, hewan, pakaian, dan pemandangan. Gunakan prompt untuk menggambarkan konten video yang diinginkan, dan model dapat menggabungkan beberapa gambar tersebut untuk menghasilkan konten video yang koheren.

ref_images_urlarray[string] (Wajib)

Array URL gambar referensi.

  1. URL publik:

Anda dapat memberikan 1 hingga 3 gambar referensi. Jika Anda memberikan lebih dari 3, hanya 3 gambar pertama yang digunakan.

Persyaratan gambar:

  • Format: JPG, JPEG, PNG, BMP, TIFF, atau WEBP.
  • Resolusi: Lebar dan tinggi harus dalam rentang [360, 2000] piksel.
  • Ukuran: Maksimal 10 MB.
  • URL tidak boleh mengandung karakter Tiongkok.

Rekomendasi:

  • Saat menggunakan gambar referensi untuk entitas, kami menyarankan agar setiap gambar hanya berisi satu entitas. Latar belakang sebaiknya berwarna solid (misalnya putih) agar entitas lebih menonjol.
  • Jika menggunakan latar belakang dari gambar referensi, Anda dapat memberikan maksimal satu gambar latar belakang, yang tidak boleh mengandung objek entitas apa pun.

parameters object (Opsional)

Parameter untuk pemrosesan video, seperti pengaturan Watermark.

Properti

obj_or_bg array[string] (Opsional)

Parameter ini digunakan untuk mengidentifikasi tujuan setiap gambar referensi dan berkorespondensi satu-ke-satu dengan parameter ref_images_url. Setiap elemen dalam array menentukan apakah gambar pada posisi yang sesuai merupakan 'subjek' atau 'latar belakang':

  • obj: Menunjukkan bahwa gambar tersebut adalah entitas referensi.
  • bg: Menentukan gambar tersebut sebagai referensi latar belakang (maksimal satu diperbolehkan).

Catatan penggunaan:

  • Kami menyarankan Anda meneruskan parameter ini, dan panjangnya harus sama dengan ref_images_url, jika tidak akan terjadi kesalahan.
  • Parameter ini dapat diabaikan dan secara default bernilai ["obj"] hanya jika ref_images_url adalah array dengan satu elemen.

Contoh: ["obj", "obj", "bg"].

size string (Opsional)

Resolusi video yang dihasilkan (lebar*tinggi). Model mendukung pembuatan video 720p. Nilai yang valid:

  • 1280*720 (Default): Rasio aspek video adalah 16:9, dengan lebar 1280 dan tinggi 720.
  • 720*1280: Rasio aspek video adalah 9:16.
  • 960*960: Rasio aspek video adalah 1:1.
  • 832*1088: Rasio aspek video adalah 3:4.
  • 1088*832: Rasio aspek video adalah 4:3.

duration integer (Opsional)

Durasi video yang dihasilkan dalam detik. Nilai ini tetap 5.

prompt_extendbool (Opsional)

Menentukan apakah akan mengaktifkan penulisan ulang prompt. Jika diaktifkan, model bahasa besar (LLM) akan menulis ulang prompt input. Ini dapat meningkatkan hasil secara signifikan untuk prompt pendek tetapi memperpanjang waktu pemrosesan.

  • true (default): Mengaktifkan penulisan ulang prompt.
  • false: Menonaktifkan penulisan ulang prompt.

seedinteger(Opsional)

Bilangan acak seed mengontrol keacakan konten yang dihasilkan oleh model. Rentang nilai parameter seed adalah [0, 2147483647].

Jika Anda tidak menentukan seed, seed akan dibuat secara otomatis. Untuk hasil yang dapat direproduksi, gunakan nilai seed yang sama pada beberapa permintaan.

watermark bool(Opsional)

Menentukan apakah akan menambahkan Watermark 'AI-generated' di pojok kanan bawah gambar.

  • false (default): Tidak menambahkan Watermark.
  • true: Menambahkan Watermark.

Pewarnaan ulang video

model string (Wajib)

Nama model. Contoh: wan2.1-vace-plus.

input object (Wajib)

Input dasar, seperti prompt.

Properti

promptstring(Wajib)

Menjelaskan elemen dan fitur visual yang ingin dimasukkan dalam video yang dihasilkan.

Mendukung bahasa Tiongkok dan Inggris. Panjang maksimum adalah 800 karakter, di mana setiap karakter Tiongkok atau huruf dihitung sebagai satu karakter. Teks yang melebihi batas ini akan dipotong secara otomatis.

Untuk teknik prompt, lihat Panduan Prompt Teks-ke-Video/Gambar-ke-Video.

functionstring(Wajib)

Nama fitur. Pewarnaan ulang video diatur ke video_repainting.

Fitur pewarnaan ulang video mengekstraksi pose dan gerakan entitas, Pencampuran aliran, kontur gerak, serta struktur garis dari video input. Fitur ini kemudian menggabungkannya dengan prompt teks untuk menghasilkan video baru dengan karakteristik dinamis yang sama. Fitur ini juga mendukung penggantian entitas dalam video asli dengan menggunakan gambar referensi, misalnya untuk mengubah penampilan karakter sambil mempertahankan gerakan aslinya.

video_urlstring (Wajib)

URL video input.

  1. URL publik:

Persyaratan video:

  • Format: MP4.
  • Laju frame: 16 FPS atau lebih tinggi.
  • Ukuran: Maksimal 50 MB.
  • Durasi: Maksimal 5 detik. Video yang lebih panjang akan dipotong menjadi 5 detik pertama.
  • URL tidak boleh mengandung karakter Tiongkok.

Resolusi video output:

  • Jika resolusi video input 720p atau lebih rendah, resolusi output akan sama dengan input.
  • Jika resolusi video input lebih tinggi dari 720p, resolusi akan diturunkan agar sesuai dalam resolusi 720p sambil mempertahankan rasio aspek asli.

Durasi video output:

  • Durasi video output sesuai dengan video input, hingga maksimal 5 detik.
  • Contoh: Jika video input berdurasi 3 detik, output juga 3 detik. Jika input 6 detik, output adalah 5 detik pertama dari input.

ref_images_urlarray[string] (Opsional)

Array URL gambar referensi.

  1. URL publik:

Hanya mendukung 1 gambar referensi. Kami menyarankan gambar ini berupa gambar entitas untuk mengganti konten entitas dalam video input.

Persyaratan gambar:

  • Format: JPG, JPEG, PNG, BMP, TIFF, atau WEBP.
  • Resolusi: Lebar dan tinggi harus dalam rentang [360, 2000] piksel.
  • Ukuran: Maksimal 10 MB.
  • URL tidak boleh mengandung karakter Tiongkok.

Rekomendasi:

  • Saat menggunakan gambar referensi untuk entitas, kami menyarankan agar gambar hanya berisi satu entitas. Latar belakang sebaiknya berwarna solid (misalnya putih) agar entitas lebih menonjol.

parameters object (Wajib)

Parameter untuk pemrosesan video, seperti pengaturan Watermark.

Properti

control_condition string (Wajib)

Metode ekstraksi fitur video.

  • posebodyface: Mengekstraksi ekspresi wajah dan gerakan tubuh entitas dari video input. Cocok untuk skenario di mana Anda perlu mempertahankan detail ekspresi wajah entitas.
  • posebody: Mengekstraksi gerakan tubuh entitas dari video input, tanpa ekspresi wajah. Cocok untuk skenario di mana Anda hanya perlu mengontrol gerakan tubuh entitas.
  • depth: Mengekstraksi Pencampuran aliran dan kontur gerak dari video input.
  • scribble: Mengekstraksi struktur garis dari video input.

strength float (Opsional)

Menyesuaikan kekuatan kontrol metode ekstraksi fitur video yang ditentukan oleh control_condition pada video yang dihasilkan.

Nilai harus dalam rentang [0.0, 1.0]. Nilai default adalah 1.0.

Nilai yang lebih besar membuat video yang dihasilkan lebih sesuai dengan gerakan dan komposisi video asli. Nilai yang lebih kecil memberikan kebebasan kreatif lebih besar.

prompt_extendbool (Opsional)

Menentukan apakah akan mengaktifkan penulisan ulang prompt. Jika diaktifkan, model bahasa besar (LLM) akan menulis ulang prompt input. Ini dapat meningkatkan hasil secara signifikan untuk prompt pendek tetapi memperpanjang waktu pemrosesan.

  • true (default): Mengaktifkan penulisan ulang prompt.
  • false: Menonaktifkan penulisan ulang prompt. (Direkomendasikan)

Jika deskripsi teks tidak konsisten dengan konten video, model mungkin salah menafsirkan input. Kami menyarankan Anda menonaktifkan ekspansi cerdas secara manual dan memberikan deskripsi adegan yang jelas dan spesifik dalam prompt untuk meningkatkan konsistensi dan akurasi.

seedinteger(Opsional)

Bilangan acak seed mengontrol keacakan konten yang dihasilkan oleh model. Rentang nilai parameter seed adalah [0, 2147483647].

Jika Anda tidak menentukan seed, seed akan dibuat secara otomatis. Untuk hasil yang dapat direproduksi, gunakan nilai seed yang sama pada beberapa permintaan.

watermark bool(Opsional)

Menentukan apakah akan menambahkan Watermark 'AI-generated' di pojok kanan bawah gambar.

  • false (default): Tidak menambahkan Watermark.
  • true: Menambahkan Watermark.

Pengeditan lokal

model string (Wajib)

Nama model. Contoh: wan2.1-vace-plus.

input object (Wajib)

Input dasar, seperti prompt.

Properti

promptstring(Wajib)

Menjelaskan elemen dan fitur visual yang ingin dimasukkan dalam video yang dihasilkan.

Mendukung bahasa Tiongkok dan Inggris. Panjang maksimum adalah 800 karakter, di mana setiap karakter Tiongkok atau huruf dihitung sebagai satu karakter. Teks yang melebihi batas ini akan dipotong secara otomatis.

Untuk teknik prompt, lihat Panduan Prompt Teks-ke-Video/Gambar-ke-Video.

functionstring(Wajib)

Nama fitur: Pengeditan lokal diatur ke video_edit.

Fitur pengeditan lokal memungkinkan Anda menambah, memodifikasi, atau menghapus elemen di area tertentu video input. Anda juga dapat mengganti entitas atau latar belakang di area pengeditan untuk pengeditan video detail halus.

video_urlstring (Wajib)

URL video input.

  1. URL publik:

Persyaratan video:

  • Format: MP4.
  • Laju frame: 16 FPS atau lebih tinggi.
  • Ukuran: Maksimal 50 MB.
  • Durasi: Maksimal 5 detik. Video yang lebih panjang akan dipotong menjadi 5 detik pertama.
  • URL tidak boleh mengandung karakter Tiongkok.

Resolusi video output:

  • Jika resolusi video input 720p atau lebih rendah, resolusi output akan sama dengan input.
  • Jika resolusi video input lebih tinggi dari 720p, resolusi akan diturunkan agar sesuai dalam resolusi 720p sambil mempertahankan rasio aspek asli.

Durasi video output:

  • Durasi video output sesuai dengan video input, hingga maksimal 5 detik.
  • Contoh: Jika video input berdurasi 3 detik, output juga 3 detik. Jika input 6 detik, output adalah 5 detik pertama dari input.

ref_images_urlarray[string] (Opsional)

Array URL gambar referensi.

  1. URL publik:

Saat ini, hanya mendukung 1 gambar referensi. Gambar ini dapat digunakan sebagai entitas atau latar belakang untuk mengganti konten yang sesuai dalam video input.

Persyaratan gambar:

  • Format: JPG, JPEG, PNG, BMP, TIFF, atau WEBP.
  • Resolusi: Lebar dan tinggi harus dalam rentang [360, 2000] piksel.
  • Ukuran: Maksimal 10 MB.
  • URL tidak boleh mengandung karakter Tiongkok.

Rekomendasi:

  • Saat menggunakan gambar referensi untuk entitas, kami menyarankan agar gambar hanya berisi satu entitas. Latar belakang sebaiknya berwarna solid (misalnya putih) agar entitas lebih menonjol.
  • Jika menggunakan latar belakang dari gambar referensi, gambar latar belakang tidak boleh mengandung objek entitas apa pun.

mask_image_urlstring (Opsional)

URL gambar mask.

  1. URL publik:

Parameter ini menentukan area pengeditan video. Anda dapat menentukan parameter ini atau parameter mask_video_url. Kami menyarankan Anda memprioritaskan parameter ini.

Pada gambar mask, area putih (nilai piksel [255, 255, 255]) menentukan wilayah yang akan diedit, sedangkan area hitam (nilai piksel [0, 0, 0]) menentukan wilayah yang akan dipertahankan.

Persyaratan gambar:

  • Format: JPG, JPEG, PNG, BMP, TIFF, atau WEBP.
  • Resolusi gambar: Harus sama dengan resolusi video input (video_url).
  • Ukuran: Maksimal 10 MB.
  • URL tidak boleh mengandung karakter Tiongkok.

mask_frame_idinteger (Opsional)

Parameter ini berlaku saat mask_image_url tidak kosong. Parameter ini menentukan ID frame dalam video tempat target mask muncul.

Nilai default adalah 1, yang menunjukkan frame pertama video.

Rentang nilai adalah [1, max_frame_id], di mana max_frame_id = laju frame video input * durasi video input + 1.

Contohnya, jika video input (video_url) memiliki laju frame 16 FPS (frame per detik) dan durasi 5 detik, jumlah total frame adalah 16 × 5 + 1 = 81. Oleh karena itu, max_frame_id = 81.

mask_video_urlstring (Opsional)

URL video mask.

  1. URL publik:

Parameter ini digunakan untuk menentukan area pengeditan video. Anda harus menentukan parameter ini atau parameter mask_image_url.

Format video, laju frame, resolusi, dan panjang video mask harus identik dengan video input (video_url).

Pada video mask, area putih (nilai piksel [255, 255, 255]) menentukan wilayah yang akan diedit, sedangkan area hitam (nilai piksel [0, 0, 0]) menentukan wilayah yang akan dipertahankan.

parameters object (Opsional)

Parameter untuk pemrosesan video, seperti pengaturan Watermark.

Properti

control_condition string (Opsional)

Metode ekstraksi fitur video. Nilai default adalah "", yang berarti tidak ada fitur yang diekstraksi.

  • posebodyface: Mengekstraksi ekspresi wajah dan gerakan tubuh entitas dari video input. Cocok untuk skenario di mana wajah entitas menempati sebagian besar frame dan fiturnya terlihat jelas.
  • depth: Mengekstraksi kontur komposisi dan gerakan dari video masukan.

mask_type string (Opsional)

Saat mask_image_url tidak kosong, parameter ini berlaku untuk menentukan perilaku area pengeditan.

  • tracking (Default): Area pengeditan mengikuti lintasan gerak objek target secara dinamis. Cocok untuk skenario di mana subjek bergerak.
  • fixed: Area pengeditan tetap dan tidak berubah mengikuti konten layar.

expand_ratio float (Opsional)

Saat mask_type adalah tracking, parameter ini berlaku dan menentukan rasio perluasan area mask ke luar.

Nilai harus dalam rentang [0.0, 1.0]. Nilai default adalah 0.05, yang direkomendasikan.

Nilai yang lebih kecil membuat area mask lebih pas mengikuti objek target, sedangkan nilai yang lebih besar memperluas area mask lebih luas.

expand_mode string (Opsional)

Saat mask_type adalah tracking, parameter ini berlaku dan menentukan bentuk area mask.

Algoritma menghasilkan video mask dengan bentuk yang sesuai dari gambar mask input, berdasarkan expand_mode yang dipilih. Nilai yang didukung adalah sebagai berikut:

  • hull (Default): Mode poligon. Mode ini menggunakan poligon untuk mengelilingi objek yang dimask.
  • bbox: Mode kotak pembatas. Mode ini menggunakan persegi panjang untuk mengelilingi objek yang dimask.
  • original: Mode asli, yang berusaha mempertahankan bentuk target mask asli.

size string (Opsional)

Resolusi video yang dihasilkan (lebar*tinggi). Model mendukung pembuatan video 720p. Nilai yang valid:

  • 1280*720 (Default): Rasio aspek video adalah 16:9, dengan lebar 1280 dan tinggi 720.
  • 720*1280: Rasio aspek video adalah 9:16.
  • 960*960: Rasio aspek video adalah 1:1.
  • 832*1088: Rasio aspek video adalah 3:4.
  • 1088*832: Rasio aspek video adalah 4:3.

duration integer (Opsional)

Durasi video yang dihasilkan dalam detik. Nilai ini tetap 5.

prompt_extendbool (Opsional)

Menentukan apakah akan mengaktifkan penulisan ulang prompt. Jika diaktifkan, model bahasa besar (LLM) akan menulis ulang prompt input. Ini dapat meningkatkan hasil secara signifikan untuk prompt pendek tetapi memperpanjang waktu pemrosesan.

  • true (default): Mengaktifkan penulisan ulang prompt.
  • false: Menonaktifkan penulisan ulang prompt. (Direkomendasikan)

Jika deskripsi teks tidak konsisten dengan konten video, model mungkin salah menafsirkan input. Kami menyarankan Anda menonaktifkan ekspansi cerdas secara manual dan memberikan deskripsi adegan yang jelas dan spesifik dalam prompt untuk meningkatkan konsistensi dan akurasi.

seedinteger(Opsional)

Bilangan acak seed mengontrol keacakan konten yang dihasilkan oleh model. Rentang nilai parameter seed adalah [0, 2147483647].

Jika Anda tidak menentukan seed, seed akan dibuat secara otomatis. Untuk hasil yang dapat direproduksi, gunakan nilai seed yang sama pada beberapa permintaan.

watermark bool(Opsional)

Menentukan apakah akan menambahkan Watermark 'AI-generated' di pojok kanan bawah gambar.

  • false (default): Tidak menambahkan Watermark.
  • true: Menambahkan Watermark.

Ekstensi video

model string (Wajib)

Nama model. Contoh: wan2.1-vace-plus.

input object (Wajib)

Input dasar, seperti prompt.

Properti

promptstring(Wajib)

Menjelaskan elemen dan fitur visual yang ingin dimasukkan dalam video yang dihasilkan.

Mendukung bahasa Tiongkok dan Inggris. Panjang maksimum adalah 800 karakter, di mana setiap karakter Tiongkok atau huruf dihitung sebagai satu karakter. Teks yang melebihi batas ini akan dipotong secara otomatis.

Untuk teknik prompt, lihat Panduan Prompt Teks-ke-Video/Gambar-ke-Video.

functionstring(Wajib)

Nama fungsi. Ekstensi video diatur ke video_extension.

Fitur ekstensi video menghasilkan konten berkelanjutan dari gambar atau video. Fitur ini juga dapat mengekstraksi fitur dinamis, seperti gerakan dan Pencampuran aliran, dari video referensi untuk membimbing pembuatan video dengan gerakan serupa.

Durasi total video yang dihasilkan adalah 5 detik. Ini adalah durasi output akhir, bukan penambahan 5 detik ke konten asli.

first_frame_urlstring (Opsional)

URL gambar frame pertama.

  1. URL publik:

Persyaratan gambar:

  • Format: JPG, JPEG, PNG, BMP, TIFF, atau WEBP.
  • Resolusi: Lebar dan tinggi harus dalam rentang [360, 2000] piksel.
  • Ukuran: Maksimal 10 MB.
  • URL tidak boleh mengandung karakter Tiongkok.

last_frame_urlstring(Opsional)

URL gambar frame terakhir.

  1. URL publik:

Persyaratan gambar:

  • Format: JPG, JPEG, PNG, BMP, TIFF, atau WEBP.
  • Resolusi: Lebar dan tinggi harus dalam rentang [360, 2000] piksel.
  • Ukuran: Maksimal 10 MB.
  • URL tidak boleh mengandung karakter Tiongkok.

first_clip_urlstring (Opsional)

URL klip video pertama.

  1. URL publik:

Persyaratan video:

  • Format: MP4.
  • Laju bingkai video: Lebih besar atau sama dengan 16 FPS. Saat first_clip_url dan last_clip_url digunakan bersama, kami menyarankan kedua klip memiliki laju frame yang sama.
  • Ukuran: Maksimal 50 MB.
  • Panjang video: Video tidak boleh lebih dari 3 detik. Jika tidak, 3 detik pertama video akan digunakan. Jika Anda menentukan first_clip_url dan last_clip_url, durasi total kedua klip video tidak boleh melebihi 3 detik.
  • URL tidak boleh mengandung karakter Tiongkok.

Resolusi video output:

  • Jika resolusi video input 720p atau lebih rendah, resolusi output akan sama dengan input.
  • Jika resolusi video input lebih tinggi dari 720p, resolusi akan diturunkan agar sesuai dalam resolusi 720p sambil mempertahankan rasio aspek asli.

last_clip_urlstring(Opsional)

URL klip video terakhir.

  1. URL publik:

Persyaratan video:

  • Format: MP4.
  • Laju bingkai video: 16 FPS atau lebih tinggi. Saat first_clip_url dan last_clip_url digunakan bersama, kami menyarankan kedua klip memiliki laju frame yang sama.
  • Ukuran: Maksimal 50 MB.
  • Durasi video: Durasi tidak boleh melebihi 3 detik. Jika video lebih panjang, hanya 3 detik pertama yang digunakan. Jika Anda menentukan first_clip_url dan last_clip_url, durasi gabungan keduanya tidak boleh melebihi 3 detik.
  • URL tidak boleh mengandung karakter Tiongkok.

Resolusi video output:

  • Jika resolusi video input 720p atau lebih rendah, resolusi output akan sama dengan input.
  • Jika resolusi video input lebih tinggi dari 720p, resolusi akan diturunkan agar sesuai dalam resolusi 720p sambil mempertahankan rasio aspek asli.

video_urlstring (Opsional)

URL video input.

  1. URL publik:

Video ini terutama digunakan untuk mengekstraksi fitur gerak yang bekerja bersama parameter first_frame_url, last_frame_url, first_clip_url, dan last_clip_url untuk membimbing pembuatan video ekstensi dengan performa gerak serupa.

Persyaratan video:

  • Format: MP4.
  • Laju frame: 16 FPS atau lebih tinggi, konsisten dengan klip sebelum dan sesudahnya.
  • Resolusi: Konsisten dengan frame dan klip sebelum dan sesudahnya.
  • Ukuran: Maksimal 50 MB.
  • Durasi: Maksimal 5 detik. Video yang lebih panjang akan dipotong menjadi 5 detik pertama.
  • URL tidak boleh mengandung karakter Tiongkok.

parameters object (Opsional)

Parameter untuk pemrosesan video, seperti pengaturan resolusi video output.

Properti

control_condition string (Opsional)

Metode ekstraksi fitur video. Parameter ini wajib jika video_url ditentukan. Nilai default adalah "", yang berarti tidak ada fitur yang diekstraksi.

  • posebodyface: Mengekstraksi ekspresi wajah dan gerakan tubuh entitas dalam video input.
  • depth: Mengekstraksi komposisi dan kontur gerak dari video input.

duration integer (Opsional)

Durasi video yang dihasilkan dalam detik. Nilai ini tetap 5.

prompt_extendbool (Opsional)

Menentukan apakah akan mengaktifkan penulisan ulang prompt. Jika diaktifkan, model bahasa besar (LLM) akan menulis ulang prompt input. Ini dapat meningkatkan hasil secara signifikan untuk prompt pendek tetapi memperpanjang waktu pemrosesan.

  • true (default): Mengaktifkan penulisan ulang prompt.
  • false: Menonaktifkan penulisan ulang prompt. (Direkomendasikan)

Jika deskripsi teks tidak konsisten dengan konten video, model mungkin salah menafsirkan input. Kami menyarankan Anda menonaktifkan ekspansi cerdas secara manual dan memberikan deskripsi adegan yang jelas dan spesifik dalam prompt untuk meningkatkan konsistensi dan akurasi.

seedinteger(Opsional)

Bilangan acak seed mengontrol keacakan konten yang dihasilkan oleh model. Rentang nilai parameter seed adalah [0, 2147483647].

Jika Anda tidak menentukan seed, seed akan dibuat secara otomatis. Untuk hasil yang dapat direproduksi, gunakan nilai seed yang sama pada beberapa permintaan.

watermark bool(Opsional)

Menentukan apakah akan menambahkan Watermark 'AI-generated' di pojok kanan bawah gambar.

  • false (default): Tidak menambahkan Watermark.
  • true: Menambahkan Watermark.

Outpainting video

model string (Wajib)

Nama model. Contoh: wan2.1-vace-plus.

input object (Wajib)

Input dasar, seperti prompt.

Properti

promptstring(Wajib)

Menjelaskan elemen dan fitur visual yang ingin dimasukkan dalam video yang dihasilkan.

Mendukung bahasa Tiongkok dan Inggris. Panjang maksimum adalah 800 karakter, di mana setiap karakter Tiongkok atau huruf dihitung sebagai satu karakter. Teks yang melebihi batas ini akan dipotong secara otomatis.

Untuk teknik prompt, lihat Panduan Prompt Teks-ke-Video/Gambar-ke-Video.

functionstring(Wajib)

Nama fitur. Nilai untuk outpainting video adalah video_outpainting.

Fitur outpainting video memperluas proporsi frame video secara proporsional ke arah atas, bawah, kiri, dan kanan.

video_urlstring (Wajib)

URL video input.

  1. URL publik:

Persyaratan video:

  • Format: MP4.
  • Laju frame: 16 FPS atau lebih tinggi.
  • Ukuran: Maksimal 50 MB.
  • Durasi: Maksimal 5 detik. Video yang lebih panjang akan dipotong menjadi 5 detik pertama.
  • URL tidak boleh mengandung karakter Tiongkok.

Resolusi video output:

  • Jika resolusi video input 720p atau lebih rendah, resolusi output akan sama dengan input.
  • Jika resolusi video input lebih tinggi dari 720p, resolusi akan diturunkan agar sesuai dalam resolusi 720p sambil mempertahankan rasio aspek asli.

Durasi video output:

  • Durasi video output sesuai dengan video input, hingga maksimal 5 detik.
  • Contoh: Jika video input berdurasi 3 detik, output juga 3 detik. Jika input 6 detik, output adalah 5 detik pertama dari input.

parameters object (Opsional)

Parameter untuk pemrosesan video, seperti pengaturan rasio ekstensi.

Properti

top_scale float (Opsional)

Memusatkan frame video dan memperluasnya ke atas dengan rasio yang ditentukan.

Nilai harus dalam rentang [1.0, 2.0]. Nilai default adalah 1.0, yang berarti tidak ada ekstensi.

bottom_scale float (Opsional)

Memusatkan frame video dan memperluasnya ke bawah dengan rasio yang ditentukan.

Nilai harus dalam rentang [1.0, 2.0]. Nilai default adalah 1.0, yang berarti tidak ada ekstensi.

left_scale float (Opsional)

Memusatkan frame video dan memperluasnya ke kiri dengan rasio yang ditentukan.

Nilai harus dalam rentang [1.0, 2.0]. Nilai default adalah 1.0, yang berarti tidak ada ekstensi.

right_scale float (Opsional)

Memusatkan frame video dan memperluasnya ke kanan dengan rasio yang ditentukan.

Nilai harus dalam rentang [1.0, 2.0]. Nilai default adalah 1.0, yang berarti tidak ada ekstensi.

duration integer (Opsional)

Durasi video yang dihasilkan dalam detik. Nilai ini tetap 5.

prompt_extendbool (Opsional)

Menentukan apakah akan mengaktifkan penulisan ulang prompt. Jika diaktifkan, model bahasa besar (LLM) akan menulis ulang prompt input. Ini dapat meningkatkan hasil secara signifikan untuk prompt pendek tetapi memperpanjang waktu pemrosesan.

  • true (default): Mengaktifkan penulisan ulang prompt.
  • false: Menonaktifkan penulisan ulang prompt. (Direkomendasikan)

Jika deskripsi teks tidak konsisten dengan konten video, model mungkin salah menafsirkan input. Kami menyarankan Anda menonaktifkan ekspansi cerdas secara manual dan memberikan deskripsi adegan yang jelas dan spesifik dalam prompt untuk meningkatkan konsistensi dan akurasi.

seedinteger(Opsional)

Bilangan acak seed mengontrol keacakan konten yang dihasilkan oleh model. Rentang nilai parameter seed adalah [0, 2147483647].

Jika Anda tidak menentukan seed, seed akan dibuat secara otomatis. Untuk hasil yang dapat direproduksi, gunakan nilai seed yang sama pada beberapa permintaan.

watermark bool(Opsional)

Menentukan apakah akan menambahkan Watermark 'AI-generated' di pojok kanan bawah gambar.

  • false (default): Tidak menambahkan Watermark.
  • true: Menambahkan Watermark.

Referensi multi-gambar

Kunci API untuk wilayah Singapura dan China (Beijing) berbeda. Dapatkan Kunci API

URL berikut untuk wilayah Singapura. Untuk wilayah China (Beijing), gunakan URL ini sebagai gantinya: https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis

# URL berikut untuk wilayah Singapura. Saat memanggil, ganti {WorkspaceId} dengan ID ruang kerja aktual Anda. URL berbeda tiap wilayah.
curl --location 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis' \
--header 'X-DashScope-Async: enable' \
--header "Authorization: Bearer $DASHSCOPE_API_KEY" \
--header 'Content-Type: application/json' \
--data '{
    "model": "wan2.1-vace-plus",
    "input": {
        "function": "image_reference",
        "prompt": "Dalam video, seorang gadis muncul dengan anggun dari hutan kuno yang berkabut. Langkahnya ringan, dan kamera menangkap setiap gerakan lincahnya. Saat ia berhenti untuk melihat hutan rimbun di sekitarnya, senyum kejutan dan kegembiraan merekah di wajahnya. Adegan ini, membeku dalam permainan cahaya dan bayangan, merekam pertemuannya yang indah dengan alam.",
        "ref_images_url": [
            "http://wanx.alicdn.com/material/20250318/image_reference_2_5_16.png",
            "http://wanx.alicdn.com/material/20250318/image_reference_1_5_16.png"
        ]
    },
    "parameters": {
        "prompt_extend": true,
        "obj_or_bg": ["obj","bg"],
        "size": "1280*720"
    }
}'

Pewarnaan ulang video

Kunci API untuk wilayah Singapura dan China (Beijing) berbeda. Dapatkan Kunci API

URL berikut untuk wilayah Singapura. Untuk wilayah China (Beijing), gunakan URL ini sebagai gantinya: https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis

# URL berikut untuk wilayah Singapura. Saat memanggil, ganti {WorkspaceId} dengan ID ruang kerja aktual Anda. URL berbeda tiap wilayah.
curl --location 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis' \
--header 'X-DashScope-Async: enable' \
--header "Authorization: Bearer $DASHSCOPE_API_KEY" \
--header 'Content-Type: application/json' \
--data '{
    "model": "wan2.1-vace-plus",
    "input": {
        "function": "video_repainting",
        "prompt": "Video menampilkan mobil bergaya steampunk hitam yang dikemudikan seorang pria, dihiasi roda gigi dan pipa tembaga. Latar belakangnya adalah pabrik permen berbasis uap dengan elemen retro, menciptakan adegan vintage dan menyenangkan.",
        "video_url": "http://wanx.alicdn.com/material/20250318/video_repainting_1.mp4"
    },
    "parameters": {
        "prompt_extend": false,
        "control_condition": "depth"
    }
}'

Pengeditan lokal

Kunci API untuk wilayah Singapura dan China (Beijing) berbeda. Dapatkan Kunci API

URL berikut untuk wilayah Singapura. Untuk wilayah China (Beijing), gunakan URL ini sebagai gantinya: https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis

# URL berikut untuk wilayah Singapura. Saat memanggil, ganti {WorkspaceId} dengan ID ruang kerja aktual Anda. URL berbeda tiap wilayah.
curl --location 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis' \
--header 'X-DashScope-Async: enable' \
--header "Authorization: Bearer $DASHSCOPE_API_KEY" \
--header 'Content-Type: application/json' \
--data '{
    "model": "wan2.1-vace-plus",
    "input": {
        "function": "video_edit",
        "prompt": "Video menampilkan kafe Prancis bergaya Paris di mana seekor singa berjas dengan elegan menyesap kopi. Ia memegang cangkir kopi dengan satu tangan, menyesap pelan dengan ekspresi santai. Kafenya didekorasi secara apik, dengan warna lembut dan pencahayaan hangat yang menerangi area singa tersebut.",
        "mask_image_url": "http://wanx.alicdn.com/material/20250318/video_edit_1_mask.png",
        "video_url": "http://wanx.alicdn.com/material/20250318/video_edit_2.mp4",
        "mask_frame_id": 1
    },
    "parameters": {
        "prompt_extend": false,
        "mask_type": "tracking",
        "expand_ratio": 0.05
    }
}'

Ekstensi video

Kunci API untuk wilayah Singapura dan China (Beijing) berbeda. Dapatkan Kunci API

URL berikut untuk wilayah Singapura. Untuk wilayah China (Beijing), gunakan URL ini sebagai gantinya: https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis

# URL berikut untuk wilayah Singapura. Saat memanggil, ganti {WorkspaceId} dengan ID ruang kerja aktual Anda. URL berbeda tiap wilayah.
curl --location 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis' \
--header 'X-DashScope-Async: enable' \
--header "Authorization: Bearer $DASHSCOPE_API_KEY" \
--header 'Content-Type: application/json' \
--data '{
    "model": "wan2.1-vace-plus",
    "input": {
        "function": "video_extension",
        "prompt": "Seekor anjing memakai kacamata hitam sedang berseluncur di jalan dengan skateboard, kartun 3D.",
        "first_clip_url": "http://wanx.alicdn.com/material/20250318/video_extension_1.mp4"
    },
    "parameters": {
        "prompt_extend": false
    }
}'

Outpainting video

Kunci API untuk wilayah Singapura dan China (Beijing) berbeda. Dapatkan Kunci API

URL berikut untuk wilayah Singapura. Untuk wilayah China (Beijing), gunakan URL ini sebagai gantinya: https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis

# URL berikut untuk wilayah Singapura. Saat memanggil, ganti {WorkspaceId} dengan ID ruang kerja aktual Anda. URL berbeda tiap wilayah.
curl --location 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis' \
--header 'X-DashScope-Async: enable' \
--header "Authorization: Bearer $DASHSCOPE_API_KEY" \
--header 'Content-Type: application/json' \
--data '{
    "model": "wan2.1-vace-plus",
    "input": {
        "function": "video_outpainting",
        "prompt": "Seorang wanita elegan memainkan biola dengan penuh semangat, dikelilingi orkestra simfoni lengkap di belakangnya.",
        "video_url": "http://wanx.alicdn.com/material/20250318/video_outpainting_1.mp4"
    },
    "parameters": {
        "prompt_extend": false,
        "top_scale": 1.5,
        "bottom_scale": 1.5,
        "left_scale": 1.5,
        "right_scale": 1.5
    }
}'

Parameter respons

output object

Output dari task asinkron.

Properti

task_id string

ID task. Berlaku untuk kueri selama 24 jam.

task_status string

Status Tugas.

Nilai enumerasi

  • PENDING
  • RUNNING
  • SUCCEEDED
  • FAILED
  • CANCELED
  • UNKNOWN: Task tidak ada atau statusnya tidak diketahui.

request_id string

Identifier permintaan unik untuk pelacakan dan troubleshooting.

code string

Kode kesalahan. Hanya dikembalikan untuk permintaan yang gagal. Lihat Kode kesalahan.

message string

Pesan kesalahan detail. Hanya dikembalikan untuk permintaan yang gagal. Lihat Kode kesalahan.

Respons sukses

Simpan task_id untuk menanyakan status dan hasil task.

{
    "output": {
        "task_status": "PENDING",
        "task_id": "0385dc79-5ff8-4d82-bcb6-xxxxxx"
    },
    "request_id": "4909100c-7b5a-9f92-bfe5-xxxxxx"
}

Respons kesalahan

Pembuatan task gagal. Lihat Kode kesalahan.

{
    "code": "InvalidApiKey",
    "message": "No API-key provided.",
    "request_id": "7438d53d-6eb8-4596-8835-xxxxxx"
}

Langkah 2: Tanyakan hasil berdasarkan ID task

Singapura

GET https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/tasks/{task_id}

Ganti {WorkspaceId} dengan ID ruang kerja aktual Anda.

China (Beijing)

GET https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/tasks/{task_id}

Ganti {WorkspaceId} dengan ID ruang kerja aktual Anda.

Parameter permintaan

Header permintaan

Authorization string (Wajib)

Mengotentikasi permintaan dengan Kunci API Model Studio. Contoh: Bearer sk-xxxx.

Parameter path URL

task_id string (Wajib)

ID task.

Tanyakan hasil task

Ganti {task_id} dengan nilai task_id yang dikembalikan oleh panggilan API sebelumnya. task_id berlaku untuk kueri selama 24 jam, Ganti {WorkspaceId} dengan ID ruang kerja aktual Anda.

curl -X GET https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/tasks/{task_id} \
--header "Authorization: Bearer $DASHSCOPE_API_KEY"

Parameter respons

outputobject

Informasi tentang output task.

Properti

task_id string

ID task. Berlaku untuk kueri selama 24 jam.

task_status string

Status task.

Nilai enumerasi

  • PENDING
  • RUNNING
  • SUCCEEDED
  • FAILED
  • CANCELED
  • UNKNOWN: Task tidak ada atau statusnya tidak diketahui.

submit_time string

Waktu saat task diajukan. Waktu dalam UTC+8 dan format YYYY-MM-DD HH:mm:ss.SSS.

scheduled_time string

Waktu saat task dieksekusi. Waktu dalam UTC+8 dan format YYYY-MM-DD HH:mm:ss.SSS.

end_time string

Waktu saat task selesai. Waktu dalam UTC+8 dan format YYYY-MM-DD HH:mm:ss.SSS.

video_urlstring

URL video MP4 (H.264) yang dihasilkan. Tautan ini berlaku selama 24 jam.

orig_prompt string

Prompt input asli.

actual_prompt string

Prompt yang digunakan untuk generasi setelah penulisan ulang prompt. Bidang ini hanya dikembalikan jika penulisan ulang prompt diaktifkan.

code string

Kode kesalahan. Hanya dikembalikan untuk permintaan yang gagal. Lihat Kode kesalahan.

message string

Pesan kesalahan detail. Hanya dikembalikan untuk permintaan yang gagal. Lihat Kode kesalahan.

usage object

Statistik output task. Hanya disediakan untuk task yang berhasil.

Properti

video_duration integer

Durasi video yang dihasilkan dalam detik.

video_ratio string

Rasio aspek video yang dihasilkan. Nilainya selalu standard.

video_count integer

Jumlah video yang dihasilkan.

request_id string

Identifier permintaan unik untuk pelacakan dan troubleshooting.

Task berhasil

Data task, termasuk status task dan URL video, tersedia selama 24 jam lalu dihapus secara otomatis. Segera simpan video yang dihasilkan.

{
    "request_id": "851985d0-fbba-9d8d-a17a-xxxxxx",
    "output": {
        "task_id": "208e2fd1-fcb4-4adf-9fcc-xxxxxx",
        "task_status": "SUCCEEDED",
        "submit_time": "2025-05-15 16:14:44.723",
        "scheduled_time": "2025-05-15 16:14:44.750",
        "end_time": "2025-05-15 16:20:09.389",
        "video_url": "https://dashscope-result-wlcb.oss-cn-wulanchabu.aliyuncs.com/xxx.mp4?xxxxxx",
        "orig_prompt": "Dalam video, seorang gadis berjalan dengan anggun keluar dari hutan kuno yang berkabut. Langkahnya ringan, dan kamera menangkap setiap gerakan lincahnya. Saat gadis tersebut berhenti dan melihat sekeliling ke hutan rimbun, senyum kejutan dan kegembiraan merekah di wajahnya. Adegan ini, membeku dalam momen permainan antara cahaya dan bayangan, merekam pertemuannya yang indah dengan alam.",
        "actual_prompt": "Seorang gadis berbaju panjang berwarna terang perlahan berjalan keluar dari hutan kuno yang berkabut, langkahnya ringan seperti menari. Rambutnya panjang agak ikal, wajahnya halus, dan matanya bersinar. Kamera mengikuti gerakannya, menangkap setiap momen lincahnya. Saat ia berhenti, berbalik, dan melihat sekeliling ke hutan rimbun, senyum kejutan dan kegembiraan merekah di wajahnya. Sinar matahari menembus daun-daun, menciptakan bayangan bercak dan membekukan momen indah harmoni antara manusia dan alam ini. Gaya potret segar dan alami, menggabungkan bidikan medium dan penuh dengan perspektif datar dan sedikit gerakan kamera."
    },
    "usage": {
        "video_duration": 5,
        "video_ratio": "standard",
        "video_count": 1
    }
}

Task gagal

Saat task gagal, task_status bernilai FAILED dengan kode dan pesan kesalahan. Lihat Kode kesalahan.

{
    "request_id": "e5d70b02-ebd3-98ce-9fe8-759d7d7b107d",
    "output": {
        "task_id": "86ecf553-d340-4e21-af6e-a0c6a421c010",
        "task_status": "FAILED",
        "code": "InvalidParameter",
        "message": "The size is not match xxxxxx"
    }
}

Batasan

  • Periode retensi data: ID task task_id dan URL video video_url hanya disimpan selama 24 jam. Setelah kedaluwarsa, Anda tidak dapat lagi menanyakan atau mengunduhnya.
  • Dukungan audio: Fitur ini saat ini hanya menghasilkan video tanpa suara. Untuk menghasilkan audio, gunakan Speech Synthesis.

Kode kesalahan

Jika panggilan model gagal dengan pesan kesalahan, lihat Kode kesalahan untuk troubleshooting.

FAQ

T: Bagaimana cara menambahkan daftar putih domain penyimpanan video?

J: Video yang dihasilkan model disimpan di OSS. API mengembalikan URL publik sementara. Untuk mengonfigurasi daftar putih firewall untuk URL unduhan ini, perhatikan hal berikut: Penyimpanan dasar dapat berubah secara dinamis. Topik ini tidak menyediakan daftar putih nama domain OSS tetap untuk mencegah masalah akses akibat informasi yang kedaluwarsa. Jika Anda memiliki persyaratan kontrol keamanan, hubungi manajer akun Anda untuk mendapatkan daftar nama domain OSS terbaru.