Wan-R2V menerima input multimodal (gambar, video, dan audio) untuk menghasilkan video yang menampilkan satu atau beberapa karakter sekaligus mempertahankan penampilan dan suara mereka di berbagai adegan.
Referensi: Panduan pengguna
Untuk memastikan panggilan API berhasil, model, URL titik akhir, dan kunci API harus berada di wilayah yang sama. Panggilan lintas wilayah akan gagal.
Pembuatan video biasanya memakan waktu 1 hingga 5 menit, sehingga API menggunakan pemanggilan asinkron. Alur kerja terdiri dari dua langkah: membuat tugas, lalu melakukan polling untuk hasilnya.
Ganti
Ganti
Nama parameter SDK sebagian besar konsisten dengan API HTTP. Struktur parameter dienkapsulasi berdasarkan fitur bahasa.
Tugas referensi-ke-video biasanya memakan waktu 1 hingga 5 menit. SDK membungkus alur asinkron HTTP dan mendukung panggilan sinkron maupun asinkron.
Atur base_http_api_url berdasarkan wilayah model:
Ganti
Atur baseHttpApiUrl berdasarkan wilayah model:
Ganti
Jika pemanggilan model gagal dan mengembalikan pesan kesalahan, lihat Kode kesalahan untuk solusinya.
Hanya wan2.7 yang mendukung referensi suara. Dalam objek
Ketersediaan
Untuk memastikan panggilan API berhasil, model, URL titik akhir, dan kunci API harus berada di wilayah yang sama. Panggilan lintas wilayah akan gagal.
- Pilih model: Konfirmasi wilayah model tersebut.
- Pilih URL: Gunakan URL titik akhir yang sesuai dengan wilayah tersebut. Protokol HTTP didukung.
- Konfigurasikan kunci API: Pilih wilayah, dapatkan kunci API, dan konfigurasikan kunci API sebagai variabel lingkungan.
Kode contoh dalam topik ini berlaku untuk wilayah Singapura.
HTTP
Pembuatan video biasanya memakan waktu 1 hingga 5 menit, sehingga API menggunakan pemanggilan asinkron. Alur kerja terdiri dari dua langkah: membuat tugas, lalu melakukan polling untuk hasilnya.
Langkah 1: Buat tugas dan dapatkan ID tugas
- Singapura
- Beijing
POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis{WorkspaceId} dengan ID ruang kerja aktual Anda.
- Setelah tugas dibuat, gunakan
task_idyang dikembalikan untuk mengkueri hasilnya.task_idberlaku selama 24 jam. Jangan membuat tugas duplikat. Sebagai gantinya, gunakan polling untuk mengambil hasilnya. - Untuk panduan pemula, lihat Panggil API dengan Postman atau cURL.
Parameter permintaanHeaderContent-Typestring (Wajib)Tipe konten permintaan. Harus berupa application/json.Authorization string (Wajib)Mengotentikasi permintaan dengan Kunci API Model Studio. Contoh: Bearer sk-xxxx.X-DashScope-Async string (Wajib)Mengaktifkan pemrosesan asinkron. Permintaan HTTP hanya mendukung panggilan asinkron. Harus diatur ke enable.Body permintaanmodelstring (Wajib)Nama model. Untuk daftar model dan harga, lihat Harga model.Contoh: wan2.7-r2v, wan2.7-r2v-2026-06-12.input object (Wajib)Informasi input dasar, seperti prompt.
Properti prompt string (Wajib)Prompt teks yang menjelaskan elemen dan fitur visual yang diinginkan dalam video yang dihasilkan.Mendukung bahasa Tionghoa dan Inggris. Setiap karakter Tionghoa, huruf, dan tanda baca dihitung sebagai satu karakter. Teks yang melebihi batas akan dipotong secara otomatis.
media. Gambar dan video dihitung secara terpisah, sehingga "Image 1" dan "Video 1" dapat digunakan bersamaan. Jika hanya ada satu gambar atau video referensi, sederhanakan referensinya menjadi "the reference image" atau "the reference video".Deskripsi adegan: Misalnya, jika Image 1 adalah kucing dan Image 2 adalah ruangan, Anda dapat menggambarkan kucing tersebut sedang bermain di ruangan itu dengan dua metode. Pertama, gunakan identifier secara langsung, seperti “Image 1 sedang bermain di Image 2”. Kedua, lengkapi deskripsi dengan subjek dan adegan, seperti “Kucing dari Image 1 sedang bermain di ruangan dari Image 2”.Jika gambar referensi berupa storyboard multi-panel, gambarkan adegan dalam format multi-shot di prompt. Anda tidak perlu menggambarkan setiap panel — cukup berikan shot utama, dan model akan secara otomatis mengenali logika panel serta melengkapi adegan yang tersisa. Untuk hasil terbaik, gunakan hanya satu gambar multi-panel dalam satu waktu.Untuk tips penggunaan prompt, lihat Panduan prompt teks-ke-video/gambar-ke-video.negative_prompt string (Opsional)Prompt negatif yang menjelaskan konten yang harus dikecualikan dari video yang dihasilkan. Gunakan ini untuk membatasi output.Mendukung bahasa Tionghoa dan Inggris. Panjang maksimum: 500 karakter. Teks yang melebihi batas akan dipotong secara otomatis.Contoh: low resolution, error, worst quality, low quality, disfigured, extra fingers, bad proportions.media array (Wajib)Array aset media (gambar, video, dan audio) yang digunakan sebagai referensi visual dan audio. Gambar dapat mencakup beberapa sudut pandang, umumnya digunakan untuk mereferensikan karakter, properti, dan adegan.
Properti type string (Wajib)Jenis aset media. Nilai yang valid:
string (Wajib)URL aset media. Setiap nilai dapat mengarah ke satu gambar atau satu video.
Kirimkan gambar referensi (type=reference_image) URL atau data yang dienkode Base64 dari gambar referensi. Gambar dapat berupa subjek (orang, hewan, atau objek) atau latar belakang. Jika berisi subjek, gambar tersebut harus hanya berisi satu karakter.Batas gambar:
Kirimkan video referensi (type=reference_video) URL video referensi. Video harus mencakup subjek (orang, hewan, atau objek). Hindari penggunaan video latar belakang atau adegan kosong. Jika video mencakup subjek, video tersebut harus hanya berisi satu karakter. Jika video memiliki audio, suara tersebut juga dapat direferensikan.Batas video:
string (Opsional)URL audio yang menentukan suara untuk karakter utama dalam aset referensi (gambar atau video). Gunakan parameter ini dengan reference_image atau reference_video. Audio hanya berfungsi sebagai referensi suara dan tidak menentukan konten yang diucapkan. Untuk hasil terbaik, sesuaikan bahasa audio referensi dengan bahasa prompt.Logika audio:
object (Opsional)Parameter pemrosesan video, seperti resolusi video.
Properti resolution string (Opsional)Tingkat resolusi video yang dihasilkan. Mengontrol jumlah total piksel.
string (Opsional)Rasio aspek video yang dihasilkan.Perilaku:
integer (Opsional)Durasi video yang dihasilkan dalam satuan detik.
boolean (Opsional)Mengaktifkan penulisan ulang prompt. Saat diaktifkan, model akan menulis ulang prompt input sebelum generasi. Ini secara signifikan meningkatkan kualitas untuk prompt yang lebih pendek tetapi meningkatkan waktu pemrosesan.
boolean (Opsional)Menambahkan watermark. Teks watermark adalah "AI Generated", ditempatkan di pojok kanan bawah video.
integer (Opsional)Bilangan acak seed harus berupa bilangan bulat dalam rentang [0, 2147483647].Jika tidak ditentukan, seed acak akan dihasilkan. Seed tetap meningkatkan kemampuan reproduksi.Karena generasi model bersifat probabilistik, seed yang sama tidak menjamin hasil identik. |
Anda dapat mengirimkan beberapa aset referensi (gambar dan video) serta menentukan suara untuk menghasilkan video. |
Parameter responsoutputobjectInformasi output tugas.
Properti task_id stringID tugas. Berlaku untuk kueri selama 24 jam.task_status stringStatus tugas.
Nilai enumerasi
stringIdentifier permintaan unik untuk pelacakan dan troubleshooting.code stringKode kesalahan. Hanya dikembalikan untuk permintaan yang gagal. Lihat Kode kesalahan.message stringPesan kesalahan detail. Hanya dikembalikan untuk permintaan yang gagal. Lihat Kode kesalahan. |
Simpan task_id untuk mengkueri status dan hasil tugas. |
Langkah 2: Kueri hasil berdasarkan ID tugas
- Singapura
- Beijing
GET https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/tasks/{task_id}{WorkspaceId} dengan ID ruang kerja aktual Anda.
- Rekomendasi polling: Pembuatan video memakan waktu beberapa menit. Gunakan mekanisme polling dengan interval yang wajar, misalnya 15 detik.
- Transisi status tugas: PENDING → RUNNING → SUCCEEDED atau FAILED.
- Tautan hasil: Setelah tugas berhasil, URL video yang berlaku selama 24 jam akan dikembalikan. Unduh dan simpan video ke penyimpanan permanen, seperti OSS.
task_idmasa berlaku: 24 jam. Setelah periode ini, kueri akan mengembalikan status tugas sebagaiUNKNOWN.
Parameter permintaanHeaderAuthorizationstring (Wajib)Mengotentikasi permintaan dengan Kunci API Model Studio. Contoh: Bearer sk-xxxx.Parameter pathtask_idstring (Wajib)ID tugas. |
Ganti {task_id} dengan nilai task_id yang dikembalikan oleh panggilan API sebelumnya. task_id berlaku untuk kueri selama 24 jam. |
Parameter responsoutputobjectInformasi output tugas.
Properti task_id string (Wajib)ID tugas.task_status stringStatus tugas.
Nilai enumerasi
stringWaktu saat tugas diajukan. Waktu dalam UTC+8 dan formatnya YYYY-MM-DD HH:mm:ss.SSS.scheduled_time stringWaktu saat tugas dieksekusi. Waktu dalam UTC+8 dan formatnya YYYY-MM-DD HH:mm:ss.SSS.end_time stringWaktu saat tugas selesai. Waktu dalam UTC+8 dan formatnya YYYY-MM-DD HH:mm:ss.SSS.video_url stringURL video yang dihasilkan. Hanya dikembalikan saat task_status bernilai SUCCEEDED.Berlaku selama 24 jam. Video dalam format MP4 dengan enkode H.264.orig_prompt stringPrompt input asli, sesuai dengan parameter permintaan prompt.code stringKode kesalahan. Hanya dikembalikan untuk permintaan yang gagal. Lihat Kode kesalahan.message stringPesan kesalahan detail. Hanya dikembalikan untuk permintaan yang gagal. Lihat Kode kesalahan.objectStatistik output. Diisi hanya untuk tugas yang berhasil.
Properti input_video_duration integerDurasi video input, dalam satuan detik.output_video_duration integerDurasi video output, dalam satuan detik.duration integerTotal durasi video. Biaya dihitung berdasarkan nilai ini.Rumus: duration = input_video_duration + output_video_duration.SR integerTingkat resolusi video yang dihasilkan. Contoh: 720.ratio stringRasio aspek video yang dihasilkan. Contoh: 16:9.video_count integerJumlah video yang dihasilkan. Nilainya selalu 1.stringIdentifier permintaan unik untuk pelacakan dan troubleshooting. |
URL video hanya berlaku selama 24 jam, lalu secara otomatis dihapus. Segera simpan video yang dihasilkan. |
DashScope SDK
Nama parameter SDK sebagian besar konsisten dengan API HTTP. Struktur parameter dienkapsulasi berdasarkan fitur bahasa.
Tugas referensi-ke-video biasanya memakan waktu 1 hingga 5 menit. SDK membungkus alur asinkron HTTP dan mendukung panggilan sinkron maupun asinkron.
Waktu pemrosesan aktual bergantung pada panjang antrian dan status layanan.
Python SDK
Atur base_http_api_url berdasarkan wilayah model:
- Singapura
- Beijing
dashscope.base_http_api_url = 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1'{WorkspaceId} dengan ID ruang kerja aktual Anda.
- Panggilan sinkron
- Panggilan asinkron
Panggilan sinkron akan menunggu hingga pembuatan video selesai dan langsung mengembalikan hasilnya.
Contoh permintaan
Contoh respons
video_url berlaku selama 24 jam. Segera unduh video tersebut.
Java SDK
Atur baseHttpApiUrl berdasarkan wilayah model:
- Singapura
- Beijing
Constants.baseHttpApiUrl = "https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1";{WorkspaceId} dengan ID ruang kerja aktual Anda.
- Panggilan sinkron
- Panggilan asinkron
Panggilan sinkron akan menunggu hingga pembuatan video selesai dan langsung mengembalikan hasilnya.
Contoh permintaan
Contoh respons
video_url berlaku selama 24 jam. Segera unduh video tersebut.
Kode kesalahan
Jika pemanggilan model gagal dan mengembalikan pesan kesalahan, lihat Kode kesalahan untuk solusinya.
FAQ
Bagaimana cara menambahkan suara ke subjek (referensi suara)?
Hanya wan2.7 yang mendukung referensi suara. Dalam objek media, Anda dapat mengirimkan URL audio dalam parameter reference_voice untuk menentukan referensi suara untuk gambar atau video referensi.