Qwen-Image-Edit mendukung input dan output multi-gambar. Fitur ini dapat memodifikasi teks dalam gambar, menambah/menghapus/memindahkan objek, mengubah aksi subjek, mentransfer gaya, serta meningkatkan detail.
Memulai
Sebelum melakukan pemanggilan, dapatkan Kunci API dan ekspor Kunci API sebagai Variabel lingkungan.
Untuk memanggil API menggunakan SDK, instal DashScope SDK. SDK tersedia untuk Python dan Java.
- Python
- Java
- curl
Unduh gambar ke perangkat lokal Anda
Unduh gambar ke perangkat lokal Anda
Rekomendasi model
qwen-image-3.0-proseries (Direkomendasikan): Model unggulan Qwen Image 3.0 dengan kemampuan generasi dan pengeditan gambar yang ditingkatkan secara komprehensif, menawarkan rendering teks yang lebih baik, tekstur realistis, ketaatan semantik, dan penulisan ulang prompt cerdas.qwen-image-3.0series: Model standar Qwen Image 3.0 yang menyeimbangkan kualitas dan kecepatan.
Instruksi input
Gambar input (messages)
Parameter messages adalah array yang harus berisi satu objek. Objek ini harus mencakup properti role dan content. Properti role harus diatur ke user. Properti content harus mencakup image (satu hingga tiga gambar) dan text (satu instruksi pengeditan).
Gambar input harus memenuhi persyaratan berikut:
-
Format gambar yang didukung adalah JPG, JPEG, PNG, BMP, TIFF, WEBP, dan GIF.
Gambar output dalam format PNG. Untuk GIF animasi, hanya frame pertama yang diproses.
- Untuk hasil terbaik, resolusi gambar harus antara 384 hingga 3.072 piksel untuk lebar dan tinggi. Resolusi rendah dapat menghasilkan output buram, sedangkan resolusi tinggi meningkatkan waktu pemrosesan.
- Ukuran file gambar tunggal tidak boleh melebihi 10 MB.
Urutan input gambar
Nomor gambar dalam prompt sesuai dengan posisi array: gambar pertama adalah "gambar 1", gambar kedua adalah "gambar 2". Anda juga dapat menggunakan penanda seperti "[gambar 1]" dan "[gambar 2]".
Gambar input | Gambar output | ||
|---|---|---|---|
![]() Gambar 1 | ![]() Gambar 2 | ![]() Prompt: Pindahkan gambar 1 ke atas gambar 2 | ![]() Prompt: Pindahkan gambar 2 ke atas gambar 1 |
Metode input gambar
URL publik
- Anda dapat memberikan URL gambar yang dapat diakses publik yang mendukung protokol HTTP atau HTTPS.
- Nilai contoh:
https://xxxx/img.png.
data:{mime_type};base64,{base64_data}.
{mime_type}: Jenis media gambar, yang harus sesuai dengan format file.{base64_data}: String yang dienkode Base64 dari file.- Nilai contoh:
data:image/jpeg;base64,GDU7MtCZz...(Contoh dipotong untuk tujuan demonstrasi.)
Parameter tambahan
Sesuaikan hasil generasi menggunakan parameter opsional berikut:
- n: Jumlah gambar yang akan dihasilkan. Nilai default adalah 1. Seri model qwen-image-3.0, qwen-image-2.0, qwen-image-edit-max, dan qwen-image-edit-plus mendukung pembuatan satu hingga enam gambar. Model
qwen-image-edithanya mendukung pembuatan satu gambar. - negative_prompt: Menggambarkan konten yang harus dikecualikan dari gambar, seperti "blur" atau "extra fingers". Parameter ini membantu mengoptimalkan kualitas gambar yang dihasilkan.
- watermark: Menentukan apakah akan menambahkan Watermark "Qwen-Image" di pojok kanan bawah gambar. Nilai default adalah
false. - seed: Seed bilangan acak. Nilainya harus berupa bilangan bulat dari
[0, 2.147.483.647]. Jika parameter ini tidak ditentukan, algoritma akan menghasilkan bilangan acak sebagai seed. Penggunaan nilai seed yang sama membantu memastikan hasil generasi yang konsisten.
- size: Resolusi gambar output. Formatnya adalah
width*height, seperti"1024*2048". Untuk model seri qwen-image-3.0, luas total piksel harus antara 512×512 dan 2048×2048, dan rasio aspek harus antara 1:8 hingga 8:1. Jika tidak ditentukan, model secara otomatis merekomendasikan resolusi berdasarkan prompt. Untuk model seri qwen-image-2.0, Anda dapat mengatur lebar dan tinggi secara bebas. Total piksel gambar output harus antara 512 × 512 dan 2048 × 2048. Secara default, resolusinya sama dengan gambar input (gambar terakhir jika beberapa disediakan). Untuk model seri qwen-image-edit-max dan qwen-image-edit-plus, lebar dan tinggi dapat berkisar antara 512 hingga 2048 piksel. Secara default, gambar output memiliki resolusi mendekati1024*1024dan rasio aspek mirip dengan gambar asli. - prompt_extend: Mengaktifkan atau menonaktifkan fitur penulisan ulang prompt. Nilai default adalah
true. Jika diaktifkan, model akan mengoptimalkan prompt. Fitur ini dapat secara signifikan meningkatkan hasil untuk prompt yang sederhana atau kurang deskriptif.
Ikhtisar
Fusi multi-gambar
Gambar input 1 | Gambar input 2 | Gambar input 3 | Gambar output |
|---|---|---|---|
![]() | ![]() | ![]() | ![]() Gadis pada Gambar 1 mengenakan kalung dari Gambar 2 dan membawa tas dari Gambar 3 di bahu kirinya. |
Konsistensi subjek
Gambar input | Gambar output 1 | Gambar output 2 | Gambar output 3 |
|---|---|---|---|
![]() | ![]() Ubah gambar menjadi foto identitas dengan latar belakang biru. Orang tersebut mengenakan kemeja putih, setelan jas hitam, dan dasi bergaris. | ![]() Orang tersebut mengenakan kemeja putih, setelan jas abu-abu, dan dasi bergaris. Satu tangan bertumpu pada dasi. Latar belakang berwarna terang. | ![]() Orang tersebut mengenakan hoodie hitam dengan tulisan "Qwen Image" dalam font kuas tebal. Ia bersandar pada pagar pembatas dengan sinar matahari di rambutnya. Jembatan dan laut terlihat di latar belakang. |
![]() | ![]() AC ditempatkan di ruang tamu di sebelah sofa. | ![]() Kabut ditambahkan dari ventilasi AC, menjalar ke atas sofa. Daun hijau juga ditambahkan. | ![]() Teks tulisan tangan putih "Natural Fresh Air Enjoy Breathing" ditambahkan di bagian atas. |
Pembuatan sketsa
Gambar input | Gambar output | |
|---|---|---|
![]() | ![]() Buat gambar yang sesuai dengan bentuk detail yang digariskan pada Gambar 1 dan ikuti deskripsi ini: Seorang wanita muda tersenyum di hari yang cerah. Ia mengenakan kacamata hitam bulat cokelat dengan bingkai motif leopard. Rambutnya diikat rapi, ia mengenakan anting mutiara, syal biru tua dengan pola bintang ungu, dan jaket kulit hitam. | ![]() Buat gambar yang sesuai dengan bentuk detail yang digariskan pada Gambar 1 dan ikuti deskripsi ini: Seorang pria tua tersenyum ke arah kamera. Wajahnya berkerut, rambutnya acak-acakan tertiup angin, dan ia mengenakan kacamata baca berbingkai bulat. Ia mengenakan syal merah lusuh dengan pola bintang di lehernya dan jaket berlapis kapas. |
Generasi produk kreatif
Gambar input | Gambar output | ||
|---|---|---|---|
![]() | ![]() Buat beruang ini duduk di bawah bulan (diwakili oleh garis lengkung abu-abu terang pada latar belakang putih), memegang gitar, dengan bintang-bintang kecil dan balon ucapan berisi frasa seperti "Be Kind" melayang di sekitarnya. | ![]() Cetak desain ini pada kaos dan tas kertas. Seorang model wanita memperagakan barang-barang ini. Wanita tersebut juga mengenakan topi baseball dengan tulisan "Be kind". | ![]() Model karakter hiper-realistis skala 1/7, dirancang sebagai produk jadi komersial, ditempatkan di atas meja dengan iMac yang memiliki keyboard putih. Model berdiri di atas alas akrilik bundar transparan yang bersih tanpa label atau teks. Pencahayaan studio profesional menyoroti detail pahatan. Di layar iMac di latar belakang, proses pemodelan ZBrush untuk model yang sama ditampilkan. Di samping model, letakkan kotak kemasan dengan jendela transparan di bagian depan, hanya menunjukkan cangkang plastik bening di dalamnya. Kotak tersebut sedikit lebih tinggi dari model dan berukuran cukup untuk menampungnya. |
![]() Beruang ini mengenakan setelan astronot dan menunjuk ke kejauhan. | ![]() Beruang ini mengenakan gaun pesta mewah, dengan lengan terentang dalam pose tarian elegan. | ![]() Beruang ini mengenakan pakaian olahraga, memegang bola basket, dengan satu kaki ditekuk. | |
Hasilkan gambar dari depth map
Gambar input | Gambar output | |
|---|---|---|
![]() | ![]() Buat gambar yang sesuai dengan depth map yang digariskan pada Gambar 1 dan ikuti deskripsi ini: Sepeda biru diparkir di gang samping, dengan beberapa gulma tumbuh dari celah-celah batu di latar belakang. | ![]() Buat gambar yang sesuai dengan depth map yang digariskan pada Gambar 1 dan ikuti deskripsi ini: Sepeda merah lusuh diparkir di jalan berlumpur, dengan hutan purba yang lebat di latar belakang. |
Hasilkan gambar dari keypoints
Gambar input | Gambar output | |
|---|---|---|
![]() | ![]() Buat gambar yang sesuai dengan pose manusia yang digariskan pada Gambar 1 dan ikuti deskripsi ini: Seorang wanita Tiongkok dalam Hanfu memegang payung kertas minyak di tengah hujan, dengan taman Suzhou di latar belakang. | ![]() Buat gambar yang sesuai dengan pose manusia yang digariskan pada Gambar 1 dan ikuti deskripsi ini: Seorang pria muda berdiri di peron kereta bawah tanah. Ia mengenakan topi baseball, kaos, dan jeans. Sebuah kereta melaju kencang di belakangnya. |
Pengeditan teks
Gambar input | Gambar output | Gambar input | Gambar output |
|---|---|---|---|
![]() | ![]() Ganti 'HEALTH INSURANCE' pada ubin Scrabble dengan 'Tomorrow Will Be Better'. | ![]() | ![]() Ubah frasa "Take a Breather" pada catatan menjadi "Relax and Recharge". |
Gambar input | Gambar output | ||
|---|---|---|---|
![]() | ![]() Ubah "Qwen-Image" menjadi font tetesan tinta hitam. | ![]() Ubah "Qwen-Image" menjadi font tulisan tangan hitam. | ![]() Ubah "Qwen-Image" menjadi font piksel hitam. |
![]() Ubah "Qwen-Image" menjadi merah. | ![]() Ubah "Qwen-Image" menjadi gradien biru-ungu. | ![]() Ubah "Qwen-Image" menjadi warna-warna permen. | |
![]() Ubah material "Qwen-Image" menjadi logam. | ![]() Ubah material "Qwen-Image" menjadi awan. | ![]() Ubah material "Qwen-Image" menjadi kaca. | |
Menambah dan menghapus
Kemampuan | Gambar input | Gambar output |
|---|---|---|
Tambah elemen | ![]() | ![]() Tambahkan papan kayu kecil di depan penguin yang bertuliskan "Welcome to Penguin Beach". |
Hapus elemen | ![]() | ![]() Hapus rambut dari piring. |
Transformasi sudut pandang
Gambar input | Gambar output | Gambar input | Gambar output |
|---|---|---|---|
![]() | ![]() Dapatkan tampilan depan. | ![]() | ![]() Menghadap ke kiri. |
![]() | ![]() Dapatkan tampilan belakang. | ![]() | ![]() Menghadap ke kanan. |
Pemrosesan foto lama
Kemampuan | Gambar input | Gambar output |
|---|---|---|
Pemulihan dan pewarnaan foto lama | ![]() | ![]() Pulihkan foto lama, hapus goresan, kurangi kebisingan, tingkatkan detail, resolusi tinggi, gambar realistis, warna kulit alami, fitur wajah jelas, tanpa distorsi. |
![]() | ![]() Warnai gambar secara cerdas berdasarkan isinya agar lebih hidup. |





























































