Skip to main content
Pengeditan gambar

Qwen-Image-Edit

Qwen-Image-Edit mendukung input dan output multi-gambar. Fitur ini dapat memodifikasi teks dalam gambar, menambah/menghapus/memindahkan objek, mengubah aksi subjek, mentransfer gaya, serta meningkatkan detail.

Memulai

Sebelum melakukan pemanggilan, dapatkan Kunci API dan ekspor Kunci API sebagai Variabel lingkungan. Untuk memanggil API menggunakan SDK, instal DashScope SDK. SDK tersedia untuk Python dan Java.
  • Python
  • Java
  • curl
import os
import base64
import mimetypes
import dashscope
from dashscope import MultiModalConversation

dashscope.base_http_api_url = 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1'

def encode_file(file_path):
    mime_type, _ = mimetypes.guess_type(file_path)
    if not mime_type or not mime_type.startswith("image/"):
        raise ValueError("Unsupported or unrecognized image format")
    with open(file_path, "rb") as image_file:
        encoded_string = base64.b64encode(image_file.read()).decode('utf-8')
    return f"data:{mime_type};base64,{encoded_string}"

# [Metode 1] Gunakan URL gambar publik
image_url = "https://alidocs.oss-cn-zhangjiakou.aliyuncs.com/res/yBRq1ZPYEaXdyOdv/img/33a80a19-7ac7-4c64-b0fa-7d685b7046a0.png"

# [Metode 2] Gunakan gambar yang dienkode Base64
# image_url = encode_file("./your_image.png")

response = MultiModalConversation.call(
    api_key=os.getenv("DASHSCOPE_API_KEY"),
    model="qwen-image-3.0-pro",
    messages=[{
        "role": "user",
        "content": [
            {"image": image_url},
            {"text": "Generate a sophisticated urban-style female portrait. Perfectly preserve the facial features and smooth black long hair of the young woman in the input image. Change her outfit to an elegant urban professional look. Set the scene in a modern minimalist upscale coffee shop."}
        ]
    }],
    prompt_extend=True
)

print(response)
if response.status_code == 200:
    url = response.output.choices[0].message.content[0]["image"]
    print(f"Generated image URL: {url}")
else:
    print(f"Error: {response.code} - {response.message}")
# Anda perlu menginstal requests untuk mengunduh gambar: pip install requests
import requests

def download_image(image_url, save_path='output.png'):
    try:
        response = requests.get(image_url, stream=True, timeout=300)  # Tetapkan timeout.
        response.raise_for_status()  # Bangkitkan pengecualian jika kode status HTTP bukan 200.
        with open(save_path, 'wb') as f:
            for chunk in response.iter_content(chunk_size=8192):
                f.write(chunk)
        print(f"Gambar berhasil diunduh ke: {save_path}")

    except requests.exceptions.RequestException as e:
        print(f"Pengunduhan gambar gagal: {e}")

image_url = "https://dashscope-result-sz.oss-cn-shenzhen.aliyuncs.com/xxx.png?Expires=xxx"
download_image(image_url, save_path='output.png')

Rekomendasi model

  • qwen-image-3.0-proseries (Direkomendasikan): Model unggulan Qwen Image 3.0 dengan kemampuan generasi dan pengeditan gambar yang ditingkatkan secara komprehensif, menawarkan rendering teks yang lebih baik, tekstur realistis, ketaatan semantik, dan penulisan ulang prompt cerdas.
  • qwen-image-3.0series: Model standar Qwen Image 3.0 yang menyeimbangkan kualitas dan kecepatan.
Untuk daftar model yang didukung di setiap wilayah, lihat Daftar model.

Instruksi input

Gambar input (messages)

Parameter messages adalah array yang harus berisi satu objek. Objek ini harus mencakup properti role dan content. Properti role harus diatur ke user. Properti content harus mencakup image (satu hingga tiga gambar) dan text (satu instruksi pengeditan). Gambar input harus memenuhi persyaratan berikut:
  • Format gambar yang didukung adalah JPG, JPEG, PNG, BMP, TIFF, WEBP, dan GIF.
    Gambar output dalam format PNG. Untuk GIF animasi, hanya frame pertama yang diproses.
  • Untuk hasil terbaik, resolusi gambar harus antara 384 hingga 3.072 piksel untuk lebar dan tinggi. Resolusi rendah dapat menghasilkan output buram, sedangkan resolusi tinggi meningkatkan waktu pemrosesan.
  • Ukuran file gambar tunggal tidak boleh melebihi 10 MB.
"messages": [
    {
        "role": "user",
        "content": [
            { "image": "Public URL or Base64 data of Image 1" },
            { "image": "Public URL or Base64 data of Image 2" },
            { "image": "Public URL or Base64 data of Image 3" },
            { "text": "Your editing instruction, for example: 'The girl in Image 1 wears the black dress from Image 2 and sits in the pose from Image 3'" }
        ]
    }
]

Urutan input gambar

Nomor gambar dalam prompt sesuai dengan posisi array: gambar pertama adalah "gambar 1", gambar kedua adalah "gambar 2". Anda juga dapat menggunakan penanda seperti "[gambar 1]" dan "[gambar 2]".
{
    "content": [
        {"text": "Editing instruction, for example: Place the alarm clock from image 1 next to the vase on the dining table in image 2"},
        {"image": "https://example.com/image1.png"},
        {"image": "https://example.com/image2.png"}
    ]
}

Gambar input

Gambar output

image (19)-转换自-png

Gambar 1

image (20)-转换自-png

Gambar 2

04e0fc39-7ad6-41e0-9df9-1f69ac3ce825-转换自-png

Prompt: Pindahkan gambar 1 ke atas gambar 2

36ed450d-bd54-4169-b13f-3d0f26d9d360-转换自-png

Prompt: Pindahkan gambar 2 ke atas gambar 1

Metode input gambar

URL publik
  • Anda dapat memberikan URL gambar yang dapat diakses publik yang mendukung protokol HTTP atau HTTPS.
  • Nilai contoh: https://xxxx/img.png.
Pengkodean Base64 Konversi file gambar menjadi string yang dienkode Base64 dan gabungkan dalam format berikut: data:{mime_type};base64,{base64_data}.
  • {mime_type}: Jenis media gambar, yang harus sesuai dengan format file.
  • {base64_data}: String yang dienkode Base64 dari file.
  • Nilai contoh: data:image/jpeg;base64,GDU7MtCZz... (Contoh dipotong untuk tujuan demonstrasi.)
Untuk contoh kode lengkap, lihat Pemanggilan SDK Python dan Pemanggilan menggunakan SDK Java.

Parameter tambahan

Sesuaikan hasil generasi menggunakan parameter opsional berikut:
  • n: Jumlah gambar yang akan dihasilkan. Nilai default adalah 1. Seri model qwen-image-3.0, qwen-image-2.0, qwen-image-edit-max, dan qwen-image-edit-plus mendukung pembuatan satu hingga enam gambar. Model qwen-image-edit hanya mendukung pembuatan satu gambar.
  • negative_prompt: Menggambarkan konten yang harus dikecualikan dari gambar, seperti "blur" atau "extra fingers". Parameter ini membantu mengoptimalkan kualitas gambar yang dihasilkan.
  • watermark: Menentukan apakah akan menambahkan Watermark "Qwen-Image" di pojok kanan bawah gambar. Nilai default adalah false.
  • seed: Seed bilangan acak. Nilainya harus berupa bilangan bulat dari [0, 2.147.483.647]. Jika parameter ini tidak ditentukan, algoritma akan menghasilkan bilangan acak sebagai seed. Penggunaan nilai seed yang sama membantu memastikan hasil generasi yang konsisten.
Parameter opsional berikut hanya tersedia untuk seri model qwen-image-3.0, qwen-image-2.0, qwen-image-edit-max, dan qwen-image-edit-plus:
  • size: Resolusi gambar output. Formatnya adalah width*height, seperti "1024*2048". Untuk model seri qwen-image-3.0, luas total piksel harus antara 512×512 dan 2048×2048, dan rasio aspek harus antara 1:8 hingga 8:1. Jika tidak ditentukan, model secara otomatis merekomendasikan resolusi berdasarkan prompt. Untuk model seri qwen-image-2.0, Anda dapat mengatur lebar dan tinggi secara bebas. Total piksel gambar output harus antara 512 × 512 dan 2048 × 2048. Secara default, resolusinya sama dengan gambar input (gambar terakhir jika beberapa disediakan). Untuk model seri qwen-image-edit-max dan qwen-image-edit-plus, lebar dan tinggi dapat berkisar antara 512 hingga 2048 piksel. Secara default, gambar output memiliki resolusi mendekati 1024*1024 dan rasio aspek mirip dengan gambar asli.
  • prompt_extend: Mengaktifkan atau menonaktifkan fitur penulisan ulang prompt. Nilai default adalah true. Jika diaktifkan, model akan mengoptimalkan prompt. Fitur ini dapat secara signifikan meningkatkan hasil untuk prompt yang sederhana atau kurang deskriptif.
Untuk daftar lengkap parameter, lihat Referensi API Qwen-Image-Edit.

Ikhtisar

Fusi multi-gambar

Gambar input 1

Gambar input 2

Gambar input 3

Gambar output

image83

image103

1

2

Gadis pada Gambar 1 mengenakan kalung dari Gambar 2 dan membawa tas dari Gambar 3 di bahu kirinya.

Konsistensi subjek

Gambar input

Gambar output 1

Gambar output 2

Gambar output 3

image5

image4

Ubah gambar menjadi foto identitas dengan latar belakang biru. Orang tersebut mengenakan kemeja putih, setelan jas hitam, dan dasi bergaris.

image6

Orang tersebut mengenakan kemeja putih, setelan jas abu-abu, dan dasi bergaris. Satu tangan bertumpu pada dasi. Latar belakang berwarna terang.

image7

Orang tersebut mengenakan hoodie hitam dengan tulisan "Qwen Image" dalam font kuas tebal. Ia bersandar pada pagar pembatas dengan sinar matahari di rambutnya. Jembatan dan laut terlihat di latar belakang.

image12

image13

AC ditempatkan di ruang tamu di sebelah sofa.

image14

Kabut ditambahkan dari ventilasi AC, menjalar ke atas sofa. Daun hijau juga ditambahkan.

image15

Teks tulisan tangan putih "Natural Fresh Air Enjoy Breathing" ditambahkan di bagian atas.

Pembuatan sketsa

Gambar input

Gambar output

image42

image43

Buat gambar yang sesuai dengan bentuk detail yang digariskan pada Gambar 1 dan ikuti deskripsi ini: Seorang wanita muda tersenyum di hari yang cerah. Ia mengenakan kacamata hitam bulat cokelat dengan bingkai motif leopard. Rambutnya diikat rapi, ia mengenakan anting mutiara, syal biru tua dengan pola bintang ungu, dan jaket kulit hitam.

image44

Buat gambar yang sesuai dengan bentuk detail yang digariskan pada Gambar 1 dan ikuti deskripsi ini: Seorang pria tua tersenyum ke arah kamera. Wajahnya berkerut, rambutnya acak-acakan tertiup angin, dan ia mengenakan kacamata baca berbingkai bulat. Ia mengenakan syal merah lusuh dengan pola bintang di lehernya dan jaket berlapis kapas.

Generasi produk kreatif

Gambar input

Gambar output

image 1

image23

Buat beruang ini duduk di bawah bulan (diwakili oleh garis lengkung abu-abu terang pada latar belakang putih), memegang gitar, dengan bintang-bintang kecil dan balon ucapan berisi frasa seperti "Be Kind" melayang di sekitarnya.

image22

Cetak desain ini pada kaos dan tas kertas. Seorang model wanita memperagakan barang-barang ini. Wanita tersebut juga mengenakan topi baseball dengan tulisan "Be kind".

image21

Model karakter hiper-realistis skala 1/7, dirancang sebagai produk jadi komersial, ditempatkan di atas meja dengan iMac yang memiliki keyboard putih. Model berdiri di atas alas akrilik bundar transparan yang bersih tanpa label atau teks. Pencahayaan studio profesional menyoroti detail pahatan. Di layar iMac di latar belakang, proses pemodelan ZBrush untuk model yang sama ditampilkan. Di samping model, letakkan kotak kemasan dengan jendela transparan di bagian depan, hanya menunjukkan cangkang plastik bening di dalamnya. Kotak tersebut sedikit lebih tinggi dari model dan berukuran cukup untuk menampungnya.

image

Beruang ini mengenakan setelan astronot dan menunjuk ke kejauhan.

image

Beruang ini mengenakan gaun pesta mewah, dengan lengan terentang dalam pose tarian elegan.

image

Beruang ini mengenakan pakaian olahraga, memegang bola basket, dengan satu kaki ditekuk.

Hasilkan gambar dari depth map

Gambar input

Gambar output

image36

image37

Buat gambar yang sesuai dengan depth map yang digariskan pada Gambar 1 dan ikuti deskripsi ini: Sepeda biru diparkir di gang samping, dengan beberapa gulma tumbuh dari celah-celah batu di latar belakang.

image38

Buat gambar yang sesuai dengan depth map yang digariskan pada Gambar 1 dan ikuti deskripsi ini: Sepeda merah lusuh diparkir di jalan berlumpur, dengan hutan purba yang lebat di latar belakang.

Hasilkan gambar dari keypoints

Gambar input

Gambar output

image40

image41

Buat gambar yang sesuai dengan pose manusia yang digariskan pada Gambar 1 dan ikuti deskripsi ini: Seorang wanita Tiongkok dalam Hanfu memegang payung kertas minyak di tengah hujan, dengan taman Suzhou di latar belakang.

image39

Buat gambar yang sesuai dengan pose manusia yang digariskan pada Gambar 1 dan ikuti deskripsi ini: Seorang pria muda berdiri di peron kereta bawah tanah. Ia mengenakan topi baseball, kaos, dan jeans. Sebuah kereta melaju kencang di belakangnya.

Pengeditan teks

Gambar input

Gambar output

Gambar input

Gambar output

image

image

Ganti 'HEALTH INSURANCE' pada ubin Scrabble dengan 'Tomorrow Will Be Better'.

image

image

Ubah frasa "Take a Breather" pada catatan menjadi "Relax and Recharge".

Gambar input

Gambar output

image53

image45

Ubah "Qwen-Image" menjadi font tetesan tinta hitam.

image46

Ubah "Qwen-Image" menjadi font tulisan tangan hitam.

image49

Ubah "Qwen-Image" menjadi font piksel hitam.

image54

Ubah "Qwen-Image" menjadi merah.

image57

Ubah "Qwen-Image" menjadi gradien biru-ungu.

image59

Ubah "Qwen-Image" menjadi warna-warna permen.

image63

Ubah material "Qwen-Image" menjadi logam.

image64

Ubah material "Qwen-Image" menjadi awan.

image67

Ubah material "Qwen-Image" menjadi kaca.

Menambah dan menghapus

Kemampuan

Gambar input

Gambar output

Tambah elemen

image

image

Tambahkan papan kayu kecil di depan penguin yang bertuliskan "Welcome to Penguin Beach".

Hapus elemen

image

image

Hapus rambut dari piring.

Transformasi sudut pandang

Gambar input

Gambar output

Gambar input

Gambar output

image

image

Dapatkan tampilan depan.

image

image

Menghadap ke kiri.

image

image

Dapatkan tampilan belakang.

image

image

Menghadap ke kanan.

Pemrosesan foto lama

Kemampuan

Gambar input

Gambar output

Pemulihan dan pewarnaan foto lama

image

image

Pulihkan foto lama, hapus goresan, kurangi kebisingan, tingkatkan detail, resolusi tinggi, gambar realistis, warna kulit alami, fitur wajah jelas, tanpa distorsi.

image31

image32

Warnai gambar secara cerdas berdasarkan isinya agar lebih hidup.

Referensi API

Lihat Qwen-Image Edit untuk parameter API.

Kode error

Jika pemanggilan model gagal dan mengembalikan pesan error, lihat Kode error untuk solusinya.

FAQ

T: Bahasa apa saja yang didukung oleh model Pengeditan Gambar Qwen?

J: Model saat ini mendukung Bahasa Tionghoa Sederhana dan Bahasa Inggris. Anda dapat mencoba bahasa lain, tetapi kinerjanya tidak dijamin.

T: Bagaimana cara melihat metrik pemanggilan model?

J: Satu jam setelah pemanggilan model selesai, buka halaman Monitoring (Singapura) atau Monitoring (China (Beijing)) untuk melihat metrik seperti jumlah pemanggilan dan tingkat keberhasilan. Untuk informasi lebih lanjut, lihat Penagihan dan manajemen biaya.

T: Bagaimana cara mendapatkan daftar putih nama domain untuk penyimpanan gambar?

J: Gambar yang dihasilkan oleh model disimpan di OSS. API mengembalikan URL publik sementara. Untuk mengonfigurasi daftar putih firewall untuk URL unduhan ini, perhatikan hal berikut: Penyimpanan dasar dapat berubah secara dinamis. Topik ini tidak menyediakan daftar putih nama domain OSS tetap untuk mencegah masalah akses akibat informasi yang kedaluwarsa. Jika Anda memiliki persyaratan kontrol keamanan, hubungi manajer akun Anda untuk mendapatkan daftar nama domain OSS terbaru. Lihat FAQ Generasi Gambar.
Rencana Token (Team Edition)
Model playground
Statistik dan Pemantauan
Asset Center
Dukungan layanan