Skip to main content
Qwen - modelos de imagem legados

Qwen-Image Edit API reference

O Qwen-Image Edit aceita entrada e saída de múltiplas imagens. Edite textos em imagens, adicione, remova ou mova objetos, altere poses, transfira estilos e aprimore detalhes usando prompts em linguagem natural.

Visão geral do modelo

Imagem de entrada 1

Imagem de entrada 2

Imagem de entrada 3

Imagens de saída (múltiplas)

image99

image98

image89

image100

imageout2

Prompt: A garota da Imagem 1 está vestindo o vestido preto da Imagem 2 e sentada na pose da Imagem 3.
Nome do modeloDescrição do modeloEspecificações da imagem de saída
qwen-image-2.0-pro Recomendado
Atualmente possui as mesmas capacidades do qwen-image-2.0-pro-2026-04-22
A série Pro dos modelos de geração e edição de imagens Qwen oferece capacidades aprimoradas em renderização de texto, texturas realistas e aderência semântica.
Para geração de imagens, consulte Qwen-Text to Image.
Resolução da imagem:
  • Personalizável: O número total de pixels deve estar entre 512512 e 20482048.
  • Padrão: O número total de pixels é próximo de 1024*1024, com uma proporção semelhante à da imagem de entrada (ou da última imagem em uma entrada de múltiplas imagens).
Formato da imagem: pngNúmero de imagens: 1–6
qwen-image-2.0-pro-2026-06-22 Recomendado
qwen-image-2.0-pro-2026-04-22
qwen-image-2.0-pro-2026-03-03
qwen-image-2.0 Recomendado
Atualmente possui as mesmas capacidades do qwen-image-2.0-2026-03-03
Esta é a versão acelerada do modelo de geração e edição de imagens Qwen, equilibrando desempenho e velocidade de resposta.
Para geração de imagens, consulte Qwen-Text to Image.
qwen-image-2.0-2026-03-03 Recomendado
qwen-image-edit-max
Atualmente possui as mesmas capacidades do qwen-image-edit-max-2026-01-16
A série Max dos modelos de edição de imagens Qwen fornece capacidades mais robustas em design industrial, raciocínio geométrico e consistência de personagens.Resolução da imagem:
  • Personalizável: A largura e a altura podem variar individualmente de [512, 2048] pixels.
  • Padrão: O número total de pixels é próximo de 1024*1024, com uma proporção semelhante à da imagem de entrada (ou da última imagem em uma entrada de múltiplas imagens).
Formato da imagem: pngNúmero de imagens: 1–6
qwen-image-edit-max-2026-01-16
qwen-image-edit-plus
Atualmente possui as mesmas capacidades do qwen-image-edit-plus-2025-10-30
A série Plus dos modelos de edição de imagens Qwen suporta múltiplas saídas de imagens e resoluções personalizadas.
qwen-image-edit-plus-2025-12-15
qwen-image-edit-plus-2025-10-30
qwen-image-editEste modelo suporta edição de imagem única e fusão de múltiplas imagens.Resolução da imagem: Não personalizável. A regra de geração é a mesma que a regra Padrão descrita acima.Formato da imagem: pngNúmero de imagens: Fixo em 1
Antes de chamar a API, verifique a Lista de Modelos para saber quais modelos são suportados em cada região.

Pré-requisitos

Antes de fazer uma chamada, obtenha uma chave de API e exporte a chave de API como uma variável de ambiente. Para chamar a API usando o SDK, instale o DashScope SDK. O SDK está disponível para Python e Java.
As regiões China (Beijing) e Singapore possuem chaves de API e endpoints de solicitação separados. Eles não podem ser usados indistintamente. Chamadas entre regiões resultam em falhas de autenticação ou erros de service.

Chamada HTTP

Região Singapore:POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation Região Beijing:POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation Ao fazer a chamada, substitua {WorkspaceId} pelo seu ID do workspace real.

Parâmetros da solicitação

  • Edição de imagem única
  • Fusão de múltiplas imagens
Este exemplo usa o modelo qwen-image-2.0-pro para gerar duas imagens.
curl --location 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation' \
        --header 'Content-Type: application/json' \
        --header "Authorization: Bearer $DASHSCOPE_API_KEY" \
        --data '{
            "model": "qwen-image-2.0-pro",
            "input": {
                "messages": [
                    {
                        "role": "user",
                        "content": [
                            {
                                "image": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/fpakfo/image36.webp"
                            },
                            {
                                "text": "Generate an image that matches the depth map, following this description: A red, dilapidated bicycle is parked on a muddy path, with a dense primeval forest in the background."
                            }
                        ]
                    }
                ]
            },
            "parameters": {
                "n": 2,
                "negative_prompt": " ",
                "prompt_extend": true,
                "watermark": false,
                "size": "1536*1024"
            }
        }'
Cabeçalhos da solicitação
Content-Type string (Obrigatório)O tipo de conteúdo da solicitação. Deve ser application/json.
Authorization string (Obrigatório)Autentica a solicitação com uma chave de API do Model Studio. Exemplo: Bearer sk-xxxx.
Corpo da solicitação
model string (Obrigatório)O nome do modelo. Exemplo: qwen-image-2.0-pro.
input object (Obrigatório)O objeto de entrada, contendo o seguinte campo:

Propriedade

messages array (Obrigatório)O array de conteúdo da solicitação. Apenas conversas de turno único são suportadas atualmente, portanto o array deve conter exatamente um objeto com as propriedades role e content.

Propriedade

rolestring (Obrigatório)A função do remetente da mensagem. Deve ser user.contentarray (Obrigatório)O conteúdo da mensagem, consistindo em uma a três imagens no formato {"image": "..."} e uma única instrução de edição no formato {"text": "..."}.

Propriedade

image string (Obrigatório)A URL ou dados codificados em Base64 da imagem de entrada. É possível fornecer de uma a três imagens.Para entrada de múltiplas imagens, a ordem das imagens é definida pela sequência do array. A proporção da imagem de saída baseia-se na última imagem.Requisitos da imagem:
  • Formato da imagem: JPG, JPEG, PNG, BMP, TIFF, WEBP ou GIF.
    A imagem de saída está no formato PNG. Para GIFs animados, apenas o primeiro quadro é processado.
  • Resolução da imagem: Para melhores resultados, a largura e a altura da imagem devem estar ambas entre 384 e 3072 pixels. Baixa resolução pode resultar em saída borrada, enquanto alta resolução aumenta o tempo de processamento.
  • Tamanho da imagem: No máximo 10 MB.
Formatos de entrada suportados
  1. URL pública:
    • Suporta protocolos HTTP e HTTPS.
    • Por exemplo: https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/fpakfo/image36.webp.
  2. String de imagem codificada em Base64
textstring(Obrigatório)Um prompt positivo descrevendo o conteúdo, estilo e composição desejados para a imagem de saída.Suporta chinês e inglês. A série qwen-image-2.0 aceita até 1.300 tokens. Outros modelos aceitam até 800 tokens. O sistema trunca tokens excedentes.Nota: O array content deve conter exatamente um objeto text. Caso contrário, ocorrerá um erro.
parameters object (Opcional)Parâmetros adicionais para controlar a geração de imagens.

Propriedade

n integer (Opcional)O número de imagens de saída. Padrão: 1.Para os modelos das séries qwen-image-2.0, qwen-image-edit-max ou qwen-image-edit-plus, é possível escolher gerar de uma a seis imagens.Para qwen-image-edit, apenas uma imagem pode ser gerada.negative_prompt string (Opcional)Um prompt negativo descrevendo o conteúdo a ser excluído da saída. Use-o para restringir a geração.Suporta chinês e inglês. Máximo de 500 caracteres. Cada caractere chinês, letra, número ou símbolo conta como um caractere. Caracteres excedentes são truncados automaticamente.Por exemplo: baixa resolução, erro, melhor qualidade, baixa qualidade, desfigurado, dedos extras ou más proporções.size string (Opcional)A resolução da imagem de saída no formato largura altura. Exemplo: "10241536".Modelos da série qwen-image-2.0:
  • O número total de pixels deve estar entre 512512 e 20482048.
  • Por padrão, o número total de pixels é próximo de 1024*1024, com uma proporção semelhante à da imagem de entrada (ou da última imagem em uma entrada de múltiplas imagens).
Modelos das séries qwen-image-edit-max ou qwen-image-edit-plus:
  • A largura e a altura podem variar individualmente de [512, 2048] pixels.
  • Por padrão, o número total de pixels é próximo de 1024*1024, com uma proporção semelhante à da imagem de entrada (ou da última imagem em uma entrada de múltiplas imagens).
Se você especificar o parâmetro size, o sistema usa a largura e a altura definidas por size como alvo e ajusta as dimensões da imagem de saída real para os múltiplos de 16 mais próximos. Por exemplo, se você especificar 1033*1032, o tamanho da imagem de saída será 1040*1024.

Resoluções recomendadas para proporções comuns

  • 1:1: 10241024 ou 15361536
  • 2:3: 7681152 ou 10241536
  • 3:2: 1152768 ou 15361024
  • 3:4: 9601280 ou 10801440
  • 4:3: 1280960 ou 14401080
  • 9:16: 7201280 ou 10801920
  • 16:9: 1280720 ou 19201080
  • 21:9: 1344576 ou 2048872
Modelos suportados: Todos os modelos, exceto qwen-image-edit.prompt_extend bool (Opcional)Ativa a reescrita inteligente de prompts. Padrão: true. Quando ativado, o modelo otimiza o prompt positivo (text), melhorando significativamente os resultados para prompts simples.Modelos suportados: Todos os modelos, exceto qwen-image-edit.watermark bool (Opcional)Adiciona uma marca d'água "Qwen-Image" no canto inferior direito. Padrão: false.seed integer (Opcional)A semente de número aleatório. Intervalo válido: [0, 2147483647].Definir o mesmo valor de seed ajuda a manter uma estabilidade relativa na saída gerada. Se omitido, o algoritmo usa uma semente aleatória.Nota: A geração de imagens é probabilística. Mesmo com a mesma seed, os resultados podem variar entre chamadas.

Parâmetros da resposta

  • Tarefa bem-sucedida
  • Erro na tarefa
Os dados da tarefa (status da tarefa e URLs das imagens) são retidos por apenas 24 horas e depois removidos automaticamente. Salve as imagens geradas prontamente.
{
            "output": {
                "choices": [
                    {
                        "finish_reason": "stop",
                        "message": {
                            "role": "assistant",
                            "content": [
                                {
                                    "image": "https://dashscope-result-sz.oss-cn-shenzhen.aliyuncs.com/xxx.png?Expires=xxx"
                                },
                                {
                                    "image": "https://dashscope-result-sz.oss-cn-shenzhen.aliyuncs.com/xxx.png?Expires=xxx"
                                }
                            ]
                        }
                    }
                ]
            },
            "usage": {
                "width": 1536,
                "image_count": 2,
                "height": 1024
            },
            "request_id": "bf37ca26-0abe-98e4-8065-xxxxxx"
        }
output objectOs resultados da geração do modelo.

Propriedade

choices arrayUma lista de opções de resultado.

Propriedade

finish_reason stringO motivo pelo qual a tarefa parou. Retorna stop para uma parada natural.message objectA mensagem retornada pelo modelo.

Propriedade

rolestringA função da mensagem. Fixa em assistant.contentarrayO conteúdo da mensagem, que contém as informações da imagem gerada.

Propriedade

image stringURL da imagem gerada no formato PNG. Válida por 24 horas. Baixe e salve a imagem prontamente.
usage objectUso de recursos para esta chamada. Retornado apenas em caso de sucesso.

Propriedade

image_count integerO número de imagens geradas.width integerA largura da imagem gerada em pixels.height integerA altura da imagem gerada em pixels.
request_id stringIdentificador único da solicitação para rastreamento e solução de problemas.
code stringCódigo de erro. Retornado apenas para solicitações com falha. Consulte Códigos de erro.
message stringMensagem de erro detalhada. Retornada apenas para solicitações com falha. Consulte Códigos de erro.

Chamada via DashScope SDK

Os nomes dos parâmetros do SDK são majoritariamente consistentes com a API HTTP. A estrutura dos parâmetros é encapsulada com base nos recursos da linguagem. Para uma lista completa de parâmetros, consulte a Referência da API Qwen.

Chamada via Python SDK

  • Recomendamos instalar a versão mais recente do DashScope Python SDK para evitar possíveis erros de execução. Para mais informações, consulte Instalar ou atualizar o SDK.
  • Interfaces assíncronas não são suportadas.

Exemplos de solicitação

import json
import os
import dashscope
from dashscope import MultiModalConversation

# The following is the URL for the Singapore region. Replace {WorkspaceId} with your Bailian workspace ID. URLs vary by region.
dashscope.base_http_api_url = 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1'

# The model supports one to three input images.
messages = [
    {
        "role": "user",
        "content": [
            {"image": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/thtclx/input1.png"},
            {"image": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/iclsnx/input2.png"},
            {"image": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/gborgw/input3.png"},
            {"text": "The girl from Image 1 is wearing the black dress from Image 2 and sitting in the pose from Image 3."}
        ]
    }
]

# The API keys for the Singapore and Beijing regions are different. To get an API key, see https://www.alibabacloud.com/help/en/model-studio/get-api-key.
# If you have not configured the environment variable, replace the next line with: api_key="sk-xxx"
api_key = os.getenv("DASHSCOPE_API_KEY")

# The qwen-image-2.0, qwen-image-edit-max, and qwen-image-edit-plus series support one to six output images. This example generates two.
response = MultiModalConversation.call(
    api_key=api_key,
    model="qwen-image-2.0-pro",
    messages=messages,
    stream=False,
    n=2,
    watermark=False,
    negative_prompt=" ",
    prompt_extend=True,
    size="1024*1536",
)

if response.status_code == 200:
    # To view the full response, uncomment the next line.
    # print(json.dumps(response, ensure_ascii=False))
    for i, content in enumerate(response.output.choices[0].message.content):
        print(f"URL of output image {i+1}: {content['image']}")
else:
    print(f"HTTP status code: {response.status_code}")
    print(f"Error code: {response.code}")
    print(f"Error message: {response.message}")
    print("For more information, see https://www.alibabacloud.com/help/en/model-studio/error-code")

Exemplo de resposta

A URL da imagem é válida por 24 horas. Baixe a imagem prontamente.
Os campos input_tokens , output_tokens e characters são compatíveis. Seus valores estão atualmente fixados em 0.
{
    "status_code": 200,
    "request_id": "fa41f9f9-3cb6-434d-a95d-4ae6b9xxxxxx",
    "code": "",
    "message": "",
    "output": {
        "text": null,
        "finish_reason": null,
        "choices": [
            {
                "finish_reason": "stop",
                "message": {
                    "role": "assistant",
                    "content": [
                        {
                            "image": "https://dashscope-result-hz.oss-cn-hangzhou.aliyuncs.com/xxx.png?Expires=xxx"
                        },
                        {
                            "image": "https://dashscope-result-hz.oss-cn-hangzhou.aliyuncs.com/xxx.png?Expires=xxx"
                        }
                    ]
                }
            }
        ],
        "audio": null
    },
    "usage": {
        "input_tokens": 0,
        "output_tokens": 0,
        "characters": 0,
        "height": 1536,
        "image_count": 2,
        "width": 1024
    }
}

Chamada via Java SDK

Instale o DashScope Java SDK mais recente para evitar erros de execução. Consulte Instalar ou atualizar o SDK.

Exemplos de solicitação

import com.alibaba.dashscope.aigc.multimodalconversation.MultiModalConversation;
import com.alibaba.dashscope.aigc.multimodalconversation.MultiModalConversationParam;
import com.alibaba.dashscope.aigc.multimodalconversation.MultiModalConversationResult;
import com.alibaba.dashscope.common.MultiModalMessage;
import com.alibaba.dashscope.common.Role;
import com.alibaba.dashscope.exception.ApiException;
import com.alibaba.dashscope.exception.NoApiKeyException;
import com.alibaba.dashscope.exception.UploadFileException;
import com.alibaba.dashscope.utils.JsonUtils;
import com.alibaba.dashscope.utils.Constants;

import java.io.IOException;
import java.util.Arrays;
import java.util.Collections;
import java.util.HashMap;
import java.util.Map;
import java.util.List;

public class QwenImageEdit {

    static {
        // The following is the URL for the Singapore region. Replace {WorkspaceId} with your Bailian workspace ID. URLs vary by region.
        Constants.baseHttpApiUrl = "https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1";
    }

    // The API keys for the Singapore and Beijing regions are different. To obtain an API key, see https://www.alibabacloud.com/help/en/model-studio/get-api-key.
    // If you have not configured the environment variable, replace the following line with your DashScope API key: apiKey="sk-xxx".
    static String apiKey = System.getenv("DASHSCOPE_API_KEY");

    public static void call() throws ApiException, NoApiKeyException, UploadFileException, IOException {

        MultiModalConversation conv = new MultiModalConversation();

        // The model supports one to three input images.
        MultiModalMessage userMessage = MultiModalMessage.builder().role(Role.USER.getValue())
                .content(Arrays.asList(
                        Collections.singletonMap("image", "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/thtclx/input1.png"),
                        Collections.singletonMap("image", "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/iclsnx/input2.png"),
                        Collections.singletonMap("image", "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20250925/gborgw/input3.png"),
                        Collections.singletonMap("text", "The girl from Image 1 is wearing the black dress from Image 2 and sitting in the pose from Image 3.")
                )).build();
        // The qwen-image-2.0, qwen-image-edit-max, and qwen-image-edit-plus series models support one to six output images. This example generates two images.
        Map<String, Object> parameters = new HashMap<>();
        parameters.put("watermark", false);
        parameters.put("negative_prompt", " ");
        parameters.put("n", 2);
        parameters.put("prompt_extend", true);
        parameters.put("size", "1024*1536");

        MultiModalConversationParam param = MultiModalConversationParam.builder()
                .apiKey(apiKey)
                .model("qwen-image-edit-max")
                .messages(Collections.singletonList(userMessage))
                .parameters(parameters)
                .build();

        MultiModalConversationResult result = conv.call(param);
        // To view the complete response, uncomment the following line.
        // System.out.println(JsonUtils.toJson(result));
        List<Map<String, Object>> contentList = result.getOutput().getChoices().get(0).getMessage().getContent();
        int imageIndex = 1;
        for (Map<String, Object> content : contentList) {
            if (content.containsKey("image")) {
                System.out.println("URL of output image " + imageIndex + ": " + content.get("image"));
                imageIndex++;
            }
        }
    }

    public static void main(String[] args) {
        try {
            call();
        } catch (ApiException | NoApiKeyException | UploadFileException | IOException e) {
            System.out.println(e.getMessage());
        }
    }
}

Exemplos de resposta

A URL da imagem é válida por 24 horas. Baixe a imagem prontamente.
{
    "requestId": "46281da9-9e02-941c-ac78-be88b8xxxxxx",
    "usage": {
        "image_count": 2,
        "width": 1024,
        "height": 1536
    },
    "output": {
        "choices": [
            {
                "finish_reason": "stop",
                "message": {
                    "role": "assistant",
                    "content": [
                        {
                            "image": "https://dashscope-result-sz.oss-cn-shenzhen.aliyuncs.com/xxx.png?Expires=xxx"
                        },
                        {
                            "image": "https://dashscope-result-sz.oss-cn-shenzhen.aliyuncs.com/xxx.png?Expires=xxx"
                        }
                    ]
                }
            }
        ]
    }
}

Códigos de erro

Se a chamada do modelo falhar e retornar uma mensagem de erro, consulte Códigos de erro para resolução.

Faturamento e limitação de taxa

  • Para cotas gratuitas e taxas de faturamento do modelo, consulte a Lista de Modelos.
  • Consulte Qwen-Image para detalhes sobre limitação de taxa do modelo.
  • Faturamento: A cobrança é feita por imagem gerada com sucesso. Chamadas com falha não incorrem em cobranças e não consomem sua cota gratuita de novo usuário.

FAQ

P: Quais idiomas o modelo de Edição de Imagem Qwen suporta?

R: O modelo atualmente suporta chinês simplificado e inglês. Você pode tentar outros idiomas, mas o desempenho não é garantido.

P: Como visualizo as métricas de invocação do modelo?

R: Uma hora após a conclusão de uma invocação do modelo, acesse a página Monitoramento (Singapore) ou Monitoramento (China (Beijing)) para visualizar métricas como contagem de invocações e taxa de sucesso. Para mais informações, consulte Faturamento e gestão de custos.

P: Como obtenho a lista de permissões de nomes de domínio para armazenamento de imagens?

R: As imagens geradas pelos modelos são armazenadas no OSS. A API retorna uma URL pública temporária. Para configurar uma lista de permissões de firewall para esta URL de download, observe o seguinte: O armazenamento subjacente pode mudar dinamicamente. Este tópico não fornece uma lista fixa de permissões de nomes de domínio do OSS para evitar problemas de acesso causados por informações desatualizadas. Se você tiver requisitos de controle de segurança, entre em contato com seu gerente de conta para obter a lista mais recente de nomes de domínio do OSS.
Referência da API de Geração de Texto
Geração de Vídeo
Áudio
API em tempo real
Incorporação de Texto
Produção de Modelos
Qwen-Image Edit API reference - Alibaba Cloud Model Studio