Este tópico descreve os parâmetros de entrada e saída do modelo Wan para edição geral de imagens.
- Estilização de imagem: Estilização global e local.
- Edição de conteúdo de imagem: Edição baseada em instruções (adicionar ou modificar conteúdo da imagem usando instruções sem especificar uma região), inpainting (adicionar, excluir ou modificar conteúdo em uma área especificada) e remoção de marca d'água de texto (chinês e inglês).
- Otimização de tamanho e resolução de imagem: Expansão de imagem (expandir por proporção) e super resolução (aprimorar para alta definição).
- Processamento de cores de imagem: Colorização (converter imagens em preto e branco ou em escala de cinza para coloridas).
- Geração baseada em imagem de referência: Geração de esboço para imagem (extrair um esboço da imagem de entrada e gerar uma imagem com base no esboço) e geração por referência de personagem de desenho animado.
Visão geral do modelo
Modelo | Preço | Limite de taxa (compartilhado por contas raiz e usuários RAM) | |
|---|---|---|---|
RPS de envio de tarefas | Tarefas simultâneas | ||
wanx2.1-imageedit | $0,020070/imagem | 2 | 2 |
Efeitos do modelo
Recurso | Imagem de entrada | Prompt de entrada | Imagem de saída |
|---|---|---|---|
Estilização global | ![]() | Converter para o estilo de livro ilustrado francês | ![]() |
Estilização local | ![]() | Mudar a casa para um estilo de madeira. | ![]() |
Edição baseada em instruções | ![]() | Mudar o cabelo dela para vermelho. | ![]() |
Inpainting | Imagem de entrada ![]() Imagem de máscara de entrada (branco é a área mascarada) ![]() | Um coelho de cerâmica segurando uma flor de cerâmica. | Imagem de saída ![]() |
Remoção de marca d'água de texto | ![]() | Remover o texto da imagem. | ![]() |
Expansão de imagem | ![]() | Uma fada verde. | ![]() |
Super resolução | Imagem desfocada ![]() | Super resolução. | Imagem nítida ![]() |
Colorização | ![]() | Fundo azul, folhas amarelas. | ![]() |
Geração de esboço para imagem | Imagem de entrada ![]() | Uma sala de estar em estilo nórdico minimalista. | Extrair o esboço da imagem original e gerar uma nova imagem ![]() |
Geração por referência de personagem de desenho animado | Imagem de referência de entrada (personagem de desenho animado) ![]() | O personagem de desenho animado espia cautelosamente, olhando para uma gema azul brilhante na sala. | Imagem de saída ![]() |
Pré-requisitos
Chame a API de edição geral de imagens Wan usando HTTP ou o DashScope SDK.
Antes de fazer uma chamada, obtenha uma chave de API e exporte a chave de API como uma variável de ambiente.
Para chamar a API usando o SDK, instale o DashScope SDK. O SDK está disponível para Python e Java.
HTTP
Os modelos de imagem levam muito tempo para processar. Para evitar tempos limite, as chamadas HTTP suportam apenas recuperação assíncrona de resultados. Duas solicitações são necessárias:
- Crie uma tarefa para obter um ID de tarefa: Envie uma solicitação para criar uma tarefa. A resposta retorna um ID de tarefa (
task_id). - Consulte o resultado usando o ID da tarefa: Use o ID da tarefa da etapa anterior para consultar o status e o resultado da tarefa. Se a tarefa for bem-sucedida, a resposta retorna uma URL de imagem válida por 24 horas.
O modelo de edição geral de imagens leva cerca de 5 a 15 segundos para processar uma solicitação. O tempo real depende do número de tarefas na fila e das condições da rede. Aguarde pacientemente pelo resultado.
Etapa 1: Criar uma tarefa para obter o ID da tarefa
POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/aigc/image2image/image-synthesis
Substitua {WorkspaceId} pelo seu ID do workspace real.
Parâmetros da solicitação |
|
Cabeçalhos da solicitação | |
Content-Type string (Obrigatório)O tipo de conteúdo da solicitação. Deve ser application/json. | |
Authorization string (Obrigatório)Autentica a solicitação com uma chave de API do Model Studio. Exemplo: Bearer sk-xxxx. | |
X-DashScope-Async string (Obrigatório)Ativa o processamento assíncrono. As solicitações HTTP suportam apenas chamadas assíncronas. Deve ser enable. | |
Corpo da solicitação | |
model string (Obrigatório)O nome do modelo, por exemplo, wanx2.1-imageedit. | |
input object (Obrigatório)As informações básicas de entrada (prompt).
Propriedades prompt string(Obrigatório)O prompt usado para descrever os elementos desejados e as características visuais na imagem gerada.Suporta chinês e inglês. Comprimento máximo: 800 caracteres. Cada caractere chinês ou letra conta como um caractere. Caracteres excedentes são truncados automaticamente.Os prompts variam para diferentes recursos. Recomendamos que você revise as dicas de prompt correspondentes para cada recurso.function string(Obrigatório)O recurso de edição de imagem. Os seguintes recursos são suportados atualmente:
string (Obrigatório)A URL ou dados codificados em Base64 da imagem de entrada.Requisitos da imagem:
string (Opcional)Este parâmetro é necessário apenas quando function está definido como description_edit_with_mask (inpainting). Não é necessário para outros recursos.A URL ou dados codificados em Base64 da imagem de máscara.Você pode passar uma URL acessível publicamente (HTTP/HTTPS) ou uma string codificada em Base64. Para mais informações, consulte Formatos suportados.Requisitos da imagem de máscara:
| |
parameters object (Opcional)Os parâmetros de processamento de imagem.
Propriedades
n integer (Opcional)O número de imagens a serem geradas. Faixa de valores: 1 a 4. Padrão: 1.seedinteger(Opcional)A semente de número aleatório, usada para controlar a aleatoriedade do conteúdo gerado pelo modelo. Faixa de valores: [0, 2147483647].Se não fornecido, o algoritmo gera automaticamente um número aleatório como semente. Para manter o conteúdo gerado relativamente estável, use o mesmo valor de parâmetro de semente.watermark bool (Opcional)Especifica se deve adicionar uma marca d'água. A marca d'água fica no canto inferior direito da imagem e exibe "Generated by AI".
|
Parâmetros da resposta |
Salve o task_id para consultar o status e o resultado da tarefa. |
output objectAs informações de saída da tarefa.
Propriedades task_id stringO ID da tarefa. Válido para consultas por 24 horas.task_status stringO status da tarefa.
Valores de enumeração
| |
request_id stringIdentificador único da solicitação para rastreamento e solução de problemas. | |
code stringCódigo de erro. Retornado apenas para solicitações com falha. Consulte Códigos de erro. | |
message stringMensagem de erro detalhada. Retornada apenas para solicitações com falha. Consulte Códigos de erro. |
Etapa 2: Consultar resultado pelo ID da tarefa
GET https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/tasks/{task_id}
Substitua {WorkspaceId} pelo seu ID do workspace real.
Parâmetros da solicitação |
Substitua 86ecf553-d340-4e21-xxxxxxxxx pelo seu task_id real. |
Cabeçalhos da solicitação | |
Authorization string (Obrigatório)Autentica a solicitação com uma chave de API do Model Studio. Exemplo: Bearer sk-xxxx. | |
Parâmetros de caminho | |
task_id string (Obrigatório)O ID da tarefa. |
Parâmetros da resposta |
Os dados da tarefa (status da tarefa e URLs de imagem) são retidos por apenas 24 horas e depois removidos automaticamente. Salve as imagens geradas prontamente. |
outputobjectAs informações de saída da tarefa.
Propriedades task_id stringO ID da tarefa. Válido para consultas por 24 horas.task_status stringO status da tarefa.
Valores de enumeração
stringO horário em que a tarefa foi enviada. O horário está em UTC+8 e o formato é YYYY-MM-DD HH:mm:ss.SSS.scheduled_time stringO horário em que a tarefa foi executada. O horário está em UTC+8 e o formato é YYYY-MM-DD HH:mm:ss.SSS.end_time stringO horário em que a tarefa foi concluída. O horário está em UTC+8 e o formato é YYYY-MM-DD HH:mm:ss.SSS.results array objectUma lista de resultados da tarefa, incluindo URLs de imagem e mensagens de erro para tarefas parcialmente falhas.
Estrutura de dados objectEstatísticas do resultado da tarefa.
Propriedades TOTAL integerO número total de tarefas.SUCCEEDED integerO número de tarefas bem-sucedidas.FAILED integerO número de tarefas com falha.stringCódigo de erro. Retornado apenas para solicitações com falha. Consulte Códigos de erro.message stringMensagem de erro detalhada. Retornada apenas para solicitações com falha. Consulte Códigos de erro. | |
usage objectAs estatísticas das informações de saída. Apenas resultados bem-sucedidos são contados.
Propriedades image_count integerNúmero de imagens geradas com sucesso. Faturamento: Custo = Número de imagens × Preço unitário. | |
request_id stringIdentificador único da solicitação para rastreamento e solução de problemas. |
DashScope SDK
Primeiro, certifique-se de ter instalado a versão mais recente do DashScope SDK. Caso contrário, pode ocorrer um erro de tempo de execução.
O DashScope SDK suporta atualmente Python e Java.
Os nomes dos parâmetros no SDK são majoritariamente consistentes com os da API HTTP. A estrutura dos parâmetros depende do encapsulamento do SDK para diferentes linguagens. Para descrições dos parâmetros, consulte 万相-图生视频-基于首帧(2.1-2.6).
O processamento do modelo de vídeo leva muito tempo, portanto o service usa uma abordagem assíncrona. O SDK fornece um wrapper que suporta chamadas síncronas e assíncronas.
O modelo de edição geral de imagens leva cerca de 5 a 15 segundos para processar uma solicitação. O tempo real depende do número de tarefas na fila e das condições da rede. Aguarde pacientemente pelo resultado.
Python SDK
Ao usar o Python SDK para processar arquivos de imagem, insira uma imagem usando um dos três métodos a seguir. Escolha o método que melhor se adapta ao seu cenário.
- URL pública: Uma URL de imagem acessível publicamente que usa o protocolo HTTP ou HTTPS.
- Codificado em Base64: Passe a string do arquivo codificada em Base64 no formato
data:{MIME_type};base64,{base64_data}. - Caminho do arquivo local: Suporta caminhos absolutos e relativos. Consulte a tabela a seguir para formatos válidos de caminho de arquivo.
Sistema | Caminho do arquivo a ser passado | Exemplo (caminho absoluto) | Exemplo (caminho relativo) |
|---|---|---|---|
Linux ou macOS | file://{caminho absoluto ou relativo do arquivo} | file:///home/images/test.png | file://./images/test.png |
Windows | file://D:/images/test.png | file://./images/test.png |
Código de exemplo
pip install -U dashscope. Consulte Instalar o SDK.- Chamada síncrona
- Chamada assíncrona
Exemplo de solicitação
Exemplo de resposta
A URL é válida por 24 horas. Baixe a imagem prontamente.
Java SDK
Ao usar o Java SDK para processar arquivos de imagem, insira uma imagem usando um dos três métodos a seguir. Escolha o método que melhor se adapta ao seu cenário.
- URL pública: Uma URL de imagem acessível publicamente que usa o protocolo HTTP ou HTTPS.
- Codificado em Base64: Passe a string do arquivo codificada em Base64 no formato
data:{MIME_type};base64,{base64_data}. - Caminho do arquivo local: Apenas caminhos absolutos são suportados. Consulte a tabela a seguir para formatos válidos de caminho de arquivo.
Sistema | Caminho do arquivo a ser passado | Exemplo |
|---|---|---|
Linux ou macOS | file://{caminho absoluto do arquivo} | file:///home/images/test.png |
Windows | file:///{caminho absoluto do arquivo} | file:///D:/images/test.png |
Código de exemplo
- Chamada síncrona
- Chamada assíncrona
Exemplo de solicitação
Exemplo de resposta
A URL é válida por 24 horas. Baixe a imagem prontamente.
Códigos de erro
Se a chamada do modelo falhar e retornar uma mensagem de erro, consulte Códigos de erro para resolução.
Esta API também possui códigos de status específicos, conforme mostrado na tabela a seguir.
Código de status HTTP | Código de erro da API (code) | Mensagem de erro da API (message) | Descrição |
|---|---|---|---|
400 | InvalidParameter | InvalidParameter | Os parâmetros da solicitação são inválidos. |
400 | IPInfringementSuspect | Input data is suspected of being involved in IP infringement. | Os dados de entrada (como o prompt ou imagem) são suspeitos de violação de propriedade intelectual. Verifique a entrada para garantir que não contenha conteúdo que represente risco de violação. |
400 | DataInspectionFailed | Input data may contain inappropriate content. | Os dados de entrada (como o prompt ou imagem) podem conter conteúdo inadequado. Modifique a entrada e tente novamente. |
500 | InternalError | InternalError | O service está anormal. Tente novamente para descartar um problema ocasional. |
Formatos de imagem de entrada
Formatos suportados
As imagens de entrada suportam múltiplos formatos de string, conforme mostrado na tabela a seguir.
Método de invocação | HTTP | Python SDK | Java SDK |
|---|---|---|---|
Métodos de imagem de entrada suportados |
|
|
|
- Forneça um endereço de imagem acessível publicamente. Os protocolos HTTP ou HTTPS são suportados.
- Exemplo:
https://xxxx/img.png
data:{MIME_type};base64,{base64_data}.
- Para o código de conversão, consulte Código de exemplo
- {MIME_type}: O tipo de mídia da imagem, que deve corresponder ao formato do arquivo
- {base64_data}: A string codificada em Base64 do arquivo de imagem
-
Referência de tipo MIME:
Formato de imagem
Tipo MIME
JPEG
image/jpeg
JPG
image/jpeg
PNG
image/png
BMP
image/bmp
TIFF
image/tiff
WEBP
image/webp
-
Exemplo:
data:image/png;base64,iVBORw0KGgoAAAANSUhEUgAABDg......Nota: A string Base64 acima está truncada para demonstração. No uso real, passe a string codificada completa.
- O HTTP não suporta caminhos de arquivo locais. Apenas o Python SDK e o Java SDK suportam este método.
- Para regras de caminho de arquivo local, consulte Python SDK e Java SDK.




















