Gere imagens a partir de descrições textuais com a API de texto para imagem. Este service, fornecido pelo Alibaba Cloud Model Studio, conta com as famílias de modelos Wan, Qwen-Image e Z-Image.
- Model Experience Center: Clique em um link Experimente online acima (Singapore, Beijing) para abri-lo. Selecione um modelo, defina a resolução de saída, ative a reescrita de prompt e envie para gerar imagens.
Desempenho dos modelos
Qwen-Image
Layout complexo ![]() | Parágrafo longo ![]() | Retrato realista ![]() |
Design de UI ![]() | PPT ![]() | Design de ilustração ![]() |
Prompts
Prompts
Wanxiang
Fotografia de retrato ![]() | Fotografia fotorrealista ![]() | Estilos artísticos ![]() |
Renderização de texto ![]() | Design de pôster ![]() | Geração de conjunto de imagens ![]() |
Visualize prompt
Visualize prompt
Seleção de modelos
- qwen-image-3.0-pro: Modelo principal da família Qwen Image 3.0. Oferece suporte à reescrita inteligente de prompts e destaca-se na renderização de texto que se integra naturalmente a materiais físicos, tanto em chinês quanto em inglês.
- wan2.7-image-pro: Disponibiliza o maior conjunto de recursos, incluindo geração de múltiplas imagens, resoluções de até 4096x4096 e controle aprimorado sobre traços faciais, cores e renderização de textos longos.
- z-image-turbo: Proporciona geração de imagens rápida e econômica, com excelente desempenho em retratos altamente realistas e imagens de products.
Opções de uso
O recurso de texto para imagem oferece duas opções de utilização. Escolha a mais adequada ao seu cenário:
Opção de uso | Codificação necessária | Ponto de entrada | Mais indicado para |
|---|---|---|---|
Experiência online via web | Não | Model Experience Center (consulte os links Experimente online no início deste tópico) | Testar modelos, validar prompts e gerar poucas imagens |
Chamada de API | Sim | Consulte Início rápido abaixo | Integrar texto para imagem em sua própria aplicação ou service em escala |
Início rápido
Pré-requisitos
Antes de começar, obtenha uma chave de API e depois defina a chave de API como variável de ambiente. Caso utilize o DashScope SDK, também é necessário instale o SDK.
Código de exemplo
Métodos de chamada:
- Todos os modelos de texto para imagem da família Qwen aceitam chamadas síncronas. A série qwen-image-3.0, além dos modelos
qwen-image-pluseqwen-image, também permite chamadas assíncronas. Para mais detalhes, consulte Qwen - Image Generation and Editing 3.0 e Qwen - Text-to-Image. - Todos os modelos de texto para imagem da família Wan aceitam chamadas assíncronas. Os modelos
wan2.7-image-pro,wan2.7-image,wan2.6-imageewan2.6-t2itambém oferecem suporte a chamadas síncronas. Para mais informações, veja Wan - Image Generation and Editing 2.7, Wan - Image Generation and Editing 2.6 e Wan - Text-to-Image V2.
- Qwen - synchronous call
- Wan - asynchronous call
- Python
- Java
- curl
Principais capacidades
1. Seguimento de prompt
Parâmetros: messages.content.text ou input.prompt (obrigatório) e negative_prompt (opcional).
- prompt: Descreve o conteúdo desejado para a imagem, incluindo sujeito, cena, estilo, iluminação e composição. Trata-se do parâmetro central para controlar a geração de texto para imagem.
- negative prompt: Especifica o que deve ser excluído da imagem, como "desfocado" ou "dedos extras". Esse parâmetro ajuda a refinar a qualidade do resultado.
Os modelos wan2.7-image-pro e wan2.7-image não oferecem suporte ao parâmetro negative_prompt. Para excluir elementos indesejados, descreva essa exclusão no próprio prompt (por exemplo, "não incluir xxx").
2. Ative reescrita de prompt
Parâmetro: parameters.prompt_extend (Booleano, padrão definido como true).
Esse recurso expande e otimiza automaticamente prompts curtos para melhorar a qualidade da imagem. Ativá-lo adiciona de 3 a 5 segundos ao tempo de geração, pois um modelo grande é utilizado para reescrever o prompt.
Recomendações:
- Ative este recurso para prompts breves ou genéricos a fim de melhorar significativamente a qualidade da imagem.
- Desative-o caso precise de controle preciso sobre detalhes da imagem, já tenha fornecido um prompt abrangente ou se a latência de resposta for uma preocupação. Para desativar, defina o parâmetro
prompt_extendcomofalse.
Os modelos wan2.7-image-pro e wan2.7-image não suportam o parâmetroParâmetro:prompt_extend. Para melhorar a qualidade da imagem nesses modelos, ative othinking_modeem vez disso. Os modelos qwen-image-3.0-pro e qwen-image-3.0 aceitam o parâmetroprompt_extend(ativado por padrão).
parameters.prompt_extend_mode (string, opcional, padrão definido como direct). Suportado apenas pelos modelos qwen-image-3.0-pro e qwen-image-3.0. Especifica o método de reescrita usado quando prompt_extend está ativado:
direct: Aprimoramento Direto de Prompt (DPE), adequado para a maioria dos cenários. Suportado tanto para texto para imagem (T2I) quanto para imagem para imagem/edição (I2I).agent: Aprimoramento de Prompt por Agente (APE), oferece uma reescrita mais refinada. Suportado apenas para texto para imagem (T2I). Passaragentpara imagem para imagem/edição (I2I) retorna um erro 400.
3. Defina a resolução da imagem de saída
Parâmetro: parameters.size (string), no formato "largura*altura".
Modelo | Formato de tamanho | Faixa de pixels | Padrão | Proporção |
|---|---|---|---|---|
wan2.7-image-pro | Abreviado |
|
| 1:8 – 8:1 |
Personalizado | 768768 – 40964096 | |||
wan2.7-image | Abreviado |
|
| 1:8 – 8:1 |
Personalizado | 768768 – 20482048 | |||
wan2.6-image (modo de saída intercalada de texto e imagem) | Personalizado | 768768 – 12801280 | Corresponde à proporção de entrada (≤1280*1280) | 1:4 – 4:1 |
wan2.6-t2i, wan2.5-t2i-preview | Personalizado | 12801280 – 14401440 | 1280*1280 | 1:4 – 4:1 |
wan2.2 e modelos t2i anteriores | Personalizado | [512, 1440], e total de pixels ≤1440*1440 | 1024*1024 | - |
qwen-image-3.0-pro, qwen-image-3.0 | Personalizado | 512512 – 20482048 | Recomendado automaticamente pelo modelo | 1:8 – 8:1 |
Série qwen-image-2.0 | Personalizado | 512512 – 20482048 | 2048*2048 | - |
Série qwen-image-max / qwen-image-plus | Apenas tamanhos predefinidos fixos | Veja os tamanhos predefinidos abaixo | 1664*928 (16:9) | - |
O modelo wan2.7-image-pro suporta resolução 4K e resoluções personalizadas de até 40964096, mas apenas para tarefas de texto para imagem (onde nenhuma imagem é inserida e a geração de conjunto de imagens está desativada). Todos os outros cenários são limitados à resolução 2K (20482048).
As séries qwen-image-max e qwen-image-plus suportam apenas as cinco resoluções fixas a seguir:
1664*928(padrão): 16:91472*1104: 4:31328*1328: 1:11104*1472: 3:4928*1664: 9:16
Proporção | 4K (wan2.7-image-pro) | 2K (wan2.7-image, qwen-image-3.0-pro, qwen-image-3.0, qwen-image-2.0) | 1K (Wan t2i) |
|---|---|---|---|
1:1 | 4096*4096 | 2048*2048 | 1280*1280 |
16:9 | 4096*2304 | 2688*1536 | 1696*960 |
9:16 | 2304*4096 | 1536*2688 | 960*1696 |
4:3 | 4096*3072 | 2368*1728 | 1472*1104 |
3:4 | 3072*4096 | 1728*2368 | 1104*1472 |
4. Geração de conjunto de imagens
Parâmetro: parameters.enable_sequential (Booleano, padrão definido como false). Suportado apenas pelos modelos wan2.7-image-pro e wan2.7-image.
Defina como true para ative o modo de geração de conjunto de imagens. Nesse modo, o modelo utiliza o prompt e quaisquer imagens de referência para gerar múltiplas imagens coerentes entre si, formando uma narrativa a partir de uma única solicitação.
- Quantidade de imagens: Controlada pelo parâmetro
n. Quando este modo está ativado, o valor pode variar de 1 a 12, com padrão de 12. O modelo determina a quantidade real de imagens geradas, que não excederán. - Observação: Com a geração de conjunto de imagens ativada, os parâmetros
thinking_modeecolor_paletteficam indisponíveis.
5. Modo de raciocínio
Parâmetro: parameters.thinking_mode (Booleano, padrão definido como true). Suportado apenas pelos modelos wan2.7-image-pro e wan2.7-image.
Quando ativado, o modelo aprimora suas capacidades de raciocínio para melhorar a qualidade da imagem. Isso aumenta o tempo de geração.
Disponível apenas quando a geração de conjunto de imagens está desativada ( enable_sequential=false ).
6. Paleta de cores personalizada
Parâmetro: parameters.color_palette (array). Suportado apenas pelos modelos wan2.7-image-pro e wan2.7-image.
Defina o esquema de cores da imagem fornecendo um array de objetos, onde cada objeto especifica uma cor hexadecimal e sua proporção. É necessário fornecer de 3 a 10 cores (recomenda-se 8), e a soma de todas as proporções deve ser igual a 100,00%.
Disponível apenas quando a geração de conjunto de imagens está desativada ( enable_sequential=false ).
Clique em para ver um exemplo de entrada
Clique em para ver um exemplo de entrada
Implantação em produção
-
Tolerância a falhas
- Tratamento de limitação de taxa: Quando a API retornar o código de erro
Throttlingou o status HTTP 429, significa que a limitação de taxa foi acionada. Para lidar com essa situação, consulte Rate Limiting. - Consulta periódica para tarefas assíncronas: Ao consultar o resultado de uma tarefa assíncrona, implemente uma estratégia de polling adequada para evitar o acionamento da limitação de taxa. Por exemplo, faça consultas a cada 3 segundos nos primeiros 30 segundos e depois aumente o intervalo. Defina um tempo limite final para a tarefa (por exemplo, 2 minutos). Se a tarefa expirar, marque-a como falha.
- Tratamento de limitação de taxa: Quando a API retornar o código de erro
-
Prevenção de riscos
- Persistência de resultados: As URLs das imagens da API têm validade de 24 horas. Seu sistema de produção deve baixe a imagem imediatamente após receber a URL e transferi-la para seu próprio service de armazenamento persistente, como o Object Storage Service (OSS) do Alibaba Cloud.
- Moderação de conteúdo: Todas as entradas de
promptenegative_promptpassam por moderação de conteúdo. Se a entrada não estiver em conformidade, a solicitação será bloqueada e um erroDataInspectionFailedserá retornado. - Riscos de direitos autorais e conformidade do conteúdo gerado: Garanta que seus prompts estejam em conformidade com todas as leis e regulamentos aplicáveis. Gerar conteúdo que inclua marcas registradas, semelhanças de celebridades ou propriedade intelectual (IP) protegida por direitos autorais pode representar riscos de violação. Você é responsável por avaliar e assumir todos os riscos associados.
Referência da API
- Qwen - Image Generation and Editing 3.0
- Qwen-Image
- Wan2.7 - image generation and editing
- Wan2.6 - image generation and editing
- Wan - text-to-image v2
- Z-Image - text-to-image
Faturamento e limitação de taxa
- Para cotas gratuitas e preços, consulte model pricing.
- Para limites de taxa, consulte Image generation.
- A cobrança ocorre apenas por imagens geradas com sucesso. Solicitações com falha e erros de processamento não geram cobranças nem consomem a free quota for new users.
Códigos de erro
Se a chamada do modelo falhar e retornar uma mensagem de erro, consulte Error codes para resolução.
FAQ
P: Qual é a validade das URLs das imagens? Como salve imagens permanentemente?
R: As URLs das imagens expiram após 24 horas. Você deve baixe a imagem programaticamente de forma imediata e salve-a em um armazenamento persistente, como um servidor local ou o Object Storage Service do Alibaba Cloud.
P: Minha chamada de API retorna um erro DataInspectionFailed. Como resolvo isso?
R: Esse erro indica que sua entrada acionou a moderação de conteúdo. Revise seu prompt ou negative_prompt, remova qualquer conteúdo não conforme e tente a solicitação novamente.
P: Quando devo ative ou desativar o parâmetro prompt_extend?
R: Mantenha-o ativado (o padrão) para prompts concisos ou para obter resultados mais criativos. Defina-o explicitamente como false quando seu prompt já for detalhado e especializado, ou quando você for sensível à latência da API.
Observação: Os modelos wan2.7-image-pro e wan2.7-image não suportam o parâmetro prompt_extend. Para melhorar a qualidade da imagem, ative o thinking_mode em vez disso.










