Skip to main content
Wan - modelos de vídeo legados

Wan - video editing (2.1)

O modelo unificado de edição de vídeo Wan 2.1 aceita múltiplas modalidades de entrada, como texto, imagens e vídeos, para diversas tarefas de geração e edição de vídeo.

Documentação relacionada: guia do usuário

Escopo

Para garantir o sucesso das chamadas, o modelo, a URL do endpoint e a chave da API devem estar na mesma região. Chamadas entre regiões diferentes falharão.
  • Selecione um modelo: Confirme a região do modelo.
  • Selecione uma URL: Escolha a URL do endpoint correspondente à região do modelo. URLs HTTP são suportadas.
  • Configure uma chave de API: Selecione uma região, obtenha uma chave de API e configure-a nas variáveis de ambiente.
Os códigos de exemplo deste tópico referem-se à região de Singapura.
O Model Studio lançou domínios específicos por workspace para as regiões China (Pequim) e Singapura. Os novos domínios dedicados oferecem desempenho superior e maior estabilidade para solicitações de inferência. Recomendamos a migração para os novos domínios:
  • China (Pequim): de https://dashscope.aliyuncs.com para https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com
  • Singapura: de https://dashscope-intl.aliyuncs.com para https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com
O {WorkspaceId} corresponde ao ID do seu workspace, disponível na página Workspace Details no console do Model Studio. O domínio existente permanece totalmente funcional.

Chamada HTTP

O modelo unificado de edição de vídeo leva de 5 a 10 minutos para processar. Por isso, a API utiliza um fluxo assíncrono com duas etapas principais: "criar tarefa -> consultar resultado".

Etapa 1: Criar uma tarefa

  • Beijing
  • Singapore
POST https://dashscope.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis
  • Singapore
  • Beijing
POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesisSubstitua WorkspaceId pelo seu ID do Workspace real.

Parâmetros da requisição

  • Referência de múltiplas imagens
  • Repintura de vídeo
  • Edição local
  • Extensão de vídeo
  • Outpainting de vídeo
As chaves de API para as regiões de Singapura e China (Pequim) são diferentes. Obter uma chave de API
A URL abaixo refere-se à região de Singapura. Para a região da China (Pequim), utilize esta URL: https://dashscope.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis
curl --location 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis' \
--header 'X-DashScope-Async: enable' \
--header "Authorization: Bearer $DASHSCOPE_API_KEY" \
--header 'Content-Type: application/json' \
--data '{
    "model": "wan2.1-vace-plus",
    "input": {
        "function": "image_reference",
        "prompt": "In the video, a girl gracefully emerges from a misty, ancient forest. Her steps are light, and the camera captures her every nimble moment. When she stops to look at the lush woods around her, a smile of surprise and joy blossoms on her face. This scene, frozen in an interplay of light and shadow, records her wonderful encounter with nature.",
        "ref_images_url": [
            "http://wanx.alicdn.com/material/20250318/image_reference_2_5_16.png",
            "http://wanx.alicdn.com/material/20250318/image_reference_1_5_16.png"
        ]
    },
    "parameters": {
        "prompt_extend": true,
        "obj_or_bg": ["obj","bg"],
        "size": "1280*720"
    }
}'
Cabeçalhos da requisição
Content-Type string (Obrigatório)O tipo de conteúdo da requisição. Deve ser application/json.
Authorization string (Obrigatório)Autentica a requisição com uma chave de API do Model Studio. Exemplo: Bearer sk-xxxx.
X-DashScope-Async string (Obrigatório)Ativa o processamento assíncrono. Requisições HTTP suportam apenas chamadas assíncronas. O valor deve ser enable.
Se este cabeçalho de requisição estiver ausente, o erro "current user api does not support synchronous calls" será retornado.
Corpo da requisição
  • Referência de múltiplas imagens
  • Repintura de vídeo
  • Edição local
  • Extensão de vídeo
  • Outpainting de vídeo
model string (Obrigatório)Nome do modelo. Exemplo: wan2.1-vace-plus.
input object (Obrigatório)Entrada básica, como o prompt.

Propriedades

promptstring(Obrigatório)Descreve os elementos e características visuais a serem incluídos no vídeo gerado.Suporta chinês e inglês. O comprimento máximo é de 800 caracteres, onde cada caractere chinês ou letra conta como um único caractere. O texto que exceder esse limite será truncado automaticamente.Para técnicas de prompt, consulte o Guia de Prompt Texto-para-Vídeo/Imagem-para-Vídeo.functionstring(Obrigatório)Nome do recurso. Para referência de múltiplas imagens, defina como image_reference.A referência de múltiplas imagens suporta até 3 imagens de referência. As imagens podem conter entidades e fundos, como pessoas, animais, roupas e cenários. Utilize um prompt para descrever o conteúdo de vídeo desejado, e o modelo combinará as múltiplas imagens para gerar um conteúdo de vídeo coerente.ref_images_urlarray[string] (Obrigatório)Um array de URLs de imagens de referência.
  1. URL pública:
É possível fornecer de 1 a 3 imagens de referência. Se você fornecer mais de 3, apenas as 3 primeiras serão utilizadas.Requisitos da imagem:
  • Formato: JPG, JPEG, PNG, BMP, TIFF ou WEBP.
  • Resolução: A largura e a altura devem estar dentro do intervalo de [360, 2000] pixels.
  • Tamanho: Até 10 MB.
  • A URL não deve conter caracteres chineses.
Recomendações:
  • Ao usar uma imagem de referência para uma entidade, recomenda-se que cada imagem contenha apenas uma entidade. O fundo deve ser de cor sólida (por exemplo, branco) para destacar melhor a entidade.
  • Se utilizar um fundo de uma imagem de referência, forneça no máximo uma imagem de fundo, que não deve conter nenhum objeto de entidade.
parameters object (Opcional)Parâmetros para processamento de vídeo, como configurações de marca d'água.

Propriedades

obj_or_bg array[string] (Opcional)Este parâmetro identifica a finalidade de cada imagem de referência e corresponde um a um com o parâmetro ref_images_url. Cada elemento no array especifica se a imagem na posição correspondente é um 'assunto' ou um 'fundo':
  • obj: Indica que a imagem é a entidade de referência.
  • bg: Especifica a imagem como referência de fundo (máximo de uma permitida).
Notas de uso:
  • Recomenda-se passar este parâmetro, e seu comprimento deve ser igual ao de ref_images_url, caso contrário, um erro será reportado.
  • Este parâmetro pode ser omitido e assumirá o padrão ["obj"] apenas se ref_images_url for um array de elemento único.
Exemplo: ["obj", "obj", "bg"].size string (Opcional)A resolução do vídeo gerado (largura*altura). O modelo suporta a geração de vídeos em 720p. Valores válidos:
  • 1280*720 (Padrão): A proporção do vídeo é 16:9, onde 1280 é a largura e 720 é a altura.
  • 720*1280: A proporção do vídeo é 9:16.
  • 960*960: A proporção do vídeo é 1:1.
  • 832*1088: A proporção do vídeo é 3:4.
  • 1088*832: A proporção do vídeo é 4:3.
duration integer (Opcional)A duração do vídeo gerado em segundos. Este valor é fixo em 5.prompt_extendbool (Opcional)Especifica se a reescrita de prompt deve ser ativada. Se ativada, um modelo de linguagem grande (LLM) reescreve o prompt de entrada. Isso pode melhorar significativamente os resultados para prompts curtos, mas aumenta o tempo de processamento.
  • true (padrão): Ativa a reescrita de prompt.
  • false: Desativa a reescrita de prompt.
seedinteger(Opcional)A semente de número aleatório controla a aleatoriedade do conteúdo gerado pelo modelo. O intervalo de valores para o parâmetro seed é [0, 2147483647].Se você não especificar uma semente, uma será gerada automaticamente. Para resultados reproduzíveis, utilize o mesmo valor de semente em múltiplas requisições.watermark bool(Opcional)Especifica se deve adicionar uma marca d'água 'AI-generated' no canto inferior direito da imagem.
  • false (padrão): Não adiciona marca d'água.
  • true: Adiciona uma marca d'água.

Parâmetros de resposta

  • Resposta bem-sucedida
  • Resposta de erro
Salve o task_id para consultar o status e o resultado da tarefa.
{
        "output": {
            "task_status": "PENDING",
            "task_id": "0385dc79-5ff8-4d82-bcb6-xxxxxx"
        },
        "request_id": "4909100c-7b5a-9f92-bfe5-xxxxxx"
    }
output objectSaída da tarefa assíncrona.

Propriedades

task_id stringID da tarefa. Válido para consultas por 24 horas.task_status stringStatus atual da tarefa.

Valores de enumeração

  • PENDING
  • RUNNING
  • SUCCEEDED
  • FAILED
  • CANCELED
  • UNKNOWN: A tarefa não existe ou seu status é desconhecido.
request_id stringIdentificador exclusivo da requisição para rastreamento e solução de problemas.
code stringCódigo de erro. Retornado apenas para requisições com falha. Consulte Códigos de erro.
message stringMensagem de erro detalhada. Retornada apenas para requisições com falha. Consulte Códigos de erro.

Etapa 2: Consultar resultado pelo ID da tarefa

  • China (Beijing)
  • Singapore
GET https://dashscope.aliyuncs.com/api/v1/tasks/{task_id}
  • Singapore
  • China (Beijing)
GET https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/tasks/{task_id}Substitua WorkspaceId pelo seu ID do Workspace real.

Parâmetros da requisição

  • Consultar resultado da tarefa
Substitua {task_id} pelo valor de task_id retornado na chamada de API anterior. O task_id permanece válido para consultas durante 24 horas.
curl -X GET https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/tasks/{task_id} \
    --header "Authorization: Bearer $DASHSCOPE_API_KEY"
Cabeçalhos da requisição
Authorization string (Obrigatório)Autentica a requisição com uma chave de API do Model Studio. Exemplo: Bearer sk-xxxx.
Parâmetros de caminho da URL
task_id string (Obrigatório)ID da tarefa.

Parâmetros de resposta

  • Tarefa bem-sucedida
  • Tarefa com falha
Os dados da tarefa, incluindo status e URL do vídeo, ficam disponíveis por 24 horas e são excluídos automaticamente após esse período. Salve o vídeo gerado prontamente.
{
    "request_id": "851985d0-fbba-9d8d-a17a-xxxxxx",
    "output": {
        "task_id": "208e2fd1-fcb4-4adf-9fcc-xxxxxx",
        "task_status": "SUCCEEDED",
        "submit_time": "2025-05-15 16:14:44.723",
        "scheduled_time": "2025-05-15 16:14:44.750",
        "end_time": "2025-05-15 16:20:09.389",
        "video_url": "https://dashscope-result-wlcb.oss-cn-wulanchabu.aliyuncs.com/xxx.mp4?xxxxxx",
        "orig_prompt": "In the video, a girl gracefully walks out from a misty, ancient forest. Her steps are light, and the camera captures her every nimble moment. When the girl stops and looks around at the lush woods, a smile of surprise and joy blossoms on her face. This scene, frozen in a moment of interplay between light and shadow, records her wonderful encounter with nature.",
        "actual_prompt": "A girl in a light-colored long dress slowly walks out from a misty, ancient forest, her steps as light as a dance. She has slightly curly long hair, a delicate face, and bright eyes. The camera follows her movements, capturing every nimble moment. When she stops, turns, and looks around at the lush woods, a smile of surprise and joy blossoms on her face. Sunlight filters through the leaves, casting mottled shadows and freezing this beautiful moment of harmony between human and nature. The style is a fresh and natural portrait, combining medium and full shots with a level perspective and slight camera movement."
    },
    "usage": {
        "video_duration": 5,
        "video_ratio": "standard",
        "video_count": 1
    }
}
outputobjectInformações sobre a saída da tarefa.

Propriedades

task_id stringID da tarefa. Válido para consultas por 24 horas.task_status stringStatus atual da tarefa.

Valores de enumeração

  • PENDING
  • RUNNING
  • SUCCEEDED
  • FAILED
  • CANCELED
  • UNKNOWN: A tarefa não existe ou seu status é desconhecido.
submit_time stringHorário de envio da tarefa. O horário está em UTC+8 e o formato é YYYY-MM-DD HH:mm:ss.SSS.scheduled_time stringHorário de execução da tarefa. O horário está em UTC+8 e o formato é YYYY-MM-DD HH:mm:ss.SSS.end_time stringHorário de conclusão da tarefa. O horário está em UTC+8 e o formato é YYYY-MM-DD HH:mm:ss.SSS.video_urlstringURL do vídeo MP4 (H.264) gerado. Este link é válido por 24 horas.orig_prompt stringPrompt de entrada original.actual_prompt stringPrompt utilizado para geração após a reescrita. Este campo é retornado apenas se a reescrita de prompt estiver ativada.code stringCódigo de erro. Retornado apenas para requisições com falha. Consulte Códigos de erro.message stringMensagem de erro detalhada. Retornada apenas para requisições com falha. Consulte Códigos de erro.
usage objectEstatísticas da saída da tarefa. Fornecido apenas para tarefas bem-sucedidas.

Propriedades

video_duration integerDuração do vídeo gerado, em segundos.video_ratio stringProporção de aspecto do vídeo gerado. O valor é sempre standard.video_count integerQuantidade de vídeos gerados.
request_id stringIdentificador exclusivo da requisição para rastreamento e solução de problemas.

Limitações

  • Período de retenção de dados: O ID da tarefa task_id e a URL do vídeo video_url são mantidos por apenas 24 horas. Após a expiração, não é mais possível consultá-los ou baixá-los.
  • Suporte a áudio: Atualmente, este recurso gera apenas vídeos sem som. Para gerar áudio, utilize a Síntese de Fala.

Códigos de erro

Se uma chamada de modelo falhar com uma mensagem de erro, consulte Códigos de erro para solucionar o problema.

Perguntas frequentes

P: Como adicionar domínios de armazenamento de vídeo à lista de permissões?

R: Os vídeos gerados pelos modelos são armazenados no OSS. A API retorna uma URL pública temporária. Para configurar uma lista de permissões de firewall para esta URL de download, observe o seguinte: o armazenamento subjacente pode mudar dinamicamente. Este tópico não fornece uma lista fixa de domínios OSS para evitar problemas de acesso causados por informações desatualizadas. Caso tenha requisitos de controle de segurança, entre em contato com seu gerente de conta para obter a lista mais recente de domínios OSS.
Referência da API de Geração de Texto
Geração de Imagens
  • FAQ
Áudio
API em tempo real
Incorporação de Texto
Produção de Modelos