Skip to main content
Geração e edição de imagens

Human instance segmentation

A segmentação de instâncias humanas identifica diferentes pessoas em uma imagem e descreve cada objeto com uma máscara no nível de pixel.

  • Este documento se aplica apenas à região China (Beijing). Para usar o modelo, utilize uma chave de API da região China (Beijing).
  • O modelo image-instance-segmentation está disponível apenas como avaliação gratuita. Após o consumo da cota gratuita, não é mais possível chamar o modelo.

Introdução

A segmentação de instâncias humanas usa tecnologias de detecção e segmentação para identificar diferentes pessoas em uma imagem e delinear cada objeto com precisão por meio de uma máscara no nível de pixel. Use a operação de API Preenchimento de exclusão de imagem para remover pessoas com IA. Para remover uma ou mais pessoas, selecione a área completa da máscara correspondente.

Cenários

  • Recorte de retrato: A segmentação humana isola o sujeito principal do fundo. Isso permite desfocar o plano de fundo para criar um efeito de grande abertura e pouca profundidade de campo, destacando a pessoa na imagem.
  • Criação de fotos para documentos: Faça upload ou tire uma foto casual com várias pessoas. O modelo segmenta cada indivíduo com precisão. Combinado aos recursos de apagamento e preenchimento, esse processo viabiliza a geração de uma foto de documento individual.
  • Produção de anúncios de marketing: Segmente imagens de product ou pessoas de cenários específicos para separar elementos indesejados do primeiro plano ou do fundo da imagem original.

Recursos e benefícios

  • Adaptabilidade a fundos complexos: O modelo segmenta uma pessoa com exatidão, mesmo em cenários visualmente complicados.
  • service de plataforma de nível empresarial: O service garante respostas estáveis durante períodos de alta concorrência e tráfego intenso, oferecendo uma operação de API de inferência simples para chamada direta.

Primeiros passos

Limites de entrada de imagem:
  • Resolução da imagem: A altura e a largura devem estar entre 512 e 4.096 pixels.
  • Formato da imagem: JPEG, PNG, JPG, BMP ou WEBP.
  • Tamanho da imagem: No máximo 10 MB.
  • A URL não pode conter caracteres chineses.

Imagem de entrada

Saída 1: Imagem de máscara no nível de pixel

Saída 2: Imagem de visualização

image

image

image

Como o modelo exige um tempo de processamento longo, o código de exemplo demonstra o uso de chamadas assíncronas para evitar tempos limite de requisição. Obter uma chave de API e exportar a chave de API como variável de ambiente. Substitua {WorkspaceId} pelo seu ID do workspace real.

curl

1. Crie uma tarefa de segmentação de instâncias humanas A API retorna um ID de tarefa. Use esse ID para consultar o resultado da geração de imagem.
# China (Beijing) region. Replace {WorkspaceId} with your Bailian workspace ID. URLs vary by region.
curl --location --request POST 'https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/aigc/image2image/image-synthesis' \
--header 'X-DashScope-Async: enable' \
--header "Authorization: Bearer $DASHSCOPE_API_KEY" \
--header 'Content-Type: application/json' \
--data-raw '{
    "model": "image-instance-segmentation",
    "input": {
        "image_url": "https://huarong123.oss-cn-hangzhou.aliyuncs.com/image/%E4%BA%BA%E5%83%8F%E5%88%86%E5%89%B2.png"
    },
    "parameters": {}
}'
2. Consultar o resultado com base no ID da tarefa
# China (Beijing) region. Replace {WorkspaceId} with your Bailian workspace ID. URLs vary by region.
curl -X GET https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/tasks/{your_task_id} \
     -H "Authorization: Bearer $DASHSCOPE_API_KEY" \

Referência da API

Para obter mais informações sobre os parâmetros de entrada e resposta da API, consulte Segmentação de instâncias humanas.
Plano de Tokens
Playground de Modelos
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento
Suporte