Skip to main content

Visual understanding

Escolha o modelo ideal para seu caso de uso, como análise de imagens, compreensão de vídeos ou OCR.

Compreensão de imagens e vídeos

Comece com qwen3.7-plus, o principal modelo da família Qwen. Ele oferece janela de contexto de 1M, suporte a vídeos de até 2 horas, function calling e ferramentas integradas. Após estabilizar sua aplicação, migre para qwen3.7-flash para reduzir custos. Essa versão entrega desempenho muito próximo ao do modelo principal, mantendo o mesmo tamanho de contexto e conjunto de recursos.

Resolução de imagem

A maioria dos modelos aceita até 16 milhões de pixels por imagem. Resoluções mais altas consomem mais tokens. Cálculo de tokens por imagem: h x w / (32 x 32) + 2.

Suporte a vídeo

  • Até 2 horas / 2 GB: qwen3.7-plus, qwen3.6-plus, qwen3.7-flash, qwen3.6-flash, qwen3.5-plus, qwen3.5-flash
  • Até 1 hora / 2 GB: qwen3-vl-plus, qwen3-vl-flash
  • Até 1 hora / 2 GB: qwen3.5-omni-plus, qwen3.5-omni-flash (também aceita entrada de áudio)

Function calling e ferramentas integradas

Esses recursos permitem que o modelo execute ações com base no conteúdo de imagens ou vídeos.
  • Function calling: disponível nas séries Qwen3.7, Qwen3.6, Qwen3.5 e Qwen3-VL.
  • Ferramentas integradas (busca na web, execução de código, sem necessidade de configuração): compatíveis com qwen3.7-plus, qwen3.6-plus, qwen3.7-flash, qwen3.6-flash, qwen3.5-plus e qwen3.5-flash.

Saída estruturada

Obtenha saídas em JSON válido a partir de entradas visuais, como extrair detalhes de product de uma foto. As séries Qwen3.7, Qwen3.6, Qwen3.5 e Qwen3-VL oferecem esse recurso no modo non-thinking.

OCR e extração de documentos

O modelo qwen3.5-ocr é otimizado para extração de texto de documentos, tabelas, provas e conteúdo manuscrito. Para extração geral de texto em imagens, use qwen3.7-plus ou qwen3.7-flash.

Modelos recomendados

ID do modelo

Contexto

Máx. pixels/imagem

Duração máx. de vídeo

Tamanho máx. de vídeo

Máx. de imagens

Máx. de vídeos

Function calling

Ferramentas integradas

Saída estruturada

qwen3.7-plus

1M

16M

2 horas

2 GB

2048

64

Supported

Supported

Supported

qwen3.7-flash

1M

16M

2 horas

2 GB

256

64

Supported

Supported

Supported

qwen3.5-omni-plus

64k

--

1 hora

2 GB

2.048

512

Supported

--

Supported

Modelos legados

Qwen3.7

ID do modeloEntradaSaídaContextoSaída máx.Máx. de imagensMáx. de vídeosFunction callingFerramentas integradasSaída estruturada
qwen3.7-plus
qwen3.7-plus-2026-05-26
Texto, imagens, vídeoTexto1M64k204864SupportedSupportedSupported
qwen3.7-flash
qwen3.7-flash-2026-07-15
Texto, imagens, vídeoTexto1M64k25664SupportedSupportedSupported

Qwen3.6

ID do modeloEntradaSaídaContextoSaída máx.Máx. de imagensMáx. de vídeosFunction callingFerramentas integradasSaída estruturada
qwen3.6-plus
qwen3.6-plus-2026-04-02
Texto, imagens, vídeoTexto1M64k25664SupportedSupportedSupported
qwen3.6-flash
qwen3.6-flash-2026-04-16
Texto, imagens, vídeoTexto1M64k25664SupportedSupportedSupported
qwen3.6-35b-a3bTexto, imagens, vídeoTexto256k64k25664SupportedSupportedSupported

Qwen3.5

ID do modeloEntradaSaídaContextoSaída máx.Máx. de imagensMáx. de vídeosFunction callingFerramentas integradasSaída estruturada
qwen3.5-plus
qwen3.5-plus-2026-02-15
Texto, imagens, vídeoTexto1M64k25664SupportedSupportedSupported
qwen3.5-flash
qwen3.5-flash-2026-02-23
Texto, imagens, vídeoTexto1M64k25664SupportedSupportedSupported
qwen3.5-397b-a17bTexto, imagens, vídeoTexto32k8k25664SupportedSupportedSupported
qwen3.5-122b-a10bTexto, imagens, vídeoTexto32k8k25664SupportedSupportedSupported
qwen3.5-27bTexto, imagens, vídeoTexto32k8k25664SupportedSupportedSupported
qwen3.5-35b-a3bTexto, imagens, vídeoTexto32k8k25664SupportedSupportedSupported
Esses modelos não são mais recomendados. Para novos projetos, use as séries Qwen3.6 ou Qwen3.5. Para consultar as especificações completas, acesse a página Models. China (Beijing) | Singapore | U.S. | China (Hong Kong) | Germany (Frankfurt)

Qwen3-VL

  • qwen3-vl-plus e seus snapshots
  • qwen3-vl-flash e seus snapshots

Qwen-Omni

  • qwen3-omni-flash e seus snapshots
  • qwen-omni-turbo e seu snapshot

Qwen-OCR

  • qwen-vl-ocr e seus snapshots
  • qwen-vl-ocr-latest

QVQ

  • qvq-max
  • qvq-plus

Qwen-VL legado

  • qwen-vl-max
  • qwen-vl-plus
Plano de Tokens
Playground de Modelos
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento
Suporte