Skip to main content
Visão

qwen3-vl-plus

Os modelos VL da série Qwen3 integram eficazmente os modos de raciocínio e não raciocínio, alcançando desempenho líder mundial em capacidades de agentes visuais em benchmarks públicos como o OS World. Esta versão traz atualizações abrangentes em codificação visual, percepção espacial e raciocínio multimodal. Além de aprimorar significativamente a percepção e o reconhecimento visual, o modelo suporta a compreensão de vídeos extremamente longos. Esta versão é funcionalmente equivalente ao snapshot qwen3-vl-plus-2025-12-19.

Provedor do service de inferência

O Alibaba Cloud Model Studio fornece o service de inferência para qwen3-vl-plus.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Hong Kong (China)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text Image Video

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Unsupported

Conclusão de prefixo

Supported

Cache de contexto

Supported

Inferência em lote

Supported

Ajuste fino

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

260096

Comprimento máximo de saída

32768

Janela de contexto

262144

Comprimento máximo de entrada (Modo de raciocínio)

258048

Comprimento máximo de saída (Modo de raciocínio)

32768

Comprimento máximo da cadeia de pensamento

81920

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Hong Kong (China)

Item de faturamento

Preço (USD)

Unidade

Entrada

0,144

Por 1M tokens

Saída

1,434

Por 1M tokens

Entrada (Cache implícito)

0,029

Por 1M tokens

Entrada (Arquivo em lote)

0,072

Por 1M tokens

Saída (Arquivo em lote)

0,717

Por 1M tokens

Criação de cache explícito

0,18

Por 1M tokens

Leitura de cache explícito

0,014

Por 1M tokens

Entrada (Chat em lote)

0,144

Por 1M tokens

Saída (Chat em lote)

1,434

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0,216

Por 1M tokens

Saída

2,151

Por 1M tokens

Entrada (Cache implícito)

0,044

Por 1M tokens

Entrada (Arquivo em lote)

0,108

Por 1M tokens

Saída (Arquivo em lote)

1,075

Por 1M tokens

Criação de cache explícito

0,27

Por 1M tokens

Leitura de cache explícito

0,022

Por 1M tokens

Entrada (Chat em lote)

0,216

Por 1M tokens

Saída (Chat em lote)

2,151

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0,431

Por 1M tokens

Saída

4,301

Por 1M tokens

Entrada (Cache implícito)

0,087

Por 1M tokens

Entrada (Arquivo em lote)

0,215

Por 1M tokens

Saída (Arquivo em lote)

2,15

Por 1M tokens

Criação de cache explícito

0,539

Por 1M tokens

Leitura de cache explícito

0,043

Por 1M tokens

Entrada (Chat em lote)

0,431

Por 1M tokens

Saída (Chat em lote)

4,301

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Hong Kong (China)

Parâmetro

Valor

RPM (Requisições por minuto)

3000

TPM (Tokens por minuto)

5.000.000

Versões snapshot

qwen3-vl-plus-2025-12-19

A série Qwen3 de modelos de compreensão visual integra eficazmente os modos de raciocínio e não raciocínio. Em comparação com o snapshot de 23 de setembro, esta versão oferece desempenho superior em tarefas de raciocínio, análise e controle de estilo, além de proporcionar menor latência e respostas mais rápidas. Esta versão baseia-se no snapshot de 19 de dezembro de 2025.

Provedor do service de inferência

O Alibaba Cloud Model Studio fornece o service de inferência para qwen3-vl-plus-2025-12-19.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Hong Kong (China)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text Image Video

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Unsupported

Conclusão de prefixo

Supported

Cache de contexto

Unsupported

Inferência em lote

Unsupported

Ajuste fino

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

260096

Comprimento máximo de saída

32768

Janela de contexto

262144

Comprimento máximo de entrada (Modo de raciocínio)

258048

Comprimento máximo de saída (Modo de raciocínio)

32768

Comprimento máximo da cadeia de pensamento

81920

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Hong Kong (China)

Item de faturamento

Preço (USD)

Unidade

Entrada

0,144

Por 1M tokens

Saída

1,434

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0,216

Por 1M tokens

Saída

2,151

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0,431

Por 1M tokens

Saída

4,301

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Hong Kong (China)

Parâmetro

Valor

RPM (Requisições por minuto)

60

TPM (Tokens por minuto)

100.000

qwen3-vl-plus-2025-09-23

Os modelos VL da série Qwen3 integram eficazmente os modos de raciocínio e não raciocínio, alcançando desempenho líder mundial em capacidades de agentes visuais em benchmarks públicos como o OS World. Esta versão traz atualizações abrangentes em codificação visual, percepção espacial e raciocínio multimodal. Além de aprimorar significativamente a percepção e o reconhecimento visual, o modelo suporta a compreensão de vídeos extremamente longos. Esta versão corresponde ao snapshot de 23 de setembro de 2025.

Provedor do service de inferência

O Alibaba Cloud Model Studio fornece o service de inferência para qwen3-vl-plus-2025-09-23.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text Image Video

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Unsupported

Conclusão de prefixo

Supported

Cache de contexto

Unsupported

Inferência em lote

Unsupported

Ajuste fino

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

260096

Comprimento máximo de saída

32768

Janela de contexto

262144

Comprimento máximo de entrada (Modo de raciocínio)

258048

Comprimento máximo de saída (Modo de raciocínio)

32768

Comprimento máximo da cadeia de pensamento

81920

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Item de faturamento

Preço (USD)

Unidade

Entrada

0,143

Por 1M tokens

Saída

1,434

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0,215

Por 1M tokens

Saída

2,15

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0,43

Por 1M tokens

Saída

4,301

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Parâmetro

Valor

RPM (Requisições por minuto)

60

TPM (Tokens por minuto)

100.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento