Skip to main content
Visão

qwen3-vl-32b-thinking

O Qwen3-VL-32B-Thinking é o maior modelo denso da série Qwen3-VL. Sua versão de raciocínio oferece capacidades multimodais superadas apenas pelo Qwen3-VL-235B-Thinking. O modelo destaca-se na resolução de problemas de STEM e matemática, além da compreensão geral de imagens e vídeos. Com desempenho de ponta em recursos de agentes multimodais, é ideal para tarefas complexas de raciocínio multimodal.

Provedor de service de inferência

O Alibaba Cloud Model Studio fornece o service de inferência para qwen3-vl-32b-thinking.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text Image Video

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Unsupported

Conclusão de prefixo

Supported

Cache de contexto

Unsupported

Inferência em lote

Unsupported

Ajuste fino

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

Comprimento máximo de saída

Janela de contexto

131.072

Comprimento máximo de entrada (Modo de raciocínio)

126.976

Comprimento máximo de saída (Modo de raciocínio)

32.768

Comprimento máximo da cadeia de pensamento

81.920

Preços

Esta página exibe apenas os preços originais das chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Item de faturamento

Preço (USD)

Unidade

Entrada (Raciocínio)

0,287

Saída (Raciocínio)

2,868

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Parâmetro

Valor

RPM (Requisições por minuto)

600

TPM (Tokens por minuto)

1.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento