Skip to main content
Geração de Texto

qwen3-32b

Integra eficazmente os modos de pensamento e não pensamento, permitindo alternar entre eles durante as conversas. Sua capacidade de raciocínio supera significativamente a do QwQ, e sua capacidade geral excede consideravelmente a do Qwen2.5-32B-Instruct, atingindo o nível SOTA para modelos da mesma escala no setor.

Provedor de service de inferência

O Alibaba Cloud Model Studio é o provedor de service de inferência para qwen3-32b.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Unsupported

Conclusão de prefixo

Supported

Cache de contexto

Unsupported

Inferência em lote

Unsupported

Ajuste fino

Supported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

98.304

Comprimento máximo de saída

8.192

Janela de contexto

131.072

Preços

Esta página exibe apenas os preços originais das chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Item de faturamento

Preço (USD)

Unidade

Entrada

0,287

Por 1M tokens

Saída

1,147

Por 1M tokens

Entrada (Pensamento)

0,287

Por 1M tokens

Saída (Pensamento)

2,868

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Parâmetro

Valor

RPM (Solicitações por minuto)

2.400

TPM (Tokens por minuto)

1.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento
qwen3-32b - Alibaba Cloud Model Studio