Skip to main content
Geração de Texto

qwen-turbo

Modelo Turbo da série Qwen3. Integra eficazmente os modos de pensamento e não pensamento, permitindo alternar entre eles durante as conversas. Suas capacidades de raciocínio equivalem às do QwQ-32B com menor tamanho de parâmetro, enquanto suas capacidades gerais superam significativamente as do Qwen2.5-Turbo, atingindo o nível SOTA na mesma escala do setor. Esta versão é funcionalmente equivalente ao snapshot qwen-turbo-2025-04-28.

Provedor de service de inferência

O Alibaba Cloud Model Studio fornece o service de inferência para qwen-turbo.

Capacidades do modelo

  • China (Beijing)
  • Singapore

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Unsupported

Saídas estruturadas

Supported

Busca na web

Unsupported

Conclusão de prefixo

Unsupported

Cache de contexto

Supported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

98.304

Comprimento máximo de saída

16.384

Janela de contexto

131.072

Preços

Esta página exibe apenas os preços originais das chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore

Item de faturamento

Preço (USD)

Unidade

Entrada

0,044

Por 1M tokens

Saída

0,087

Por 1M tokens

Entrada (Pensamento)

0,044

Por 1M tokens

Saída (Pensamento)

0,431

Por 1M tokens

Entrada (Cache implícito)

0,009

Por 1M tokens

Entrada (Cache implícito de pensamento)

0,009

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore

Parâmetro

Valor

RPM (Solicitações por minuto)

1.200

TPM (Tokens por minuto)

5.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento