Skip to main content
Geração de Texto

qwen3-next-80b-a3b-thinking

Nova geração de modelos open-source com modo de raciocínio baseados no Qwen3. Esta versão oferece melhor adesão a instruções e respostas resumidas mais concisas em comparação à iteração anterior (Qwen3-235B-A22B-Thinking-2507).

Provedor de service de inferência

O Alibaba Cloud Model Studio é o provedor de service de inferência para qwen3-next-80b-a3b-thinking.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Unsupported

Function Calling

Unsupported

Saídas estruturadas

Unsupported

Pesquisa na web

Unsupported

Conclusão de prefixo

Unsupported

Cache de contexto

Unsupported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

126.976

Comprimento máximo de saída

32.768

Janela de contexto

131.072

Preços

Esta página exibe apenas os preços originais das chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Item de faturamento

Preço (USD)

Unidade

Input(Thinking)

0,144

Por 1M tokens

Output(Thinking)

1,434

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Parâmetro

Valor

RPM (Requests Per Minute)

600

TPM (Tokens Per Minute)

1.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento