Skip to main content
Geração de Texto

qwen-max

O Qwen-Max conta com uma escala de parâmetros na casa das centenas de bilhões e aceita diversos idiomas de entrada, como chinês e inglês. O modelo recebe atualizações contínuas. Em comparação com versões anteriores, apresenta melhorias significativas na geração de código em chinês e inglês, no raciocínio lógico e nas capacidades multilíngues. O estilo de resposta passou por amplos ajustes para se alinhar às preferências humanas, com avanços notáveis no nível de detalhe e na clareza. Além disso, houve aprimoramentos específicos em escrita criativa, adesão à formatação JSON e interpretação de papéis. Esta versão do modelo é funcionalmente equivalente ao snapshot qwen-max-2025-01-25.

Provedor de service de inferência

O Alibaba Cloud Model Studio fornece o service de inferência para qwen-max.

Capacidades do modelo

  • China (Beijing)
  • Singapore

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Supported

Cache de contexto

Supported

Inferência em lote

Supported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

30720

Comprimento máximo de saída

8192

Janela de contexto

32768

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore

Item de faturamento

Preço (USD)

Unidade

Entrada

0.345

Por 1M tokens

Saída

1.377

Por 1M tokens

Entrada (cache implícito)

0.072

Por 1M tokens

Entrada (arquivo em lote)

0.172

Por 1M tokens

Saída (arquivo em lote)

0.688

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore

Parâmetro

Valor

RPM (solicitações por minuto)

1200

TPM (tokens por minuto)

1.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento