O Qwen-Max conta com uma escala de parâmetros na casa das centenas de bilhões e aceita diversos idiomas de entrada, como chinês e inglês. O modelo recebe atualizações contínuas. Em comparação com versões anteriores, apresenta melhorias significativas na geração de código em chinês e inglês, no raciocínio lógico e nas capacidades multilíngues. O estilo de resposta passou por amplos ajustes para se alinhar às preferências humanas, com avanços notáveis no nível de detalhe e na clareza. Além disso, houve aprimoramentos específicos em escrita criativa, adesão à formatação JSON e interpretação de papéis. Esta versão do modelo é funcionalmente equivalente ao snapshot qwen-max-2025-01-25.
Provedor de service de inferência
O Alibaba Cloud Model Studio fornece o service de inferência para qwen-max.
Capacidades do modelo
- China (Beijing)
- Singapore
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de entrada | Text | Modalidade de saída | Text |
Experiência do modelo | Supported | Function Calling | Supported |
Saídas estruturadas | Supported | Pesquisa na web | Supported |
Conclusão de prefixo | Supported | Cache de contexto | Supported |
Inferência em lote | Supported | Fine-tuning | Unsupported |
Limites de contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento máximo de entrada | 30720 | Comprimento máximo de saída | 8192 |
Janela de contexto | 32768 |
Preços
Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
- China (Beijing)
- Singapore
Item de faturamento | Preço (USD) | Unidade |
Entrada | 0.345 | Por 1M tokens |
Saída | 1.377 | Por 1M tokens |
Entrada (cache implícito) | 0.072 | Por 1M tokens |
Entrada (arquivo em lote) | 0.172 | Por 1M tokens |
Saída (arquivo em lote) | 0.688 | Por 1M tokens |
Limites de taxa
- China (Beijing)
- Singapore
Parâmetro | Valor |
RPM (solicitações por minuto) | 1200 |
TPM (tokens por minuto) | 1.000.000 |