O Qwen-Plus é uma versão aprimorada do modelo de linguagem de grande escala Qwen que aceita vários idiomas de entrada, como chinês e inglês. Em comparação com as versões anteriores, apresenta melhorias significativas na geração de código em chinês e inglês, no raciocínio lógico e nas capacidades multilíngues. O estilo de resposta foi amplamente ajustado para se alinhar às preferências humanas, com avanços notáveis no nível de detalhe e na clareza. Também houve otimizações específicas para escrita criativa, aderência à formatação JSON e interpretação de papéis. Esta versão do modelo é funcionalmente equivalente ao modelo snapshot qwen-plus-2025-12-01-us.
Provedor de service de inferência
O Alibaba Cloud Model Studio fornece o service de inferência para qwen-plus-us.
Capacidades do modelo
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de entrada | Text | Modalidade de saída | Text |
Experiência do modelo | Supported | Function Calling | Unsupported |
Saídas estruturadas | Supported | Pesquisa na web | Unsupported |
Conclusão de prefixo | Supported | Cache de contexto | Supported |
Inferência em lote | Unsupported | Fine-tuning | Unsupported |
Limites de contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento máximo de entrada | 995.904 | Comprimento máximo de saída | 32.768 |
Janela de contexto | 1.000.000 | Comprimento máximo de entrada (Modo de Pensamento) | 995.904 |
Comprimento máximo de saída (Modo de Pensamento) | 32.768 | Comprimento máximo da cadeia de pensamento | 81.920 |
Preços
Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
- US (Virginia)
Input<=256k
Input<=256k
Item de faturamento | Preço (USD) | Unidade |
Input | 0,4 | Per 1M tokens |
Output | 1,2 | Per 1M tokens |
Input(Thinking) | 0,4 | Per 1M tokens |
Output(Thinking) | 4 | Per 1M tokens |
Input(Implicit Cache) | 0,08 | Per 1M tokens |
Input(Thinking Implicit Cache) | 0,08 | Per 1M tokens |
256k<Input<=1m
256k<Input<=1m
Item de faturamento | Preço (USD) | Unidade |
Input | 1,2 | Per 1M tokens |
Output | 3,6 | Per 1M tokens |
Input(Thinking) | 1,2 | Per 1M tokens |
Output(Thinking) | 12 | Per 1M tokens |
Input(Implicit Cache) | 0,24 | Per 1M tokens |
Input(Thinking Implicit Cache) | 0,24 | Per 1M tokens |
Limites de taxa
- US (Virginia)
Parâmetro | Valor |
RPM (Requests Per Minute) | 600 |
TPM (Tokens Per Minute) | 1.000.000 |
Versões snapshot
qwen-plus-2025-12-01-us
Esta versão é um snapshot de 1º de dezembro de 2025 e oferece capacidades de raciocínio aprimoradas em relação ao snapshot de 28 de julho. As funcionalidades de agente e a invocação de ferramentas em múltiplas rodadas foram ainda mais aperfeiçoadas, e o desempenho em tarefas criativas subjetivas melhorou significativamente. O modelo aceita comprimento de contexto de até 1 milhão de tokens, com precificação escalonada conforme o tamanho do contexto.
Provedor de service de inferência
O Alibaba Cloud Model Studio fornece o service de inferência para qwen-plus-2025-12-01-us.
Capacidades do modelo
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de entrada | Text | Modalidade de saída | Text |
Experiência do modelo | Unsupported | Function Calling | Unsupported |
Saídas estruturadas | Unsupported | Pesquisa na web | Unsupported |
Conclusão de prefixo | Unsupported | Cache de contexto | Unsupported |
Inferência em lote | Unsupported | Fine-tuning | Unsupported |
Limites de contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento máximo de entrada | 997.952 | Comprimento máximo de saída | 32.768 |
Janela de contexto | 1.000.000 | Comprimento máximo de entrada (Modo de Pensamento) | 995.904 |
Comprimento máximo de saída (Modo de Pensamento) | 32.768 |
Preços
Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
- US (Virginia)
Input<=256k
Input<=256k
Item de faturamento | Preço (USD) | Unidade |
Input | 0,4 | Per 1M tokens |
Output | 1,2 | Per 1M tokens |
Input(Thinking) | 0,4 | Per 1M tokens |
Output(Thinking) | 4 | Per 1M tokens |
256k<Input<=1m
256k<Input<=1m
Item de faturamento | Preço (USD) | Unidade |
Input | 1,2 | Per 1M tokens |
Output | 3,6 | Per 1M tokens |
Input(Thinking) | 1,2 | Per 1M tokens |
Output(Thinking) | 12 | Per 1M tokens |
Limites de taxa
- US (Virginia)
Parâmetro | Valor |
RPM (Requests Per Minute) | 600 |
TPM (Tokens Per Minute) | 1.000.000 |