Skip to main content
Geração de Texto

qwen-plus-us

O Qwen-Plus é uma versão aprimorada do modelo de linguagem de grande escala Qwen que aceita vários idiomas de entrada, como chinês e inglês. Em comparação com as versões anteriores, apresenta melhorias significativas na geração de código em chinês e inglês, no raciocínio lógico e nas capacidades multilíngues. O estilo de resposta foi amplamente ajustado para se alinhar às preferências humanas, com avanços notáveis no nível de detalhe e na clareza. Também houve otimizações específicas para escrita criativa, aderência à formatação JSON e interpretação de papéis. Esta versão do modelo é funcionalmente equivalente ao modelo snapshot qwen-plus-2025-12-01-us.

Provedor de service de inferência

O Alibaba Cloud Model Studio fornece o service de inferência para qwen-plus-us.

Capacidades do modelo

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Unsupported

Saídas estruturadas

Supported

Pesquisa na web

Unsupported

Conclusão de prefixo

Supported

Cache de contexto

Supported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

995.904

Comprimento máximo de saída

32.768

Janela de contexto

1.000.000

Comprimento máximo de entrada (Modo de Pensamento)

995.904

Comprimento máximo de saída (Modo de Pensamento)

32.768

Comprimento máximo da cadeia de pensamento

81.920

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • US (Virginia)
Escopo: US

Item de faturamento

Preço (USD)

Unidade

Input

0,4

Per 1M tokens

Output

1,2

Per 1M tokens

Input(Thinking)

0,4

Per 1M tokens

Output(Thinking)

4

Per 1M tokens

Input(Implicit Cache)

0,08

Per 1M tokens

Input(Thinking Implicit Cache)

0,08

Per 1M tokens

Item de faturamento

Preço (USD)

Unidade

Input

1,2

Per 1M tokens

Output

3,6

Per 1M tokens

Input(Thinking)

1,2

Per 1M tokens

Output(Thinking)

12

Per 1M tokens

Input(Implicit Cache)

0,24

Per 1M tokens

Input(Thinking Implicit Cache)

0,24

Per 1M tokens

Limites de taxa

  • US (Virginia)
Escopo: US

Parâmetro

Valor

RPM (Requests Per Minute)

600

TPM (Tokens Per Minute)

1.000.000

Versões snapshot

qwen-plus-2025-12-01-us

Esta versão é um snapshot de 1º de dezembro de 2025 e oferece capacidades de raciocínio aprimoradas em relação ao snapshot de 28 de julho. As funcionalidades de agente e a invocação de ferramentas em múltiplas rodadas foram ainda mais aperfeiçoadas, e o desempenho em tarefas criativas subjetivas melhorou significativamente. O modelo aceita comprimento de contexto de até 1 milhão de tokens, com precificação escalonada conforme o tamanho do contexto.

Provedor de service de inferência

O Alibaba Cloud Model Studio fornece o service de inferência para qwen-plus-2025-12-01-us.

Capacidades do modelo

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Unsupported

Function Calling

Unsupported

Saídas estruturadas

Unsupported

Pesquisa na web

Unsupported

Conclusão de prefixo

Unsupported

Cache de contexto

Unsupported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

997.952

Comprimento máximo de saída

32.768

Janela de contexto

1.000.000

Comprimento máximo de entrada (Modo de Pensamento)

995.904

Comprimento máximo de saída (Modo de Pensamento)

32.768

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • US (Virginia)
Escopo: US

Item de faturamento

Preço (USD)

Unidade

Input

0,4

Per 1M tokens

Output

1,2

Per 1M tokens

Input(Thinking)

0,4

Per 1M tokens

Output(Thinking)

4

Per 1M tokens

Item de faturamento

Preço (USD)

Unidade

Input

1,2

Per 1M tokens

Output

3,6

Per 1M tokens

Input(Thinking)

1,2

Per 1M tokens

Output(Thinking)

12

Per 1M tokens

Limites de taxa

  • US (Virginia)
Escopo: US

Parâmetro

Valor

RPM (Requests Per Minute)

600

TPM (Tokens Per Minute)

1.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento