O Qwen-Plus é uma versão aprimorada do modelo de linguagem ultra-grande Qwen, com suporte a múltiplos idiomas de entrada, como chinês e inglês. Em comparação com versões anteriores, apresenta melhorias significativas na geração de código em chinês e inglês, no raciocínio lógico e nas capacidades multilíngues. O estilo de resposta foi amplamente ajustado para se alinhar às preferências humanas, com avanços notáveis no nível de detalhe e na clareza das respostas. Também foram implementadas otimizações especializadas em escrita criativa, aderência à formatação JSON e habilidades de interpretação de papéis. Esta versão do modelo é funcionalmente equivalente ao modelo snapshot qwen-plus-2025-07-28.
Provedor de serviço de inferência
O provedor de serviço de inferência para qwen-plus é o Alibaba Cloud Model Studio.
Capacidades do modelo
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
- Hong Kong (China)
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de entrada | Text | Modalidade de saída | Text |
Experiência do modelo | Supported | Function Calling | Supported |
Saídas estruturadas | Supported | Pesquisa na web | Supported |
Conclusão de prefixo | Supported | Cache de contexto | Supported |
Inferência em lote | Supported | Fine-tuning | Unsupported |
Limites de contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento máximo de entrada | 997952 | Comprimento máximo de saída | 32768 |
Janela de contexto | 1000000 | Comprimento máximo de entrada (Modo de Pensamento) | 995904 |
Comprimento máximo de saída (Modo de Pensamento) | 32768 | Comprimento máximo da Cadeia de Pensamento | 81920 |
Preços
Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
- Hong Kong (China)
Input<=128k
Input<=128k
Item de faturamento | Preço (USD) | Unidade |
Entrada | 0.115 | Por 1M tokens |
Saída | 0.287 | Por 1M tokens |
Entrada (Pensamento) | 0.115 | Por 1M tokens |
Saída (Pensamento) | 1.147 | Por 1M tokens |
Entrada (Cache Implícito) | 0.023 | Por 1M tokens |
Entrada (Cache Implícito de Pensamento) | 0.023 | Por 1M tokens |
Saída de Pensamento (Arquivo em Lote) | 0.573 | Por 1M tokens |
Entrada (Arquivo em Lote) | 0.057 | Por 1M tokens |
Saída (Arquivo em Lote) | 0.143 | Por 1M tokens |
Entrada (Arquivo em Lote com Pensamento) | 0.057 | Por 1M tokens |
Criação de Cache Explícito | 0.144 | Por 1M tokens |
Leitura de Cache Explícito | 0.012 | Por 1M tokens |
Criação de Cache Explícito (Pensamento) | 0.144 | Por 1M tokens |
Leitura de Cache Explícito (Pensamento) | 0.012 | Por 1M tokens |
Entrada (Chat em Lote) | 0.115 | Por 1M tokens |
Saída (Chat em Lote) | 0.287 | Por 1M tokens |
Entrada (Chat em Lote no Modo de Pensamento) | 0.115 | Por 1M tokens |
Saída (Chat em Lote no Modo de Pensamento) | 1.147 | Por 1M tokens |
128k<Input<=256k
128k<Input<=256k
Item de faturamento | Preço (USD) | Unidade |
Entrada | 0.345 | Por 1M tokens |
Saída | 2.868 | Por 1M tokens |
Entrada (Pensamento) | 0.345 | Por 1M tokens |
Saída (Pensamento) | 3.441 | Por 1M tokens |
Entrada (Cache Implícito) | 0.069 | Por 1M tokens |
Entrada (Cache Implícito de Pensamento) | 0.069 | Por 1M tokens |
Saída de Pensamento (Arquivo em Lote) | 1.72 | Por 1M tokens |
Entrada (Arquivo em Lote) | 0.172 | Por 1M tokens |
Saída (Arquivo em Lote) | 1.434 | Por 1M tokens |
Entrada (Arquivo em Lote com Pensamento) | 0.172 | Por 1M tokens |
Criação de Cache Explícito | 0.431 | Por 1M tokens |
Leitura de Cache Explícito | 0.035 | Por 1M tokens |
Criação de Cache Explícito (Pensamento) | 0.431 | Por 1M tokens |
Leitura de Cache Explícito (Pensamento) | 0.035 | Por 1M tokens |
Entrada (Chat em Lote) | 0.345 | Por 1M tokens |
Saída (Chat em Lote) | 2.868 | Por 1M tokens |
Entrada (Chat em Lote no Modo de Pensamento) | 0.345 | Por 1M tokens |
Saída (Chat em Lote no Modo de Pensamento) | 3.441 | Por 1M tokens |
256k<Input<=1m
256k<Input<=1m
Item de faturamento | Preço (USD) | Unidade |
Entrada | 0.689 | Por 1M tokens |
Saída | 6.881 | Por 1M tokens |
Entrada (Pensamento) | 0.689 | Por 1M tokens |
Saída (Pensamento) | 9.175 | Por 1M tokens |
Entrada (Cache Implícito) | 0.138 | Por 1M tokens |
Entrada (Cache Implícito de Pensamento) | 0.138 | Por 1M tokens |
Saída de Pensamento (Arquivo em Lote) | 4.587 | Por 1M tokens |
Entrada (Arquivo em Lote) | 0.344 | Por 1M tokens |
Saída (Arquivo em Lote) | 3.44 | Por 1M tokens |
Entrada (Arquivo em Lote com Pensamento) | 0.344 | Por 1M tokens |
Criação de Cache Explícito | 0.861 | Por 1M tokens |
Leitura de Cache Explícito | 0.069 | Por 1M tokens |
Criação de Cache Explícito (Pensamento) | 0.861 | Por 1M tokens |
Leitura de Cache Explícito (Pensamento) | 0.069 | Por 1M tokens |
Entrada (Chat em Lote) | 0.689 | Por 1M tokens |
Saída (Chat em Lote) | 6.881 | Por 1M tokens |
Entrada (Chat em Lote no Modo de Pensamento) | 0.689 | Por 1M tokens |
Saída (Chat em Lote no Modo de Pensamento) | 9.175 | Por 1M tokens |
Limites de taxa
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
- Hong Kong (China)
Parâmetro | Valor |
RPM (Requisições por Minuto) | 30000 |
TPM (Tokens por Minuto) | 5,000,000 |
Atualizações dinâmicas
qwen-plus-latest
O modelo da série Qwen foi otimizado para oferecer desempenho equilibrado. Ele proporciona eficiência de inferência intermediária entre o Qwen-Max e o Qwen-Turbo, sendo projetado para lidar eficazmente com tarefas de complexidade moderada. Esta versão recebe atualizações dinâmicas sem aviso prévio.
Provedor do service de inferência
O provedor do service de inferência para qwen-plus-latest é o Alibaba Cloud Model Studio.
Capacidades do modelo
- China (Beijing)
- Singapore
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de entrada | Text | Modalidade de saída | Text |
Experiência do modelo | Supported | Function Calling | Supported |
Saídas estruturadas | Supported | Pesquisa na web | Supported |
Conclusão de prefixo | Supported | Cache de contexto | Unsupported |
Inferência em lote | Supported | Fine-tuning | Unsupported |
Limites de contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento máximo de entrada | 995904 | Comprimento máximo de saída | 32768 |
Janela de contexto | 1000000 |
Preços
Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
- China (Beijing)
- Singapore
Input<=128k
Input<=128k
Item de faturamento | Preço (USD) | Unidade |
Input | 0.115 | Per 1M tokens |
Output | 0.287 | Per 1M tokens |
Input(Thinking) | 0.115 | Per 1M tokens |
Output(Thinking) | 1.147 | Per 1M tokens |
Thinking Output(Batch File) | 0.573 | Per 1M tokens |
Input(Batch File) | 0.057 | Per 1M tokens |
Output(Batch File) | 0.143 | Per 1M tokens |
Input(Thinking Batch File) | 0.057 | Per 1M tokens |
128k<Input<=256k
128k<Input<=256k
Item de faturamento | Preço (USD) | Unidade |
Input | 0.345 | Per 1M tokens |
Output | 2.868 | Per 1M tokens |
Input(Thinking) | 0.345 | Per 1M tokens |
Output(Thinking) | 3.441 | Per 1M tokens |
Thinking Output(Batch File) | 1.72 | Per 1M tokens |
Input(Batch File) | 0.172 | Per 1M tokens |
Output(Batch File) | 1.434 | Per 1M tokens |
Input(Thinking Batch File) | 0.172 | Per 1M tokens |
256k<Input<=1m
256k<Input<=1m
Item de faturamento | Preço (USD) | Unidade |
Input | 0.689 | Per 1M tokens |
Output | 6.881 | Per 1M tokens |
Input(Thinking) | 0.689 | Per 1M tokens |
Output(Thinking) | 9.175 | Per 1M tokens |
Thinking Output(Batch File) | 4.587 | Per 1M tokens |
Input(Batch File) | 0.344 | Per 1M tokens |
Output(Batch File) | 3.44 | Per 1M tokens |
Input(Thinking Batch File) | 0.344 | Per 1M tokens |
Limites de taxa
- China (Beijing)
- Singapore
Parâmetro | Valor |
RPM (Requests Per Minute) | 15000 |
TPM (Tokens Per Minute) | 1,200,000 |
Versões snapshot
qwen-plus-2025-12-01
Esta versão é um snapshot de 1º de dezembro de 2025 e apresenta capacidades de raciocínio aprimoradas em relação ao snapshot de 28 de julho. As funcionalidades de agente e a invocação de ferramentas em múltiplas turnos foram melhoradas, além de uma melhoria significativa no desempenho em tarefas criativas subjetivas. O modelo suporta comprimento de contexto de até 1 milhão de tokens, com preços escalonados conforme o tamanho do contexto.
Provedor do service de inferência
O provedor do service de inferência para qwen-plus-2025-12-01 é o Alibaba Cloud Model Studio.
Capacidades do modelo
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
- Hong Kong (China)
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de entrada | Text | Modalidade de saída | Text |
Experiência do modelo | Supported | Function Calling | Supported |
Saídas estruturadas | Supported | Pesquisa na web | Supported |
Conclusão de prefixo | Supported | Cache de contexto | Unsupported |
Inferência em lote | Unsupported | Fine-tuning | Unsupported |
Limites de contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento máximo de entrada | 997952 | Comprimento máximo de saída | 32768 |
Janela de contexto | 1000000 | Comprimento máximo de entrada (Modo Thinking) | 995904 |
Comprimento máximo de saída (Modo Thinking) | 32768 |
Preços
Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
- Hong Kong (China)
Input<=128k
Input<=128k
Item de faturamento | Preço (USD) | Unidade |
Input | 0.115 | Per 1M tokens |
Output | 0.287 | Per 1M tokens |
Input(Thinking) | 0.115 | Per 1M tokens |
Output(Thinking) | 1.147 | Per 1M tokens |
128k<Input<=256k
128k<Input<=256k
Item de faturamento | Preço (USD) | Unidade |
Input | 0.345 | Per 1M tokens |
Output | 2.868 | Per 1M tokens |
Input(Thinking) | 0.345 | Per 1M tokens |
Output(Thinking) | 3.441 | Per 1M tokens |
256k<Input<=1m
256k<Input<=1m
Item de faturamento | Preço (USD) | Unidade |
Input | 0.689 | Per 1M tokens |
Output | 6.881 | Per 1M tokens |
Input(Thinking) | 0.689 | Per 1M tokens |
Output(Thinking) | 9.175 | Per 1M tokens |
Limites de taxa
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
- Hong Kong (China)
Parâmetro | Valor |
RPM (Requests Per Minute) | 120 |
TPM (Tokens Per Minute) | 1,000,000 |
qwen-plus-2025-09-11
No snapshot de 11 de setembro de 2025, esta versão apresenta melhorias no seguimento de instruções e respostas de resumo mais concisas no modo de pensamento. O modo sem pensamento oferece compreensão superior de texto em chinês e capacidades aprimoradas de raciocínio lógico. O modelo suporta comprimento de contexto de 1M com preços escalonados.
Provedor de service de inferência
O provedor de service de inferência para qwen-plus-2025-09-11 é o Alibaba Cloud Model Studio.
Capacidades do modelo
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de entrada | Text | Modalidade de saída | Text |
Experiência do modelo | Unsupported | Function Calling | Unsupported |
Saídas estruturadas | Unsupported | Pesquisa na web | Unsupported |
Conclusão de prefixo | Unsupported | Cache de contexto | Unsupported |
Inferência em lote | Unsupported | Fine-tuning | Unsupported |
Limites de contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento máximo de entrada | 995904 | Comprimento máximo de saída | 32768 |
Janela de contexto | 1000000 |
Preços
Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
Input<=128k
Input<=128k
Item de faturamento | Preço (USD) | Unidade |
Input | 0.115 | Por 1M tokens |
Output | 0.287 | Por 1M tokens |
Input(Thinking) | 0.115 | Por 1M tokens |
Output(Thinking) | 1.147 | Por 1M tokens |
128k<Input<=256k
128k<Input<=256k
Item de faturamento | Preço (USD) | Unidade |
Input | 0.345 | Por 1M tokens |
Output | 2.868 | Por 1M tokens |
Input(Thinking) | 0.345 | Por 1M tokens |
Output(Thinking) | 3.441 | Por 1M tokens |
256k<Input<=1m
256k<Input<=1m
Item de faturamento | Preço (USD) | Unidade |
Input | 0.689 | Por 1M tokens |
Output | 6.881 | Por 1M tokens |
Input(Thinking) | 0.689 | Por 1M tokens |
Output(Thinking) | 9.175 | Por 1M tokens |
Limites de taxa
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
Parâmetro | Valor |
RPM (Requests Per Minute) | 60 |
TPM (Tokens Per Minute) | 1,000,000 |
qwen-plus-2025-07-28
Modelo Plus da série Qwen3 que integra modos de pensamento e sem pensamento, permitindo alternar entre eles durante o diálogo. Em comparação à versão anterior, inclui melhorias dedicadas para capacidades em chinês e inglês, além de chamadas de ferramentas. Este snapshot de 28 de julho de 2025 é o primeiro a suportar comprimento de contexto de 1M e utiliza preços escalonados.
Provedor de service de inferência
O provedor de service de inferência para qwen-plus-2025-07-28 é o Alibaba Cloud Model Studio.
Capacidades do modelo
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de entrada | Text | Modalidade de saída | Text |
Experiência do modelo | Supported | Function Calling | Supported |
Saídas estruturadas | Supported | Pesquisa na web | Supported |
Conclusão de prefixo | Supported | Cache de contexto | Unsupported |
Inferência em lote | Unsupported | Fine-tuning | Unsupported |
Limites de contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento máximo de entrada | 995904 | Comprimento máximo de saída | 32768 |
Janela de contexto | 1000000 |
Preços
Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
Input<=128k
Input<=128k
Item de faturamento | Preço (USD) | Unidade |
Input | 0.115 | Por 1M tokens |
Output | 0.287 | Por 1M tokens |
Input(Thinking) | 0.115 | Por 1M tokens |
Output(Thinking) | 1.147 | Por 1M tokens |
128k<Input<=256k
128k<Input<=256k
Item de faturamento | Preço (USD) | Unidade |
Input | 0.345 | Por 1M tokens |
Output | 2.868 | Por 1M tokens |
Input(Thinking) | 0.345 | Por 1M tokens |
Output(Thinking) | 3.441 | Por 1M tokens |
256k<Input<=1m
256k<Input<=1m
Item de faturamento | Preço (USD) | Unidade |
Input | 0.689 | Por 1M tokens |
Output | 6.881 | Por 1M tokens |
Input(Thinking) | 0.689 | Por 1M tokens |
Output(Thinking) | 9.175 | Por 1M tokens |
Limites de Taxa
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
Parâmetro | Valor |
RPM (Requisições Por Minuto) | 60 |
TPM (Tokens Por Minuto) | 1.000.000 |
qwen-plus-2025-07-14
O modelo Plus da Série Qwen3 integra eficazmente os modos de pensamento e não-pensamento, permitindo a alternância entre eles durante as conversas. Esta versão é um snapshot de 14 de julho de 2025. Em comparação à versão anterior, houve melhorias significativas nas capacidades em chinês e inglês no modo de não-pensamento, além de habilidades aprimoradas para chamada de ferramentas.
Provedor de Serviço de Inferência
O provedor de serviço de inferência para qwen-plus-2025-07-14 é o Alibaba Cloud Model Studio.
Capacidades do Modelo
- China (Beijing)
- Singapore
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de Entrada | Text | Modalidade de Saída | Text |
Experiência do Modelo | Supported | Function Calling | Supported |
Saídas Estruturadas | Supported | Busca na Web | Supported |
Conclusão de Prefixo | Supported | Cache de Contexto | Unsupported |
Inferência em Lote | Unsupported | Fine-tuning | Unsupported |
Limites de Contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento Máximo de Entrada | 98304 | Comprimento Máximo de Saída | 16384 |
Janela de Contexto | 131072 |
Preços
Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para conferir ofertas promocionais.
- China (Beijing)
- Singapore
Item de Faturamento | Preço (USD) | Unidade |
Entrada | 0,115 | Por 1M tokens |
Saída | 0,287 | Por 1M tokens |
Entrada (Pensamento) | 0,115 | Por 1M tokens |
Saída (Pensamento) | 1,147 | Por 1M tokens |
Limites de Taxa
- China (Beijing)
- Singapore
Parâmetro | Valor |
RPM (Requisições Por Minuto) | 60 |
TPM (Tokens Por Minuto) | 100.000 |
qwen-plus-2025-04-28
O modelo Plus da série Qwen3 integra eficazmente os modos de pensamento e não-pensamento, permitindo alternar entre eles durante as conversas. Suas capacidades de raciocínio superam significativamente as do QwQ, e suas capacidades gerais excedem notavelmente as do Qwen2.5-Plus, atingindo o nível SOTA na mesma escala dentro da indústria. Este modelo corresponde ao snapshot de 28 de abril de 2025.
Provedor de Serviço de Inferência
O provedor de serviço de inferência para qwen-plus-2025-04-28 é o Alibaba Cloud Model Studio.
Capacidades do Modelo
- China (Beijing)
- Singapore
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de Entrada | Text | Modalidade de Saída | Text |
Experiência do Modelo | Supported | Function Calling | Supported |
Saídas Estruturadas | Supported | Busca na Web | Unsupported |
Conclusão de Prefixo | Supported | Cache de Contexto | Unsupported |
Inferência em Lote | Unsupported | Fine-tuning | Unsupported |
Limites de Contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento Máximo de Entrada | 98304 | Comprimento Máximo de Saída | 16384 |
Janela de Contexto | 131072 |
Preços
Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para conferir ofertas promocionais.
- China (Beijing)
- Singapore
Item de Faturamento | Preço (USD) | Unidade |
Entrada | 0,115 | Por 1M tokens |
Saída | 0,287 | Por 1M tokens |
Entrada (Pensamento) | 0,115 | Por 1M tokens |
Saída (Pensamento) | 1,147 | Por 1M tokens |
Limites de Taxa
- China (Beijing)
- Singapore
Parâmetro | Valor |
RPM (Requisições Por Minuto) | 60 |
TPM (Tokens Por Minuto) | 1.000.000 |
qwen-plus-2025-01-25
Os modelos da série Qwen apresentam capacidades equilibradas, oferecendo desempenho e velocidade de raciocínio intermediários entre o Qwen-Max e o Qwen-Turbo, sendo adequados para tarefas de complexidade moderada. Em relação às versões anteriores, há melhorias significativas na geração de código em chinês e inglês, no raciocínio lógico e nas habilidades multilíngues. O estilo de resposta foi amplamente ajustado para alinhar-se às preferências humanas, com aprimoramentos notáveis no nível de detalhe e na clareza das respostas. Também foram implementadas melhorias especializadas em escrita criativa, adesão à formatação JSON e capacidades de interpretação de papéis.
Provedor de Serviço de Inferência
O provedor de serviço de inferência para qwen-plus-2025-01-25 é o Alibaba Cloud Model Studio.
Capacidades do Modelo
- China (Beijing)
- Singapore
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de Entrada | Text | Modalidade de Saída | Text |
Experiência do Modelo | Supported | Function Calling | Supported |
Saídas Estruturadas | Supported | Busca na Web | Unsupported |
Conclusão de Prefixo | Supported | Cache de Contexto | Unsupported |
Inferência em Lote | Unsupported | Fine-tuning | Unsupported |
Limites de Contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento Máximo de Entrada | 129024 | Comprimento Máximo de Saída | 8192 |
Janela de Contexto | 131072 |
Preços
Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para conferir ofertas promocionais.
- China (Beijing)
- Singapore
Item de Faturamento | Preço (USD) | Unidade |
Entrada | 0,115 | Por 1M tokens |
Saída | 0,287 | Por 1M tokens |
Limites de Taxa
- China (Beijing)
- Singapore
Parâmetro | Valor |
RPM (Requisições Por Minuto) | 60 |
TPM (Tokens Por Minuto) | 150.000 |
qwen-plus-0112
, -Max-Turbo, .-Plus-2024-1220, , , , codeswtich, .
Provedor de Serviço de Inferência
O provedor de serviço de inferência para qwen-plus-0112 é o Alibaba Cloud Model Studio.
Capacidades do Modelo
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de Entrada | Text | Modalidade de Saída | Text |
Experiência do Modelo | Supported | Function Calling | Unsupported |
Saídas Estruturadas | Unsupported | Busca na Web | Unsupported |
Conclusão de Prefixo | Unsupported | Cache de Contexto | Unsupported |
Inferência em Lote | Unsupported | Fine-tuning | Unsupported |
Limites de Contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento Máximo de Entrada | 129024 | Comprimento Máximo de Saída | 8192 |
Janela de Contexto | 131072 |
Preços
Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para conferir ofertas promocionais.
- China (Beijing)
Item de Faturamento | Preço (USD) | Unidade |
Entrada | 0,115 | Por 1M tokens |
Saída | 0,287 | Por 1M tokens |
Limites de Taxa
- China (Beijing)
Parâmetro | Valor |
RPM (Requisições Por Minuto) | 60 |
TPM (Tokens Por Minuto) | 150.000 |
qwen-plus-1220
, -Max-Turbo, .-Plus-1125, , , , codeswtich, .
Provedor de Serviço de Inferência
O provedor de serviço de inferência para qwen-plus-1220 é o Alibaba Cloud Model Studio.
Capacidades do Modelo
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de Entrada | Text | Modalidade de Saída | Text |
Experiência do Modelo | Supported | Function Calling | Unsupported |
Saídas Estruturadas | Unsupported | Busca na Web | Unsupported |
Conclusão de Prefixo | Unsupported | Cache de Contexto | Unsupported |
Inferência em Lote | Unsupported | Fine-tuning | Unsupported |
Limites de Contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento Máximo de Entrada | 129024 | Comprimento Máximo de Saída | 8192 |
Janela de Contexto | 131072 |
Preços
Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para conferir ofertas promocionais.
- China (Beijing)
Item de Faturamento | Preço (USD) | Unidade |
Entrada | 0,115 | Por 1M tokens |
Saída | 0,287 | Por 1M tokens |
Limites de Taxa
- China (Beijing)
Parâmetro | Valor |
RPM (Requisições Por Minuto) | 60 |
TPM (Tokens Por Minuto) | 150.000 |