A versão aprimorada do modelo de raciocínio Qwen QwQ, treinada com base no modelo Qwen2.5, teve suas capacidades de raciocínio significativamente melhoradas por meio de aprendizado por reforço. As principais métricas do modelo em matemática e programação (como AIME 24/25 e LiveCodeBench), além de algumas métricas gerais (como IFEval e LiveBench), atingiram o mesmo nível da versão completa do DeepSeek-R1.
Provedor de service de inferência
O Alibaba Cloud Model Studio é o provedor de service de inferência para qwq-plus.
Capacidades do modelo
- China (Beijing)
- Singapore
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de entrada | Text | Modalidade de saída | Text |
Experiência do modelo | Supported | Function Calling | Supported |
Saídas estruturadas | Unsupported | Busca na web | Supported |
Conclusão de prefixo | Unsupported | Cache de contexto | Unsupported |
Inferência em lote | Supported | Fine-tuning | Unsupported |
Limites de contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento máximo de entrada | 98.304 | Comprimento máximo de saída | 8.192 |
Janela de contexto | 131.072 |
Preços
Esta página exibe apenas os preços originais das chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
- China (Beijing)
- Singapore
Item de faturamento | Preço (USD) | Unidade |
Entrada | 0,23 | Por 1 milhão de tokens |
Saída | 0,574 | Por 1 milhão de tokens |
Entrada (arquivo em lote) | 0,115 | Por 1 milhão de tokens |
Saída (arquivo em lote) | 0,287 | Por 1 milhão de tokens |
Limites de taxa
- China (Beijing)
- Singapore
Parâmetro | Valor |
RPM (solicitações por minuto) | 600 |
TPM (tokens por minuto) | 1.000.000 |