Skip to main content
Geração de Texto

qwq-plus

A versão aprimorada do modelo de raciocínio Qwen QwQ, treinada com base no modelo Qwen2.5, teve suas capacidades de raciocínio significativamente melhoradas por meio de aprendizado por reforço. As principais métricas do modelo em matemática e programação (como AIME 24/25 e LiveCodeBench), além de algumas métricas gerais (como IFEval e LiveBench), atingiram o mesmo nível da versão completa do DeepSeek-R1.

Provedor de service de inferência

O Alibaba Cloud Model Studio é o provedor de service de inferência para qwq-plus.

Capacidades do modelo

  • China (Beijing)
  • Singapore

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Unsupported

Busca na web

Supported

Conclusão de prefixo

Unsupported

Cache de contexto

Unsupported

Inferência em lote

Supported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

98.304

Comprimento máximo de saída

8.192

Janela de contexto

131.072

Preços

Esta página exibe apenas os preços originais das chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore

Item de faturamento

Preço (USD)

Unidade

Entrada

0,23

Por 1 milhão de tokens

Saída

0,574

Por 1 milhão de tokens

Entrada (arquivo em lote)

0,115

Por 1 milhão de tokens

Saída (arquivo em lote)

0,287

Por 1 milhão de tokens

Limites de taxa

  • China (Beijing)
  • Singapore

Parâmetro

Valor

RPM (solicitações por minuto)

600

TPM (tokens por minuto)

1.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento