A Série de Modelos de Interpretação de Papéis Qwen é otimizada especificamente para cenários de interação antropomórfica multilíngue. O modelo apresenta capacidades avançadas na manutenção da consistência do personagem, na progressão de diálogos contextualizados e no engajamento empático, o que permite uma personificação personalizada e precisa. Esta versão aprimora significativamente a localização linguística para o japonês (incluindo dialetos e honoríficos), a autenticidade humana na interpretação de papéis, o controle de coerência narrativa e a inteligência cognitiva baseada em cenários.
Provedor de service de Inferência
O Alibaba Cloud Model Studio fornece o service de inferência para qwen-flash-character.
Capacidades do Modelo
- China (Beijing)
- Singapore
- US (Virginia)
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de Entrada | Text | Modalidade de Saída | Text |
Experiência do Modelo | Supported | Function Calling | Unsupported |
Saídas Estruturadas | Supported | Pesquisa na Web | Supported |
Conclusão de Prefixo | Unsupported | Cache de Contexto | Supported |
Inferência em Lote | Unsupported | Ajuste Fino | Unsupported |
Limites de Contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento Máximo de Entrada | 32,768 | Comprimento Máximo de Saída | 32,768 |
Janela de Contexto | 32,768 |
Preços
Esta página exibe apenas os preços originais das chamadas de API do modelo e não inclui promoções por tempo limitado. Acesse o Console do Model Studio para conferir ofertas promocionais.
- China (Beijing)
- Singapore
- US (Virginia)
Item de Faturamento | Preço (USD) | Unidade |
Entrada | 0,034 | Por 1M tokens |
Saída | 0,203 | Por 1M tokens |
Entrada (Cache Implícito) | 0,007 | Por 1M tokens |
Limites de Taxa
- China (Beijing)
- Singapore
- US (Virginia)
Parâmetro | Valor |
RPM (Requisições Por Minuto) | 120 |
TPM (Tokens Por Minuto) | 500.000 |