O Qwen-MT-Flash é um modelo de linguagem grande da série Qwen, totalmente atualizado com a arquitetura Qwen 3 para oferecer desempenho e qualidade de tradução significativamente aprimorados. Ele fornece tradução rápida e econômica em 92 idiomas, além de suportar recursos avançados como intervenção de terminologia, preservação de formatação e adaptação a domínios específicos. É a escolha ideal para aplicações que exigem equilíbrio eficiente entre velocidade, qualidade e custo.
Provedor do service de inferência
O provedor do service de inferência para qwen-mt-flash é o Alibaba Cloud Model Studio.
Capacidades do modelo
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de entrada | Text | Modalidade de saída | Text |
Experiência do modelo | Supported | Function Calling | Unsupported |
Saídas estruturadas | Unsupported | Pesquisa na web | Unsupported |
Conclusão de prefixo | Unsupported | Cache de contexto | Unsupported |
Inferência em lote | Unsupported | Ajuste fino | Unsupported |
Limites de contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento máximo de entrada | 8192 | Comprimento máximo de saída | 8192 |
Janela de contexto | 16384 |
Preços
Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
Item de faturamento | Preço (USD) | Unidade |
Entrada | 0,101 | Por 1 milhão de tokens |
Saída | 0,28 | Por 1 milhão de tokens |
Limites de taxa
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
Parâmetro | Valor |
RPM (Requisições por minuto) | 60 |
TPM (Tokens por minuto) | 35.000 |