O modelo nativo de visão e linguagem Qwen3.5 série 397B-A17B baseia-se em uma arquitetura híbrida que integra um mecanismo de atenção linear a um modelo de mistura esparsa de especialistas, o que garante maior eficiência na inferência. Ele oferece desempenho de última geração, comparável aos modelos mais avançados em diversas tarefas, como compreensão de linguagem, raciocínio lógico, geração de código, tarefas baseadas em agentes, compreensão de imagens e vídeos e interações com interface gráfica do usuário (GUI). Com suas capacidades robustas de geração de código e atuação como agente, o modelo apresenta forte generalização em cenários variados de agentes.
Provedor de service de inferência
O provedor de service de inferência para qwen3.5-397b-a17b é o Alibaba Cloud Model Studio.
Capacidades do modelo
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de entrada | Text Image Video | Modalidade de saída | Text |
Experiência do modelo | Supported | Function Calling | Supported |
Saídas estruturadas | Supported | Pesquisa na web | Supported |
Conclusão de prefixo | Supported | Cache de contexto | Unsupported |
Inferência em lote | Unsupported | Fine-tuning | Unsupported |
Limites de contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento máximo de entrada | 260.096 | Comprimento máximo de saída | 65.536 |
Janela de contexto | 262.144 | Comprimento máximo de entrada (Modo de Pensamento) | 258.048 |
Comprimento máximo de saída (Modo de Pensamento) | 65.536 | Comprimento máximo da cadeia de pensamento | 81.920 |
Preços
Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
Input<=128k
Input<=128k
Item de faturamento | Preço (USD) | Unidade |
Entrada | 0,172 | Por 1M tokens |
Saída | 1,032 | Por 1M tokens |
128k<Input<=256k
128k<Input<=256k
Item de faturamento | Preço (USD) | Unidade |
Entrada | 0,43 | Por 1M tokens |
Saída | 2,58 | Por 1M tokens |
Limites de taxa
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
Parâmetro | Valor |
RPM (Requisições por minuto) | 600 |
TPM (Tokens por minuto) | 1.000.000 |