Skip to main content
Geração de Texto

qwen3.5-397b-a17b

O modelo nativo de visão e linguagem Qwen3.5 série 397B-A17B baseia-se em uma arquitetura híbrida que integra um mecanismo de atenção linear a um modelo de mistura esparsa de especialistas, o que garante maior eficiência na inferência. Ele oferece desempenho de última geração, comparável aos modelos mais avançados em diversas tarefas, como compreensão de linguagem, raciocínio lógico, geração de código, tarefas baseadas em agentes, compreensão de imagens e vídeos e interações com interface gráfica do usuário (GUI). Com suas capacidades robustas de geração de código e atuação como agente, o modelo apresenta forte generalização em cenários variados de agentes.

Provedor de service de inferência

O provedor de service de inferência para qwen3.5-397b-a17b é o Alibaba Cloud Model Studio.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text Image Video

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Supported

Cache de contexto

Unsupported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

260.096

Comprimento máximo de saída

65.536

Janela de contexto

262.144

Comprimento máximo de entrada (Modo de Pensamento)

258.048

Comprimento máximo de saída (Modo de Pensamento)

65.536

Comprimento máximo da cadeia de pensamento

81.920

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Item de faturamento

Preço (USD)

Unidade

Entrada

0,172

Por 1M tokens

Saída

1,032

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0,43

Por 1M tokens

Saída

2,58

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Parâmetro

Valor

RPM (Requisições por minuto)

600

TPM (Tokens por minuto)

1.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento