Skip to main content
Geração de Texto

qwen3.7-max-us

O modelo Max, o maior e mais avançado da série Qwen3.7, oferece atualmente uma interface exclusivamente textual para experimentação pública. O Qwen3.7 é um modelo principal de última geração, projetado para a era centrada em agentes. Seus principais pontos fortes residem na amplitude e na profundidade das capacidades no nível de agente: destaca-se em programação, tarefas de escritório e produtividade, além de execução autônoma de longo prazo.

Provedor de service de inferência

O provedor de service de inferência para qwen3.7-max-us é o Alibaba Cloud Model Studio.

Capacidades do modelo

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Busca na web

Unsupported

Conclusão de prefixo

Supported

Cache de contexto

Supported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

991.808

Comprimento máximo de saída

131.072

Janela de contexto

1.000.000

Comprimento máximo de entrada (Modo de raciocínio)

983.616

Comprimento máximo de saída (Modo de raciocínio)

131.072

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
  • US (Virginia)
Escopo: US

Item de faturamento

Preço (USD)

Unidade

Entrada

2,5

Por 1M tokens

Saída

7,5

Por 1M tokens

Entrada (cache implícito)

0,5

Por 1M tokens

Criação de cache explícito

3.125

Por 1M tokens

Leitura de cache explícito

0,25

Por 1M tokens

Limites de taxa

  • US (Virginia)
Escopo: US

Parâmetro

Valor

RPM (solicitações por minuto)

600

TPM (tokens por minuto)

1.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento