Skip to main content
Geração de Texto

qwen3.7-max

O modelo Max, o maior e mais capaz da série Qwen3.7, oferece atualmente uma interface exclusivamente textual para experimentação pública. O Qwen3.7 é um modelo principal de última geração, projetado para a era centrada em agentes. Seus principais pontos fortes residem na amplitude e profundidade de suas capacidades no nível de agente: ele se destaca em programação, tarefas de escritório e produtividade, além de execução autônoma de longo prazo. Esta versão do modelo é funcionalmente equivalente ao modelo snapshot qwen3.7-max-2026-05-20.

Provedor de service de inferência

O Alibaba Cloud Model Studio é o provedor de service de inferência para qwen3.7-max.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Supported

Cache de contexto

Supported

Inferência em lote

Supported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

991808

Comprimento máximo de saída

131072

Janela de contexto

1000000

Comprimento máximo de entrada (Modo de raciocínio)

983616

Comprimento máximo de saída (Modo de raciocínio)

131072

Comprimento máximo da cadeia de pensamento

262144

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para conferir ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Item de faturamento

Preço (USD)

Unidade

Entrada

1,65

Por 1M tokens

Saída

4,951

Por 1M tokens

Entrada (Cache implícito)

0,33

Por 1M tokens

Entrada (Arquivo em lote)

0,825

Por 1M tokens

Saída (Arquivo em lote)

2,475

Por 1M tokens

Criação de cache explícito

2,063

Por 1M tokens

Leitura de cache explícito

0,165

Por 1M tokens

Entrada (Chat em lote)

1,65

Por 1M tokens

Saída (Chat em lote)

4,951

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Parâmetro

Valor

RPM (Requisições por minuto)

30000

TPM (Tokens por minuto)

5.000.000

Versões snapshot

qwen3.7-max-preview

O modelo Max, a variante maior e mais capaz da série Qwen3.7, está disponível como preview e suporta apenas o modo de raciocínio, oferecendo uma interface exclusivamente textual para experimentação. Ele é otimizado principalmente para casos de uso conversacional de propósito geral, como perguntas e respostas baseadas em conhecimento, seguimento de instruções e escrita criativa.

Provedor de service de inferência

O Alibaba Cloud Model Studio é o provedor de service de inferência para qwen3.7-max-preview.

Capacidades do modelo

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Supported

Cache de contexto

Unsupported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

991808

Comprimento máximo de saída

131072

Janela de contexto

1000000

Comprimento máximo de entrada (Modo de raciocínio)

983616

Comprimento máximo de saída (Modo de raciocínio)

131072

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para conferir ofertas promocionais.
  • Singapore
Escopo: Internacional

Item de faturamento

Preço (USD)

Unidade

Entrada

2,5

Por 1M tokens

Saída

7,5

Por 1M tokens

Limites de taxa

  • Singapore
Escopo: Internacional

Parâmetro

Valor

RPM (Requisições por minuto)

600

TPM (Tokens por minuto)

1.000.000

qwen3.7-max-2026-06-08

Em comparação ao snapshot de maio, o modelo Max — o maior e mais capaz da série Qwen3.7 — adicionou compreensão de modalidade visual. Esse recurso permite perceber cenas do mundo real e suportar capacidades de agentes híbridos interativos multimodais. Esta versão baseia-se em um snapshot obtido em 8 de junho de 2026.

Provedor de service de inferência

O Alibaba Cloud Model Studio é o provedor de service de inferência para qwen3.7-max-2026-06-08.

Capacidades do modelo

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Image Text Video

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Supported

Cache de contexto

Supported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

991808

Comprimento máximo de saída

131072

Janela de contexto

1000000

Comprimento máximo de entrada (Modo de raciocínio)

983616

Comprimento máximo de saída (Modo de raciocínio)

131072

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para conferir ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Hong Kong (China)

Item de faturamento

Preço (USD)

Unidade

Entrada

1,65

Por 1M tokens

Saída

4,951

Por 1M tokens

Entrada (Cache implícito)

0,33

Por 1M tokens

Criação de cache explícito

2,063

Por 1M tokens

Leitura de cache explícito

0,165

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Hong Kong (China)

Parâmetro

Valor

RPM (Requisições por minuto)

600

TPM (Tokens por minuto)

1.000.000

qwen3.7-max-2026-05-20

O modelo Max, o maior e mais capaz da série Qwen3.7, oferece atualmente uma interface exclusivamente textual para experimentação pública. O Qwen3.7 é um modelo principal de última geração, projetado para a era centrada em agentes. Seus principais pontos fortes residem na amplitude e profundidade de suas capacidades no nível de agente: ele se destaca em programação, tarefas de escritório e produtividade, além de execução autônoma de longo prazo. Esta versão é um snapshot de 20 de maio de 2026.

Provedor de service de inferência

O Alibaba Cloud Model Studio é o provedor de service de inferência para qwen3.7-max-2026-05-20.

Capacidades do modelo

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Supported

Cache de contexto

Supported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

991808

Comprimento máximo de saída

131072

Janela de contexto

1000000

Comprimento máximo de entrada (Modo de raciocínio)

983616

Comprimento máximo de saída (Modo de raciocínio)

131072

Comprimento máximo da cadeia de pensamento

262144

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para conferir ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Item de faturamento

Preço (USD)

Unidade

Entrada

1,65

Por 1M tokens

Saída

4,951

Por 1M tokens

Criação de cache explícito

2,063

Por 1M tokens

Leitura de cache explícito

0,165

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Parâmetro

Valor

RPM (Requisições por minuto)

600

TPM (Tokens por minuto)

1.000.000

qwen3.7-max-2026-05-17

A versão inicial do modelo Max na série Qwen3.7 suporta apenas o modo de raciocínio e disponibiliza suas capacidades de texto simples para experimentação. O Qwen3.7 é um modelo principal de última geração, projetado para a era centrada em agentes, com grandes melhorias em codificação e capacidades no nível de agente. Esta versão é um snapshot de 17 de maio de 2026.

Provedor de service de inferência

O Alibaba Cloud Model Studio é o provedor de service de inferência para qwen3.7-max-2026-05-17.

Capacidades do modelo

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Supported

Cache de contexto

Unsupported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

991808

Comprimento máximo de saída

131072

Janela de contexto

1000000

Comprimento máximo de entrada (Modo de raciocínio)

983616

Comprimento máximo de saída (Modo de raciocínio)

131072

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para conferir ofertas promocionais.
  • Singapore
Escopo: Internacional

Item de faturamento

Preço (USD)

Unidade

Entrada

2,5

Por 1M tokens

Saída

7,5

Por 1M tokens

Limites de taxa

  • Singapore
Escopo: Internacional

Parâmetro

Valor

RPM (Requisições por minuto)

600

TPM (Tokens por minuto)

1.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento