Skip to main content
Geração de Texto

qwen3.7-plus

Na série Qwen3.7, o modelo Plus oferece excelente custo-benefício e aprimora suas sólidas capacidades de texto com uma atualização abrangente das habilidades de visão e linguagem. Ele mantém inteligência completa no nível de agente para codificação, uso de ferramentas e fluxos de trabalho de produtividade. Seu principal diferencial são as capacidades de agente híbrido interativo multimodal, que permitem perceber cenários do mundo real, ler telas e interagir com GUIs, gerar código a partir de referências visuais e realizar navegação ponta a ponta em aplicativos móveis. Esta versão do modelo é funcionalmente equivalente ao modelo snapshot qwen3.7-plus-2026-05-26.

Provedor de service de inferência

O provedor de service de inferência para qwen3.7-plus é o Alibaba Cloud Model Studio.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Image Text Video

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Supported

Cache de contexto

Supported

Inferência em lote

Supported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

991.808

Comprimento máximo de saída

131.072

Janela de contexto

1.000.000

Comprimento máximo de entrada (Modo de raciocínio)

983.616

Comprimento máximo de saída (Modo de raciocínio)

131.072

Comprimento máximo da cadeia de pensamento

262.144

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Item de faturamento

Preço (USD)

Unidade

Entrada

0,276

Por 1M tokens

Saída

1,101

Por 1M tokens

Entrada (Cache implícito)

0,056

Por 1M tokens

Entrada (Arquivo em lote)

0,143

Por 1M tokens

Saída (Arquivo em lote)

0,574

Por 1M tokens

Criação de cache explícito

0,344

Por 1M tokens

Leitura de cache explícito

0,028

Por 1M tokens

Entrada (Chat em lote)

0,287

Por 1M tokens

Saída (Chat em lote)

1,147

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0,826

Por 1M tokens

Saída

3,301

Por 1M tokens

Entrada (Cache implícito)

0,166

Por 1M tokens

Entrada (Arquivo em lote)

0,43

Por 1M tokens

Saída (Arquivo em lote)

1,72

Por 1M tokens

Criação de cache explícito

1,032

Por 1M tokens

Leitura de cache explícito

0,083

Por 1M tokens

Entrada (Chat em lote)

0,86

Por 1M tokens

Saída (Chat em lote)

3,44

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Parâmetro

Valor

RPM (Solicitações por minuto)

30.000

TPM (Tokens por minuto)

5.000.000

Versões snapshot

qwen3.7-plus-2026-05-26

Na série Qwen3.7, o modelo Plus oferece excelente custo-benefício e aprimora suas sólidas capacidades de texto com uma atualização abrangente das habilidades de visão e linguagem. Ele mantém inteligência completa no nível de agente para codificação, uso de ferramentas e fluxos de trabalho de produtividade. Seu principal diferencial são as capacidades de agente híbrido interativo multimodal, que permitem perceber cenários do mundo real, ler telas e interagir com GUIs, gerar código a partir de referências visuais e realizar navegação ponta a ponta em aplicativos móveis. Esta versão é um snapshot de 26 de maio de 2026.

Provedor de service de inferência

O provedor de service de inferência para qwen3.7-plus-2026-05-26 é o Alibaba Cloud Model Studio.

Capacidades do modelo

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Image Text Video

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Supported

Cache de contexto

Supported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

991.808

Comprimento máximo de saída

131.072

Janela de contexto

1.000.000

Comprimento máximo de entrada (Modo de raciocínio)

983.616

Comprimento máximo de saída (Modo de raciocínio)

131.072

Comprimento máximo da cadeia de pensamento

262.144

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Item de faturamento

Preço (USD)

Unidade

Entrada

0,276

Por 1M tokens

Saída

1,101

Por 1M tokens

Entrada (Cache implícito)

0,056

Por 1M tokens

Criação de cache explícito

0,344

Por 1M tokens

Leitura de cache explícito

0,028

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0,826

Por 1M tokens

Saída

3,301

Por 1M tokens

Entrada (Cache implícito)

0,166

Por 1M tokens

Criação de cache explícito

1,032

Por 1M tokens

Leitura de cache explícito

0,083

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Parâmetro

Valor

RPM (Solicitações por minuto)

600

TPM (Tokens por minuto)

1.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento