Skip to main content
Geração de Texto

qwen3.7-flash

Os modelos Flash da série nativa de visão e linguagem Qwen3.7 aprimoram significativamente a compreensão multimodal e as capacidades de execução de Agent em comparação ao 3.6-Flash. As principais melhorias incluem o fortalecimento das habilidades multimodais fundamentais, reconhecimento de objetos mais preciso e maior inteligência espacial e percepção do mundo real. Cenários de Agent multimodal, como Search Agent e CI Agent, receberam atualizações importantes que resultam em execução de tarefas ponta a ponta mais estável. Além disso, as capacidades de codificação multimodal foram otimizadas para proporcionar uma experiência de vibe coding mais fluida.

Provedor de service de inferência

O Alibaba Cloud Model Studio fornece o service de inferência para qwen3.7-flash.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Image Text Video

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Supported

Cache de contexto

Supported

Inferência em lote

Supported

Ajuste fino

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

991.808

Comprimento máximo de saída

131.072

Janela de contexto

1.000.000

Comprimento máximo de entrada (Modo de raciocínio)

983.616

Comprimento máximo de saída (Modo de raciocínio)

131.072

Comprimento máximo da cadeia de pensamento

262.144

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Item de faturamento

Preço (USD)

Unidade

Entrada

0,028

Por 1M tokens

Saída

0,11

Por 1M tokens

Entrada (Cache implícito)

0,006

Por 1M tokens

Entrada (Arquivo em lote)

0,014

Por 1M tokens

Saída (Arquivo em lote)

0,055

Por 1M tokens

Criação de cache explícito

0,034

Por 1M tokens

Leitura de cache explícito

0,003

Por 1M tokens

Entrada (Chat em lote)

0,028

Por 1M tokens

Saída (Chat em lote)

0,11

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0,083

Por 1M tokens

Saída

0,33

Por 1M tokens

Entrada (Cache implícito)

0,017

Por 1M tokens

Entrada (Arquivo em lote)

0,041

Por 1M tokens

Saída (Arquivo em lote)

0,165

Por 1M tokens

Criação de cache explícito

0,103

Por 1M tokens

Leitura de cache explícito

0,008

Por 1M tokens

Entrada (Chat em lote)

0,083

Por 1M tokens

Saída (Chat em lote)

0,33

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0,165

Por 1M tokens

Saída

0,66

Por 1M tokens

Entrada (Cache implícito)

0,033

Por 1M tokens

Entrada (Arquivo em lote)

0,083

Por 1M tokens

Saída (Arquivo em lote)

0,33

Por 1M tokens

Criação de cache explícito

0,206

Por 1M tokens

Leitura de cache explícito

0,017

Por 1M tokens

Entrada (Chat em lote)

0,165

Por 1M tokens

Saída (Chat em lote)

0,66

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • Japan (Tokyo)
  • Hong Kong (China)

Parâmetro

Valor

RPM (Requisições por minuto)

30.000

TPM (Tokens por minuto)

5.000.000

Versões de snapshot

qwen3.7-flash-2026-07-15

Os modelos Flash da série nativa de visão e linguagem Qwen3.7 aprimoram significativamente a compreensão multimodal e as capacidades de execução de Agent em comparação ao 3.6-Flash. As principais melhorias incluem o fortalecimento das habilidades multimodais fundamentais, reconhecimento de objetos mais preciso e maior inteligência espacial e percepção do mundo real. Cenários de Agent multimodal, como Search Agent e CI Agent, receberam atualizações importantes que resultam em execução de tarefas ponta a ponta mais estável. Além disso, as capacidades de codificação multimodal foram otimizadas para proporcionar uma experiência de vibe coding mais fluida.

Provedor de service de inferência

O Alibaba Cloud Model Studio fornece o service de inferência para qwen3.7-flash-2026-07-15.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Image Text Video

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Supported

Cache de contexto

Supported

Inferência em lote

Unsupported

Ajuste fino

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

991.808

Comprimento máximo de saída

131.072

Janela de contexto

1.000.000

Comprimento máximo de entrada (Modo de raciocínio)

983.616

Comprimento máximo de saída (Modo de raciocínio)

131.072

Comprimento máximo da cadeia de pensamento

262.144

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Item de faturamento

Preço (USD)

Unidade

Entrada

0,028

Por 1M tokens

Saída

0,11

Por 1M tokens

Entrada (Cache implícito)

0,006

Por 1M tokens

Criação de cache explícito

0,034

Por 1M tokens

Leitura de cache explícito

0,003

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0,083

Por 1M tokens

Saída

0,33

Por 1M tokens

Entrada (Cache implícito)

0,017

Por 1M tokens

Criação de cache explícito

0,103

Por 1M tokens

Leitura de cache explícito

0,008

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0,165

Por 1M tokens

Saída

0,66

Por 1M tokens

Entrada (Cache implícito)

0,033

Por 1M tokens

Criação de cache explícito

0,206

Por 1M tokens

Leitura de cache explícito

0,017

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • Japan (Tokyo)
  • Hong Kong (China)

Parâmetro

Valor

RPM (Requisições por minuto)

30.000

TPM (Tokens por minuto)

5.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento
qwen3.7-flash - Alibaba Cloud Model Studio