Skip to main content
Geração de Texto

qwen3.6-flash-us

A série de modelos Flash nativos de visão e linguagem Qwen3.6 oferece desempenho significativamente superior ao da versão 3.5-Flash. Este modelo se destaca especialmente na codificação agêntica e supera substancialmente seu antecessor em vários benchmarks de agentes de código, além de apresentar melhorias no raciocínio matemático e de código. No aspecto visual, a inteligência espacial foi notavelmente aprimorada, com avanços expressivos na localização e na detecção de objetos.

Provedor do service de inferência

O Alibaba Cloud Model Studio é o provedor do service de inferência para qwen3.6-flash-us.

Capacidades do modelo

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text Image Video

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Unsupported

Conclusão de prefixo

Supported

Cache de contexto

Supported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

991.808

Comprimento máximo de saída

65.536

Janela de contexto

1.000.000

Comprimento máximo de entrada (Modo de Pensamento)

983.616

Comprimento máximo de saída (Modo de Pensamento)

65.536

Preços

Esta página exibe apenas os preços originais das chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • US (Virginia)
Escopo: US

Item de faturamento

Preço (USD)

Unidade

Entrada

0,25

Por 1M tokens

Saída

1,5

Por 1M tokens

Criação de cache explícito

0,3125

Por 1M tokens

Leitura de cache explícito

0,025

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

1

Por 1M tokens

Saída

4

Por 1M tokens

Criação de cache explícito

1,25

Por 1M tokens

Leitura de cache explícito

0,1

Por 1M tokens

Limites de taxa

  • US (Virginia)
Escopo: US

Parâmetro

Valor

RPM (Requisições por minuto)

15.000

TPM (Tokens por minuto)

5.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento