Skip to main content
Geração de Texto

qwen3.8-flash

Qwen3.8-Flash e o modelo multimodal mais recente da familia Qwen, combinando raciocinio e geracao poderosos com velocidade notavel. Suporta nativamente uma janela de contexto de um milhao de tokens, permitindo processar documentos longos, repositorios de codigo inteiros e conversas complexas em uma unica passagem. Destaca-se em assistencia de codificacao, fluxos de trabalho agentivos e compreensao visual. Totalmente compativel com os protocolos de API OpenAI e Anthropic, integra-se perfeitamente com ferramentas de desenvolvimento populares como Claude Code e Codex. Com desempenho robusto e custos de inferencia altamente competitivos, Qwen3.8-Flash e a escolha ideal para desenvolvedores e empresas que buscam o melhor dos dois mundos em aplicacoes de IA.

Capacidades do Modelo

  • China (Pequim)
  • Singapura
CapacidadeSuporteCapacidadeSuporte

Modalidade de Entrada

Imagem Texto Video

Modalidade de Saida

Texto

Experiencia do Modelo

Suportado

Function Calling

Suportado

Saidas Estruturadas

Suportado

Busca Web

Suportado

Modo Prefixo

Suportado

Cache de Contexto

Suportado

Inferencia em Lote

Nao Suportado

Fine-tuning

Nao Suportado

Limites de Contexto

ParametroValorParametroValor

Comprimento Maximo de Entrada

991808

Comprimento Maximo de Saida

131072

Comprimento Maximo de Entrada (Modo Pensamento)

983616

Comprimento Maximo de Saida (Modo Pensamento)

131072

Janela de Contexto

1000000

Comprimento Maximo da Cadeia de Pensamento

262144

Precos

Esta pagina mostra apenas os precos originais para chamadas de API do modelo, excluindo promocoes por tempo limitado. Visite o Console Model Studio para ofertas promocionais.
  • China (Pequim)
  • Singapura
Item de CobrancaPreco (USD)Unidade

Entrada

0.14

Por 1M de tokens

Saida

0.42

Por 1M de tokens

Entrada (Cache Implicito)

0.014

Por 1M de tokens

Criacao de Cache Explicito

0.177

Por 1M de tokens

Leitura de Cache Explicito

0.014

Por 1M de tokens

Limites de Taxa

  • China (Pequim)
  • Singapura
ParametroValor

RPM (Requisicoes Por Minuto)

30.000

TPM (Tokens Por Minuto)

5.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento