Skip to main content
Geração de Texto

qwen3-coder-flash

Baseado no Qwen3, este modelo de geração de código herda as capacidades de agente de codificação do Qwen3-Coder-Plus e oferece suporte à interação de ferramentas em múltiplos turnos. O modelo apresenta otimizações focadas na compreensão em nível de repositório e maior estabilidade na chamada de ferramentas. Esta versão é funcionalmente equivalente ao snapshot qwen3-coder-flash-2025-07-28.

Provedor de service de inferência

O Alibaba Cloud Model Studio fornece o service de inferência para qwen3-coder-flash.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Unsupported

Pesquisa na web

Unsupported

Conclusão de prefixo

Unsupported

Cache de contexto

Supported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

997952

Comprimento máximo de saída

65536

Janela de contexto

1000000

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Item de faturamento

Preço (USD)

Unidade

Entrada

0,144

Por 1M tokens

Saída

0,574

Por 1M tokens

Entrada (cache implícito)

0,029

Por 1M tokens

Criação de cache explícito

0,18

Por 1M tokens

Leitura de cache explícito

0,014

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0,216

Por 1M tokens

Saída

0,861

Por 1M tokens

Entrada (cache implícito)

0,044

Por 1M tokens

Criação de cache explícito

0,27

Por 1M tokens

Leitura de cache explícito

0,022

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0,359

Por 1M tokens

Saída

1,434

Por 1M tokens

Entrada (cache implícito)

0,072

Por 1M tokens

Criação de cache explícito

0,449

Por 1M tokens

Leitura de cache explícito

0,036

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0,717

Por 1M tokens

Saída

3,584

Por 1M tokens

Entrada (cache implícito)

0,144

Por 1M tokens

Criação de cache explícito

0,896

Por 1M tokens

Leitura de cache explícito

0,072

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Parâmetro

Valor

RPM (requisições por minuto)

5000

TPM (tokens por minuto)

5.000.000

Versões snapshot

qwen3-coder-flash-2025-07-28

Baseado no Qwen3, este modelo de geração de código herda as capacidades de agente de codificação do Qwen3-Coder-Plus e oferece suporte à interação de ferramentas em múltiplos turnos. O modelo apresenta otimizações focadas na compreensão em nível de repositório e maior estabilidade na chamada de ferramentas. Esta versão é um snapshot datado de 28 de julho de 2025.

Provedor de service de inferência

O Alibaba Cloud Model Studio fornece o service de inferência para qwen3-coder-flash-2025-07-28.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Unsupported

Pesquisa na web

Unsupported

Conclusão de prefixo

Unsupported

Cache de contexto

Unsupported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

997952

Comprimento máximo de saída

65536

Janela de contexto

1000000

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Item de faturamento

Preço (USD)

Unidade

Entrada

0,144

Por 1M tokens

Saída

0,574

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0,216

Por 1M tokens

Saída

0,861

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0,359

Por 1M tokens

Saída

1,434

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

0,717

Por 1M tokens

Saída

3,584

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)

Parâmetro

Valor

RPM (requisições por minuto)

60

TPM (tokens por minuto)

1.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento