Skip to main content
Geração de Texto

qwen3.6-max-preview

O modelo Max, variante mais robusta e avançada da série Qwen3.6, já está disponível em versão preview. Atualmente, apenas os recursos de texto simples estão abertos para experimentação. Em comparação com os modelos Qwen3-Max e Qwen3.6-Plus lançados anteriormente, este modelo oferece habilidades aprimoradas de vibe coding, execução mais eficiente de agentes de codificação e competências significativamente melhores em desenvolvimento front-end. Além disso, a retenção de conhecimento de cauda longa recebeu novas melhorias.

Provedor de service de inferência

O Alibaba Cloud Model Studio é o provedor de service de inferência para qwen3.6-max-preview.

Capacidades do modelo

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Supported

Cache de contexto

Supported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

245.760

Comprimento máximo de saída

65.536

Janela de contexto

262.144

Comprimento máximo de entrada (Thinking Mode)

229.376

Comprimento máximo de saída (Thinking Mode)

65.536

Comprimento máximo da cadeia de pensamento

131.072

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para conferir ofertas promocionais.
  • China (Beijing)
  • Singapore

Item de faturamento

Preço (USD)

Unidade

Entrada

1,238

Por 1M tokens

Saída

7,426

Por 1M tokens

Criação de cache explícito

1,547

Por 1M tokens

Leitura de cache explícito

0,1238

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

2,063

Por 1M tokens

Saída

12,377

Por 1M tokens

Criação de cache explícito

2,579

Por 1M tokens

Leitura de cache explícito

0,206

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore

Parâmetro

Valor

RPM (Requisições por minuto)

600

TPM (Tokens por minuto)

1.000.000

Versões de snapshot

qwen3.6-max-preview

O modelo Max, variante mais robusta e avançada da série Qwen3.6, já está disponível em versão preview. Atualmente, apenas os recursos de texto simples estão abertos para experimentação. Em comparação com os modelos Qwen3-Max e Qwen3.6-Plus lançados anteriormente, este modelo oferece habilidades aprimoradas de vibe coding, execução mais eficiente de agentes de codificação e competências significativamente melhores em desenvolvimento front-end. Além disso, a retenção de conhecimento de cauda longa recebeu novas melhorias.

Provedor de service de inferência

O Alibaba Cloud Model Studio é o provedor de service de inferência para qwen3.6-max-preview.

Capacidades do modelo

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Supported

Cache de contexto

Supported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

245.760

Comprimento máximo de saída

65.536

Janela de contexto

262.144

Comprimento máximo de entrada (Thinking Mode)

229.376

Comprimento máximo de saída (Thinking Mode)

65.536

Comprimento máximo da cadeia de pensamento

131.072

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para conferir ofertas promocionais.
  • China (Beijing)
  • Singapore

Item de faturamento

Preço (USD)

Unidade

Entrada

1,238

Por 1M tokens

Saída

7,426

Por 1M tokens

Criação de cache explícito

1,547

Por 1M tokens

Leitura de cache explícito

0,1238

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

2,063

Por 1M tokens

Saída

12,377

Por 1M tokens

Criação de cache explícito

2,579

Por 1M tokens

Leitura de cache explícito

0,206

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore

Parâmetro

Valor

RPM (Requisições por minuto)

600

TPM (Tokens por minuto)

1.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento