Skip to main content
Geração de Texto

qwen3.6-plus

Os modelos da série Plus nativa de visão e linguagem Qwen3.6 apresentam desempenho excepcional, equivalente ao estado da arte atual, com melhoria significativa nos resultados gerais em comparação à série 3.5. Houve aprimoramentos expressivos nas capacidades relacionadas a código, como codificação agêntica, programação front-end e Vibe coding, além de avanços no reconhecimento multimodal geral de objetos, OCR e localização de objetos. Esta versão do modelo é funcionalmente equivalente ao modelo snapshot qwen3.6-plus-2026-04-02.

Provedor de service de inferência

O Alibaba Cloud Model Studio fornece o service de inferência para qwen3.6-plus.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Image Text Video

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Supported

Cache de contexto

Supported

Inferência em lote

Supported

Ajuste fino

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

991.808

Comprimento máximo de saída

65.536

Janela de contexto

1.000.000

Comprimento máximo de entrada (Modo de Pensamento)

983.616

Comprimento máximo de saída (Modo de Pensamento)

65.536

Comprimento máximo da Cadeia de Pensamento

81.920

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Item de faturamento

Preço (USD)

Unidade

Entrada

0,276

Por 1M tokens

Saída

1,651

Por 1M tokens

Entrada (Arquivo em Lote)

0,138

Por 1M tokens

Saída (Arquivo em Lote)

0,825

Por 1M tokens

Criação de Cache Explícito

0,344

Por 1M tokens

Leitura de Cache Explícito

0,028

Por 1M tokens

Entrada (Chat em Lote)

0,275

Por 1M tokens

Saída (Chat em Lote)

1,65

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

1,101

Por 1M tokens

Saída

6,602

Por 1M tokens

Entrada (Arquivo em Lote)

0,55

Por 1M tokens

Saída (Arquivo em Lote)

3,301

Por 1M tokens

Criação de Cache Explícito

1,376

Por 1M tokens

Leitura de Cache Explícito

0,111

Por 1M tokens

Entrada (Chat em Lote)

1,1

Por 1M tokens

Saída (Chat em Lote)

6,601

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Parâmetro

Valor

RPM (Requisições Por Minuto)

30.000

TPM (Tokens Por Minuto)

5.000.000

Versões snapshot

qwen3.6-plus-2026-04-02

Os modelos da série Plus nativa de visão e linguagem Qwen3.6 apresentam desempenho excepcional, equivalente ao estado da arte atual, com melhoria significativa nos resultados gerais em comparação à série 3.5. As capacidades relacionadas a código foram significativamente aprimoradas, incluindo codificação agêntica, programação front-end e Vibe coding, além de melhorias no reconhecimento multimodal geral de objetos, OCR e localização de objetos. Esta versão é um snapshot de 2 de abril de 2026.

Provedor de service de inferência

O Alibaba Cloud Model Studio fornece o service de inferência para qwen3.6-plus-2026-04-02.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Image Text Video

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Supported

Cache de contexto

Unsupported

Inferência em lote

Unsupported

Ajuste fino

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

991.808

Comprimento máximo de saída

65.536

Janela de contexto

1.000.000

Comprimento máximo de entrada (Modo de Pensamento)

983.616

Comprimento máximo de saída (Modo de Pensamento)

65.536

Comprimento máximo da Cadeia de Pensamento

81.920

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)

Item de faturamento

Preço (USD)

Unidade

Entrada

0,276

Por 1M tokens

Saída

1,651

Por 1M tokens

Item de faturamento

Preço (USD)

Unidade

Entrada

1,101

Por 1M tokens

Saída

6,602

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)

Parâmetro

Valor

RPM (Requisições Por Minuto)

600

TPM (Tokens Por Minuto)

1.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento