Skip to main content
Geração de Texto

qwen3.8-max

Modelo principal MoE com 2,4 trilhões de parâmetros e capacidades aprimoradas para cenários de programação e escritório. Adequado para tarefas profissionais em áreas como direito, finanças e design. Oferece compreensão visual nativa, análise semântica de documentos extensos e vídeos longos, além de planejamento autônomo e iteração para tarefas de longo prazo.

ID do modelo (valor do parâmetro model): qwen3.8-max

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Image Text Video

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Modo parcial

Supported

Cache de contexto

Supported

Inferência em lote

Supported

Ajuste fino

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

991.808

Comprimento máximo de saída

131.072

Comprimento máximo de entrada (Modo de raciocínio)

983.616

Comprimento máximo de saída (Modo de raciocínio)

131.072

Janela de contexto

1.000.000

Comprimento máximo da cadeia de pensamento

262.144

O comprimento suportado pelo modelo varia conforme as combinações de parâmetros de entrada da API.

Preços

Esta página exibe apenas os preços originais das chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Item de faturamento

Preço (USD)

Unidade

Entrada

1,65

Por 1 milhão de tokens

Saída

4.951

Por 1 milhão de tokens

Entrada (Cache implícito)

0.206

Por 1 milhão de tokens

Criação de cache explícito

2.063

Por 1 milhão de tokens

Leitura de cache explícito

0.137

Por 1 milhão de tokens

Entrada (Arquivo em lote)

0.825

Por 1 milhão de tokens

Saída (Arquivo em lote)

2.475

Por 1 milhão de tokens

Entrada (Chat em lote)

1,65

Por 1 milhão de tokens

Saída (Chat em lote)

4.951

Por 1 milhão de tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Parâmetro

Valor

RPM (Requisições por minuto)

30.000

TPM (Tokens por minuto)

5.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento