Skip to main content
Geração de Texto

deepseek-v3.2

O DeepSeek-V3.2 é a versão oficial do modelo que incorpora o DeepSeek Sparse Attention, um mecanismo de atenção esparsa. É também o primeiro modelo da DeepSeek a integrar raciocínio ao uso de ferramentas, com suporte a chamadas de ferramentas com e sem raciocínio.

Provedor de service de inferência

O Alibaba Cloud Model Studio fornece o service de inferência para deepseek-v3.2.

Capacidades do modelo

  • China (Beijing)
  • Singapore

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Chamada de função

Supported

Saídas estruturadas

Unsupported

Pesquisa na web

Supported

Conclusão de prefixo

Unsupported

Cache de contexto

Supported

Inferência em lote

Supported

Ajuste fino

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

98.304

Comprimento máximo de saída

65.536

Janela de contexto

131.072

Preços

Esta página exibe apenas os preços originais das chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore

Item de faturamento

Preço (USD)

Unidade

Entrada

0,287

Por 1M tokens

Saída

0,431

Por 1M tokens

Entrada (cache implícito)

0,058

Por 1M tokens

Entrada (arquivo em lote)

0,144

Por 1M tokens

Saída (arquivo em lote)

0,216

Por 1M tokens

Criação de cache explícito

0,359

Por 1M tokens

Leitura de cache explícito

0,029

Por 1M tokens

Entrada (chat em lote)

0,287

Por 1M tokens

Saída (chat em lote)

0,431

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore

Parâmetro

Valor

RPM (solicitações por minuto)

15.000

TPM (tokens por minuto)

1.000.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento