Skip to main content
Geração de Texto

deepseek-v4-pro

Modelo grande MoE principal com 1,6 trilhão de parâmetros e 49 bilhões de parâmetros ativados, com suporte nativo a contextos de até um milhão de tokens. Treinado em um vasto corpus de dados de alta qualidade, destaca-se no raciocínio matemático avançado, na inferência lógica complexa, na codificação especializada e na análise profunda de textos longos. É ideal para aplicações exigentes, como pesquisas de ponta, fluxos de trabalho corporativos sofisticados e agentes de IA avançados.

Provedor do service de inferência

O Alibaba Cloud Model Studio é o provedor do service de inferência para deepseek-v4-pro.

Capacidades do modelo

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Unsupported

Cache de contexto

Supported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

1.000.000

Comprimento máximo de saída

393.216

Janela de contexto

1.000.000

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)

Item de faturamento

Preço (USD)

Unidade

Entrada

1,65

Por 1M tokens

Saída

3.301

Por 1M tokens

Entrada (cache implícito)

0,138

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)

Parâmetro

Valor

RPM (solicitações por minuto)

15.000

TPM (tokens por minuto)

1.200.000

Versões de snapshot

deepseek-v4-pro-0813

MoE, 1,6T, 49B, ., , , , , , .

Provedor do service de inferência

O Alibaba Cloud Model Studio é o provedor do service de inferência para deepseek-v4-pro-0813.

Capacidades do modelo

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Supported

Pesquisa na web

Supported

Conclusão de prefixo

Unsupported

Cache de contexto

Supported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

1.000.000

Comprimento máximo de saída

393.216

Janela de contexto

1.000.000

Comprimento máximo de entrada (modo de pensamento)

1.000.000

Comprimento máximo de saída (modo de pensamento)

393.216

Comprimento máximo da cadeia de pensamento

393.216

Preços

Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Item de faturamento

Preço (USD)

Unidade

Entrada

0,636

Por 1M tokens

Entrada

1.272

Por 1M tokens

Saída

1.908

Por 1M tokens

Saída

3.816

Por 1M tokens

Entrada (cache implícito)

0,064

Por 1M tokens

Entrada (cache implícito)

0,127

Por 1M tokens

Limites de taxa

  • China (Beijing)
  • Singapore
  • Germany (Frankfurt)
  • US (Virginia)
  • Japan (Tokyo)
  • Hong Kong (China)

Parâmetro

Valor

RPM (solicitações por minuto)

15.000

TPM (tokens por minuto)

1.200.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento