Modelo grande MoE principal com 1,6 trilhão de parâmetros e 49 bilhões de parâmetros ativados, com suporte nativo a contextos de até um milhão de tokens. Treinado em um vasto corpus de dados de alta qualidade, destaca-se no raciocínio matemático avançado, na inferência lógica complexa, na codificação especializada e na análise profunda de textos longos. É ideal para aplicações exigentes, como pesquisas de ponta, fluxos de trabalho corporativos sofisticados e agentes de IA avançados.
Provedor do service de inferência
O Alibaba Cloud Model Studio é o provedor do service de inferência para deepseek-v4-pro.
Capacidades do modelo
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
- Japan (Tokyo)
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de entrada | Text | Modalidade de saída | Text |
Experiência do modelo | Supported | Function Calling | Supported |
Saídas estruturadas | Supported | Pesquisa na web | Supported |
Conclusão de prefixo | Unsupported | Cache de contexto | Supported |
Inferência em lote | Unsupported | Fine-tuning | Unsupported |
Limites de contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento máximo de entrada | 1.000.000 | Comprimento máximo de saída | 393.216 |
Janela de contexto | 1.000.000 |
Preços
Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
- Japan (Tokyo)
Item de faturamento | Preço (USD) | Unidade |
Entrada | 1,65 | Por 1M tokens |
Saída | 3.301 | Por 1M tokens |
Entrada (cache implícito) | 0,138 | Por 1M tokens |
Limites de taxa
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
- Japan (Tokyo)
Parâmetro | Valor |
RPM (solicitações por minuto) | 15.000 |
TPM (tokens por minuto) | 1.200.000 |
Versões de snapshot
deepseek-v4-pro-0813
MoE, 1,6T, 49B, ., , , , , , .
Provedor do service de inferência
O Alibaba Cloud Model Studio é o provedor do service de inferência para deepseek-v4-pro-0813.
Capacidades do modelo
Capacidade | Suporte | Capacidade | Suporte |
Modalidade de entrada | Text | Modalidade de saída | Text |
Experiência do modelo | Supported | Function Calling | Supported |
Saídas estruturadas | Supported | Pesquisa na web | Supported |
Conclusão de prefixo | Unsupported | Cache de contexto | Supported |
Inferência em lote | Unsupported | Fine-tuning | Unsupported |
Limites de contexto
Parâmetro | Valor | Parâmetro | Valor |
Comprimento máximo de entrada | 1.000.000 | Comprimento máximo de saída | 393.216 |
Janela de contexto | 1.000.000 | Comprimento máximo de entrada (modo de pensamento) | 1.000.000 |
Comprimento máximo de saída (modo de pensamento) | 393.216 | Comprimento máximo da cadeia de pensamento | 393.216 |
Preços
Esta página exibe apenas os preços originais para chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Console do Model Studio para consultar ofertas promocionais.
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
- Japan (Tokyo)
- Hong Kong (China)
Item de faturamento | Preço (USD) | Unidade |
Entrada | 0,636 | Por 1M tokens |
Entrada | 1.272 | Por 1M tokens |
Saída | 1.908 | Por 1M tokens |
Saída | 3.816 | Por 1M tokens |
Entrada (cache implícito) | 0,064 | Por 1M tokens |
Entrada (cache implícito) | 0,127 | Por 1M tokens |
Limites de taxa
- China (Beijing)
- Singapore
- Germany (Frankfurt)
- US (Virginia)
- Japan (Tokyo)
- Hong Kong (China)
Parâmetro | Valor |
RPM (solicitações por minuto) | 15.000 |
TPM (tokens por minuto) | 1.200.000 |