Skip to main content
Geração de Texto

deepseek-r1

Modelo de linguagem grande aprimorado por aprendizado por reforço extensivo durante o pós-treinamento. Alcança alta capacidade de raciocínio com poucos dados rotulados e apresenta bom desempenho em tarefas de matemática, programação e raciocínio em linguagem natural.

Provedor do service de inferência

O Alibaba Cloud Model Studio é o provedor do service de inferência para deepseek-r1.

Capacidades do modelo

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Unsupported

Pesquisa na web

Supported

Conclusão de prefixo

Unsupported

Cache de contexto

Supported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

98304

Comprimento máximo de saída

16384

Janela de contexto

131072

Preços

Esta página exibe apenas os preços originais das chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • China (Beijing)

Item de faturamento

Preço (USD)

Unidade

Entrada

0,574

Por 1M tokens

Saída

2,294

Por 1M tokens

Entrada (cache implícito)

0,115

Por 1M tokens

Entrada (arquivo em lote)

0,287

Por 1M tokens

Saída (arquivo em lote)

1,147

Por 1M tokens

Limites de taxa

  • China (Beijing)

Parâmetro

Valor

RPM (solicitações por minuto)

15000

TPM (tokens por minuto)

1.200.000

Versões de snapshot

deepseek-r1-0528

Modelo de linguagem grande aprimorado por aprendizado por reforço extensivo durante o pós-treinamento. Alcança alta capacidade de raciocínio com poucos dados rotulados e apresenta bom desempenho em tarefas de matemática, programação e raciocínio em linguagem natural.

Provedor do service de inferência

O Alibaba Cloud Model Studio é o provedor do service de inferência para deepseek-r1-0528.

Capacidades do modelo

Capacidade

Suporte

Capacidade

Suporte

Modalidade de entrada

Text

Modalidade de saída

Text

Experiência do modelo

Supported

Function Calling

Supported

Saídas estruturadas

Unsupported

Pesquisa na web

Supported

Conclusão de prefixo

Unsupported

Cache de contexto

Unsupported

Inferência em lote

Unsupported

Fine-tuning

Unsupported

Limites de contexto

Parâmetro

Valor

Parâmetro

Valor

Comprimento máximo de entrada

98304

Comprimento máximo de saída

16384

Janela de contexto

131072

Preços

Esta página exibe apenas os preços originais das chamadas de API do modelo, sem incluir promoções por tempo limitado. Acesse o Model Studio Console para consultar ofertas promocionais.
  • China (Beijing)

Item de faturamento

Preço (USD)

Unidade

Entrada

0,574

Por 1M tokens

Saída

2,294

Por 1M tokens

Limites de taxa

  • China (Beijing)

Parâmetro

Valor

RPM (solicitações por minuto)

60

TPM (tokens por minuto)

100.000

Plano de Tokens
Playground de Modelos
  • Music generation
Inferência do Modelo
Avaliação
Compressão de Modelos
Estatísticas e Monitoramento