Skip to main content
文本產生

deepseek-r1

DeepSeek-R1 在後訓練階段大規模使用了強化學習技術,在僅有極少標註資料的情況下,極大提升了模型推理能力。在數學、代碼、自然語言推理等任務上,效能較高,能力較強。

推理服務供應商

deepseek-r1模型的推理服務供應商為阿里雲百鍊。

模型能力

能力項支援情況能力項支援情況

輸入模態

Text

輸出模態

Text

模型體驗

支援

Function Calling

支援

結構化輸出

不支援

連網搜尋

支援

首碼續寫

不支援

上下文緩衝

支援

批量推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

98304

最大輸出長度

16384

上下文長度

131072

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
  • 華北2(北京)
計費項目價格(美元)單位

輸入

0.574

每百萬tokens

輸出

2.294

每百萬tokens

輸入(快取命中)

0.115

每百萬tokens

輸入(Batch File)

0.287

每百萬tokens

輸出(Batch File)

1.147

每百萬tokens

限流

  • 華北2(北京)
參數

RPM(每分鐘請求數)

15000

TPM(每分鐘tokens)

1,200,000

快照版本

deepseek-r1-0528

0528為R1模型的小版本升級,相較於舊版 R1,新版在複雜推理任務中的表現有了顯著提升。在數學、編程與通用邏輯等多個基準測評中取得了優異成績。

推理服務供應商

deepseek-r1-0528模型的推理服務供應商為阿里雲百鍊。

模型能力

能力項支援情況能力項支援情況

輸入模態

Text

輸出模態

Text

模型體驗

支援

Function Calling

支援

結構化輸出

不支援

連網搜尋

支援

首碼續寫

不支援

上下文緩衝

不支援

批量推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

98304

最大輸出長度

16384

上下文長度

131072

模型價格

本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
  • 華北2(北京)
計費項目價格(美元)單位

輸入

0.574

每百萬tokens

輸出

2.294

每百萬tokens

限流

  • 華北2(北京)
參數

RPM(每分鐘請求數)

60

TPM(每分鐘tokens)

100,000

Token Plan
模型體驗
  • 音樂產生
用量統計與效能監控
資產中心
服務支援