本文檔介紹如何在阿里雲百鍊平台通過OpenAI相容介面或DashScope SDK調用DeepSeek系列模型。
服務接入地址
不同地區的服務接入地址不同,請根據您選擇的地區配置對應的 Base URL(調用時請將{WorkspaceId}替換為真實的業務空間ID)。各地區可調用的模型及限流不同,請參見限流文檔。
- OpenAI相容
- OpenAI相容-Responses API
- DashScope
- 華北2(北京)
- 美國(維吉尼亞)
- 新加坡
- 德國(法蘭克福)
- 日本(東京)
SDK 調用配置的
base_url:https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1HTTP 要求地址:POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1/chat/completions快速開始
deepseek-v4-pro-0813 是 DeepSeek 系列旗艦模型,在編程、數學和通用任務方面表現出色。deepseek-v4-flash-0731 是Flash系列最新版本。您可以通過enable_thinking參數在思考與非思考模式之間切換。以下樣本以 deepseek-v4-pro 模型為例展示思考模式的調用方式,您可以將 model 參數替換為其他 DeepSeek 模型。
需要已擷取與配置 API Key並完成配置API Key到環境變數。如果通過SDK調用,需要安裝 OpenAI 或 DashScope SDK。
- OpenAI相容
- DashScope
- Anthropic相容
enable_thinking非 OpenAI 標準參數,OpenAI Python SDK通過 extra_body傳入,Node.js SDK作為頂層參數傳入。reasoning_effort是 OpenAI 標準參數,可直接作為頂層參數傳入。- Python
- Node.js
- HTTP
範例程式碼
返回結果
推理強度(reasoning_effort)
deepseek-v4-pro、deepseek-v4-flash 、 deepseek-v4-flash-0731 和 deepseek-v4-pro-0813預設開啟思考模式。通過reasoning_effort參數可以調整推理強度,可選值為low(僅deepseek-v4-flash-0731 和 deepseek-v4-pro-0813 支援)、high和max,預設為high。
- OpenAI相容
- DashScope
Python
Responses API
deepseek-v4-flash、deepseek-v4-flash-0731、deepseek-v4-pro與deepseek-v4-pro-0813支援通過 OpenAI 相容的 Responses API 呼叫,僅支援華北2(北京)與新加坡地區,服務接入地址參見服務接入地址。
通過 Responses API 呼叫時,可在tools參數中添加web_search(連網搜尋)、web_extractor(網頁抓取)與code_interpreter(代碼解譯器)工具。
Python
其它功能
| 模型 | 多輪對話 | Function Calling | 上下文緩衝 | 結構化輸出 | 首碼續寫 |
|---|---|---|---|---|---|
| deepseek-v4-pro | 支援 | 支援 | 支援 | 支援 | 不支援 |
| deepseek-v4-pro-us | 支援 | 支援 | 支援 | 支援 | 不支援 |
| deepseek-v4-flash-0731 | 支援 | 支援 | 支援 | 支援 | 不支援 |
| deepseek-v4-flash | 支援 | 支援 | 支援 | 支援 | 不支援 |
| deepseek-v4-flash-us | 支援 | 支援 | 支援 | 支援 | 不支援 |
| deepseek-v3.2 | 支援 | 支援 | 支援 | 不支援 | 不支援 |
| deepseek-v3.2-exp | 支援 | 支援僅支援非思考模式。 | 不支援 | 不支援 | 不支援 |
| deepseek-v3.1 | 支援 | 支援僅支援非思考模式。 | 支援 | 不支援 | 不支援 |
| deepseek-r1 | 支援 | 支援 | 支援 | 不支援 | 不支援 |
| deepseek-r1-0528 | 支援 | 支援 | 不支援 | 不支援 | 不支援 |
| deepseek-v3 | 支援 | 支援 | 支援 | 不支援 | 不支援 |
| 蒸餾模型 | 支援 | 不支援 | 不支援 | 不支援 | 不支援 |
參數預設值
模型 | temperature | top_p | repetition_penalty | presence_penalty | max_tokens | thinking_budget |
|---|---|---|---|---|---|---|
deepseek-v4-pro | 1.0 | 1.0 | - | - | 共393,216 | |
deepseek-v4-pro-us | 1.0 | 1.0 | - | - | 共393,216 | |
deepseek-v4-flash-0731 | 1.0 | 1.0 | - | - | 共393,216 | |
deepseek-v4-flash | 1.0 | 1.0 | - | - | 共393,216 | |
deepseek-v4-flash-us | 1.0 | 1.0 | - | - | 共393,216 | |
deepseek-v3.2 | 1.0 | 0.95 | - | - | 65,536 | 32,768 |
deepseek-v3.2-exp | 0.6 | 0.95 | 1.0 | - | 65,536 | 32,768 |
deepseek-v3.1 | 0.6 | 0.95 | 1.0 | - | 65,536 | 32,768 |
deepseek-r1 | 0.6 | 0.95 | - | 1 | 16,384 | 32,768 |
deepseek-r1-0528 | 0.6 | 0.95 | - | 1 | 16,384 | 32,768 |
蒸餾版 | 0.6 | 0.95 | - | 1 | 16,384 | 16,384 |
deepseek-v3 | 0.7 | 0.6 | - | - | 16,384 | - |
- “-” 表示沒有預設值,也不支援設定。
- deepseek-r1、deepseek-r1-0528、蒸餾版模型不支援設定以上參數值。
- “共393,216” 表示 deepseek-v4 系列模型的 max_tokens 與 thinking_budget 共用同一上限,兩者合計最大為 393,216 Token(即模型的最大輸出長度)。
- 參數含義請參考OpenAI相容-Chat。
模型列表與計費
- 混合思考模型(通過
enable_thinking參數控制是否思考):deepseek-v4-pro、deepseek-v4-flash、deepseek-v4-flash-0731、deepseek-v3.2、deepseek-v3.2-exp、deepseek-v3.1 - 僅思考模型(回複前總會思考):deepseek-r1、deepseek-r1-0528
- 非思考模型:deepseek-v3
思考模式下,思維鏈按照輸出 Token 計費。
常見問題
可以上傳圖片或文檔進行提問嗎?
DeepSeek 模型僅支援文本輸入,不支援圖片或文檔輸入。如需圖片輸入,請使用千問VL模型;如需文檔輸入,請使用Qwen-Long模型。
如何查看Token消耗量及調用次數?
模型調用完一小時後,在模型觀測版面設定查詢條件(例如,選擇時間範圍、業務空間等),再在模型列表地區找到目標模型並單擊操作列的监控,即可查看該模型的調用統計結果。具體請參見模型監控文檔。
資料按小時更新,高峰期可能有小時級延遲,請您耐心等待。