DeepSeek-V3.2 adalah rilis resmi model yang menggabungkan DeepSeek Sparse Attention—mekanisme perhatian sparse. Ini juga merupakan model pertama dari DeepSeek yang mengintegrasikan reasoning ke dalam penggunaan tool, mendukung baik pemanggilan tool dengan maupun tanpa reasoning.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk deepseek-v3.2 adalah Alibaba Cloud Model Studio.
Kemampuan Model
- China (Beijing)
- Singapura
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Text | Output Modality | Text |
Model Experience | Didukung | Function Calling | Didukung |
Structured Outputs | Tidak didukung | Web Search | Didukung |
Prefix Completion | Tidak didukung | Context Caching | Didukung |
Batch Inference | Didukung | Fine-tuning | Tidak didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 98304 | Max Output Length | 65536 |
Context Window | 131072 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Konsol Model Studio untuk penawaran promosi.
- China (Beijing)
- Singapura
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,287 | Per 1 juta token |
Output | 0,431 | Per 1 juta token |
Input(Implicit Cache) | 0,058 | Per 1 juta token |
Input(Batch File) | 0,144 | Per 1 juta token |
Output(Batch File) | 0,216 | Per 1 juta token |
Explicit Cache Creation | 0,359 | Per 1 juta token |
Explicit Cache Read | 0,029 | Per 1 juta token |
Input(Batch Chat) | 0,287 | Per 1 juta token |
Output(Batch Chat) | 0,431 | Per 1 juta token |
Batas Laju
- China (Beijing)
- Singapura
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 15000 |
TPM (Tokens Per Minute) | 1.000.000 |