Model Mixture-of-Experts (MoE) buatan sendiri dengan 671 miliar parameter (37 miliar diaktifkan), yang telah menjalani pre-train pada 14,8 triliun token. Model ini menunjukkan kemampuan luar biasa dalam pemrosesan teks panjang, coding, matematika, pengetahuan ensiklopedis, dan tugas berbahasa Tiongkok.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk deepseek-v3 adalah Alibaba Cloud Model Studio.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Text | Output Modality | Text |
Model Experience | Didukung | Function Calling | Didukung |
Structured Outputs | Tidak Didukung | Web Search | Didukung |
Prefix Completion | Tidak Didukung | Context Caching | Didukung |
Batch Inference | Tidak Didukung | Fine-tuning | Tidak Didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 57344 | Max Output Length | 8192 |
Context Window | 65536 |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,287 | Per 1 juta token |
Output | 1,147 | Per 1 juta token |
Input(Implicit Cache) | 0,057 | Per 1 juta token |
Input(Batch File) | 0,143 | Per 1 juta token |
Output(Batch File) | 0,573 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 15000 |
TPM (Tokens Per Minute) | 1.200.000 |