Model besar MoE unggulan dengan 1,6 triliun parameter dan 49 miliar parameter yang diaktifkan, secara native mendukung panjang konteks hingga satu juta token. Dilatih pada korpus data berkualitas tinggi dalam jumlah besar, model ini unggul dalam penalaran matematika tingkat lanjut, inferensi logis kompleks, pengkodean spesialis, dan analisis mendalam teks berformat panjang, sehingga sangat cocok untuk aplikasi yang menuntut seperti penelitian mutakhir, alur kerja kantor canggih, dan agen AI tingkat lanjut.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk deepseek-v4-pro adalah Alibaba Cloud Model Studio.
Kemampuan Model
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Jepang (Tokyo)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Text | Output Modality | Text |
Model Experience | Supported | Function Calling | Supported |
Structured Outputs | Supported | Web Search | Supported |
Prefix Completion | Unsupported | Context Caching | Supported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 1000000 | Max Output Length | 393216 |
Context Window | 1000000 |
Harga
Halaman ini hanya menampilkan harga standar untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk informasi penawaran promosi.
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Jepang (Tokyo)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 1,65 | Per 1 juta token |
Output | 3,301 | Per 1 juta token |
Input(Implicit Cache) | 0,138 | Per 1 juta token |
Batas Laju
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Jepang (Tokyo)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 15000 |
TPM (Tokens Per Minute) | 1.200.000 |
Versi Snapshot
deepseek-v4-pro-0813
MoE, 1,6T, 49B, ., , , , , , .
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk deepseek-v4-pro-0813 adalah Alibaba Cloud Model Studio.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Text | Output Modality | Text |
Model Experience | Supported | Function Calling | Supported |
Structured Outputs | Supported | Web Search | Supported |
Prefix Completion | Unsupported | Context Caching | Supported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 1000000 | Max Output Length | 393216 |
Context Window | 1000000 | Max Input Length (Thinking Mode) | 1000000 |
Max Output Length (Thinking Mode) | 393216 | Max Chain-of-Thought Length | 393216 |
Harga
Halaman ini hanya menampilkan harga standar untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk informasi penawaran promosi.
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Jepang (Tokyo)
- Hong Kong (China)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,636 | Per 1 juta token |
Input | 1,272 | Per 1 juta token |
Output | 1,908 | Per 1 juta token |
Output | 3,816 | Per 1 juta token |
Input(Implicit Cache) | 0,064 | Per 1 juta token |
Input(Implicit Cache) | 0,127 | Per 1 juta token |
Batas Laju
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Jepang (Tokyo)
- Hong Kong (China)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 15000 |
TPM (Tokens Per Minute) | 1.200.000 |