Model MoE yang sangat efisien dan ringan dengan total 284 miliar parameter dan 13 miliar parameter aktif, secara native mendukung jendela konteks hingga satu juta token. Model ini menawarkan inferensi cepat, latensi rendah, serta biaya pemanggilan hemat, menghadirkan kinerja keseluruhan yang seimbang. Dirancang untuk beban kerja ringan dengan konkurensi tinggi, model ini sangat cocok untuk kasus penggunaan umum dan esensial seperti dialog sehari-hari, pembuatan konten, aplikasi RAG dasar, dan pemrosesan teks batch.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk deepseek-v4-flash adalah Alibaba Cloud Model Studio.
Kemampuan Model
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Jepang (Tokyo)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Text | Output Modality | Text |
Model Experience | Didukung | Function Calling | Didukung |
Structured Outputs | Didukung | Web Search | Didukung |
Prefix Completion | Tidak Didukung | Context Caching | Didukung |
Batch Inference | Tidak Didukung | Fine-tuning | Tidak Didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 1000000 | Max Output Length | 393216 |
Context Window | 1000000 |
Harga
Halaman ini hanya menampilkan harga standar untuk pemanggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk informasi penawaran promosi.
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Jepang (Tokyo)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,138 | Per 1 juta token |
Output | 0,275 | Per 1 juta token |
Input(Implicit Cache) | 0,028 | Per 1 juta token |
Batas Laju
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Jepang (Tokyo)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 15000 |
TPM (Tokens Per Minute) | 1.200.000 |
Versi Snapshot
deepseek-v4-flash-0731
MoE, 284B, 13B, ., , , , , , , , RAG, .
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk deepseek-v4-flash-0731 adalah Alibaba Cloud Model Studio.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Text | Output Modality | Text |
Model Experience | Didukung | Function Calling | Didukung |
Structured Outputs | Tidak Didukung | Web Search | Didukung |
Prefix Completion | Tidak Didukung | Context Caching | Didukung |
Batch Inference | Tidak Didukung | Fine-tuning | Tidak Didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 1000000 | Max Output Length | 393216 |
Context Window | 1000000 |
Harga
Halaman ini hanya menampilkan harga asli untuk pemanggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk melihat penawaran promosi.
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Jepang (Tokyo)
- Hong Kong (China)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,212 | Per 1 juta token |
Input | 0,424 | Per 1 juta token |
Output | 0,636 | Per 1 juta token |
Output | 1,272 | Per 1 juta token |
Input(Implicit Cache) | 0,021 | Per 1 juta token |
Input(Implicit Cache) | 0,042 | Per 1 juta token |
Batas Laju
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- Jepang (Tokyo)
- Hong Kong (China)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 15000 |
TPM (Tokens Per Minute) | 1.200.000 |