Skip to main content
Text Generation

deepseek-v4-flash

Model MoE yang sangat efisien dan ringan dengan total 284 miliar parameter dan 13 miliar parameter aktif, secara native mendukung jendela konteks hingga satu juta token. Model ini menawarkan inferensi cepat, latensi rendah, serta biaya pemanggilan hemat, menghadirkan kinerja keseluruhan yang seimbang. Dirancang untuk beban kerja ringan dengan konkurensi tinggi, model ini sangat cocok untuk kasus penggunaan umum dan esensial seperti dialog sehari-hari, pembuatan konten, aplikasi RAG dasar, dan pemrosesan teks batch.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk deepseek-v4-flash adalah Alibaba Cloud Model Studio.

Kemampuan Model

  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Jepang (Tokyo)
KemampuanDukunganKemampuanDukungan

Input Modality

Text

Output Modality

Text

Model Experience

Didukung

Function Calling

Didukung

Structured Outputs

Didukung

Web Search

Didukung

Prefix Completion

Tidak Didukung

Context Caching

Didukung

Batch Inference

Tidak Didukung

Fine-tuning

Tidak Didukung

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

1000000

Max Output Length

393216

Context Window

1000000

Harga

Halaman ini hanya menampilkan harga standar untuk pemanggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk informasi penawaran promosi.
  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Jepang (Tokyo)
Item PenagihanHarga (USD)Unit

Input

0,138

Per 1 juta token

Output

0,275

Per 1 juta token

Input(Implicit Cache)

0,028

Per 1 juta token

Batas Laju

  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Jepang (Tokyo)
ParameterNilai

RPM (Requests Per Minute)

15000

TPM (Tokens Per Minute)

1.200.000

Versi Snapshot

deepseek-v4-flash-0731

MoE, 284B, 13B, ., , , , , , , , RAG, .

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk deepseek-v4-flash-0731 adalah Alibaba Cloud Model Studio.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Input Modality

Text

Output Modality

Text

Model Experience

Didukung

Function Calling

Didukung

Structured Outputs

Tidak Didukung

Web Search

Didukung

Prefix Completion

Tidak Didukung

Context Caching

Didukung

Batch Inference

Tidak Didukung

Fine-tuning

Tidak Didukung

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

1000000

Max Output Length

393216

Context Window

1000000

Harga

Halaman ini hanya menampilkan harga asli untuk pemanggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk melihat penawaran promosi.
  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • AS (Virginia)
  • Jepang (Tokyo)
  • Hong Kong (China)
Item PenagihanHarga (USD)Unit

Input

0,212

Per 1 juta token

Input

0,424

Per 1 juta token

Output

0,636

Per 1 juta token

Output

1,272

Per 1 juta token

Input(Implicit Cache)

0,021

Per 1 juta token

Input(Implicit Cache)

0,042

Per 1 juta token

Batas Laju

  • China (Beijing)
  • Singapura
  • Jerman (Frankfurt)
  • Jepang (Tokyo)
  • Hong Kong (China)
ParameterNilai

RPM (Requests Per Minute)

15000

TPM (Tokens Per Minute)

1.200.000

Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center
Dukungan layanan