Qwen3.8-Flash adalah model multimodal terbaru dari keluarga Qwen, menggabungkan kemampuan penalaran dan generasi yang kuat dengan kecepatan yang luar biasa. Model ini secara native mendukung context window satu juta token, memungkinkan pemrosesan dokumen panjang, seluruh repository kode, dan percakapan kompleks dalam satu kali proses. Unggul dalam bantuan coding, alur kerja agentic, dan pemahaman visual. Sepenuhnya kompatibel dengan protokol API OpenAI dan Anthropic, terintegrasi mulus dengan alat pengembang populer seperti Claude Code dan Codex. Dengan performa kuat dan biaya inferensi yang sangat kompetitif, Qwen3.8-Flash adalah pilihan ideal bagi pengembang dan bisnis yang mencari keseimbangan efektivitas dan efisiensi dalam aplikasi AI.
Kemampuan Model
- Tiongkok (Beijing)
- Singapura
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Gambar Teks Video | Modalitas Output | Teks |
Pengalaman Model | Didukung | Function Calling | Didukung |
Output Terstruktur | Didukung | Pencarian Web | Didukung |
Mode Prefix | Didukung | Cache Konteks | Didukung |
Inferensi Batch | Tidak Didukung | Fine-tuning | Tidak Didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Panjang Input Maks | 991808 | Panjang Output Maks | 131072 |
Panjang Input Maks (Mode Berpikir) | 983616 | Panjang Output Maks (Mode Berpikir) | 131072 |
Jendela Konteks | 1000000 | Panjang Chain-of-Thought Maks | 262144 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi waktu terbatas. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
| Item Penagihan | Harga (USD) | Satuan |
|---|---|---|
Input | 0.14 | Per 1 juta token |
Output | 0.42 | Per 1 juta token |
Input (Cache Implisit) | 0.014 | Per 1 juta token |
Pembuatan Cache Eksplisit | 0.177 | Per 1 juta token |
Pembacaan Cache Eksplisit | 0.014 | Per 1 juta token |
Batas Rate
- Tiongkok (Beijing)
- Singapura
| Parameter | Nilai |
|---|---|
RPM (Permintaan Per Menit) | 30.000 |
TPM (Token Per Menit) | 5.000.000 |