Qwen3.8-2.4T-A95B adalah rilis open-source dari model andalan terbaru Qwen, yang diluncurkan pada Agustus 2026. Arsitektur MoE sparse-nya memiliki total 2,4 triliun parameter dengan ~95 miliar parameter yang diaktifkan per langkah, dipadukan dengan attention hibrida dan jendela konteks 1 juta token. Benchmark utama: GPQA Diamond 92,6, PaperBench 93,0, OSWorld 86,1, BabyVision 82,0. Peringkat ke-4 di CodeArena.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3.8-2.4t-a95b adalah Alibaba Cloud Model Studio.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Teks | Modalitas Output | Teks |
Pengalaman Model | Didukung | Function Calling | Didukung |
Output Terstruktur | Didukung | Pencarian Web | Didukung |
Kompleksi Prefiks | Didukung | Caching Konteks | Didukung |
Inferensi Batch | Tidak Didukung | Fine-tuning | Tidak Didukung |
Batas Konteks
Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Panjang Input Maksimum | 991808 | Panjang Output Maksimum | 131072 |
Panjang Konteks | 1000000 | Panjang Input Maksimum (Mode Berpikir) | 983616 |
Panjang Output Maksimum (Mode Berpikir) | 131072 | Panjang Chain-of-Thought Maksimum | 131072 |
Harga
Halaman ini hanya menampilkan harga asli untuk pemanggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- China (Beijing)
- Singapura
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 1.65 | Per 1 juta token |
Output | 4.951 | Per 1 juta token |
Input (Cache Hit) | 0.206 | Per 1 juta token |
Pembuatan Cache Eksplisit | 2.063 | Per 1 juta token |
Cache Hit Eksplisit | 0.137 | Per 1 juta token |
Batas Laju
- China (Beijing)
- Singapura
| Parameter | Nilai |
|---|---|
RPM (Permintaan Per Menit) | 5000 |
TPM (Token Per Menit) | 5,000,000 |