Versi Instruct dari model Dense 8B dalam seri Qwen3-VL membutuhkan lebih sedikit memori GPU dan menawarkan peningkatan komprehensif dalam pemahaman gambar dan video, dukungan konteks sangat panjang seperti video dan dokumen berdurasi lama, kesadaran spasial, serta kemampuan pengenalan objek, sehingga cocok untuk menangani tugas-tugas kompleks di dunia nyata.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3-vl-8b-instruct adalah Alibaba Cloud Model Studio.
Kemampuan Model
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text Image Video | Modalitas Output | Text |
Pengalaman Model | Didukung | Function Calling | Didukung |
Structured Outputs | Didukung | Web Search | Tidak Didukung |
Prefix Completion | Didukung | Context Caching | Tidak Didukung |
Batch Inference | Tidak Didukung | Fine-tuning | Didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Panjang Input Maksimum | 129024 | Panjang Output Maksimum | 32768 |
Jendela Konteks | 131072 |
Harga
Halaman ini hanya menampilkan harga dasar untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,072 | Per 1 juta token |
Output | 0,287 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 600 |
TPM (Tokens Per Minute) | 1.000.000 |