Versi Thinking dari model MoE terbesar kedua dalam seri Qwen3-VL menawarkan respons cepat serta peningkatan kemampuan pemahaman dan penalaran multimodal, agen visual, dan dukungan untuk konteks sangat panjang seperti video dan dokumen berdurasi lama. Model ini juga dilengkapi peningkatan komprehensif dalam pemahaman gambar/video, kesadaran spasial, serta kemampuan pengenalan objek, sehingga sangat cocok untuk tugas-tugas dunia nyata yang kompleks.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3-vl-30b-a3b-thinking adalah Alibaba Cloud Model Studio.
Kemampuan Model
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text Image Video | Modalitas Output | Text |
Pengalaman Model | Didukung | Function Calling | Didukung |
Structured Outputs | Didukung | Web Search | Tidak Didukung |
Prefix Completion | Didukung | Context Caching | Tidak Didukung |
Batch Inference | Tidak Didukung | Fine-tuning | Tidak Didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Panjang Input Maksimum | 126976 | Panjang Output Maksimum | 32768 |
Jendela Konteks | 131072 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input(Thinking) | 0,108 | Per 1 juta token |
Output(Thinking) | 1,075 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 600 |
TPM (Tokens Per Minute) | 1.000.000 |