Model padat terbesar dalam seri Qwen3-VL versi non-inferensi ini menawarkan performa keseluruhan yang hanya sedikit di bawah Qwen3-VL-235B-Instruct. Model ini unggul dalam pengenalan dan pemahaman dokumen, menunjukkan kemampuan kuat dalam kesadaran spasial dan identifikasi objek, serta mencapai performa teknologi terkini dalam deteksi visual 2D dan penalaran spasial. Model ini sangat cocok untuk tugas persepsi kompleks di berbagai skenario umum.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3-vl-32b-instruct adalah Alibaba Cloud Model Studio.
Kemampuan Model
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text Image Video | Modalitas Output | Text |
Pengalaman Model | Didukung | Function Calling | Didukung |
Structured Outputs | Didukung | Web Search | Tidak Didukung |
Prefix Completion | Didukung | Context Caching | Tidak Didukung |
Batch Inference | Tidak Didukung | Fine-tuning | Tidak Didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Panjang Input Maksimum | 129024 | Panjang Output Maksimum | 32768 |
Jendela Konteks | 131072 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,287 | |
Output | 1,147 |
Batas Laju
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 600 |
TPM (Tokens Per Minute) | 1.000.000 |