Model padat terbesar dalam seri Qwen3-VL, versi reasoning-nya memiliki kemampuan reasoning multimodal yang hanya kalah dari Qwen3-VL-235B-Thinking. Model ini unggul dalam pemecahan masalah STEM dan matematika, pemahaman umum terhadap gambar dan video, serta mencapai performa teknologi terkini dalam kemampuan agen multimodal, sehingga ideal untuk tugas reasoning multimodal yang kompleks.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3-vl-32b-thinking adalah Alibaba Cloud Model Studio.
Kemampuan Model
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Text Image Video | Output Modality | Text |
Model Experience | Didukung | Function Calling | Didukung |
Structured Outputs | Didukung | Web Search | Tidak Didukung |
Prefix Completion | Didukung | Context Caching | Tidak Didukung |
Batch Inference | Tidak Didukung | Fine-tuning | Tidak Didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | — | Max Output Length | — |
Context Window | 131072 | Max Input Length (Thinking Mode) | 126976 |
Max Output Length (Thinking Mode) | 32768 | Max Chain-of-Thought Length | 81920 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input(Thinking) | 0,287 | |
Output(Thinking) | 2,868 |
Batas Laju
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 600 |
TPM (Tokens Per Minute) | 1.000.000 |