Qwen-VL-Max adalah model bahasa visual berskala besar dari seri Qwen. Dibandingkan dengan versi Plus, model ini menawarkan peningkatan signifikan dalam kemampuan penalaran visual dan pemahaman instruksi, serta menyediakan tingkat persepsi dan kognisi visual yang lebih tinggi. Model ini memberikan performa optimal pada tugas-tugas yang lebih kompleks. Secara fungsional, versi ini setara dengan model Snapshot qwen-vl-max-2025-08-13.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen-vl-max adalah Alibaba Cloud Model Studio.
Kemampuan Model
- Tiongkok (Beijing)
- Singapura
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text Image Video | Modalitas Output | Text |
Pengalaman Model | Didukung | Function Calling | Tidak Didukung |
Structured Outputs | Didukung | Web Search | Tidak Didukung |
Prefix Completion | Didukung | Context Caching | Didukung |
Batch Inference | Didukung | Fine-tuning | Tidak Didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Panjang Input Maksimum | 129024 | Panjang Output Maksimum | 8192 |
Jendela Konteks | 131072 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,229 | Per 1 juta token |
Output | 0,573 | Per 1 juta token |
Input(Implicit Cache) | 0,046 | Per 1 juta token |
Input(Batch File) | 0,115 | Per 1 juta token |
Output(Batch File) | 0,287 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
- Singapura
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 1200 |
TPM (Tokens Per Minute) | 1.000.000 |