Qwen-VL-Plus adalah versi yang ditingkatkan dari model bahasa visual tingkat tinggi. Model ini secara signifikan meningkatkan kemampuan pengenalan detail dan teks, serta mendukung gambar dengan resolusi melebihi satu juta piksel dan rasio aspek apa pun. Model ini menawarkan performa luar biasa dalam berbagai tugas visual. Secara fungsional, versi ini setara dengan model Snapshot qwen-vl-plus-2025-08-15.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen-vl-plus adalah Alibaba Cloud Model Studio.
Kemampuan Model
- Tiongkok (Beijing)
- Singapura
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text Image Video | Modalitas Output | Text |
Pengalaman Model | Didukung | Function Calling | Tidak Didukung |
Structured Outputs | Didukung | Web Search | Tidak Didukung |
Prefix Completion | Didukung | Context Caching | Didukung |
Batch Inference | Didukung | Fine-tuning | Didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 129024 | Max Output Length | 8192 |
Context Window | 131072 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,115 | Per 1 juta token |
Output | 0,287 | Per 1 juta token |
Input(Implicit Cache) | 0,023 | Per 1 juta token |
Input(Batch File) | 0,057 | Per 1 juta token |
Output(Batch File) | 0,143 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
- Singapura
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 1200 |
TPM (Tokens Per Minute) | 1.000.000 |