Model VL seri Qwen3 secara efektif mengintegrasikan mode berpikir dan tidak berpikir, mencapai kinerja terdepan di dunia dalam kemampuan agen visual pada dataset benchmark publik seperti OS World. Versi ini menampilkan peningkatan komprehensif dalam pengkodean visual, persepsi spasial, dan penalaran multimodal, secara signifikan meningkatkan kemampuan persepsi dan pengenalan visual serta mendukung pemahaman video ultra-panjang. Secara fungsional, versi model ini setara dengan model Snapshot qwen3-vl-plus-2025-12-19.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3-vl-plus adalah Alibaba Cloud Model Studio.
Kemampuan Model
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Hong Kong (Tiongkok)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text Image Video | Modalitas Output | Text |
Pengalaman Model | Didukung | Function Calling | Didukung |
Structured Outputs | Didukung | Web Search | Tidak Didukung |
Prefix Completion | Didukung | Context Caching | Didukung |
Batch Inference | Didukung | Fine-tuning | Tidak Didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Panjang Input Maksimum | 260096 | Panjang Output Maksimum | 32768 |
Jendela Konteks | 262144 | Panjang Input Maksimum (Mode Berpikir) | 258048 |
Panjang Output Maksimum (Mode Berpikir) | 32768 | Panjang Chain-of-Thought Maksimum | 81920 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Hong Kong (Tiongkok)
Input<=32k
Input<=32k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,144 | Per 1 juta token |
Output | 1,434 | Per 1 juta token |
Input(Implicit Cache) | 0,029 | Per 1 juta token |
Input(Batch File) | 0,072 | Per 1 juta token |
Output(Batch File) | 0,717 | Per 1 juta token |
Explicit Cache Creation | 0,18 | Per 1 juta token |
Explicit Cache Read | 0,014 | Per 1 juta token |
Input(Batch Chat) | 0,144 | Per 1 juta token |
Output(Batch Chat) | 1,434 | Per 1 juta token |
32k<Input<=128k
32k<Input<=128k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,216 | Per 1 juta token |
Output | 2,151 | Per 1 juta token |
Input(Implicit Cache) | 0,044 | Per 1 juta token |
Input(Batch File) | 0,108 | Per 1 juta token |
Output(Batch File) | 1,075 | Per 1 juta token |
Explicit Cache Creation | 0,27 | Per 1 juta token |
Explicit Cache Read | 0,022 | Per 1 juta token |
Input(Batch Chat) | 0,216 | Per 1 juta token |
Output(Batch Chat) | 2,151 | Per 1 juta token |
128k<Input<=256k
128k<Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,431 | Per 1 juta token |
Output | 4,301 | Per 1 juta token |
Input(Implicit Cache) | 0,087 | Per 1 juta token |
Input(Batch File) | 0,215 | Per 1 juta token |
Output(Batch File) | 2,15 | Per 1 juta token |
Explicit Cache Creation | 0,539 | Per 1 juta token |
Explicit Cache Read | 0,043 | Per 1 juta token |
Input(Batch Chat) | 0,431 | Per 1 juta token |
Output(Batch Chat) | 4,301 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Hong Kong (Tiongkok)
| Parameter | Nilai |
|---|---|
RPM (Permintaan Per Menit) | 3000 |
TPM (Token Per Menit) | 5.000.000 |
Versi Snapshot
qwen3-vl-plus-2025-12-19
Model pemahaman visual seri Qwen3 secara efektif mengintegrasikan mode berpikir dan tidak berpikir. Dibandingkan dengan snapshot yang dirilis pada 23 September, versi ini menawarkan kinerja unggul dalam tugas penalaran, analisis, dan kontrol gaya, serta latensi lebih rendah dan kecepatan respons lebih cepat. Versi ini didasarkan pada snapshot yang diambil pada 19 Desember 2025.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3-vl-plus-2025-12-19 adalah Alibaba Cloud Model Studio.
Kemampuan Model
- Tiongkok (Beijing)
- Singapura
- Hong Kong (Tiongkok)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text Image Video | Modalitas Output | Text |
Pengalaman Model | Didukung | Function Calling | Didukung |
Structured Outputs | Didukung | Web Search | Tidak Didukung |
Prefix Completion | Didukung | Context Caching | Tidak Didukung |
Batch Inference | Tidak Didukung | Fine-tuning | Tidak Didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Panjang Input Maksimum | 260096 | Panjang Output Maksimum | 32768 |
Jendela Konteks | 262144 | Panjang Input Maksimum (Mode Berpikir) | 258048 |
Panjang Output Maksimum (Mode Berpikir) | 32768 | Panjang Chain-of-Thought Maksimum | 81920 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
- Hong Kong (Tiongkok)
Input<=32k
Input<=32k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,144 | Per 1 juta token |
Output | 1,434 | Per 1 juta token |
32k<Input<=128k
32k<Input<=128k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,216 | Per 1 juta token |
Output | 2,151 | Per 1 juta token |
128k<Input<=256k
128k<Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,431 | Per 1 juta token |
Output | 4,301 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
- Singapura
- Hong Kong (Tiongkok)
| Parameter | Nilai |
|---|---|
RPM (Permintaan Per Menit) | 60 |
TPM (Token Per Menit) | 100.000 |
qwen3-vl-plus-2025-09-23
Model VL seri Qwen3 secara efektif mengintegrasikan mode berpikir dan tidak berpikir, mencapai kinerja terdepan di dunia dalam kemampuan agen visual pada dataset benchmark publik seperti OS World. Versi ini menampilkan peningkatan komprehensif dalam pengkodean visual, persepsi spasial, dan penalaran multimodal, secara signifikan meningkatkan kemampuan persepsi dan pengenalan visual serta mendukung pemahaman video ultra-panjang. Versi ini merupakan snapshot per tanggal 23 September 2025.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3-vl-plus-2025-09-23 adalah Alibaba Cloud Model Studio.
Kemampuan Model
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text Image Video | Modalitas Output | Text |
Pengalaman Model | Didukung | Function Calling | Didukung |
Structured Outputs | Didukung | Web Search | Tidak Didukung |
Prefix Completion | Didukung | Context Caching | Tidak Didukung |
Batch Inference | Tidak Didukung | Fine-tuning | Tidak Didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Panjang Input Maksimum | 260096 | Panjang Output Maksimum | 32768 |
Jendela Konteks | 262144 | Panjang Input Maksimum (Mode Berpikir) | 258048 |
Panjang Output Maksimum (Mode Berpikir) | 32768 | Panjang Chain-of-Thought Maksimum | 81920 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
Input<=32k
Input<=32k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,143 | Per 1 juta token |
Output | 1,434 | Per 1 juta token |
32k<Input<=128k
32k<Input<=128k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,215 | Per 1 juta token |
Output | 2,15 | Per 1 juta token |
128k<Input<=256k
128k<Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,43 | Per 1 juta token |
Output | 4,301 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Parameter | Nilai |
|---|---|
RPM (Permintaan Per Menit) | 60 |
TPM (Token Per Menit) | 100.000 |