Seri model vision-language native Flash Qwen3.6 menawarkan peningkatan performa signifikan dibandingkan versi 3.5-Flash. Model ini unggul terutama dalam kemampuan coding agentic, melampaui pendahulunya secara substansial pada berbagai benchmark code-agent, serta dalam penalaran matematika dan kode. Dari sisi visi, model ini menunjukkan kecerdasan spasial yang jauh lebih baik, dengan peningkatan utama dalam pelokalan objek dan deteksi objek.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3.6-flash adalah Alibaba Cloud Model Studio.
Kemampuan Model
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Jepang (Tokyo)
- Hong Kong (Tiongkok)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Image Text Video | Output Modality | Text |
Model Experience | Supported | Function Calling | Supported |
Structured Outputs | Supported | Web Search | Supported |
Prefix Completion | Supported | Context Caching | Supported |
Batch Inference | Supported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 991808 | Max Output Length | 65536 |
Context Window | 1000000 | Max Input Length (Thinking Mode) | 983616 |
Max Output Length (Thinking Mode) | 65536 | Max Chain-of-Thought Length | 131072 |
Harga
Halaman ini hanya menampilkan harga standar untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk informasi penawaran promosi.
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Jepang (Tokyo)
- Hong Kong (Tiongkok)
Input<=256k
Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,165 | Per 1 juta token |
Output | 0,99 | Per 1 juta token |
Input(Batch File) | 0,083 | Per 1 juta token |
Output(Batch File) | 0,495 | Per 1 juta token |
Explicit Cache Creation | 0,206 | Per 1 juta token |
Explicit Cache Read | 0,017 | Per 1 juta token |
Input(Batch Chat) | 0,165 | Per 1 juta token |
Output(Batch Chat) | 0,99 | Per 1 juta token |
256k<Input<=1m
256k<Input<=1m
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,66 | Per 1 juta token |
Output | 3,961 | Per 1 juta token |
Input(Batch File) | 0,33 | Per 1 juta token |
Output(Batch File) | 1,98 | Per 1 juta token |
Explicit Cache Creation | 0,825 | Per 1 juta token |
Explicit Cache Read | 0,066 | Per 1 juta token |
Input(Batch Chat) | 0,66 | Per 1 juta token |
Output(Batch Chat) | 3,961 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Jepang (Tokyo)
- Hong Kong (Tiongkok)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 30000 |
TPM (Tokens Per Minute) | 10.000.000 |
Versi Snapshot
qwen3.6-flash-2026-04-16
Seri model vision-language native Flash Qwen3.6 menawarkan peningkatan performa signifikan dibandingkan versi 3.5-Flash. Model ini unggul terutama dalam kemampuan coding agentic, melampaui pendahulunya secara substansial pada berbagai benchmark code-agent, serta dalam penalaran matematika dan kode. Dari sisi visi, model ini menunjukkan kecerdasan spasial yang jauh lebih baik, dengan peningkatan utama dalam pelokalan objek dan deteksi objek. Rilis ini berdasarkan snapshot yang diambil pada 16 April 2026.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3.6-flash-2026-04-16 adalah Alibaba Cloud Model Studio.
Kemampuan Model
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Jepang (Tokyo)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Image Text Video | Output Modality | Text |
Model Experience | Supported | Function Calling | Supported |
Structured Outputs | Supported | Web Search | Supported |
Prefix Completion | Supported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Supported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 991808 | Max Output Length | 65536 |
Context Window | 1000000 | Max Input Length (Thinking Mode) | 983616 |
Max Output Length (Thinking Mode) | 65536 | Max Chain-of-Thought Length | 131072 |
Harga
Halaman ini hanya menampilkan harga standar untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk informasi penawaran promosi.
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Jepang (Tokyo)
Input<=256k
Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,165 | Per 1 juta token |
Output | 0,99 | Per 1 juta token |
256k<Input<=1m
256k<Input<=1m
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,66 | Per 1 juta token |
Output | 3,961 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Jepang (Tokyo)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 600 |
TPM (Tokens Per Minute) | 1.000.000 |