Seri model vision-language native Qwen3.6 Flash memberikan peningkatan performa signifikan dibandingkan versi 3.5-Flash. Model ini unggul terutama dalam kemampuan coding agentic, secara substansial melampaui pendahulunya pada berbagai benchmark code-agent, serta dalam penalaran matematika dan pemrosesan kode. Dari sisi vision, model ini menunjukkan peningkatan kecerdasan spasial yang mencolok, khususnya dalam pelokalan dan deteksi objek.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3.6-flash-us adalah Alibaba Cloud Model Studio.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text Image Video | Modalitas Output | Text |
Pengalaman Model | Didukung | Function Calling | Didukung |
Structured Outputs | Didukung | Web Search | Tidak Didukung |
Prefix Completion | Didukung | Context Caching | Didukung |
Batch Inference | Tidak Didukung | Fine-tuning | Tidak Didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Panjang Input Maksimum | 991808 | Panjang Output Maksimum | 65536 |
Context Window | 1000000 | Panjang Input Maksimum (Thinking Mode) | 983616 |
Panjang Output Maksimum (Thinking Mode) | 65536 |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Konsol Model Studio untuk penawaran promosi.
- AS (Virginia)
Input<=256k
Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,25 | Per 1 juta token |
Output | 1,5 | Per 1 juta token |
Explicit Cache Creation | 0,3125 | Per 1 juta token |
Explicit Cache Read | 0,025 | Per 1 juta token |
256k<Input<=1m
256k<Input<=1m
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 1 | Per 1 juta token |
Output | 4 | Per 1 juta token |
Explicit Cache Creation | 1,25 | Per 1 juta token |
Explicit Cache Read | 0,1 | Per 1 juta token |
Batas Laju
- AS (Virginia)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 15000 |
TPM (Tokens Per Minute) | 5.000.000 |