Berdasarkan Qwen3, model generasi kode ini mewarisi kemampuan coding agent dari Qwen3-Coder-Plus dan mendukung interaksi tool multi-turn. Model ini menampilkan optimasi yang difokuskan pada pemahaman tingkat repositori serta peningkatan stabilitas pemanggilan tool. Versi ini secara fungsional setara dengan snapshot model qwen3-coder-flash-2025-07-28.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3-coder-flash adalah Alibaba Cloud Model Studio.
Kemampuan Model
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Text | Output Modality | Text |
Model Experience | Supported | Function Calling | Supported |
Structured Outputs | Unsupported | Web Search | Unsupported |
Prefix Completion | Unsupported | Context Caching | Supported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 997952 | Max Output Length | 65536 |
Context Window | 1000000 |
Harga
Halaman ini hanya menampilkan harga standar untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Konsol Model Studio untuk informasi penawaran promosi.
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
Input<=32k
Input<=32k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,144 | Per 1 juta token |
Output | 0,574 | Per 1 juta token |
Input(Implicit Cache) | 0,029 | Per 1 juta token |
Explicit Cache Creation | 0,18 | Per 1 juta token |
Explicit Cache Read | 0,014 | Per 1 juta token |
32k<Input<=128k
32k<Input<=128k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,216 | Per 1 juta token |
Output | 0,861 | Per 1 juta token |
Input(Implicit Cache) | 0,044 | Per 1 juta token |
Explicit Cache Creation | 0,27 | Per 1 juta token |
Explicit Cache Read | 0,022 | Per 1 juta token |
128k<Input<=256k
128k<Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,359 | Per 1 juta token |
Output | 1,434 | Per 1 juta token |
Input(Implicit Cache) | 0,072 | Per 1 juta token |
Explicit Cache Creation | 0,449 | Per 1 juta token |
Explicit Cache Read | 0,036 | Per 1 juta token |
256k<Input<=1m
256k<Input<=1m
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,717 | Per 1 juta token |
Output | 3,584 | Per 1 juta token |
Input(Implicit Cache) | 0,144 | Per 1 juta token |
Explicit Cache Creation | 0,896 | Per 1 juta token |
Explicit Cache Read | 0,072 | Per 1 juta token |
Batas Laju
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 5000 |
TPM (Tokens Per Minute) | 5.000.000 |
Versi Snapshot
qwen3-coder-flash-2025-07-28
Berdasarkan Qwen3, model generasi kode ini mewarisi kemampuan coding agent dari Qwen3-Coder-Plus dan mendukung interaksi tool multi-turn. Model ini menampilkan optimasi yang difokuskan pada pemahaman tingkat repositori serta peningkatan stabilitas pemanggilan tool. Versi ini merupakan snapshot bertanggal 28 Juli 2025.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3-coder-flash-2025-07-28 adalah Alibaba Cloud Model Studio.
Kemampuan Model
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Text | Output Modality | Text |
Model Experience | Supported | Function Calling | Supported |
Structured Outputs | Unsupported | Web Search | Unsupported |
Prefix Completion | Unsupported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 997952 | Max Output Length | 65536 |
Context Window | 1000000 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Konsol Model Studio untuk penawaran promosi.
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
Input<=32k
Input<=32k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,144 | Per 1 juta token |
Output | 0,574 | Per 1 juta token |
32k<Input<=128k
32k<Input<=128k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,216 | Per 1 juta token |
Output | 0,861 | Per 1 juta token |
128k<Input<=256k
128k<Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,359 | Per 1 juta token |
Output | 1,434 | Per 1 juta token |
256k<Input<=1m
256k<Input<=1m
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,717 | Per 1 juta token |
Output | 3,584 | Per 1 juta token |
Batas Laju
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 60 |
TPM (Tokens Per Minute) | 1.000.000 |