Model Flash seri vision-language native Qwen3.7 secara komprehensif meningkatkan kemampuan pemahaman multimodal dan eksekusi Agent dibandingkan dengan 3.6-Flash. Peningkatan utama mencakup penguatan kemampuan multimodal dasar, peningkatan pengenalan objek, serta persepsi dunia nyata dan kecerdasan spasial yang lebih baik. Skenario Multimodal Agent seperti Search Agent dan CI Agent mengalami peningkatan signifikan dengan eksekusi tugas end-to-end yang lebih stabil. Kemampuan coding multimodal juga dioptimalkan untuk memberikan pengalaman coding vibe yang lebih lancar.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3.7-flash adalah Alibaba Cloud Model Studio.
Kemampuan Model
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Jepang (Tokyo)
- Hong Kong (China)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Image Text Video | Output Modality | Text |
Model Experience | Didukung | Function Calling | Didukung |
Structured Outputs | Didukung | Web Search | Didukung |
Prefix Completion | Didukung | Context Caching | Didukung |
Batch Inference | Didukung | Fine-tuning | Tidak didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 991808 | Max Output Length | 131072 |
Context Window | 1000000 | Max Input Length (Thinking Mode) | 983616 |
Max Output Length (Thinking Mode) | 131072 | Max Chain-of-Thought Length | 262144 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Jepang (Tokyo)
- Hong Kong (China)
Input<=32k
Input<=32k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,028 | Per 1 juta token |
Output | 0,11 | Per 1 juta token |
Input(Implicit Cache) | 0,006 | Per 1 juta token |
Input(Batch File) | 0,014 | Per 1 juta token |
Output(Batch File) | 0,055 | Per 1 juta token |
Explicit Cache Creation | 0,034 | Per 1 juta token |
Explicit Cache Read | 0,003 | Per 1 juta token |
Input(Batch Chat) | 0,028 | Per 1 juta token |
Output(Batch Chat) | 0,11 | Per 1 juta token |
32k<Input<=256k
32k<Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,083 | Per 1 juta token |
Output | 0,33 | Per 1 juta token |
Input(Implicit Cache) | 0,017 | Per 1 juta token |
Input(Batch File) | 0,041 | Per 1 juta token |
Output(Batch File) | 0,165 | Per 1 juta token |
Explicit Cache Creation | 0,103 | Per 1 juta token |
Explicit Cache Read | 0,008 | Per 1 juta token |
Input(Batch Chat) | 0,083 | Per 1 juta token |
Output(Batch Chat) | 0,33 | Per 1 juta token |
256k<Input<=1m
256k<Input<=1m
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,165 | Per 1 juta token |
Output | 0,66 | Per 1 juta token |
Input(Implicit Cache) | 0,033 | Per 1 juta token |
Input(Batch File) | 0,083 | Per 1 juta token |
Output(Batch File) | 0,33 | Per 1 juta token |
Explicit Cache Creation | 0,206 | Per 1 juta token |
Explicit Cache Read | 0,017 | Per 1 juta token |
Input(Batch Chat) | 0,165 | Per 1 juta token |
Output(Batch Chat) | 0,66 | Per 1 juta token |
Batas Laju
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- Jepang (Tokyo)
- Hong Kong (China)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 30000 |
TPM (Tokens Per Minute) | 5.000.000 |
Versi Snapshot
qwen3.7-flash-2026-07-15
Model Flash seri vision-language native Qwen3.7 secara komprehensif meningkatkan kemampuan pemahaman multimodal dan eksekusi Agent dibandingkan dengan 3.6-Flash. Peningkatan utama mencakup penguatan kemampuan multimodal dasar, peningkatan pengenalan objek, serta persepsi dunia nyata dan kecerdasan spasial yang lebih baik. Skenario Multimodal Agent seperti Search Agent dan CI Agent mengalami peningkatan signifikan dengan eksekusi tugas end-to-end yang lebih stabil. Kemampuan coding multimodal juga dioptimalkan untuk memberikan pengalaman coding vibe yang lebih lancar.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3.7-flash-2026-07-15 adalah Alibaba Cloud Model Studio.
Kemampuan Model
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Jepang (Tokyo)
- Hong Kong (China)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Image Text Video | Output Modality | Text |
Model Experience | Didukung | Function Calling | Didukung |
Structured Outputs | Didukung | Web Search | Didukung |
Prefix Completion | Didukung | Context Caching | Didukung |
Batch Inference | Tidak didukung | Fine-tuning | Tidak didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 991808 | Max Output Length | 131072 |
Context Window | 1000000 | Max Input Length (Thinking Mode) | 983616 |
Max Output Length (Thinking Mode) | 131072 | Max Chain-of-Thought Length | 262144 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Jepang (Tokyo)
- Hong Kong (China)
Input<=32k
Input<=32k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,028 | Per 1 juta token |
Output | 0,11 | Per 1 juta token |
Input(Implicit Cache) | 0,006 | Per 1 juta token |
Explicit Cache Creation | 0,034 | Per 1 juta token |
Explicit Cache Read | 0,003 | Per 1 juta token |
32k<Input<=256k
32k<Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,083 | Per 1 juta token |
Output | 0,33 | Per 1 juta token |
Input(Implicit Cache) | 0,017 | Per 1 juta token |
Explicit Cache Creation | 0,103 | Per 1 juta token |
Explicit Cache Read | 0,008 | Per 1 juta token |
256k<Input<=1m
256k<Input<=1m
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,165 | Per 1 juta token |
Output | 0,66 | Per 1 juta token |
Input(Implicit Cache) | 0,033 | Per 1 juta token |
Explicit Cache Creation | 0,206 | Per 1 juta token |
Explicit Cache Read | 0,017 | Per 1 juta token |
Batas Laju
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- Jepang (Tokyo)
- Hong Kong (China)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 30000 |
TPM (Tokens Per Minute) | 5.000.000 |