Model Max merupakan model terbesar dan paling canggih dalam seri Qwen3.7, yang saat ini hanya menyediakan antarmuka berbasis teks murni untuk eksperimen publik. Qwen3.7 adalah model unggulan generasi berikutnya yang dirancang untuk era berbasis agent, dengan keunggulan utama pada cakupan dan kedalaman kemampuan tingkat agent: unggul dalam pemrograman, tugas kantor dan produktivitas, serta eksekusi otonom jangka panjang.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3.7-max-us adalah Alibaba Cloud Model Studio.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Text |
Pengalaman Model | Didukung | Function Calling | Didukung |
Structured Outputs | Didukung | Web Search | Tidak Didukung |
Prefix Completion | Didukung | Context Caching | Didukung |
Batch Inference | Tidak Didukung | Fine-tuning | Tidak Didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 991808 | Max Output Length | 131072 |
Context Window | 1000000 | Max Input Length (Thinking Mode) | 983616 |
Max Output Length (Thinking Mode) | 131072 |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Konsol Model Studio untuk penawaran promosi.
- AS (Virginia)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 2,5 | Per 1 juta token |
Output | 7,5 | Per 1 juta token |
Input(Implicit Cache) | 0,5 | Per 1 juta token |
Explicit Cache Creation | 3,125 | Per 1 juta token |
Explicit Cache Read | 0,25 | Per 1 juta token |
Batas Laju
- AS (Virginia)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 600 |
TPM (Tokens Per Minute) | 1.000.000 |