Model Max dalam seri Qwen 3 telah mengalami peningkatan khusus dalam pemrograman agen dan pemanggilan tool dibandingkan dengan versi pratinjau. Model yang dirilis secara resmi kali ini telah mencapai performa state-of-the-art (SOTA) di bidangnya dan lebih cocok untuk memenuhi kebutuhan agen yang beroperasi dalam skenario lebih kompleks. Versi ini secara fungsional setara dengan snapshot model qwen3-max-2026-01-23.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3-max adalah Alibaba Cloud Model Studio.
Kemampuan Model
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Hong Kong (Tiongkok)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Text | Output Modality | Text |
Model Experience | Didukung | Function Calling | Didukung |
Structured Outputs | Didukung | Web Search | Didukung |
Prefix Completion | Didukung | Context Caching | Didukung |
Batch Inference | Didukung | Fine-tuning | Tidak didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 258048 | Max Output Length | 65536 |
Context Window | 262144 | Max Input Length (Thinking Mode) | 258048 |
Max Output Length (Thinking Mode) | 32768 | Max Chain-of-Thought Length | 81920 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Hong Kong (Tiongkok)
Input<=32k
Input<=32k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,359 | Per 1 juta token |
Output | 1,434 | Per 1 juta token |
Input(Implicit Cache) | 0,072 | Per 1 juta token |
Input(Batch File) | 0,18 | Per 1 juta token |
Output(Batch File) | 0,717 | Per 1 juta token |
Explicit Cache Creation | 0,448 | Per 1 juta token |
Explicit Cache Read | 0,036 | Per 1 juta token |
Input(Batch Chat) | 0,359 | Per 1 juta token |
Output(Batch Chat) | 1,434 | Per 1 juta token |
32k<Input<=128k
32k<Input<=128k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,574 | Per 1 juta token |
Output | 2,294 | Per 1 juta token |
Input(Implicit Cache) | 0,115 | Per 1 juta token |
Input(Batch File) | 0,287 | Per 1 juta token |
Output(Batch File) | 1,147 | Per 1 juta token |
Explicit Cache Creation | 0,717 | Per 1 juta token |
Explicit Cache Read | 0,058 | Per 1 juta token |
Input(Batch Chat) | 0,574 | Per 1 juta token |
Output(Batch Chat) | 2,294 | Per 1 juta token |
128k<Input<=256k
128k<Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 1,004 | Per 1 juta token |
Output | 4,014 | Per 1 juta token |
Input(Implicit Cache) | 0,201 | Per 1 juta token |
Input(Batch File) | 0,502 | Per 1 juta token |
Output(Batch File) | 2,007 | Per 1 juta token |
Explicit Cache Creation | 1,255 | Per 1 juta token |
Explicit Cache Read | 0,101 | Per 1 juta token |
Input(Batch Chat) | 1,004 | Per 1 juta token |
Output(Batch Chat) | 4,014 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
- Hong Kong (Tiongkok)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 30000 |
TPM (Tokens Per Minute) | 5.000.000 |
Versi Snapshot
qwen3-max-preview
Versi pratinjau Model Max dalam seri Qwen 3 mencapai integrasi efektif antara mode berpikir dan non-berpikir. Dalam mode berpikir, terdapat peningkatan signifikan dalam kemampuan seperti pemrograman agen cerdas, penalaran akal sehat, serta penalaran lintas bidang matematika, sains, dan umum.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3-max-preview adalah Alibaba Cloud Model Studio.
Kemampuan Model
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Text | Output Modality | Text |
Model Experience | Didukung | Function Calling | Tidak didukung |
Structured Outputs | Tidak didukung | Web Search | Tidak didukung |
Prefix Completion | Tidak didukung | Context Caching | Didukung |
Batch Inference | Tidak didukung | Fine-tuning | Tidak didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 258048 | Max Output Length | 65536 |
Context Window | 262144 | Max Input Length (Thinking Mode) | 258048 |
Max Output Length (Thinking Mode) | 32768 | Max Chain-of-Thought Length | 81920 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
Input<=32k
Input<=32k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,861 | Per 1 juta token |
Output | 3,441 | Per 1 juta token |
Input(Implicit Cache) | 0,173 | Per 1 juta token |
32k<Input<=128k
32k<Input<=128k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 1,434 | Per 1 juta token |
Output | 5,735 | Per 1 juta token |
Input(Implicit Cache) | 0,287 | Per 1 juta token |
128k<Input<=256k
128k<Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 2,151 | Per 1 juta token |
Output | 8,602 | Per 1 juta token |
Input(Implicit Cache) | 0,431 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 600 |
TPM (Tokens Per Minute) | 1.000.000 |
qwen3-max-2026-01-23
Dibandingkan dengan snapshot per 23 September 2025, Model Max seri Qwen 3 pada rilis ini mencapai integrasi efektif antara mode berpikir dan non-berpikir, menghasilkan peningkatan komprehensif dan substansial dalam performa keseluruhan model. Dalam mode berpikir, model secara simultan mendukung pencarian web, ekstraksi informasi web, dan tool interpreter kode, memungkinkannya menangani masalah yang lebih kompleks dan menantang dengan akurasi lebih tinggi melalui pemanfaatan tool eksternal disertai penalaran deliberatif yang lambat. Versi ini berdasarkan snapshot yang diambil pada 23 Januari 2026.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3-max-2026-01-23 adalah Alibaba Cloud Model Studio.
Kemampuan Model
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- Hong Kong (Tiongkok)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Text | Output Modality | Text |
Model Experience | Didukung | Function Calling | Didukung |
Structured Outputs | Didukung | Web Search | Didukung |
Prefix Completion | Didukung | Context Caching | Tidak didukung |
Batch Inference | Tidak didukung | Fine-tuning | Tidak didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 258048 | Max Output Length | 65536 |
Context Window | 262144 | Max Input Length (Thinking Mode) | 258048 |
Max Output Length (Thinking Mode) | 32768 | Max Chain-of-Thought Length | 81920 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- Hong Kong (Tiongkok)
Input<=32k
Input<=32k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,359 | Per 1 juta token |
Output | 1,434 | Per 1 juta token |
32k<Input<=128k
32k<Input<=128k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,574 | Per 1 juta token |
Output | 2,294 | Per 1 juta token |
128k<Input<=256k
128k<Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 1,004 | Per 1 juta token |
Output | 4,014 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- Hong Kong (Tiongkok)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 600 |
TPM (Tokens Per Minute) | 1.000.000 |
qwen3-max-2025-09-23
Model Max dalam seri Qwen 3 telah mengalami peningkatan khusus dalam pemrograman agen dan pemanggilan tool dibandingkan dengan versi pratinjau. Model yang dirilis secara resmi kali ini telah mencapai performa state-of-the-art (SOTA) di bidangnya dan lebih cocok untuk memenuhi kebutuhan agen yang beroperasi dalam skenario lebih kompleks. Versi ini merupakan snapshot per 23 September 2025.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3-max-2025-09-23 adalah Alibaba Cloud Model Studio.
Kemampuan Model
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Text | Output Modality | Text |
Model Experience | Didukung | Function Calling | Didukung |
Structured Outputs | Didukung | Web Search | Didukung |
Prefix Completion | Didukung | Context Caching | Tidak didukung |
Batch Inference | Tidak didukung | Fine-tuning | Tidak didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 258048 | Max Output Length | 32768 |
Context Window | 262144 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
Input<=32k
Input<=32k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,86 | Per 1 juta token |
Output | 3,44 | Per 1 juta token |
32k<Input<=128k
32k<Input<=128k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 1,434 | Per 1 juta token |
Output | 5,734 | Per 1 juta token |
128k<Input<=256k
128k<Input<=256k
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 2,15 | Per 1 juta token |
Output | 8,601 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 60 |
TPM (Tokens Per Minute) | 100.000 |