Qwen-Max mendukung skala parameter ratusan miliar dan menerima input dalam beberapa bahasa, termasuk Tiongkok dan Inggris. Model ini diperbarui secara berkala dan menunjukkan peningkatan signifikan dibandingkan versi sebelumnya dalam kemampuan menghasilkan kode, penalaran logis, serta pemrosesan multibahasa—baik dalam bahasa Tiongkok maupun Inggris. Gaya tanggapan telah disesuaikan secara signifikan agar selaras dengan preferensi manusia, dengan peningkatan nyata pada tingkat detail dan kejelasan. Peningkatan khusus juga dilakukan dalam penulisan kreatif, kepatuhan terhadap format JSON, serta kemampuan bermain peran. Versi ini secara fungsional setara dengan model Snapshot qwen-max-2025-01-25.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen-max adalah Alibaba Cloud Model Studio.
Kemampuan Model
- Tiongkok (Beijing)
- Singapura
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Text | Output Modality | Text |
Model Experience | Didukung | Function Calling | Didukung |
Structured Outputs | Didukung | Web Search | Didukung |
Prefix Completion | Didukung | Context Caching | Didukung |
Batch Inference | Didukung | Fine-tuning | Tidak Didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 30720 | Max Output Length | 8192 |
Context Window | 32768 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
| Item Tagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,345 | Per 1 juta token |
Output | 1,377 | Per 1 juta token |
Input(Implicit Cache) | 0,072 | Per 1 juta token |
Input(Batch File) | 0,172 | Per 1 juta token |
Output(Batch File) | 0,688 | Per 1 juta token |
Batas Laju
- Tiongkok (Beijing)
- Singapura
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 1200 |
TPM (Tokens Per Minute) | 1.000.000 |