Merupakan versi yang ditingkatkan dari model penalaran Qwen QwQ, yang dilatih berdasarkan model Qwen2.5 dan telah meningkatkan kemampuan penalarannya secara signifikan melalui Pembelajaran Penguatan. Metrik inti model ini dalam bidang matematika dan pemrograman (misalnya, AIME 24/25, LiveCodeBench) serta beberapa metrik umum (misalnya, IFEval, LiveBench) telah mencapai tingkat yang setara dengan versi lengkap DeepSeek-R1.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwq-plus adalah Alibaba Cloud Model Studio.
Kemampuan Model
- China (Beijing)
- Singapura
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Text | Output Modality | Text |
Model Experience | Supported | Function Calling | Supported |
Structured Outputs | Unsupported | Web Search | Supported |
Prefix Completion | Unsupported | Context Caching | Unsupported |
Batch Inference | Supported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 98304 | Max Output Length | 8192 |
Context Window | 131072 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Konsol Model Studio untuk penawaran promosi.
- China (Beijing)
- Singapura
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,23 | Per 1 juta token |
Output | 0,574 | Per 1 juta token |
Input(Batch File) | 0,115 | Per 1 juta token |
Output(Batch File) | 0,287 | Per 1 juta token |
Batas Laju
- China (Beijing)
- Singapura
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 600 |
TPM (Tokens Per Minute) | 1.000.000 |