Seri Model Role-Playing Qwen dioptimalkan khusus untuk skenario interaksi antropomorfik multibahasa. Model ini menunjukkan kemampuan tingkat lanjut dalam menjaga konsistensi karakter, memajukan dialog yang peka terhadap konteks, serta melibatkan pengguna secara empatik, sehingga memungkinkan penerapan karakter personalisasi yang akurat. Versi ini secara signifikan meningkatkan pelokalan linguistik bahasa Jepang (termasuk dialek dan bentuk hormat), keaslian role-playing ala manusia, kontrol koherensi naratif, dan kecerdasan kognitif berbasis skenario.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen-flash-character adalah Alibaba Cloud Model Studio.
Kemampuan Model
- China (Beijing)
- Singapura
- AS (Virginia)
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Text | Output Modality | Text |
Model Experience | Supported | Function Calling | Unsupported |
Structured Outputs | Supported | Web Search | Supported |
Prefix Completion | Unsupported | Context Caching | Supported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 32,768 | Max Output Length | 32,768 |
Context Window | 32,768 |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Konsol Model Studio untuk penawaran promosi.
- China (Beijing)
- Singapura
- AS (Virginia)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,034 | Per 1 juta token |
Output | 0,203 | Per 1 juta token |
Input(Implicit Cache) | 0,007 | Per 1 juta token |
Batas Laju
- China (Beijing)
- Singapura
- AS (Virginia)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 120 |
TPM (Tokens Per Minute) | 500.000 |