Qwen-MT-Flash, sebuah model bahasa besar dari seri Qwen, telah ditingkatkan sepenuhnya dengan arsitektur Qwen 3 untuk memberikan peningkatan signifikan dalam performa dan kualitas terjemahan. Model ini menyediakan layanan terjemahan cepat dan hemat biaya dalam 92 bahasa, serta mendukung fitur-fitur lanjutan seperti intervensi terminologi, pelestarian format, dan adaptasi berbasis domain. Model ini merupakan pilihan ideal untuk aplikasi yang membutuhkan keseimbangan optimal antara kecepatan, kualitas, dan biaya.
Inference Service Provider
Penyedia layanan inferensi untuk qwen-mt-flash adalah Alibaba Cloud Model Studio.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Input Modality | Text | Output Modality | Text |
Model Experience | Didukung | Function Calling | Tidak didukung |
Structured Outputs | Tidak didukung | Web Search | Tidak didukung |
Prefix Completion | Tidak didukung | Context Caching | Tidak didukung |
Batch Inference | Tidak didukung | Fine-tuning | Tidak didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | 8192 | Max Output Length | 8192 |
Context Window | 16384 |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Konsol Model Studio untuk informasi penawaran promosi.
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Input | 0,101 | Per 1 juta token |
Output | 0,28 | Per 1 juta token |
Batas Laju
- China (Beijing)
- Singapura
- Jerman (Frankfurt)
- AS (Virginia)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 60 |
TPM (Tokens Per Minute) | 35.000 |