Qwen-Audio-3.1-ASR-Flash-Filetrans adalah model pengenalan ucapan offline end-to-end yang dirancang untuk skenario seperti transkripsi rapat, produksi konten, dan analisis panggilan. Model ini mendukung pengenalan dialek Tiongkok multibahasa dan multi-wilayah. Model ini memiliki kemampuan transkripsi presisi tinggi, peningkatan kata panas dan konteks, pemisahan pembicara, prediksi tanda baca, dan normalisasi teks. Model ini mempertahankan kinerja yang stabil bahkan di lingkungan yang bising dan kompleks, menjadikannya pilihan utama untuk transkripsi audio panjang. Versi ini juga mendukung keluaran ASR/AST yang dapat dikontrol untuk berbagai dialek.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen-audio-3.1-asr-flash-filetrans adalah Alibaba Cloud Model Studio.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
| Modalitas Input | Audio | Modalitas Output | Teks |
| Pengalaman Model | Tidak Didukung | Function Calling | Tidak Didukung |
| Structured Outputs | Tidak Didukung | Pencarian Web | Tidak Didukung |
| Prefix Completion | Tidak Didukung | Caching Konteks | Tidak Didukung |
| Inferensi Batch | Tidak Didukung | Fine-tuning | Tidak Didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
| Panjang Input Maksimum | 8192 Token | Panjang Output Maksimum | 1024 Token |
| Jendela Konteks | 8192 Token |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi waktu terbatas. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapore
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
| Input | 0.113 | Per juta token |
| Output | 0.382 | Per juta token |
Batas Laju
- Tiongkok (Beijing)
- Singapore
| Parameter | Nilai |
|---|---|
| RPM (permintaan per menit) | 600 |