Model Qwen Voice-Enrollment merupakan rangkaian model replikasi suara dari model speech Qwen. Model ini mampu mereplikasi suara yang sangat mirip hanya dengan audio berdurasi 5 detik atau lebih. Saat digunakan bersama model qwen3-tts-vc-realtime, model ini dapat mereplikasi suara seseorang dengan tingkat kesetiaan tinggi dan menghasilkan ucapan dalam 10 bahasa. Selain itu, audio hasil sintesis mampu menyesuaikan nada secara adaptif sesuai teks serta memiliki kemampuan pemrosesan yang baik untuk sintesis teks kompleks.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen-voice-enrollment adalah Alibaba Cloud Model Studio.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Audio | Modalitas Output | Text |
Pengalaman Model | Tidak Didukung | Function Calling | Tidak Didukung |
Structured Outputs | Tidak Didukung | Web Search | Tidak Didukung |
Prefix Completion | Tidak Didukung | Context Caching | Tidak Didukung |
Batch Inference | Tidak Didukung | Fine-tuning | Tidak Didukung |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | — | Max Output Length | — |
Context Window | — |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Singapura
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Voice Enrollment And Design | 0,01 | call(s) |
Batas Laju
- Tiongkok (Beijing)
- Singapura
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 180 |