Model Qwen Voice-Design adalah rangkaian model desain suara dari Qwen Speech Model. Model ini hanya memerlukan deskripsi teks sederhana untuk secara cepat menghasilkan suara yang sesuai. Saat digunakan bersama model qwen3-tts-vd-realtime, model ini dapat mendesain dan menghasilkan output suara dalam 10 bahasa. Selain itu, audio sintesis dapat menyesuaikan nada secara adaptif berdasarkan teks input dan memiliki kemampuan pemrosesan yang baik untuk sintesis teks kompleks.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen-voice-design adalah Alibaba Cloud Model Studio.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Audio |
Pengalaman Model | Unsupported | Function Calling | Unsupported |
Structured Outputs | Unsupported | Web Search | Unsupported |
Prefix Completion | Unsupported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | — | Max Output Length | — |
Context Window | — |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
Voice Enrollment And Design | 0,2 | Per voice |
Batas Laju
- Tiongkok (Beijing)
- Singapura
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 180 |