Model sintesis suara berkinerja tinggi dalam seri CosyVoice yang dilengkapi kemampuan kloning suara dan desain yang ditingkatkan. Model ini mendukung kontrol instruksi gaya bebas sambil mempertahankan kemiripan pembicara serta menawarkan beragam gaya sintesis. Latensi suku kata pertama dikurangi, akurasi pelafalan ditingkatkan, dan prosodi serta kualitas suara disempurnakan. Model ini memungkinkan sintesis suara real-time multibahasa (Tiongkok, Inggris, Jerman, Prancis, Rusia, Jepang, Korea, Portugis, Thailand, Indonesia, Vietnam) yang sangat alami.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk cosyvoice-v3.5-flash adalah Alibaba Cloud Model Studio.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Audio |
Pengalaman Model | Unsupported | Function Calling | Unsupported |
Structured Outputs | Unsupported | Web Search | Unsupported |
Prefix Completion | Unsupported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | — | Max Output Length | — |
Context Window | — |
Harga
Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
TTS | 0,116 | Per 10.000 karakter |
Batas Laju
- Tiongkok (Beijing)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 180 |