Model sintesis suara dengan ekspresivitas tinggi dari seri CosyVoice yang dilengkapi kemampuan kloning suara dan desain yang ditingkatkan. Model ini mendukung kontrol instruksi gaya bebas sambil mempertahankan kemiripan pembicara, serta menyediakan berbagai gaya sintesis yang kaya. Latensi suku kata pertama dikurangi, akurasi pelafalan ditingkatkan, dan prosodi serta kualitas suara disempurnakan. Model ini memungkinkan sintesis suara real-time multibahasa (Tiongkok, Inggris, Jerman, Prancis, Rusia, Jepang, Korea, Portugis, Thailand, Indonesia, Vietnam) yang sangat alami.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk cosyvoice-v3.5-plus adalah Alibaba Cloud Model Studio.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Audio |
Pengalaman Model | Unsupported | Function Calling | Unsupported |
Structured Outputs | Unsupported | Web Search | Unsupported |
Prefix Completion | Unsupported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | — | Max Output Length | — |
Context Window | — |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
TTS | 0,22 | Per 10.000 karakter |
Batas Laju
- Tiongkok (Beijing)
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 180 |