Kemampuan Sintesis: CosyVoice-v3-Flash adalah model sintesis suara berkinerja tinggi terbaru dalam seri CosyVoice dari Tongyi Labs, yang menawarkan peningkatan naturalitas, timbre, prosodi, dan ekspresi emosional dibandingkan versi sebelumnya. Model ini mendukung sintesis teks-ke-ucapan (text-to-speech) secara streaming real-time. Kemampuan Kloning: CosyVoice-v3-Flash juga merupakan model kloning suara terbaru dalam seri CosyVoice dari Tongyi Labs. Dibandingkan versi sebelumnya, model ini meningkatkan akurasi pengucapan dan kemiripan timbre, serta menambah dukungan untuk lebih banyak bahasa yang kurang umum digunakan (Jerman, Spanyol, Prancis, Italia, Rusia, Jepang). Model ini dapat menghasilkan suara kustom yang sangat mirip dan terdengar alami hanya dari 5–20 detik audio referensi.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk cosyvoice-v3-flash adalah Alibaba Cloud Model Studio.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Audio |
Pengalaman Model | Unsupported | Function Calling | Unsupported |
Structured Outputs | Unsupported | Web Search | Unsupported |
Prefix Completion | Unsupported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | — | Max Output Length | — |
Context Window | — |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Konsol Model Studio untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
TTS | 0,14335 | Per 10.000 karakter |
Batas Laju
- Tiongkok (Beijing)
- Singapura
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 180 |