Skip to main content
Sintesis suara

cosyvoice-v3-flash

Kemampuan Sintesis: CosyVoice-v3-Flash adalah model sintesis suara berkinerja tinggi terbaru dalam seri CosyVoice dari Tongyi Labs, yang menawarkan peningkatan naturalitas, timbre, prosodi, dan ekspresi emosional dibandingkan versi sebelumnya. Model ini mendukung sintesis teks-ke-ucapan (text-to-speech) secara streaming real-time. Kemampuan Kloning: CosyVoice-v3-Flash juga merupakan model kloning suara terbaru dalam seri CosyVoice dari Tongyi Labs. Dibandingkan versi sebelumnya, model ini meningkatkan akurasi pengucapan dan kemiripan timbre, serta menambah dukungan untuk lebih banyak bahasa yang kurang umum digunakan (Jerman, Spanyol, Prancis, Italia, Rusia, Jepang). Model ini dapat menghasilkan suara kustom yang sangat mirip dan terdengar alami hanya dari 5–20 detik audio referensi.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk cosyvoice-v3-flash adalah Alibaba Cloud Model Studio.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Modalitas Input

Text

Modalitas Output

Audio

Pengalaman Model

Unsupported

Function Calling

Unsupported

Structured Outputs

Unsupported

Web Search

Unsupported

Prefix Completion

Unsupported

Context Caching

Unsupported

Batch Inference

Unsupported

Fine-tuning

Unsupported

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

—

Max Output Length

—

Context Window

—

Harga

Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • Tiongkok (Beijing)
  • Singapura
Item PenagihanHarga (USD)Unit

TTS

0,14335

Per 10.000 karakter

Batas Laju

  • Tiongkok (Beijing)
  • Singapura
ParameterNilai

RPM (Requests Per Minute)

180

Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center