Skip to main content
Sintesis suara

qwen-voice-enrollment

Model Qwen Voice-Enrollment merupakan rangkaian model replikasi suara dari model speech Qwen. Model ini mampu mereplikasi suara yang sangat mirip hanya dengan audio berdurasi 5 detik atau lebih. Saat digunakan bersama model qwen3-tts-vc-realtime, model ini dapat mereplikasi suara seseorang dengan tingkat kesetiaan tinggi dan menghasilkan ucapan dalam 10 bahasa. Selain itu, audio hasil sintesis mampu menyesuaikan nada secara adaptif sesuai teks serta memiliki kemampuan pemrosesan yang baik untuk sintesis teks kompleks.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen-voice-enrollment adalah Alibaba Cloud Model Studio.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Modalitas Input

Audio

Modalitas Output

Text

Pengalaman Model

Tidak Didukung

Function Calling

Tidak Didukung

Structured Outputs

Tidak Didukung

Web Search

Tidak Didukung

Prefix Completion

Tidak Didukung

Context Caching

Tidak Didukung

Batch Inference

Tidak Didukung

Fine-tuning

Tidak Didukung

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

—

Max Output Length

—

Context Window

—

Harga

Halaman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • Singapura
Lingkup: Internasional
Item PenagihanHarga (USD)Unit

Voice Enrollment And Design

0,01

call(s)

Batas Laju

  • Tiongkok (Beijing)
  • Singapura
ParameterNilai

RPM (Requests Per Minute)

180

Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center