Skip to main content
Sintesis suara

qwen-voice-design

Model Qwen Voice-Design adalah rangkaian model desain suara dari Qwen Speech Model. Model ini hanya memerlukan deskripsi teks sederhana untuk secara cepat menghasilkan suara yang sesuai. Saat digunakan bersama model qwen3-tts-vd-realtime, model ini dapat mendesain dan menghasilkan output suara dalam 10 bahasa. Selain itu, audio sintesis dapat menyesuaikan nada secara adaptif berdasarkan teks input dan memiliki kemampuan pemrosesan yang baik untuk sintesis teks kompleks.

Penyedia Layanan Inferensi

Penyedia layanan inferensi untuk qwen-voice-design adalah Alibaba Cloud Model Studio.

Kemampuan Model

KemampuanDukunganKemampuanDukungan

Modalitas Input

Text

Modalitas Output

Audio

Pengalaman Model

Unsupported

Function Calling

Unsupported

Structured Outputs

Unsupported

Web Search

Unsupported

Prefix Completion

Unsupported

Context Caching

Unsupported

Batch Inference

Unsupported

Fine-tuning

Unsupported

Batas Konteks

ParameterNilaiParameterNilai

Max Input Length

—

Max Output Length

—

Context Window

—

Harga

Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu. Kunjungi Konsol Model Studio untuk penawaran promosi.
  • Tiongkok (Beijing)
  • Singapura
Item PenagihanHarga (USD)Unit

Voice Enrollment And Design

0,2

Per voice

Batas Laju

  • Tiongkok (Beijing)
  • Singapura
ParameterNilai

RPM (Requests Per Minute)

180

Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center