Skip to main content
Generasi Audio

qwen-audio-3.1-tts-next

Qwen-Audio-3.1-TTS-Next adalah model AudioGen yang dirancang untuk generasi audio terpadu. Melampaui sistem TTS konvensional yang hanya berfokus pada sintesis ucapan, model ini dapat menghasilkan konten audio lengkap dalam satu kali proses dari input seperti teks, stempel waktu, dan audio referensi, menggabungkan ucapan, efek suara, suara latar, dan lainnya secara mulus. Model ini mendukung berbagai tugas, termasuk TTS multibahasa, ucapan pembicara tunggal, dialog multi-pembicara, podcast, lanskap suara sinematik, audio latar, dan efek suara. Keunggulan utamanya meliputi ucapan yang lebih alami dan ekspresif, identitas suara yang konsisten, kontrol waktu yang fleksibel, dan generasi lanskap suara berkualitas tinggi. Kemampuan ini menjadikannya sangat cocok untuk pembuatan konten, video pendek, podcast, produksi film dan televisi, audio game, dan skenario pembuatan audio profesional lainnya.

Penyedia layanan inferensi

Alibaba Cloud Model Studio menyediakan layanan inferensi untuk model ini.

Kemampuan model

KemampuanDukunganKemampuanDukungan
Modalitas inputTeks dan audio referensiModalitas outputAudio
BahasaCina dan InggrisMode outputNon-streaming
Format outputWAV, MP3, dan PCMAudio referensiURL atau Base64

Batas konteks

ParameterNilai
Panjang input maksimum3,000 karakter
Durasi output maksimum per permintaanPodcast: 240 detik (4 menit); skenario lain: 120 detik
Jumlah audio referensiHingga 3 klip
Durasi per klip referensiHingga 30 detik
Ukuran per klip referensiHingga 10 MB
Format audio referensiWAV, MP3, dan OGG Opus. PCM mentah tidak didukung.

Harga model

Daftar harga berikut tidak termasuk promosi. Untuk penawaran promosi, lihat konsol Model Studio.
  • Tiongkok (Beijing)
Item penagihanHarga satuan (USD/juta token)
Input0.848
Output1.696
Token input dan output ditagih secara terpisah. Untuk detailnya, lihat Harga model.

Batas laju

  • Tiongkok (Beijing)
MetrikNilai
Permintaan per detik (RPS)3

Akses API

Gunakan API HTTPS untuk menerima file audio lengkap. Untuk contoh dan panduan prompt, lihat Generasi audio. Untuk parameter dan kode sampel, lihat Referensi API generasi audio.
Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center
Dukungan layanan
  • FAQ
  • Perjanjian Terkait