Antarmuka utama dan parameter permintaan untuk sintesis suara real-time Qwen pada DashScope Java SDK.
Prasyarat
Diperlukan DashScope Java SDK versi 2.22.7 atau lebih baru.
Mulai menggunakan
- Mode server commit
- Mode commit
appendText()Parameter permintaan
Konfigurasikan parameter permintaan berikut menggunakan metode chaining atau setter dari objek QwenTtsRealtimeParam, lalu teruskan objek tersebut ke konstruktor QwenTtsRealtime.
Parameter | Tipe | Wajib | Deskripsi |
|---|---|---|---|
model | String | Ya | Nama model (lihat Model yang didukung). |
url | String | Ya | China (Beijing): Singapura: |
QwenTtsRealtimeConfig, lalu teruskan objek tersebut ke metode updateSession.
Parameter | Type | Wajib | Deskripsi |
|---|---|---|---|
voice | String | Ya | Voice untuk sintesis suara. Untuk informasi selengkapnya, lihat Voice yang didukung. Voice sistem dan voice kustom didukung:
|
languageType | String | Tidak | Menentukan bahasa audio hasil sintesis. Nilai default adalah
|
mode | String | Tidak | Mode interaksi. Nilai yang valid:
|
format | String | Tidak | Format output audio dari model. Format yang didukung:
Qwen-TTS-Realtime (lihat Model yang didukung) hanya mendukung |
sampleRate | int | Tidak | Laju sampel output audio dari model, dalam Hz. Laju sampel yang didukung:
Qwen-TTS-Realtime (lihat Model yang didukung) hanya mendukung 24000. |
speechRate | float | Tidak | Kecepatan bicara audio. Nilai 1.0 adalah kecepatan normal. Nilai kurang dari 1.0 lebih lambat, dan nilai lebih dari 1.0 lebih cepat. Nilai default: 1.0. Rentang valid: [0.5, 2.0]. Qwen-TTS-Realtime (lihat Model yang didukung) tidak mendukung parameter ini. |
volume | int | Tidak | Volume audio. Nilai default: 50. Rentang valid: [0, 100]. Qwen-TTS-Realtime (lihat Model yang didukung) tidak mendukung parameter ini. |
pitchRate | float | Tidak | Nada audio hasil sintesis. Nilai default: 1.0. Rentang valid: [0.5, 2.0]. Qwen-TTS-Realtime (lihat Model yang didukung) tidak mendukung parameter ini. |
bitRate | int | Tidak | Menentukan bitrate audio dalam kbps. Bitrate yang lebih tinggi menghasilkan kualitas audio lebih baik dan ukuran file lebih besar. Parameter ini hanya tersedia ketika format audio ( Nilai default: 128. Rentang valid: [6, 510]. Qwen-TTS-Realtime (lihat Model yang didukung) tidak mendukung parameter ini. |
instructions | String | Tidak | Mengatur instruksi. Untuk informasi selengkapnya, lihat Sintesis suara real-time - Qwen. Nilai default: Tidak ada. Parameter tidak aktif jika tidak diatur. Batas panjang: Panjang tidak boleh melebihi 1600 token. Bahasa yang didukung: Hanya bahasa Mandarin dan Inggris. Cakupan: Fitur ini hanya tersedia untuk seri model Qwen3-TTS-Instruct-Flash-Realtime. |
optimizeInstructions | boolean | Tidak | Menentukan apakah akan mengoptimalkan Nilai default: false. Perilaku: Ketika diatur ke true, sistem meningkatkan dan menulis ulang konten Skenario: Direkomendasikan untuk skenario yang membutuhkan ekspresi suara berkualitas tinggi dan detail halus. Ketergantungan: Parameter ini bergantung pada parameter Cakupan: Fitur ini hanya tersedia untuk seri model Qwen3-TTS-Instruct-Flash-Realtime. |
Antarmuka utama
Kelas QwenTtsRealtime
Untuk mengimpor:
| Metode | Signature | Event server | Deskripsi |
|---|---|---|---|
| connect | session.createdSesi dibuatsession.updated Konfigurasi sesi diperbarui | Membuka koneksi WebSocket ke server. | |
| updateSession | session.updatedKonfigurasi sesi diperbarui | Memperbarui konfigurasi sesi. Lihat Parameter permintaan.Setelah terhubung, server mengembalikan konfigurasi input dan output default untuk sesi. Panggil metode ini segera setelah connect() untuk mengganti nilai default.Server memvalidasi parameter saat menerima event session.update. Jika ada parameter yang tidak valid, server mengembalikan error. Jika tidak, server memperbarui konfigurasi sesi di sisi server. | |
| appendText | Tidak ada | Menambahkan segmen teks ke buffer input sisi server. Buffer menyimpan teks hingga Anda mengirimkannya.
| |
| clearAppendedText | input_text_buffer.clearedMenghapus teks yang diterima oleh server | Menghapus semua teks dalam buffer input sisi server. | |
| commit | input_text_buffer.committedCommit teks dan picu sintesis suararesponse.output_item.added Konten output baru muncul dalam responsresponse.content_part.added Konten output baru ditambahkan ke item pesan asistenresponse.audio.delta Model menghasilkan audio secara inkrementalresponse.audio.done Generasi audio selesairesponse.content_part.done Streaming konten audio untuk pesan asisten selesairesponse.output_item.done Streaming seluruh item output untuk pesan asisten selesairesponse.done Respons selesai | Commit teks yang sebelumnya ditambahkan ke buffer sisi server dan langsung mensintesis semua teks. Mengembalikan error jika buffer kosong.
| |
| finish | session.finishedRespons selesai | Menghentikan tugas saat ini. | |
| close | Tidak ada | Menutup koneksi. | |
| getSessionId | Tidak ada | Mengembalikan ID sesi dari tugas saat ini. | |
| getResponseId | Tidak ada | Mengembalikan ID respons dari respons terbaru. | |
| getFirstAudioDelay | Tidak ada | Mengembalikan latensi paket audio pertama dalam milidetik. |
Antarmuka callback (QwenTtsRealtimeCallback)
| Metode | Parameter | Nilai kembali | Deskripsi |
|---|---|---|---|
| Tidak ada | Tidak ada | Dipanggil segera setelah koneksi WebSocket terbentuk. | |
| message: event respons sisi server. | Tidak ada | Dipanggil ketika server mengirim event, termasuk respons panggilan API dan audio yang dihasilkan model. Lihat Event sisi server. | |
| code: kode status penutupan WebSocket.reason: alasan penutupan. | Tidak ada | Dipanggil setelah server menutup koneksi. |