Prasyarat
Diperlukan DashScope Python SDK versi 1.25.11 atau yang lebih baru.
Mulai
Parameter permintaan
Tetapkan parameter berikut dalam konstruktor QwenTtsRealtime:
Parameter | Type | Wajib | Deskripsi |
|---|---|---|---|
model | str | Ya | Nama model (lihat Model yang didukung). |
url | str | Ya | China (Beijing): Singapura: |
Parameter | Type | Wajib | Deskripsi |
|---|---|---|---|
voice | str | Ya | Voice untuk sintesis suara. Untuk informasi selengkapnya, lihat Voice yang didukung. Mendukung suara sistem dan suara kustom:
|
language_type | str | Tidak | Menentukan bahasa audio hasil sintesis. Nilai default adalah
|
mode | str | Tidak | Mode interaksi. Nilai yang valid:
|
format | str | Tidak | Format output audio dari model. Format yang didukung:
Qwen-TTS-Realtime (lihat Model yang didukung) hanya mendukung |
sample_rate | int | Tidak | Laju sampel output audio dari model, dalam Hz. Laju sampel yang didukung:
Qwen-TTS-Realtime (lihat Model yang didukung) hanya mendukung 24000. |
speech_rate | float | Tidak | Laju bicara audio. Nilai 1.0 adalah kecepatan normal. Nilai kurang dari 1.0 lebih lambat, dan nilai lebih dari 1.0 lebih cepat. Nilai default: 1.0. Rentang valid: [0.5, 2.0]. Qwen-TTS-Realtime (lihat Model yang didukung) tidak mendukung parameter ini. |
volume | int | Tidak | Volume audio. Nilai default: 50. Rentang valid: [0, 100]. Qwen-TTS-Realtime (lihat Model yang didukung) tidak mendukung parameter ini. |
pitch_rate | float | Tidak | Pitch audio hasil sintesis. Nilai default: 1.0. Rentang valid: [0.5, 2.0]. Qwen-TTS-Realtime (lihat Model yang didukung) tidak mendukung parameter ini. |
bit_rate | int | Tidak | Menentukan bitrate audio dalam kbps. Bitrate yang lebih tinggi menghasilkan kualitas audio lebih baik dan ukuran file lebih besar. Parameter ini hanya tersedia ketika format audio ( Nilai default: 128. Rentang valid: [6, 510]. Qwen-TTS-Realtime (lihat Model yang didukung) tidak mendukung parameter ini. |
instructions | str | Tidak | Menetapkan instruksi. Untuk informasi selengkapnya, lihat Real-time speech synthesis - Qwen. Nilai default: None. Parameter ini tidak aktif jika tidak diatur. Batas panjang: Panjang tidak boleh melebihi 1600 token. Bahasa yang didukung: Hanya Bahasa Tiongkok dan Inggris. Cakupan: Fitur ini hanya tersedia untuk seri model Qwen3-TTS-Instruct-Flash-Realtime. |
optimize_instructions | bool | Tidak | Menentukan apakah akan mengoptimalkan Nilai default: False Perilaku: Ketika diatur ke True, sistem meningkatkan dan menulis ulang Skenario: Direkomendasikan untuk skenario yang memerlukan ekspresi suara berkualitas tinggi dan detail halus. Ketergantungan: Parameter ini bergantung pada pengaturan parameter Cakupan: Fitur ini hanya tersedia untuk seri model Qwen3-TTS-Instruct-Flash-Realtime. |
Antarmuka utama
Kelas QwenTtsRealtime
Impor: from dashscope.audio.qwen_tts_realtime import QwenTtsRealtime
| Signature metode | Event respons server (dikirimkan melalui callback) | Deskripsi |
|---|---|---|
session.createdSesi dibuatsession.updated Konfigurasi sesi diperbarui | Terhubung ke server. | |
session.updatedKonfigurasi sesi diperbarui | Perbarui konfigurasi sesi default. Untuk detail parameter, lihat Parameter permintaan.Setelah terhubung, server mengembalikan konfigurasi input dan output default. Panggil metode ini segera setelah terhubung untuk memperbarui default tersebut.Server memvalidasi parameter saat menerima event session.update. Jika validasi gagal, server mengembalikan error; jika tidak, konfigurasi sesi diperbarui. | |
| Tidak ada | Tambahkan chunk teks ke buffer input cloud (penyimpanan sementara teks sebelum dikirim).
| |
input_text_buffer.clearedTeks biasa diterima oleh server. | Hapus semua teks dalam buffer cloud. | |
input_text_buffer.committedKirim teks dan picu sintesis suararesponse.output_item.added Konten output baru ditambahkanresponse.content_part.added Konten baru ditambahkan ke pesan asistenresponse.audio.delta Audio inkremental yang dihasilkan modelresponse.audio.done Generasi audio selesairesponse.content_part.done Streaming konten audio untuk pesan asisten selesairesponse.output_item.done Streaming seluruh item output untuk pesan asisten selesairesponse.done Respons selesai | Kirim semua teks dalam buffer cloud dan langsung lakukan sintesis. Mengembalikan error jika buffer kosong.
| |
session.finishedRespons selesai | Akhiri tugas. | |
| Tidak ada | Tutup koneksi. | |
| Tidak ada | Dapatkan ID sesi untuk tugas saat ini. | |
| Tidak ada | Dapatkan ID respons dari respons terbaru. | |
| Tidak ada | Dapatkan penundaan sebelum paket audio pertama tiba. |
Antarmuka callback (QwenTtsRealtimeCallback)
Server mengirim respons dan data melalui callback. Implementasikan metode callback untuk menanganinya.
Impor: from dashscope.audio.qwen_tts_realtime import QwenTtsRealtimeCallback
| Metode | Parameter | Nilai kembalian | Deskripsi |
|---|---|---|---|
| Tidak ada | Tidak ada | Dipanggil ketika koneksi server terbentuk. | |
| message: Event respons server. | Tidak ada | Mencakup respons panggilan API, teks yang dihasilkan model, dan audio. Lihat Event server. | |
| close_status_code: Kode status penutupan WebSocket.close_msg: Pesan penutupan WebSocket. | Tidak ada | Dipanggil setelah server menutup koneksi. |