model | str | Ya | Nama model. |
voice | str | Ya | Voice yang digunakan untuk sintesis suara.
- Voice sistem: Lihat Daftar voice Qwen-Audio-TTS
- Suara kloning: Suara kustom yang dibuat melalui kloning suara.
- Suara kustom: Suara yang dibuat melalui desain suara.
|
format | enum | Tidak | Format encoding audio dan laju sampel.Default: AudioFormat.MP3_22050HZ_MONO_256KBPS.Enum AudioFormat terletak di dashscope.audio.tts_v2 dan mendukung format MP3, WAV, PCM, dan lainnya. |
volume | int | Tidak | Tingkat volume.Nilai default: 50.Nilai valid: [0, 100]. |
speech_rate | float | Tidak | Laju bicara.Nilai default: 1.0.Nilai valid: [0.5, 2.0]. |
pitch_rate | float | Tidak | Pitch.Nilai default: 1.0.Nilai valid: [0.5, 2.0]. |
bit_rate | int | Tidak | Bit rate audio dalam kbps. Saat format audio adalah mp3 atau opus, gunakan bit_rate untuk menyesuaikan bit rate.Nilai default: 32.Nilai valid: [6, 510].Setel bit_rate melalui parameter additional_params:synthesizer = SpeechSynthesizer(
model="qwen-audio-3.0-tts-flash",
voice="longanhuan_v3.6",
additional_params={"bit_rate": 128}
)
|
word_timestamp_enabled | bool | Tidak | Menentukan apakah timestamp tingkat kata diaktifkan.Nilai default: false.Hanya tersedia dalam mode keluaran streaming. Suara hasil kloning didukung. Untuk suara sistem yang didukung, lihat Daftar voice Qwen-Audio-TTS.Setel word_timestamp_enabled melalui parameter additional_params:synthesizer = SpeechSynthesizer(
model="qwen-audio-3.0-tts-flash",
voice="your_voice", # Voice sistem atau hasil kloning yang mendukung timestamp tingkat kata
additional_params={"word_timestamp_enabled": True}
)
|
seed | int | Tidak | Seed acak untuk mengontrol variasi dalam output sintesis. Ketika versi model, teks, voice, dan parameter lainnya tidak berubah, menggunakan seed yang sama menghasilkan output identik.Nilai default: 0.Nilai valid: [0, 65535]. |
language_hints | list[str] | Tidak |
- Parameter ini berupa array, tetapi versi saat ini hanya memproses elemen pertama. Berikan satu nilai saja.
- Parameter ini menentukan bahasa target untuk sintesis suara. Parameter ini tidak terkait dengan bahasa sampel audio yang digunakan dalam kloning suara. Untuk mengatur bahasa sumber dalam tugas kloning, lihat referensi API kloning suara.
Menentukan bahasa target untuk sintesis suara guna meningkatkan kualitas output.Saat pelafalan angka, ekspansi singkatan, pembacaan simbol, atau sintesis bahasa minoritas tidak sesuai ekspektasi, gunakan parameter ini. Contohnya:
- Pelafalan angka tidak sesuai: "hello, this is 110" dibaca sebagai "hello, this is one zero" alih-alih pelafalan Mandarin yang diharapkan
- Pelafalan simbol tidak akurat: "@" dibaca sebagai ekuivalen Mandarin alih-alih "at"
- Kualitas sintesis bahasa minoritas buruk dengan hasil tidak alami
- zh: Tionghoa
- en: Inggris
- fr: Prancis
- de: Jerman
- ja: Jepang
- ko: Korea
- ru: Rusia
- pt: Portugis
- th: Thai
- id: Bahasa Indonesia
- vi: Vietnam
- es: Spanyol
- it: Italia
- ms: Malaysia
- fil: Filipino
- ar: Arab
|
instruction | str | Tidak | Mengontrol karakteristik sintesis seperti dialek, emosi, atau gaya berbicara.Untuk detail penggunaan, lihat Kontrol instruksi. |
enable_aigc_tag | bool | Tidak | Menentukan apakah watermark AIGC disematkan dalam audio yang dihasilkan. Saat diatur ke true, watermark disematkan dalam file audio dengan format yang didukung (wav/mp3/opus).Nilai default: false.Setel enable_aigc_tag, aigc_propagator, dan aigc_propagate_id melalui parameter additional_params:synthesizer = SpeechSynthesizer(
model="qwen-audio-3.0-tts-flash",
voice="longanhuan_v3.6",
additional_params={
"enable_aigc_tag": True,
"aigc_propagator": "your_propagator",
"aigc_propagate_id": "your_propagate_id"
}
)
|
aigc_propagator | str | Tidak | Mengatur bidang ContentPropagator dalam watermark AIGC, yang mengidentifikasi propagator konten. Hanya berlaku saat enable_aigc_tag bernilai true.Nilai default: UID Alibaba Cloud.Diatur melalui parameter additional_params. Lihat contoh enable_aigc_tag. |
aigc_propagate_id | str | Tidak | Mengatur bidang PropagateID dalam watermark AIGC, yang secara unik mengidentifikasi aksi propagasi tertentu. Hanya berlaku saat enable_aigc_tag bernilai true.Nilai default: ID permintaan dari permintaan sintesis suara saat ini.Diatur melalui parameter additional_params. Lihat contoh enable_aigc_tag. |
hot_fix | dict | Tidak | Mengonfigurasi koreksi pelafalan dan penggantian teks yang diterapkan sebelum sintesis.Parameter:
- pronunciation: Pelafalan kustom. Menentukan anotasi pinyin untuk kata-kata guna memperbaiki pelafalan default yang tidak akurat.
- replace: Penggantian teks. Mengganti kata-kata tertentu dengan teks target sebelum sintesis. Teks yang diganti digunakan sebagai input sintesis aktual.
Contoh:synthesizer = SpeechSynthesizer(
model="qwen-audio-3.0-tts-flash",
voice="your_voice_id", # Voice
hot_fix={
"pronunciation": [{"weather": "tian1 qi4"}],
"replace": [{"today": "gold day"}]
}
)
|
callback | ResultCallback | Tidak | Instans callback untuk menerima audio hasil sintesis dan notifikasi event secara asinkron. Saat diatur, call() berjalan dalam mode streaming dan mengirimkan audio melalui callback on_data. Saat tidak diatur, call() berjalan dalam mode non-streaming dan mengembalikan seluruh audio sebagai bytes. |