Gunakan API HTTP untuk membuat, menampilkan daftar, mengkueri, memperbarui, dan menghapus suara yang dikloning.
Titik akhir layanan
- Singapura
- Tiongkok (Beijing)
POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/audio/tts/customizationGanti {WorkspaceId} dengan ID ruang kerja Anda yang sebenarnya.Header permintaan
Parameter | Tipe | Wajib | Deskripsi |
|---|---|---|---|
Authorization | string | Ya | Token otentikasi dalam format |
Content-Type | string | Ya | Jenis media dari badan permintaan. Atur ke |
Buat suara
Isi permintaanmodelstring(wajib)Model kloning suara. Nilai yang valid:
object(wajib)Parameter input.
Properti action string(wajib)Jenis aksi.
string(wajib)Model text-to-speech (TTS) yang menggerakkan suara yang dikloning. Harus sesuai dengan model yang Anda tentukan saat memanggil API TTS; jika tidak, sintesis akan gagal.url string(wajib bersyarat)URL file audio untuk kloning suara. URL harus dapat diakses publik.audio object(wajib bersyarat)Data audio. Dua metode pengiriman didukung:
string(opsional)Transkrip audio, digunakan untuk meningkatkan kualitas kloning.prefix string(wajib bersyarat)Awalan untuk nama suara. Hanya karakter alfanumerik yang diizinkan, dengan panjang maksimum 10 karakter. Nama suara yang dihasilkan mengikuti format berikut: {target_model}-{prefix}-{unique_id}.preferred_name string(wajib bersyarat)Awalan untuk nama suara. Hanya karakter alfanumerik dan garis bawah (_) yang diizinkan, dengan panjang maksimum 16 karakter.language_hints array[string](opsional)Membantu model mengidentifikasi bahasa audio sampel untuk mengekstraksi fitur suara lebih akurat dan meningkatkan kualitas kloning. Jika bahasa yang ditentukan tidak sesuai dengan bahasa audio sebenarnya (misalnya, mengatur en saat audionya dalam bahasa Tiongkok), sistem akan mengabaikan nilai ini dan mendeteksi bahasa secara otomatis.Parameter ini berupa array, tetapi versi saat ini hanya memproses elemen pertama.Nilai yang valid bervariasi tergantung model:
string(opsional)Bahasa dari audio yang disediakan di audio.data. Jika Anda menggunakan parameter ini, pastikan bahasa yang ditentukan sesuai dengan bahasa sebenarnya dari audio yang digunakan untuk kloning.Nilai yang valid:
float(opsional)Durasi maksimum (dalam detik) dari audio referensi setelah pra-pemrosesan. Nilai yang valid: [3.0, 30.0].Default: 10.0.enable_preprocess boolean(opsional)Apakah akan mengaktifkan pra-pemrosesan audio (pengurangan noise, peningkatan audio, dan normalisasi volume). Aktifkan ini untuk rekaman dengan noise latar belakang. Nonaktifkan untuk rekaman di lingkungan tenang agar karakteristik suara asli tetap terjaga.Default: false.enable_volume_normalization string(opsional)Apakah akan menormalisasi volume audio sampel yang digunakan untuk kloning suara. Nilai yang valid:
"false". | Contoh ini menggunakan titik akhir wilayah Singapura. Untuk wilayah Beijing, gunakan: https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/audio/tts/customization.Ganti {WorkspaceId} dengan ID ruang kerja Anda yang sebenarnya. |
Isi responsrequest_idstringPengidentifikasi unik untuk permintaan ini.outputobjectData yang dikembalikan oleh model.
Properti voice_id / voice stringID suara. Qwen-Audio-TTS/CosyVoice mengembalikan voice_id, sedangkan Qwen mengembalikan voice. Gunakan nilai ini langsung pada parameter voice API TTS.target_modelstringModel TTS yang menggerakkan suara yang dikloning.fallback_modebooleanApakah suara dibuat dalam mode fallback. Nilai true menunjukkan bahwa kualitas audio buruk atau tidak sesuai dengan teks yang diberikan, sehingga kualitas kloning mungkin berkurang.fallback_reasonstringAlasan fallback. Nilai yang mungkin termasuk no_merged_segments (tidak dapat menggabungkan segmen audio) dan no_valid_asr_segments (ketidaksesuaian parah antara audio dan teks).objectInformasi penggunaan untuk permintaan ini.
Properti count integerJumlah suara yang dibuat. Selalu 1. |
Kueri daftar suara
Badan permintaanmodelstring(wajib)Model kloning suara. Nilai yang valid:
object(wajib)Parameter input.
Properti action string(wajib)Jenis aksi. Qwen-Audio-TTS/CosyVoice: list_voice. Qwen: list.prefix string(opsional)Menyaring suara berdasarkan awalan nama.page_index integer(opsional)Indeks halaman.page_size integer(opsional)Jumlah entri per halaman. | Contoh ini menggunakan titik akhir wilayah Singapura. Untuk wilayah Beijing, gunakan: https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/audio/tts/customization.Ganti {WorkspaceId} dengan ID ruang kerja Anda yang sebenarnya. |
Badan responsrequest_idstringPengidentifikasi unik untuk permintaan ini.outputobjectData yang dikembalikan oleh model.
Properti page_index integerIndeks halaman saat ini.page_sizeintegerJumlah entri per halaman.total_countintegerTotal jumlah suara.voice_listarray[object]Daftar suara yang dikueri. Baik Qwen-Audio-TTS/CosyVoice maupun Qwen menggunakan nama bidang voice_list.
Properti voice_id / voice stringID suara. Qwen-Audio-TTS/CosyVoice menggunakan voice_id, sedangkan Qwen menggunakan voice.gmt_createstringWaktu pembuatan.gmt_modifiedstringWaktu modifikasi terakhir.statusstringStatus suara. Untuk nilai yang valid, lihat "Deskripsi status suara".target_modelstringModel TTS yang menggerakkan suara yang dikloning.objectInformasi penggunaan untuk permintaan ini.
Properti count integerSelalu 1 untuk Qwen-Audio-TTS/CosyVoice. Selalu 0 untuk Qwen. |
Kueri detail suara
Isi permintaanmodelstring(wajib)Atur ke voice-enrollment (Qwen-Audio-TTS/CosyVoice).inputobject(wajib)Parameter input.
Properti action string(wajib)Atur ke query_voice.voice_id string(wajib)ID suara yang akan dikueri. | Contoh ini menggunakan titik akhir wilayah Singapura. Untuk wilayah Beijing, gunakan: https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/audio/tts/customization.Ganti {WorkspaceId} dengan ID ruang kerja Anda yang sebenarnya.
|
Isi responsrequest_idstringPengidentifikasi unik untuk permintaan ini.outputobjectData yang dikembalikan oleh model.
Properti resource_link stringURL file audio.gmt_createstringWaktu pembuatan.gmt_modifiedstringWaktu modifikasi terakhir.statusstringStatus suara. Untuk nilai yang valid, lihat "Deskripsi status suara".target_modelstringModel TTS yang menggerakkan suara yang dikloning.objectInformasi penggunaan untuk permintaan ini.
Properti count integerSelalu 1. |
Perbarui suara
Isi permintaanmodelstring(wajib)Atur ke voice-enrollment.inputobject(wajib)Parameter input.
Properti action string(wajib)Atur ke update_voice.voice_id string(wajib)ID suara yang akan diperbarui.url string(wajib)URL file audio baru. URL harus dapat diakses publik. | Contoh ini menggunakan titik akhir wilayah Singapura. Untuk wilayah Beijing, gunakan: https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/audio/tts/customization. |
Isi Responsrequest_idstringPengidentifikasi unik untuk permintaan ini.outputobjectData yang dikembalikan oleh model. Operasi pembaruan tidak mengembalikan data bisnis. Tanggapan mungkin menyertakan bidang preview_audio, yang merupakan objek kosong yang dapat Anda abaikan.usageobjectInformasi penggunaan untuk permintaan ini.
Properti count integerSelalu 1. |
Hapus suara
Isi permintaanmodelstring(wajib)Model kloning suara. Nilai yang valid:
object(wajib)Parameter input.
Properti action string(wajib)Jenis aksi. Qwen-Audio-TTS/CosyVoice: delete_voice. Qwen: delete.voice_id string(wajib bersyarat)ID suara yang akan dihapus.voice string(wajib bersyarat)Nama suara yang akan dihapus. | Contoh ini menggunakan titik akhir wilayah Singapura. Untuk wilayah Beijing, gunakan: https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/audio/tts/customization.Ganti {WorkspaceId} dengan ID ruang kerja Anda yang sebenarnya. |
Badan tanggapanrequest_idstringPengidentifikasi unik untuk permintaan ini.outputobjectData yang dikembalikan oleh model. Qwen-Audio-TTS/CosyVoice mengembalikan objek kosong, sedangkan Qwen mengembalikan nama suara yang dihapus.
Properti voice stringNama suara yang dihapus.objectInformasi penggunaan untuk permintaan ini.
Properti count integerSelalu 1 untuk Qwen-Audio-TTS/CosyVoice. Selalu 0 untuk Qwen. |
Deskripsi status suara
Setelah suara dibuat, suara tersebut melewati proses peninjauan. Status berikut hanya berlaku untuk Qwen-Audio-TTS/CosyVoice (ketika model adalah voice-enrollment). Tanggapan kueri dan daftar Qwen tidak menyertakan bidang status.
Status | Deskripsi |
|---|---|
DEPLOYING | Sedang dalam peninjauan atau pemrosesan. |
OK | Peninjauan berhasil. Suara siap digunakan. |
UNDEPLOYED | Peninjauan ditolak. Suara tidak dapat digunakan. |