Gunakan SDK Python untuk membuat, menampilkan daftar, mengkueri, memperbarui, dan menghapus kosakata kustom untuk pengenalan ucapan.
Endpoint
SDK terhubung ke endpoint China (Beijing) secara default. Untuk menggunakan wilayah lain, atur dashscope.base_http_api_url sebelum melakukan panggilan API apa pun.
- Singapura
- China (Beijing)
https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1Ganti {WorkspaceId} dengan Workspace ID Anda yang sebenarnya.dashscope.base_http_api_url sebelum melakukan panggilan apa pun:
- Kunci API berbeda antar wilayah. Gunakan Kunci API yang sesuai dengan wilayah Anda.
- Pengaturan wilayah bersifat global dan memengaruhi semua panggilan API DashScope.
VocabularyService
Paket: dashscope.audio.asr.VocabularyService
Deskripsi: Membuat, menampilkan daftar, mengkueri, memperbarui, dan menghapus kosakata kustom.
Konstruktor
api_key tidak diberikan, SDK akan menggunakan dashscope.api_key global.
create_vocabulary() - Buat kosakata kustom
Signature metode:
Parameter | Tipe | Wajib | Deskripsi |
|---|---|---|---|
target_model | str | Ya | Model pengenalan ucapan yang menggunakan kosakata ini. Nilai ini harus sesuai dengan model yang Anda tentukan saat memanggil API pengenalan ucapan. |
prefix | str | Ya | Awalan kustom untuk kosakata. Hanya huruf kecil dan angka yang diizinkan, dengan panjang maksimum 10 karakter. |
vocabulary | List[dict] | Ya | Daftar hotword. Setiap entri adalah dict dengan bidang text, weight, dan lang. Untuk informasi selengkapnya, lihat Struktur kamus hotword. |
Jenis | Deskripsi |
|---|---|
str | ID kosakata yang dibuat. |
list_vocabularies() - Tampilkan daftar kosakata kustom
Memetakan ke API HTTP action: list_vocabulary (HTTP menggunakan bentuk tunggal, sedangkan nama metode Python list_vocabularies menggunakan bentuk jamak).
Signature metode:
Parameter | Tipe | Wajib | Deskripsi |
|---|---|---|---|
prefix | str | Tidak | Awalan kustom dari kosakata. Jika ditentukan, hanya kosakata dengan awalan ini yang dikembalikan. |
page_index | int | Tidak | Nomor halaman, dimulai dari 0. Nilai default: 0. |
page_size | int | Tidak | Jumlah entri per halaman. Nilai default: 10. |
Tipe | Deskripsi |
|---|---|
List[dict] | Daftar objek kosakata, masing-masing berisi vocabulary_id, gmt_create, gmt_modified, dan status. |
Bidang | Tipe | Deskripsi |
|---|---|---|
vocabulary_id | str | ID kosakata. |
gmt_create | str | Waktu pembuatan. |
gmt_modified | str | Waktu modifikasi terakhir. |
status | str | Status:
|
query_vocabulary() - Kueri kosakata kustom
Signature metode:
Parameter | Tipe | Wajib | Deskripsi |
|---|---|---|---|
vocabulary_id | str | Ya | ID kosakata kustom yang akan dikueri. |
Tipe | Deskripsi |
|---|---|
dict | Objek kosakata yang berisi vocabulary, target_model, gmt_create, gmt_modified, dan status. |
Bidang | Tipe | Deskripsi |
|---|---|---|
vocabulary | List[dict] | Konten daftar hotword. |
target_model | str | Model pengenalan ucapan yang menggunakan kosakata ini. Nilai ini harus sesuai dengan model yang Anda tentukan saat memanggil API pengenalan ucapan. |
gmt_create | str | Waktu pembuatan. |
gmt_modified | str | Waktu modifikasi terakhir. |
status | str | Status:
|
update_vocabulary() - Perbarui kosakata kustom
Signature metode:
Parameter | Tipe | Wajib | Deskripsi |
|---|---|---|---|
vocabulary_id | str | Ya | ID kosakata yang akan diperbarui. |
vocabulary | List[dict] | Ya | Kosakata baru. Ini sepenuhnya menggantikan entri yang ada. |
delete_vocabulary() - Hapus kosakata kustom
Signature metode:
Parameter | Tipe | Wajib | Deskripsi |
|---|---|---|---|
vocabulary_id | str | Ya | ID kosakata yang akan dihapus. |
Struktur kamus hotword
Bidang dalam setiap dict kosakata:
Bidang | Type | Wajib | Deskripsi |
|---|---|---|---|
text | str | Ya | Teks entri kosakata. Bahasa teks harus didukung oleh model yang dipilih. Bahasa yang didukung bervariasi tergantung model. Gunakan kata aktual, bukan kombinasi karakter arbitrer, untuk meningkatkan akurasi pengenalan. Panjang maksimum: 15 karakter untuk teks yang mencakup karakter non-ASCII, atau 7 kata yang dipisahkan spasi untuk teks ASCII saja. |
weight | int | Ya | Bobot entri kosakata. Nilai yang direkomendasikan: 4. Nilai valid: 1 hingga 5. Jika akurasi pengenalan tidak membaik, tingkatkan bobotnya. Bobot yang terlalu tinggi dapat mengurangi akurasi pengenalan kata lain. |
lang | str | Tidak | Kode bahasa audio yang akan dikenali. Saat diatur, sistem meningkatkan pengenalan entri kosakata dalam bahasa yang ditentukan. Jika Anda tidak dapat menentukan bahasa sebelumnya, biarkan parameter ini tidak diatur. Model akan mendeteksi bahasa secara otomatis. Nilai valid (bervariasi tergantung model):
|