Berikan string JSON ke parameter parameters metode nui_initialize untuk mengonfigurasi pengaturan ini.Contoh parameter: String JSON berikut adalah contoh dan tidak mencantumkan semua parameter. Tambahkan parameter sesuai kebutuhan di kode Anda:
Mode operasi. Untuk pengenalan ucapan non-real-time, atur parameter ini ke "1".
device_id
String
Ya
String unik yang mengidentifikasi pengguna akhir. Anda dapat menggunakan ID pengguna dalam aplikasi atau pengidentifikasi perangkat unik yang dibuat klien. ID ini terutama digunakan untuk pelacakan log dan pemecahan masalah.
debug_path
String
Tidak
Jalur untuk file log. Parameter ini hanya berlaku saat Anda memanggil nui_initialize dengan save_log diatur ke YES. Dalam hal ini, Anda harus menentukan jalur file log. Jika tidak, akan terjadi error. Hingga dua file log dipertahankan secara lokal.
max_log_file_size
int
Tidak
Ukuran file log maksimum dalam byte. Parameter ini hanya berlaku saat Anda memanggil nui_initialize dengan save_log diatur ke YES. Default: 104857600 (100 * 1024 * 1024 byte, atau 100 MiB).
log_track_level
int
Tidak
Tingkat pemfilteran untuk log yang dikirim melalui callback logging (onFileTransLogTrackCallback). Default: 2. Nilai yang valid: - 0: LOG_LEVEL_VERBOSE - 1: LOG_LEVEL_DEBUG - 2: LOG_LEVEL_INFO - 3: LOG_LEVEL_WARNING - 4: LOG_LEVEL_ERROR - 5: LOG_LEVEL_NONE (menonaktifkan fitur ini). Catatan: log_track_level dan level (dikonfigurasi melalui metode nui_initialize) bersama-sama menentukan log mana yang dikirimkan. Tingkat numerik log harus lebih besar dari atau sama dengan log_track_level dan level agar log dapat dikirimkan. Misalnya, jika log_track_level diatur ke 2 (INFO) dan level diatur ke 3 (WARNING), hanya log WARNING dan tingkat keparahan yang lebih tinggi (tingkat numerik >= 3) yang dikirimkan.
Gunakan nui_file_trans_start untuk mengonfigurasi semua parameter pengenalan.Contoh parameter: String JSON berikut adalah contoh dan tidak mencantumkan semua parameter. Tambahkan parameter sesuai kebutuhan di kode Anda:
Format audio. Atur parameter ini ke format aktual. Format yang didukung meliputi wav, mp3, opus. Untuk detailnya, lihat Audio specifications.
nls_config.sample_rate
string
Tidak
Tingkat sampel audio dalam Hz. Misalnya, 16000 menunjukkan tingkat sampel 16 kHz. Untuk detailnya, lihat Audio specifications.
nls_config.vocabulary_id
string
Tidak
ID kosakata yang telah dikompilasi sebelumnya. Buat kosakata terlebih dahulu dan berikan ID-nya selama pengenalan untuk menggunakan kata kuncinya. Gunakan opsi ini jika kosakata sudah diketahui, relatif stabil, dan digunakan kembali di berbagai permintaan. Untuk petunjuk penggunaan, lihat Kata kunci yang telah dikompilasi sebelumnya.
nls_config.instant_vocabulary
object
Tidak
Kata kunci instan. Berikan pasangan kunci-nilai. Kuncinya adalah teks kata kunci (string) dan nilainya adalah bobotnya (integer). Anda tidak perlu membuat kosakata terlebih dahulu. Bobot yang valid adalah [1, 5] atau 50. Dalam rentang [1, 5], bobot yang lebih tinggi membuat model lebih mungkin menghasilkan kata tersebut. Bobot 50 menentukan kata kunci super dan secara signifikan meningkatkan recall. Anda dapat menentukan hingga 50 kata kunci super. Gunakan opsi ini untuk optimasi kata kunci sementara tingkat sesi. Jika kata kunci instan dan yang telah dikompilasi sebelumnya dikonfigurasi, sistem akan menggabungkannya. Jika daftar gabungan melebihi 2000 entri, sistem akan memilih 2000 entri secara acak. Untuk petunjuk penggunaan, lihat Kata kunci instan.
Untuk model dan batas yang berlaku untuk hotword instan, lihat Hotword instan.
Copy
{ "张三": 5, "李四": 5}
nls_config.language_hints
array[string]
Tidak
Kode bahasa untuk pengenalan. Jika bahasa tidak diketahui sebelumnya, abaikan parameter ini agar model mendeteksinya secara otomatis. Untuk model Qwen-Audio-3.0-ASR-Flash, didukung hingga empat nilai. Jika lebih dari itu yang ditentukan, hanya empat pertama yang berlaku. Untuk model Fun-ASR-Flash, hanya satu nilai yang didukung. Jika beberapa nilai ditentukan, hanya nilai pertama yang berlaku.
Daftar pesan. Berisi audio yang akan dikenali dan konteks percakapan opsional untuk meningkatkan pengenalan. Lihat deskripsi berikut.
parameter messages:
Konteks meningkatkan akurasi pengenalan istilah khusus. Untuk petunjuk penggunaan, lihat Context enhancement.Batasan: Pesan konteks (tipe input_text dan text ) dibatasi masing-masing lima. Jika batas terlampaui, hanya lima pesan terbaru yang dipertahankan. Total panjang teks konteks per giliran (jumlah panjang bidang user dan assistanttext ) tidak boleh melebihi 400 karakter. Setiap karakter dihitung sebagai satu. Karakter berlebih akan dipotong dari akhir.
Jika konteks disertakan, pesan messages harus mengikuti urutan tertentu. Atur pesan konteks berdasarkan giliran percakapan. Dalam setiap giliran, user (tipe input_text ) harus mendahului assistant (tipe text ) yang sesuai. Pesan input_audiouser yang berisi audio input harus ditempatkan di akhir messages .
Parameter
Tipe
Wajib
Deskripsi
role
string
Ya
Peran pesan. Nilai yang valid:
user (wajib): Pesan pengguna. Jika tipe adalah input_audio, ini mewakili audio yang akan dikenali. Jika tipe adalah input_text, ini mewakili hasil pengenalan dari giliran sebelumnya atau kosakata spesifik domain (konteks opsional).
assistant (konteks opsional): Respons model bahasa besar dari percakapan sebelumnya.
content
array[object]
Ya
Daftar isi pesan. Lihat deskripsi berikut.
parameter content:
Parameter
Tipe
Wajib
Deskripsi
type
string
Ya
Tipe konten. Setiap permintaan memerlukan setidaknya satu input_audio pesan. Nilai yang valid:
input_audio (wajib): Input audio yang akan dikenali (role adalah user). Anda juga harus menyediakan objek input_audio.
input_text (konteks opsional): Hasil pengenalan ucapan pengguna dari percakapan sebelumnya atau kosakata khusus domain (role adalah user). Anda juga harus menyediakan bidang text.
text (konteks opsional): Respons model bahasa besar dari percakapan sebelumnya (role adalah assistant). Anda juga harus menyediakan bidang text.
input_audio
object
Tidak
Wajib diisi ketika type adalah input_audio.
input_audio.data
string
Ya
Data audio yang akan dikenali. Untuk format audio yang didukung, batas ukuran file, batas durasi, dan persyaratan input lainnya, lihat Spesifikasi audio. Dua metode input berikut didukung:
URL file audio: Berikan URL file audio yang dapat diakses secara publik.
Base64 Data URI: Berikan audio yang dienkode Base64 sebagai Data URI. Gabungkan prefiks data:{MIME_TYPE};base64, dengan data audio yang dienkode Base64. Jenis MIME yang didukung meliputi audio/wav, audio/mp3.
Wajib jika type adalah input_text, berikan hasil pengenalan ucapan pengguna dari giliran sebelumnya atau kosakata spesifik domain. Jika type adalah text, berikan respons model bahasa besar dari giliran sebelumnya. Panjang teks dihitung dalam karakter, dengan setiap karakter dihitung sebagai satu. Total panjang semua bidang text pesan di setiap giliran konteks tidak boleh melebihi 400 karakter. Karakter berlebih akan dipotong dari akhir.
Apakah akan menyimpan log secara lokal. Jika diatur ke YES, gunakan Connection and control parameters untuk mengatur debug_path guna menentukan path, dan gunakan max_log_file_size untuk mengatur ukuran file.
Gunakan metode ini untuk mengatur atau memperbarui nls_config secara terpisah. Anda tidak perlu memanggil metode ini jika semua parameter disediakan dalam nui_file_trans_start dalam satu panggilan.Signature metode
Lepaskan semua sumber daya internal SDK dan hentikan paksa semua tugas yang sedang berlangsung. Setelah panggilan ini, instans SDK menjadi tidak tersedia. Untuk menggunakannya lagi, panggil nui_initialize untuk menginisialisasinya kembali.Signature metode