Pra-pemrosesan file video untuk meningkatkan efisiensi transkripsi file (untuk skenario pengenalan file audio)
API pengenalan suara Paraformer mendukung file video. Namun, file video biasanya besar dan memerlukan waktu lama untuk ditransfer. Kami merekomendasikan pra-pemrosesan dengan mengekstraksi track audio yang relevan untuk pengenalan suara serta menerapkan kompresi yang sesuai guna mengurangi ukuran file secara signifikan. Hal ini akan meningkatkan efisiensi throughput transkripsi file video. Berikut adalah praktik terbaik menggunakan ffmpeg untuk pra-pemrosesan.
Secara umum, file audio keluaran akan jauh lebih kecil dibandingkan file video masukan. Anda kemudian dapat mengirimkan file audio ini (ditentukan oleh URL) ke API transkripsi file untuk mendapatkan hasil pengenalan suara.