Skip to main content
Qwen-Audio-ASR-Streaming

Qwen-Audio-ASR-Streaming Panduan koneksi WebSocket

Topik ini menjelaskan titik akhir layanan, header permintaan, dan alur interaksi untuk mengakses layanan pengenalan ucapan real-time Qwen-Audio-ASR-Streaming melalui koneksi WebSocket.

Titik akhir layanan

URL WebSocket bersifat tetap:
  • Singapore
  • China (Beijing)
wss://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api-ws/v1/inferenceGanti {WorkspaceId} dengan Workspace ID Anda yang sebenarnya.
Alibaba Cloud Model Studio telah merilis domain khusus ruang kerja untuk wilayah China (Beijing) dan Singapore. Domain khusus baru ini memberikan performa lebih unggul dan stabilitas lebih tinggi untuk permintaan inferensi. Kami merekomendasikan migrasi ke domain baru berikut:
  • China (Beijing): dari dashscope.aliyuncs.com ke {WorkspaceId}.cn-beijing.maas.aliyuncs.com
  • Singapore: dari dashscope-intl.aliyuncs.com ke {WorkspaceId}.ap-southeast-1.maas.aliyuncs.com

Header permintaan

Tambahkan informasi berikut ke header permintaan:
ParameterTypeRequiredDescription
AuthorizationstringYesToken autentikasi dalam format Bearer <your_api_key>. Ganti <your_api_key> dengan Kunci API Anda yang sebenarnya.
user-agentstringNoIdentifier client yang membantu server melacak sumber permintaan.
X-DashScope-WorkSpacestringNoModel Studio ID ruang kerja.
X-DashScope-DataInspectionstringNoApakah inspeksi kepatuhan data diaktifkan. Parameter ini secara default diabaikan atau diatur ke enable. Jangan aktifkan parameter ini kecuali diperlukan.
Authorization diverifikasi selama handshake WebSocket. Jika Kunci API tidak valid atau tidak ada, handshake gagal dan mengembalikan error HTTP 401 atau 403.

Alur interaksi

Untuk detail tentang event client dan event server, lihat Client events dan Server-side events. Client dan server berinteraksi dalam urutan berikut:
  1. Membuat koneksi: Client membuat koneksi WebSocket ke server.
  2. Memulai task: Client mengirim instruksi run-task untuk memulai task dan menerima event task-started dari server. Event ini mengonfirmasi bahwa task telah dimulai dan Anda dapat melanjutkan ke langkah berikutnya.
  3. Mengirim aliran audio: Client mulai mengirim audio biner (harus mono) dan secara bersamaan menerima aliran event result-generated dari server. Setiap event berisi hasil pengenalan ucapan.
  4. Memberi tahu server untuk mengakhiri task: Client mengirim instruksi finish-task untuk memberi sinyal ke server agar mengakhiri task dan terus menerima event result-generated dari server.
  5. Mengakhiri task: Client menerima event task-finished dari server, yang menandakan bahwa task telah berakhir.
  6. Menutup koneksi: Client menutup koneksi WebSocket.
Pembuatan Gambar
  • FAQ
Video Generation
Model Dunia
Audio
  • Pembuatan audio
Realtime API
Penyematan Teks
TokenPlan
Model production