Skip to main content
Omni-modal

qwen3.8-omni-flash-realtime

Model untuk interaksi audio dan video waktu nyata dengan output teks dan audio, audio multikanal, dan pemanggilan alat.

Penyedia layanan inferensi

Penyedia layanan inferensi untuk qwen3.8-omni-flash-realtime adalah Alibaba Cloud Model Studio.

Kemampuan model

Wilayah yang didukung: Tiongkok (Beijing) dan Singapura. Gunakan kunci API dari wilayah yang dipilih.
KemampuanDukunganKemampuanDukungan
Modalitas inputTeks, audio streaming, dan video (frame gambar berurutan)Modalitas outputTeks dan audio
Function CallingMendukung pemanggilan alat kustomMCPMendukung alat MCP jarak jauh. Lihat alur interaksi MCP
Audio multikanalAkses WebSocket mendukung 1, 2, atau 4 saluran; input multikanal menggunakan PCM 16 kHzAgregasi videoKonfigurasikan session.video.input.representation_compact: defaultnya adalah none; atur ke normal untuk mengaktifkan agregasi
SuaraDefaultnya adalah Tina. Lihat parameter suara dan pratinjau audio
Akses model melalui WebSocket, WebRTC, atau AOQ. Lihat panduan waktu nyata untuk contoh dan konfigurasi SDK. Untuk akses WebSocket, gunakan endpoint WebSocket khusus ruang kerja. Untuk konfigurasi, lihat Membuat koneksi.

Batas konteks

ParameterNilaiParameterNilai
Total token input maksimum196608Riwayat audioHingga 100 giliran dan 600 detik total
Riwayat videoHingga 50 giliran dan 240 detik totalToken output maksimum65536
Riwayat yang lebih lama akan dibuang ketika jumlah giliran atau durasi media kumulatif melebihi batas. Durasi media kumulatif bukanlah total durasi sesi.

Harga model

Lihat Harga model untuk harga inferensi. Untuk output ucapan, qwen3.8-omni-flash-realtime menagih biaya audio dan teks terkaitnya masing-masing berdasarkan tarif outputnya. Model Qwen3.5-Omni-Realtime hanya menagih biaya audio; teks terkaitnya tidak dikenakan biaya. Kuota gratis: 1 juta token, hanya tersedia di Singapore. Berlaku selama 90 hari sejak aktivasi layanan, rilis model, atau persetujuan aplikasi, mana yang lebih akhir. Lihat Free quota.
  • Tiongkok (Beijing)
  • Singapore
Item penagihanHarga (USD)Unit

Input: audio

0.848

Per juta token

Output: audio

1.696

Per juta token

Input: teks/gambar/video

0.212

Per juta token

Output: teks

0.636

Per juta token

Batas laju

Beijing dan Singapore sama-sama memiliki batas 60 RPM dan 2,000,000 TPM. Lihat Batas laju untuk batas permintaan model.
Rencana Token (Team Edition)
Model playground
  • Pembuatan audio
  • Pembuatan musik
Statistik dan Pemantauan
Asset Center
Dukungan layanan