Model untuk interaksi audio dan video waktu nyata dengan output teks dan audio, audio multikanal, dan pemanggilan alat.
Penyedia layanan inferensi
Penyedia layanan inferensi untuk qwen3.8-omni-flash-realtime adalah Alibaba Cloud Model Studio.
Kemampuan model
Wilayah yang didukung: Tiongkok (Beijing) dan Singapura. Gunakan kunci API dari wilayah yang dipilih.
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
| Modalitas input | Teks, audio streaming, dan video (frame gambar berurutan) | Modalitas output | Teks dan audio |
| Function Calling | Mendukung pemanggilan alat kustom | MCP | Mendukung alat MCP jarak jauh. Lihat alur interaksi MCP |
| Audio multikanal | Akses WebSocket mendukung 1, 2, atau 4 saluran; input multikanal menggunakan PCM 16 kHz | Agregasi video | Konfigurasikan session.video.input.representation_compact: defaultnya adalah none; atur ke normal untuk mengaktifkan agregasi |
| Suara | Defaultnya adalah Tina. Lihat parameter suara dan pratinjau audio |
Batas konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
| Total token input maksimum | 196608 | Riwayat audio | Hingga 100 giliran dan 600 detik total |
| Riwayat video | Hingga 50 giliran dan 240 detik total | Token output maksimum | 65536 |
Harga model
Lihat Harga model untuk harga inferensi.
Untuk output ucapan, qwen3.8-omni-flash-realtime menagih biaya audio dan teks terkaitnya masing-masing berdasarkan tarif outputnya. Model Qwen3.5-Omni-Realtime hanya menagih biaya audio; teks terkaitnya tidak dikenakan biaya.
Kuota gratis: 1 juta token, hanya tersedia di Singapore. Berlaku selama 90 hari sejak aktivasi layanan, rilis model, atau persetujuan aplikasi, mana yang lebih akhir. Lihat Free quota.
- Tiongkok (Beijing)
- Singapore
| Item penagihan | Harga (USD) | Unit |
|---|---|---|
Input: audio | 0.848 | Per juta token |
Output: audio | 1.696 | Per juta token |
Input: teks/gambar/video | 0.212 | Per juta token |
Output: teks | 0.636 | Per juta token |