Model Qwen3-TTS-Flash-Realtime adalah model dasar sintesis suara real-time terbaru dari Tongyi yang menawarkan 17 suara ekspresif serta menyediakan sintesis audio berlatensi rendah dan stabilitas tinggi. Model ini mendukung output multibahasa dan dialek dengan karakteristik suara yang konsisten lintas bahasa. Dilatih pada set data yang sangat luas, sistem ini secara otonom menyesuaikan nada vokal berdasarkan semantik teks dan menunjukkan kemampuan kuat dalam mensintesis konten kompleks. Versi model ini secara fungsional setara dengan model Snapshot qwen3-tts-flash-realtime-2025-11-27.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3-tts-flash-realtime adalah Alibaba Cloud Model Studio.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Audio |
Pengalaman Model | Unsupported | Function Calling | Unsupported |
Structured Outputs | Unsupported | Web Search | Unsupported |
Prefix Completion | Unsupported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | — | Max Output Length | — |
Context Window | — |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Model Studio Console untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
TTS | 0,143353 | Per 10.000 karakter |
Batas Laju
- Tiongkok (Beijing)
- Singapura
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 180 |
Versi Snapshot
qwen3-tts-flash-realtime-2025-11-27
Model Qwen3-TTS-Flash-Realtime adalah model sintesis suara real-time skala besar terbaru dari Tongyi yang menawarkan 51 timbre manusia yang sangat ekspresif dan mampu mensintesis audio secara real-time dengan latensi rendah serta stabilitas tinggi. Model ini juga mendukung banyak bahasa dan dialek, serta memungkinkan output multibahasa menggunakan timbre yang sama. Dilatih pada data dalam jumlah sangat besar, model ini dapat menyesuaikan nada secara adaptif berdasarkan teks dan menangani sintesis teks kompleks secara efektif. Model ini disediakan sebagai versi Snapshot.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3-tts-flash-realtime-2025-11-27 adalah Alibaba Cloud Model Studio.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Audio |
Pengalaman Model | Unsupported | Function Calling | Unsupported |
Structured Outputs | Unsupported | Web Search | Unsupported |
Prefix Completion | Unsupported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | — | Max Output Length | — |
Context Window | — |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Model Studio Console untuk penawaran promosi.
- Singapura
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
TTS | 0,13 | Per 10.000 karakter |
Batas Laju
- Tiongkok (Beijing)
- Singapura
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 180 |
qwen3-tts-flash-realtime-2025-09-18
Model Qwen3-TTS-Flash-Realtime-2025-09-18 adalah model dasar sintesis suara real-time terbaru dari Tongyi yang menawarkan 17 suara ekspresif serta menyediakan sintesis audio berlatensi rendah dan stabilitas tinggi. Model ini mendukung output multibahasa dan dialek dengan karakteristik suara yang konsisten lintas bahasa. Dilatih pada set data yang sangat luas, sistem ini secara otonom menyesuaikan nada vokal berdasarkan semantik teks dan menunjukkan kemampuan kuat dalam mensintesis konten kompleks. Model ini disediakan sebagai versi Snapshot.
Penyedia Layanan Inferensi
Penyedia layanan inferensi untuk qwen3-tts-flash-realtime-2025-09-18 adalah Alibaba Cloud Model Studio.
Kemampuan Model
| Kemampuan | Dukungan | Kemampuan | Dukungan |
|---|---|---|---|
Modalitas Input | Text | Modalitas Output | Audio |
Pengalaman Model | Unsupported | Function Calling | Unsupported |
Structured Outputs | Unsupported | Web Search | Unsupported |
Prefix Completion | Unsupported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Batas Konteks
| Parameter | Nilai | Parameter | Nilai |
|---|---|---|---|
Max Input Length | — | Max Output Length | — |
Context Window | — |
Harga
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Model Studio Console untuk penawaran promosi.
- Tiongkok (Beijing)
- Singapura
| Item Penagihan | Harga (USD) | Unit |
|---|---|---|
TTS | 0,143353 | Per 10.000 karakter |
Batas Laju
- Tiongkok (Beijing)
- Singapura
| Parameter | Nilai |
|---|---|
RPM (Requests Per Minute) | 10 |