Model Qwen3-TTS-VD adalah model sintesis suara real-time terbaru dari Tongyi. Model ini mampu melakukan sintesis suara real-time beresolusi tinggi pada voice yang dirancang melalui layanan qwen3-voice-design, serta mendukung output suara dalam 11 bahasa menggunakan voice yang sama. Model ini telah dilatih menggunakan data dalam jumlah sangat besar, dan audio hasil sintesisnya dapat menyesuaikan nada secara adaptif sesuai teks, menunjukkan kemampuan pemrosesan yang baik untuk sintesis teks kompleks. Model ini merupakan versi Snapshot per 15 Januari 2026.
Inference Service Provider
Penyedia layanan inferensi untuk qwen3-tts-vd-realtime-2026-01-15 adalah Alibaba Cloud Model Studio.
Model Capabilities
| Capability | Support | Capability | Support |
|---|---|---|---|
Input Modality | Text | Output Modality | Audio |
Model Experience | Unsupported | Function Calling | Unsupported |
Structured Outputs | Unsupported | Web Search | Unsupported |
Prefix Completion | Unsupported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Context Limits
| Parameter | Value | Parameter | Value |
|---|---|---|---|
Max Input Length | — | Max Output Length | — |
Context Window | — |
Pricing
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Model Studio Console untuk penawaran promosi.
- China (Beijing)
- Singapore
| Billing Item | Price (USD) | Unit |
|---|---|---|
TTS | 0,143353 | Per 10.000 karakter |
Rate Limits
- China (Beijing)
- Singapore
| Parameter | Value |
|---|---|
RPM (Requests Per Minute) | 180 |
Snapshot Versions
qwen3-tts-vd-realtime-2026-01-15
Model Qwen3-TTS-VD adalah model sintesis suara real-time terbaru dari Tongyi. Model ini mampu melakukan sintesis suara real-time beresolusi tinggi pada voice yang dirancang melalui layanan qwen3-voice-design, serta mendukung output suara dalam 11 bahasa menggunakan voice yang sama. Model ini telah dilatih menggunakan data dalam jumlah sangat besar, dan audio hasil sintesisnya dapat menyesuaikan nada secara adaptif sesuai teks, menunjukkan kemampuan pemrosesan yang baik untuk sintesis teks kompleks. Model ini merupakan versi Snapshot per 15 Januari 2026.
Inference Service Provider
Penyedia layanan inferensi untuk qwen3-tts-vd-realtime-2026-01-15 adalah Alibaba Cloud Model Studio.
Model Capabilities
| Capability | Support | Capability | Support |
|---|---|---|---|
Input Modality | Text | Output Modality | Audio |
Model Experience | Unsupported | Function Calling | Unsupported |
Structured Outputs | Unsupported | Web Search | Unsupported |
Prefix Completion | Unsupported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Context Limits
| Parameter | Value | Parameter | Value |
|---|---|---|---|
Max Input Length | — | Max Output Length | — |
Context Window | — |
Pricing
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Model Studio Console untuk penawaran promosi.
- China (Beijing)
- Singapore
| Billing Item | Price (USD) | Unit |
|---|---|---|
TTS | 0,143353 | Per 10.000 karakter |
Rate Limits
- China (Beijing)
- Singapore
| Parameter | Value |
|---|---|
RPM (Requests Per Minute) | 180 |
qwen3-tts-vd-realtime-2025-12-16
Model Qwen3-TTS-VD adalah model sintesis suara real-time terbaru dari Tongyi. Model ini mampu melakukan sintesis suara real-time beresolusi tinggi pada voice yang dirancang melalui layanan qwen3-voice-design, serta mendukung output suara dalam 11 bahasa menggunakan voice yang sama. Model ini telah dilatih menggunakan data dalam jumlah sangat besar, dan audio hasil sintesisnya dapat menyesuaikan nada secara adaptif sesuai teks, menunjukkan kemampuan pemrosesan yang baik untuk sintesis teks kompleks. Model ini merupakan versi Snapshot per 16 Desember 2025.
Inference Service Provider
Penyedia layanan inferensi untuk qwen3-tts-vd-realtime-2025-12-16 adalah Alibaba Cloud Model Studio.
Model Capabilities
| Capability | Support | Capability | Support |
|---|---|---|---|
Input Modality | Text | Output Modality | Audio |
Model Experience | Unsupported | Function Calling | Unsupported |
Structured Outputs | Unsupported | Web Search | Unsupported |
Prefix Completion | Unsupported | Context Caching | Unsupported |
Batch Inference | Unsupported | Fine-tuning | Unsupported |
Context Limits
| Parameter | Value | Parameter | Value |
|---|---|---|---|
Max Input Length | — | Max Output Length | — |
Context Window | — |
Pricing
Laman ini hanya menampilkan harga asli untuk panggilan API model, tidak termasuk promosi berbatas waktu apa pun. Kunjungi Model Studio Console untuk penawaran promosi.
- China (Beijing)
- Singapore
| Billing Item | Price (USD) | Unit |
|---|---|---|
TTS | 0,143353 | Per 10.000 karakter |
Rate Limits
- China (Beijing)
- Singapore
| Parameter | Value |
|---|---|
RPM (Requests Per Minute) | 180 |