Qwen3-TTS-VD模型是通義最新推出的即時語音合成大模型,可對qwen3-voice-design服務設計的聲音進行高保真即時語音合成,且同一音色支援11個語種的語音輸出。該模型經過海量資料訓練,合成音頻可以根據文本自適應調節語氣,對複雜文本合成也有較好的處理能力。該模型為2026年01月26日快照版本模型。
推理服務供應商
qwen3-tts-vd-2026-01-26模型的推理服務供應商為阿里雲百鍊。
模型能力
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Text | 輸出模態 | Audio |
模型體驗 | 不支援 | Function Calling | 不支援 |
結構化輸出 | 不支援 | 連網搜尋 | 不支援 |
首碼續寫 | 不支援 | 上下文緩衝 | 不支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | — | 最大輸出長度 | — |
上下文長度 | — |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
- 新加坡
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
語音合成 | 0.115 | 每萬字元 |
限流
- 華北2(北京)
- 新加坡
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 180 |
快照版本
qwen3-tts-vd-2026-01-26
Qwen3-TTS-VD模型是通義最新推出的即時語音合成大模型,可對qwen3-voice-design服務設計的聲音進行高保真即時語音合成,且同一音色支援11個語種的語音輸出。該模型經過海量資料訓練,合成音頻可以根據文本自適應調節語氣,對複雜文本合成也有較好的處理能力。該模型為2026年01月26日快照版本模型。
推理服務供應商
qwen3-tts-vd-2026-01-26模型的推理服務供應商為阿里雲百鍊。
模型能力
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Text | 輸出模態 | Audio |
模型體驗 | 不支援 | Function Calling | 不支援 |
結構化輸出 | 不支援 | 連網搜尋 | 不支援 |
首碼續寫 | 不支援 | 上下文緩衝 | 不支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | — | 最大輸出長度 | — |
上下文長度 | — |
模型價格
本文僅展示模型調用原價,不包含限時優惠等活動資訊,請前往百鍊控制台查看活動優惠。
- 華北2(北京)
- 新加坡
| 計費項目 | 價格(美元) | 單位 |
|---|---|---|
語音合成 | 0.115 | 每萬字元 |
限流
- 華北2(北京)
- 新加坡
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 180 |