大模型聲音複刻服務依託先進的大模型技術進行特徵提取,無需訓練過程就可以完成聲音的複刻。僅需提供極短的音頻,即可迅速產生高度相似且聽感自然的定製聲音。 大模型聲音設計使用FunAudioGen-VD模型,支援通過文本Prompt描述,創造聲音。無需受限任何音頻品質,根據目標情境對音色、語氣、語調、語速、情緒等各方面表現力的需求描述,即可產生高品質語音。高度還原專業配音演員的演出水準。
推理服務供應商
voice-enrollment模型的推理服務供應商為阿里雲百鍊。
模型能力
- 華北2(北京)
- 新加坡
| 能力項 | 支援情況 | 能力項 | 支援情況 |
|---|---|---|---|
輸入模態 | Audio | 輸出模態 | Audio |
模型體驗 | 不支援 | Function Calling | 不支援 |
結構化輸出 | 不支援 | 連網搜尋 | 不支援 |
首碼續寫 | 不支援 | 上下文緩衝 | 不支援 |
批量推理 | 不支援 | 模型調優 | 不支援 |
上下文限制
| 參數 | 值 | 參數 | 值 |
|---|---|---|---|
最大輸入長度 | — | 最大輸出長度 | — |
上下文長度 | — |
模型價格
暫無公開定價資訊。
限流
- 華北2(北京)
- 新加坡
| 參數 | 值 |
|---|---|
RPM(每分鐘請求數) | 600 |