Skip to main content
語音合成

voice-enrollment

大模型聲音複刻服務依託先進的大模型技術進行特徵提取,無需訓練過程就可以完成聲音的複刻。僅需提供極短的音頻,即可迅速產生高度相似且聽感自然的定製聲音。 大模型聲音設計使用FunAudioGen-VD模型,支援通過文本Prompt描述,創造聲音。無需受限任何音頻品質,根據目標情境對音色、語氣、語調、語速、情緒等各方面表現力的需求描述,即可產生高品質語音。高度還原專業配音演員的演出水準。

推理服務供應商

voice-enrollment模型的推理服務供應商為阿里雲百鍊。

模型能力

  • 華北2(北京)
  • 新加坡
能力項支援情況能力項支援情況

輸入模態

Audio

輸出模態

Audio

模型體驗

不支援

Function Calling

不支援

結構化輸出

不支援

連網搜尋

不支援

首碼續寫

不支援

上下文緩衝

不支援

批量推理

不支援

模型調優

不支援

上下文限制

參數參數

最大輸入長度

最大輸出長度

上下文長度

模型價格

暫無公開定價資訊。

限流

  • 華北2(北京)
  • 新加坡
參數

RPM(每分鐘請求數)

600

Token Plan
模型體驗
  • 音樂產生
用量統計與效能監控
資產中心