萬相-圖生視頻模型根據 首幀映像 和 文本提示詞 ,產生一段流暢的視頻。
相關文檔:使用指南
為確保調用成功,請務必保證模型、endpoint URL 和 API Key 均屬於同一地區。跨地區調用將會失敗。
圖生視頻任務耗時較長(通常為1-5分鐘),API採用非同步呼叫的方式。整個流程包含 “建立任務 -> 輪詢擷取” 兩個核心步驟,具體如下:
調用時請將
調用時請將
SDK 的參數命名與HTTP介面基本一致,參數結構根據語言特性進行封裝。
由於圖生視頻任務耗時較長(通常為1-5分鐘),SDK 在底層封裝了 HTTP 非同步呼叫流程,支援同步、非同步兩種調用方式。
根據模型所在地區設定
調用時請將
根據模型所在地區設定
調用時請將
使用 wan2.6-i2v-flash 產生圓形物體連續旋轉(如圓環、齒輪、錶盤)的動畫時,畫面在約 3 秒後可能出現短暫卡頓(畫面靜止約 1 秒)。如需產生此類連續旋轉效果,建議改用萬相2.7-圖生視頻模型以規避此問題。
如果模型調用失敗並返回報錯資訊,請參見錯誤碼進行解決。
A: 輸出視頻的寬高比由輸入首幀映像(img_url)決定,但無法保證精確比例(如嚴格3:4),會存在一定偏差。
A: 模型產生的視頻儲存於阿里雲OSS,API將返回一個臨時的公網URL。若需要對該下載地址進行防火牆白名單配置,請注意:由於底層儲存會根據業務情況進行動態變更,為避免到期資訊影響訪問,文檔不提供固定的OSS網域名稱白名單。如有安全管控需求,請聯絡客戶經理擷取最新OSS網域名稱列表。
全新推出的萬相2.7-圖生視頻支援首幀生視頻、首尾幀生視頻、視頻續寫三大任務,推薦優先選用。本文檔的圖生視頻-基於首幀(wan2.6及早期模型)僅支援首幀生視頻。
適用範圍
為確保調用成功,請務必保證模型、endpoint URL 和 API Key 均屬於同一地區。跨地區調用將會失敗。
- 選擇模型:確認模型所屬的地區。
- 選擇 URL:選擇對應的地區 Endpoint URL,支援HTTP URL或 DashScope SDK URL。
- 配置 API Key:擷取該地區的API Key,再配置API Key到環境變數。
- 安裝 SDK:如需通過SDK進行調用,請安裝DashScope SDK。
本文的範例程式碼適用於新加坡地區。
HTTP調用
圖生視頻任務耗時較長(通常為1-5分鐘),API採用非同步呼叫的方式。整個流程包含 “建立任務 -> 輪詢擷取” 兩個核心步驟,具體如下:
步驟1:建立任務擷取任務ID
- 新加坡
- 維吉尼亞
- 北京
- 法蘭克福
POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis{WorkspaceId}替換為真實的業務空間ID。
- 建立成功後,使用介面返回的
task_id查詢結果,task_id 有效期間為 24 小時。請勿重複建立任務,輪詢擷取即可。 - 新手指引請參見Postman。
請求參數要求標頭(Headers)Content-Typestring(必選)請求內容類型。此參數必須設定為application/json。Authorizationstring(必選)請求身份認證。介面使用阿里雲百鍊API Key進行身份認證。樣本值:Bearer sk-xxxx。X-DashScope-Asyncstring(必選)非同步處理配置參數。HTTP請求只支援非同步,必須設定為enable。請求體(Request Body)modelstring (必選)模型名稱。模型列表與價格詳見模型價格。樣本值:wan2.6-i2v-flash。input object (必選)輸入的基本資料,如提示詞等。
屬性 prompt string (可選)文本提示詞。用來描述產生映像中期望包含的元素和視覺特點。支援中英文,每個漢字/字母佔一個字元,超過部分會自動截斷。長度限制因模型版本而異:
string (可選)反向提示詞,用來描述不希望在視頻畫面中看到的內容,可以對視頻畫面進行限制。支援中英文,長度不超過500個字元,超過部分會自動截斷。樣本值:低解析度、錯誤、最差品質、低品質、殘缺、多餘的手指、比例不良等。img_url string (必選)首幀映像的URL或 Base 64 編碼資料。映像限制:
string (可選)支援模型:wan2.6和wan2.5系列模型。音頻檔案的 URL,模型將使用該音頻產生視頻。支援輸入的格式:
object (可選)視頻處理參數,如設定視頻解析度、設定視頻時間長度、開啟prompt智能改寫、添加浮水印等。
屬性 resolution string (可選)指定產生的視頻解析度檔位,用於調整視頻的清晰度(總像素)。模型根據選擇的解析度檔位,自動縮放至相近總像素,視頻寬高比將盡量與輸入映像 img_url 的寬高比保持一致,詳見常見問題。此參數的預設值和可用枚舉值依賴於 model 參數,規則如下:
integer (可選)產生視頻的時間長度,單位為秒。該參數的取值依賴於 model參數:
boolean (可選)是否開啟prompt智能改寫。開啟後使用大模型對輸入prompt進行智能改寫。對於較短的prompt產生效果提升明顯,但會增加耗時。
string (可選)支援模型:wan2.6系列模型。指定產生視頻的鏡頭類型,即視頻是由一個連續鏡頭還是多個切換鏡頭組成。生效條件:僅當"prompt_extend": true 時生效。參數優先順序:shot_type > prompt。例如,若 shot_type設定為"single",即使 prompt 中包含“產生多鏡頭視頻”,模型仍會輸出單鏡頭視頻。可選值:
當希望嚴格控制視頻的敘事結構(如產品展示用單鏡頭、故事短片用多鏡頭),可通過此參數指定。 boolean (可選)支援模型:wan2.6-i2v-flash。是否產生有聲視頻。參數優先順序:audio > audio_url。當 audio=false時,即使傳入 audio_url,輸出仍為無聲視頻,且計費按無聲視頻計算。可選值:
boolean (可選)是否添加浮水印標識,浮水印位於視頻右下角,文案固定為“AI產生”。
integer(可選)隨機數種子,取值範圍為[0, 2147483647]。未指定時,系統自動產生隨機種子。若需提升產生結果的可複現性,建議固定seed值。請注意,由於模型產生具有機率性,即使使用相同 seed,也不能保證每次產生結果完全一致。樣本值:12345。 |
僅wan2.6系列模型支援此功能。可通過設定 "prompt_extend": true和"shot_type":"multi"啟用。 |
響應參數outputobject任務輸出資訊。
屬性 task_id string任務ID。查詢有效期間24小時。task_status string任務狀態。
枚舉值
string請求唯一標識。可用於請求明細溯源和問題排查。codestring請求失敗的錯誤碼。請求成功時不會返回此參數,詳情請參見錯誤碼。messagestring請求失敗的詳細資料。請求成功時不會返回此參數,詳情請參見錯誤碼。 |
請儲存 task_id,用於查詢任務狀態與結果。 |
步驟2:根據任務ID查詢結果
- 新加坡
- 維吉尼亞
- 北京
- 法蘭克福
GET https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/tasks/{task_id}{WorkspaceId}替換為真實的業務空間ID。
- 輪詢建議:視頻產生過程約需數分鐘,建議採用輪詢機制,並設定合理的查詢間隔(如 15 秒)來擷取結果。
- 任務狀態流轉:PENDING(排隊中)→ RUNNING(處理中)→ SUCCEEDED(成功)/ FAILED(失敗)。
- 結果連結:任務成功後返回視頻連結,有效期間為 24 小時。建議在擷取連結後立即下載並轉存至永久儲存(如阿里雲 OSS)。
- task_id 有效期間:24小時,逾時後將無法查詢結果,介面將返回任務狀態為
UNKNOWN。
請求參數要求標頭(Headers)Authorizationstring(必選)請求身份認證。介面使用阿里雲百鍊API Key進行身份認證。樣本值:Bearer sk-xxxx。URL路徑參數(Path parameters)task_idstring(必選)任務ID。 |
將 {task_id}完整替換為上一步介面返回的task_id的值。task_id查詢有效期間為24小時,並請將{WorkspaceId}替換為真實的業務空間ID。 |
響應參數outputobject任務輸出資訊。
屬性 task_id string任務ID。查詢有效期間24小時。task_status string任務狀態。
枚舉值
string任務提交時間。時區為UTC+8,格式為 YYYY-MM-DD HH:mm:ss.SSS。scheduled_time string任務執行時間。時區為UTC+8,格式為 YYYY-MM-DD HH:mm:ss.SSS。end_time string任務完成時間。時區為UTC+8,格式為 YYYY-MM-DD HH:mm:ss.SSS。video_urlstring視頻URL。僅在 task_status 為 SUCCEEDED 時返回。連結有效期間24小時,可通過此URL下載視頻。視頻格式為MP4(H.264 編碼)。orig_prompt string原始輸入的prompt,對應請求參數prompt。actual_prompt string當 prompt_extend=true 時,系統會對輸入 prompt 進行智能改寫,此欄位返回實際用於產生的最佳化後 prompt。
string請求失敗的錯誤碼。請求成功時不會返回此參數,詳情請參見錯誤碼。messagestring請求失敗的詳細資料。請求成功時不會返回此參數,詳情請參見錯誤碼。object輸出資訊統計,只對成功的結果計數。
屬性
wan2.6系列模型返回參數 input_video_duration integer輸入的視頻的時間長度,單位秒。當前不支援傳入的視訊,因此固定為0。output_video_duration integer僅在使用 wan2.6 模型時返回。輸出視頻的時間長度,單位秒。其值等同於input.duration的值。duration integer總的視頻時間長度,用於計費。計費公式:duration=input_video_duration+output_video_duration。SR integer僅在使用 wan2.6 模型時返回。產生視頻的解析度檔位。樣本值:720。video_count integer產生視頻的數量。固定為1。audioboolean僅在使用wan2.6-i2v-flash模型時返回。表示輸出視頻是否為有聲視頻。
wan2.2和wan2.5系列模型返回參數 duration integer產生視頻的時間長度,單位為秒。枚舉值為5、10。計費公式:費用 = 視頻秒數 × 單價。SR integer產生視頻的解析度。枚舉值為480、720、1080。video_count integer產生視頻的數量。固定為1。
wan2.1系列模型返回參數 video_duration integer產生視頻的時間長度,單位為秒。枚舉值為3、4、5。計費公式:費用 = 視頻秒數 × 單價。video_ratio string產生視頻的比例。固定為standard。video_count integer產生視頻的數量。固定為1。string請求唯一標識。可用於請求明細溯源和問題排查。 |
視頻URL僅保留24小時,逾時後會被自動清除,請及時儲存產生的視頻。 |
DashScope SDK調用
SDK 的參數命名與HTTP介面基本一致,參數結構根據語言特性進行封裝。
由於圖生視頻任務耗時較長(通常為1-5分鐘),SDK 在底層封裝了 HTTP 非同步呼叫流程,支援同步、非同步兩種調用方式。
具體耗時受限於排隊任務數和服務執行情況,請在擷取結果時耐心等待。
Python SDK調用
根據模型所在地區設定 base_http_api_url:
- 新加坡
- 維吉尼亞
- 北京
- 法蘭克福
dashscope.base_http_api_url = 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1'{WorkspaceId}替換為真實的業務空間ID。
範例程式碼
- 同步調用
- 非同步呼叫
同步調用會阻塞等待,直到視頻產生完成並返回結果。本樣本展示三種映像輸入方式:公網URL、Base64編碼、本地檔案路徑。
請求樣本
響應樣本
video_url 有效期間24小時,請及時下載視頻。
Java SDK調用
根據模型所在地區設定 baseHttpApiUrl:
- 新加坡
- 維吉尼亞
- 北京
- 法蘭克福
Constants.baseHttpApiUrl = "https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1";{WorkspaceId}替換為真實的業務空間ID。
範例程式碼
- 同步調用
- 非同步呼叫
同步調用會阻塞等待,直到視頻產生完成並返回結果。本樣本展示三種映像輸入方式:公網URL、Base64編碼、本地檔案路徑。
請求樣本
響應樣本
video_url 有效期間24小時,請及時下載視頻。
使用限制
- 資料時效:任務task_id和 視頻url均只保留 24 小時,到期後將無法查詢或下載。
- 內容審核:輸入的內容(如prompt、映像)、輸出視頻均會經過Alibaba Content Security Service審核,含違規內容將返回 “IPInfringementSuspect”或“DataInspectionFailed”錯誤,詳見參見錯誤碼。
已知限制
使用 wan2.6-i2v-flash 產生圓形物體連續旋轉(如圓環、齒輪、錶盤)的動畫時,畫面在約 3 秒後可能出現短暫卡頓(畫面靜止約 1 秒)。如需產生此類連續旋轉效果,建議改用萬相2.7-圖生視頻模型以規避此問題。
錯誤碼
如果模型調用失敗並返回報錯資訊,請參見錯誤碼進行解決。
常見問題
Q:如何產生特定寬高比(如3:4)的視頻?
A: 輸出視頻的寬高比由輸入首幀映像(img_url)決定,但無法保證精確比例(如嚴格3:4),會存在一定偏差。
-
為什麼會有偏差?
模型會以輸入映像的比例為基準,結合設定的解析度檔位(resolution)總像素,自動計算出最接近的合法解析度。由於要求視頻的長和寬必須是 16 的倍數,模型會對最終解析度做微調,因此無法保證輸出比例嚴格等於 3:4,但會非常接近。
- 例如:輸入映像750×1000(寬高比 3:4 = 0.75),並設定 resolution = "720P"(目標總像素約 92 萬),實際輸出816×1104(寬高比 ≈ 0.739,總像素約90萬)。
-
實踐建議:
- 輸入控制:盡量使用與目標比例一致的圖片作為首幀輸入。
- 後期處理:如果您對比例有嚴格要求,建議在視頻產生後,使用編輯工具進行簡單的裁剪或黑邊填充。