Skip to main content
視頻編輯

視頻編輯2.1

萬相視頻編輯統一模型支援 多模態輸入 (文本/映像/視頻),可實現 多圖參考、視頻重繪、局部編輯、視頻延展、畫面擴充 五大核心能力。

適用範圍

  • 各地區支援的模型有所差異,且資源相互獨立。各地區支援的模型請參見百鍊控制台
  • 調用時,確保模型、Endpoint URL 和 API Key 均屬於同一地區,跨地區調用將會失敗。
本文的範例程式碼適用於新加坡地區

核心能力

多圖參考

功能介紹:支援最多 3張參考映像,可包括主體與背景(如人物、動物、服飾、情境等)。模型將多張圖片融合產生連貫的視頻內容。 參數設定:
  • function:必須設為 image_reference
  • ref_images_url:URL數組,支援輸入1~3張參考圖。
  • obj_or_bg:標識每張圖為主體(obj)還是背景(bg),與ref_images_url長度一致。
輸入提示詞輸入參考圖1(參考主體)輸入參考圖2(參考背景)輸出視頻
視頻中,一位女孩自晨霧繚繞的古老森林深處款款走出,她步伐輕盈,鏡頭捕捉她每一個靈動瞬間。當她站定,環顧四周蔥鬱林木時,她臉上綻放出驚喜與喜悅交織的笑容。這一幕,定格在了光影交錯的瞬間,記錄下她與大自然的美妙邂逅。
image
image
在調用前,先擷取API Key,再配置API Key到環境變數
  • curl
  • Python
  • Java
步驟1:建立任務擷取任務ID
curl --location 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis' \
--header 'X-DashScope-Async: enable' \
--header "Authorization: Bearer $DASHSCOPE_API_KEY" \
--header 'Content-Type: application/json' \
--data '{
    "model": "wan2.1-vace-plus",
    "input": {
        "function": "image_reference",
        "prompt": "視頻中,一位女孩自晨霧繚繞的古老森林深處款款走出,她步伐輕盈,鏡頭捕捉她每一個靈動瞬間。當她站定,環顧四周蔥鬱林木時,她臉上綻放出驚喜與喜悅交織的笑容。這一幕,定格在了光影交錯的瞬間,記錄下她與大自然的美妙邂逅。",
        "ref_images_url": [
            "http://wanx.alicdn.com/material/20250318/image_reference_2_5_16.png",
            "http://wanx.alicdn.com/material/20250318/image_reference_1_5_16.png"
        ]
    },
    "parameters": {
        "prompt_extend": true,
        "obj_or_bg": ["obj","bg"],
        "size": "1280*720"
    }
}'
步驟2:根據任務ID擷取結果{task_id}完整替換為上一步介面返回的task_id的值。task_id查詢有效期間為24小時。
curl -X GET https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/tasks/{task_id} \
--header "Authorization: Bearer $DASHSCOPE_API_KEY"

視頻重繪

功能介紹:從輸入視頻中提取主體姿態與動作、構圖與運動輪廓或線稿結構,結合文本提示詞產生具有相同動態特徵的新視頻。還支援通過參考映像替換原視頻中的主體。 參數設定:
  • function: 必須設為 video_repainting
  • video_url必填。輸入視頻的URL地址(MP4格式,≤50MB,≤5秒)。
  • control_condition必填。設定視頻特徵提取的方式,決定了新視頻保留原視頻的哪些特徵。
    • posebodyface:提取臉部表情和肢體動作(保留面部表情細節)。
    • posebody:僅提取肢體動作,不含臉部(僅控制身體動作)。
    • depth:提取構圖和運動輪廓(保留情境結構)。
    • scribble:提取線稿結構(保留線稿邊緣細節)。
  • strength:可選。控制特徵提取的強度,範圍 [0.0, 1.0],預設 1.0。數值越大越貼近原視頻,數值越小產生越自由。
  • ref_images_url:可選。傳入1張參考映像URL,用於替換輸入視頻中的主體。
輸入提示詞輸入視頻輸出視頻
視頻展示了一輛黑色的蒸汽龐克風格汽車,紳士駕駛著,車輛裝飾著齒輪和銅管。背景是蒸汽驅動的糖果工廠和複古元素,畫面複古與趣味
  • curl
  • Python
  • Java
步驟1:建立任務擷取任務ID
curl --location 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis' \
--header 'X-DashScope-Async: enable' \
--header "Authorization: Bearer $DASHSCOPE_API_KEY" \
--header 'Content-Type: application/json' \
--data '{
    "model": "wan2.1-vace-plus",
    "input": {
        "function": "video_repainting",
        "prompt": "視頻展示了一輛黑色的蒸汽龐克風格汽車,紳士駕駛著,車輛裝飾著齒輪和銅管。背景是蒸汽驅動的糖果工廠和複古元素,畫面複古與趣味。",
        "video_url": "http://wanx.alicdn.com/material/20250318/video_repainting_1.mp4"
    },
    "parameters": {
        "prompt_extend": false,
        "control_condition": "depth"
    }
}'
步驟2:根據任務ID擷取結果{task_id}完整替換為上一步介面返回的task_id的值。task_id查詢有效期間為24小時。
curl -X GET https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/tasks/{task_id} \
--header "Authorization: Bearer $DASHSCOPE_API_KEY"

局部編輯

功能介紹:對視頻指定地區進行精細化編輯,支援元素增刪改和主體背景替換。上傳掩碼映像指定編輯地區,模型將自動跟蹤目標並融合產生內容。 參數設定:
  • function:必須設為 video_edit
  • video_url必填。輸入原視頻的URL地址。
  • mask_image_url:可選。與 mask_video_url 二選一,推薦使用此參數。輸入遮罩映像URL,白色地區代表需要編輯的部分,黑色地區保留不變。
  • mask_frame_id:可選。配合 mask_image_url 使用,指定掩碼對應視頻的哪一幀(預設第1幀)。
  • mask_type:可選。指定編輯地區的行為方式:
    • tracking(預設):編輯地區會根據目標物體的運動軌跡自動跟隨。
    • fixed:編輯地區保持固定位置不變。
  • expand_ratio:可選。僅當 mask_typetracking 時生效。
    • 作用:設定掩碼地區向外擴充的比例。取值範圍[0.0, 1.0],預設值為 0.05。
    • 說明:數值越小,掩碼越貼合目標;數值越大,掩碼擴充範圍越廣。
  • ref_images_url:可選。傳入1張參考映像URL,用於將編輯地區的內容替換為該參考圖的內容。
輸入提示詞輸入視頻輸入遮罩映像輸出視頻
視頻展示了一家巴黎風情的法式咖啡館,一隻穿著西裝的獅子優雅地品著咖啡。它一手端著咖啡杯,輕輕啜飲,神情愜意。咖啡館裝飾雅緻,柔和的色調與溫暖燈光映照著獅子所在的地區。
mask
白色地區表示編輯地區
  • curl
  • Python
  • Java
步驟1:建立任務擷取任務ID
curl --location 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis' \
--header 'X-DashScope-Async: enable' \
--header "Authorization: Bearer $DASHSCOPE_API_KEY" \
--header 'Content-Type: application/json' \
--data '{
    "model": "wan2.1-vace-plus",
    "input": {
        "function": "video_edit",
        "prompt": "視頻展示了一家巴黎風情的法式咖啡館,一隻穿著西裝的獅子優雅地品著咖啡。它一手端著咖啡杯,輕輕啜飲,神情愜意。咖啡館裝飾雅緻,柔和的色調與溫暖燈光映照著獅子所在的地區。",
        "mask_image_url": "http://wanx.alicdn.com/material/20250318/video_edit_1_mask.png",
        "video_url": "http://wanx.alicdn.com/material/20250318/video_edit_2.mp4",
        "mask_frame_id": 1
    },
    "parameters": {
        "prompt_extend": false,
        "mask_type": "tracking",
        "expand_ratio": 0.05
    }
}'
步驟2:根據任務ID擷取結果{task_id}完整替換為上一步介面返回的task_id的值。task_id查詢有效期間為24小時。
curl -X GET https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/tasks/{task_id} \
--header "Authorization: Bearer $DASHSCOPE_API_KEY"

視頻延展

功能介紹:基於輸入的映像或視頻片段,預測並產生具有連續性的後續內容。支援“首幀/首片段”向後延展,或“尾幀/尾片段”向前延展。最終產生的視頻總時間長度固定為5秒。 參數設定:
  • function:必須設為 video_extension
  • prompt必填。描述期望產生的延展內容。
  • first_clip_url:可選。輸入首段視頻URL(≤3秒),模型將基於此片段向後延續產生視頻。
  • last_clip_url:可選。輸入尾段視頻URL(≤3秒),模型將基於此片段向前反向推算產生視頻。
  • first_frame_url:可選,輸入首幀映像的 URL 地址。基於首幀映像向後延展。
  • last_frame_url:可選,輸入尾幀映像的 URL 地址。基於尾幀映像向前延展。
    注意:first_clip_url、last_clip_url、first_frame_url、last_frame_url 四個參數中,必須至少提供一項作為輸入。
輸入提示詞輸入首片段視頻(1秒)輸出視頻(延長後的視頻為5秒)
一隻戴著墨鏡的狗在街道上滑滑板,3D卡通。
  • curl
  • Python
  • Java
步驟1:建立任務擷取任務ID
curl --location 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis' \
--header 'X-DashScope-Async: enable' \
--header "Authorization: Bearer $DASHSCOPE_API_KEY" \
--header 'Content-Type: application/json' \
--data '{
    "model": "wan2.1-vace-plus",
    "input": {
        "function": "video_extension",
        "prompt": "一隻戴著墨鏡的狗在街道上滑滑板,3D卡通。",
        "first_clip_url": "http://wanx.alicdn.com/material/20250318/video_extension_1.mp4"
    },
    "parameters": {
        "prompt_extend": false
    }
}'
步驟2:根據任務ID擷取結果{task_id}完整替換為上一步介面返回的task_id的值。task_id查詢有效期間為24小時。
curl -X GET https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/tasks/{task_id} \
--header "Authorization: Bearer $DASHSCOPE_API_KEY"

視頻畫面擴充

功能介紹: 在視頻的上下左右四個方向上,根據提示詞按比例擴充畫面內容,保持視頻主體的連貫性和背景的自然融合。 參數設定:
  • function:必須設為 video_outpainting
  • video_url必填。輸入原視頻的URL地址。
  • top_scale:可選。向上擴充比例,範圍 [1.0, 2.0],預設值為1.0(不擴充)。
  • bottom_scale:可選。向下擴充比例,範圍 [1.0, 2.0],預設值為1.0。
  • left_scale:可選。向左擴充比例,範圍 [1.0, 2.0],預設值為1.0。
  • right_scale:可選。向右擴充比例,範圍 [1.0, 2.0],預設值為1.0。
樣本:設定 left_scale 為 1.5,表示左側畫面將擴充為原寬度的1.5倍。
輸入提示詞輸入視頻輸出視頻
一位優雅的女士正在激情演奏小提琴,她身後是一支完整的交響樂團
  • curl
  • Python
  • Java
步驟1:建立任務擷取任務ID
curl --location 'https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis' \
--header 'X-DashScope-Async: enable' \
--header "Authorization: Bearer $DASHSCOPE_API_KEY" \
--header 'Content-Type: application/json' \
--data '{
    "model": "wan2.1-vace-plus",
    "input": {
        "function": "video_outpainting",
        "prompt": "一位優雅的女士正在激情演奏小提琴,她身後是一支完整的交響樂團。",
        "video_url": "http://wanx.alicdn.com/material/20250318/video_outpainting_1.mp4"
    },
    "parameters": {
        "prompt_extend": false,
        "top_scale": 1.5,
        "bottom_scale": 1.5,
        "left_scale": 1.5,
        "right_scale": 1.5
    }
}'
步驟2:根據任務ID擷取結果{task_id}完整替換為上一步介面返回的task_id的值。task_id查詢有效期間為24小時。
curl -X GET https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/tasks/{task_id} \
--header "Authorization: Bearer $DASHSCOPE_API_KEY"

如何輸入映像和視頻

輸入映像

輸入視頻

輸出視頻

  • 視頻數量:1個。
  • 視頻規格:解析度總像素固定為720P,幀率30fps,格式為MP4(H.264 編碼)。
  • 視頻URL有效期間24小時
  • 視頻尺寸:根據所選功能不同而有所差異。
    • 多圖參考 / 局部編輯
      • 輸出固定為 720P 規格。
      • 具體寬高由請求參數 size 決定。
    • 視頻重繪 / 視頻延展 / 視頻畫面擴充
      • 若輸入視頻解析度 ≤ 720P:保持原生解析度輸出。
      • 若輸入視頻解析度 > 720P:保持寬高比不變,按比例縮放至 720P 輸出。

計費與限流

  • 模型免費額度和計費單價請參見模型價格
  • 模型限流請參見萬相系列
  • 計費說明:
    • 輸入不計費,輸出計費。按成功產生的 視頻秒數 計費。
    • 模型調用失敗或處理錯誤不產生任何費用,也不消耗新人免費額度
    • 通用視頻編輯還支援節省計劃

API文檔

通用視頻編輯API參考

常見問題

Q:多圖參考功能最多支援幾張圖片?

A:最多支援3張參考映像。若超過3張,僅保留前3張作為輸入。建議主體映像使用純色背景以便更好突出主體,背景映像不包含任何主體對象。

Q: 視頻重繪時什麼情況下應該關閉prompt智能改寫?

A: 當文本描述與輸入視頻內容不一致時,模型可能產生誤解。建議手動關閉智能改寫prompt_extend=false,並在prompt中提供清晰、具體的畫面描述,以提升產生一致性與準確性。

Q:局部編輯功能中,掩碼映像和掩碼視頻有什麼區別?

A:掩碼映像mask_image_url與掩碼視頻mask_video_url二選一填寫。推薦優先使用掩碼映像,只需指定一幀的編輯地區,系統會自動跟蹤目標。
Token Plan
模型體驗
用量統計與效能監控
資產中心
服務支援