通過文生圖API,您可以基於文本描述創造出全新的映像。阿里雲百鍊提供萬相(Wan)、千問(Qwen-Image)和z-image系列模型。
- 模型體驗中心:點擊上方的線上體驗連結(新加坡、北京)進入,可選擇模型、設定輸出解析度、開啟智能改寫後直接提交產生。
模型效果
千問(Qwen-image)
複雜布局 ![]() | 長段落 ![]() | 寫實人像 ![]() |
UI設計 ![]() | PPT ![]() | 插畫設計 ![]() |
點擊查看提示詞
點擊查看提示詞
萬相
人像寫真 ![]() | 寫實攝影 ![]() | 繪畫流派 ![]() |
文字產生 ![]() | 海報設計 ![]() | 組圖產生 ![]() |
點擊查看提示詞
點擊查看提示詞
模型選型
- qwen-image-3.0-pro:千問映像3.0旗艦版,支援prompt智能改寫,擅長文本渲染,能精準產生貼合物理材質的中英文。
- wan2.7-image-pro:功能最全面,支援組圖產生和高達4096x4096的解析度,並增強了五官控制、色彩控制和超長文字渲染能力。
- z-image-turbo:追求速度與性價比。產生速度快、成本低,擅長高逼真度的人像與產品圖。
使用方式
文生圖提供兩種使用方式,請按需選擇:
使用方式 | 是否需要編程 | 入口 | 適用情境 |
|---|---|---|---|
網頁版線上體驗 | 否 | 模型體驗中心(見本文開篇的線上體驗連結) | 快速試用模型、驗證提示詞效果、少量出圖 |
API 呼叫 | 是 | 見下方快速開始 | 在自有應用或服務中批量、自動化地整合文生圖能力 |
快速開始
前提條件
在調用前,請擷取與配置 API Key,再配置API Key到環境變數。如果通過DashScope SDK進行調用,還需要安裝SDK。
範例程式碼
調用方式說明:
- 千問生圖模型(qwen-image-3.0系列、qwen-image-2.0系列)均支援同步調用,其中qwen-image-3.0系列、qwen-image-plus、qwen-image模型支援非同步呼叫,詳情請參見千問-映像產生與編輯3.0和千問-文生圖。
- 萬相文生圖模型均支援非同步呼叫,其中wan2.7-image-pro、wan2.7-image、wan2.6-image、wan2.6-t2i支援同步調用,詳情請參見萬相-映像產生與編輯2.7、萬相-映像產生與編輯2.6和萬相-文生圖V2。
- 千問-同步調用
- 萬相-非同步呼叫
- Python
- Java
- curl
關鍵能力
1. 指令遵循(提示詞)
參數:messages.content.text或input.prompt(必選)、negative_prompt(可選)。
- text \ prompt(正向提示詞):描述希望在畫面中看到的內容、主體、情境、風格、光照和構圖。文生圖的核心控制參數。
- negative_prompt(反向提示詞):描述不希望在畫面中出現的內容,如“模糊”、“多餘的手指”等。僅用於輔助最佳化產生品質。
- 文本渲染(畫面中的文字):模型可在畫面中產生中英文文字,但對長文本(如完整古詩、長段落或多行文字)難以逐字精準還原,易出現錯字、漏字或形近字替代。如對畫面內文字的準確性有要求,建議盡量縮短畫面內文字、僅保留關鍵標題或短語,或對成圖中的關鍵文字進行後期編輯。
wan2.7-image-pro、wan2.7-image不支援negative_prompt參數,對於不希望出現的元素,請在正向提示詞中描述(不要出現xxx)。
2. 開啟prompt智能改寫
參數: parameters.prompt_extend (bool, 預設為 true)。
此功能可自動擴充和最佳化較短的Prompt,提升出圖效果。開啟此功能額外耗時 3-5 秒。此耗時為使用大模型改寫文本。
實踐建議:
- 建議開啟:當輸入 Prompt 較簡潔或寬泛時,此功能可顯著增益圖像效果。
- 建議關閉:若需控制畫面細節、或已提供詳細描述,或對響應延遲敏感。請將參數
prompt_extend顯式設為false。
wan2.7-image-pro、wan2.7-image不支援參數:prompt_extend參數,可通過開啟thinking_mode提升出圖品質。
parameters.prompt_extend_mode (string,可選,預設為 direct)。僅qwen-image-3.0系列支援,用於指定prompt_extend開啟後的改寫方式:
direct:直接提示詞增強(DPE),適用於大多數情境。文生圖(T2I)和圖生圖/影像編輯(I2I)均支援。agent:智能體提示詞增強(APE),提供更精細的改寫效果,僅支援文生圖(T2I)。圖生圖/影像編輯(I2I)情境傳入agent將返回400錯誤。
3. 設定輸出映像解析度
參數: parameters.size (string),格式為 "寬*高"。
模型 | size格式 | 總像素支援範圍 | 預設 | 寬高比 |
|---|---|---|---|---|
wan2.7-image-pro | 縮寫 |
|
| 1:8 – 8:1 |
自訂 | 768*768 – 4096*4096 | |||
wan2.7-image | 縮寫 |
|
| 1:8 – 8:1 |
自訂 | 768*768 – 2048*2048 | |||
wan2.6-image(圖文混排輸出模式) | 自訂 | 768*768 – 1280*1280 | 匹配輸入寬高比 (≤1280*1280) | 1:4 – 4:1 |
wan2.6-t2i, wan2.5-t2i-preview | 自訂 | 1280*1280 – 1440*1440 | 1280*1280 | 1:4 – 4:1 |
wan2.2 及更早的 t2i 模型 | 自訂 | [512, 1440],且總像素 ≤1440*1440 | 1024*1024 | - |
qwen-image-3.0 系列 | 自訂 | 512*512 – 2048*2048 | 模型自動推薦 | 1:8 – 8:1 |
qwen-image-2.0 系列 | 自訂 | 512*512 – 2048*2048 | 2048*2048 | - |
qwen-image-max / qwen-image-plus 系列 | 僅限固定預設尺寸 | 見下方預設尺寸 | 1664*928 (16:9) | - |
wan2.7-image-pro僅文生圖情境(無圖片輸入、非組圖產生)支援4K與自訂40964096解析度,其餘情境僅支援2K與20482048解析度。qwen-image-max、qwen-image-plus 系列:僅支援以下 5 種固定的解析度:
1664*928(預設值):16:91472*1104:4:31328*1328:1:11104*1472:3:4928*1664:9:16
寬高比 | 4K (wan2.7-image-pro) | 2K (wan2.7-image, qwen-image-3.0系列, qwen-image-2.0系列) | 1K (Wan t2i) |
|---|---|---|---|
1:1 | 4096*4096 | 2048*2048 | 1280*1280 |
16:9 | 4096*2304 | 2688*1536 | 1696*960 |
9:16 | 2304*4096 | 1536*2688 | 960*1696 |
4:3 | 4096*3072 | 2368*1728 | 1472*1104 |
3:4 | 3072*4096 | 1728*2368 | 1104*1472 |
4. 組圖產生
參數:parameters.enable_sequential(bool,預設為 false)。僅wan2.7-image-pro和wan2.7-image支援。
設為true時啟用組圖模式,模型將根據提示詞和參考圖片的內容一次性產生多張有故事連貫性的映像。
- 產生數量:通過
n參數控制,開啟組圖模式時,取值範圍1~12(預設12),實際數量由模型決定且不超過n。 - 注意:開啟組圖模式時,
thinking_mode和color_palette參數不可用。
5. 思考模式
參數:parameters.thinking_mode(bool,預設為 true)。僅wan2.7-image-pro和wan2.7-image支援。
開啟時,模型將增強推理能力以提升出圖品質,但會增加產生耗時。
僅在關閉組圖模式(enable_sequential=false)時可用。
6. 自訂色彩主題
參數:parameters.color_palette(array)。僅wan2.7-image-pro和wan2.7-image支援。
通過傳入包含顏色(hex)和佔比(ratio)的對象數組,自訂產生映像的顏色方案。需包含3至10種顏色,推薦設定為8種。所有ratio值相加總和必須為100.00%。
僅在關閉組圖模式(enable_sequential=false)時可用。
點擊查看輸入樣本
點擊查看輸入樣本
7. 其他通用參數
參數:parameters.n(integer,可選,預設為 1)。輸出映像的數量。qwen-image-3.0 系列支援 1~6 張;wan2.7-image-pro、wan2.7-image 在關閉組圖模式時支援 1~4 張;開啟組圖模式時表示最大產生映像數量(取值範圍 1~12,預設為 12),詳見上文“組圖產生”。
n 直接影響費用:費用 = 單價 × 成功產生的圖片張數。參數:
parameters.seed(integer,可選,取值範圍 [0, 2147483647])。隨機數種子,未傳入時由服務隨機播放;使用相同 seed 可使產生結果保持相對穩定。具體支援情況以各模型的 API 參考為準。
參數:parameters.watermark(bool,可選,預設為 false)。是否添加浮水印標識,浮水印位於圖片右下角,文案為“AI產生”。
應用於生產環境
-
容錯策略
- 處理限流:當 API 返回
Throttling錯誤碼或 HTTP 429 狀態代碼時,表明已觸發限流,限流處理請參見限流。 - 非同步任務輪詢:輪詢查詢非同步任務結果時,建議採用合理的輪詢策略(如前30秒每3秒一次,之後拉長間隔),避免因過於頻繁的請求而觸發限流。為任務設定一個最終逾時時間(如 2 分鐘),逾時後標記為失敗。
- 處理限流:當 API 返回
-
風險防範
- 結果持久化:API 返回的圖片 URL 有 24 小時有效期間。生產系統必須在擷取 URL 後立即下載圖片,並轉存至您自己的持久化儲存服務中(如阿里雲Object Storage Service)。
- Alibaba Content Security Service審核:所有
prompt和negative_prompt都會經過Alibaba Content Security Service審核。若輸入內容不合規,請求將被攔截並返回DataInspectionFailed錯誤。 - 產生內容的著作權與合規風險:請確保您的提示詞內容符合相關法律法規。產生包含品牌商標、名人肖像、受著作權保護的 IP 形象等內容可能涉及侵權風險,請您自行評估並承擔相應責任。
API文檔
錯誤碼
如果模型調用失敗並返回報錯資訊,請參見錯誤碼進行解決。
常見問題
Q: 圖片 URL 多久會失效?我應該如何永久儲存圖片?
A: 圖片 URL 的有效期間為 24 小時。您必須在擷取到 URL 後,立即通過程式下載圖片,並將其儲存到您自己的持久化儲存中,例如本機伺服器或阿里雲Object Storage Service。
Q: 調用API返回DataInspectionFailed錯誤,如何處理?
A: 該錯誤表示輸入文本觸發了Alibaba Content Security Service審核。請檢查並修改prompt或negative_prompt中的文本,移除可能違規的內容後重試。
Q: prompt_extend參數應該開啟還是關閉?
A: 當輸入的prompt比較簡潔或希望模型發揮更多創意時,建議保持開啟(預設)。當prompt已經非常詳細、專業,或對API響應延遲有嚴格要求時,建議顯式設定為false。
注意:wan2.7-image-pro、wan2.7-image不支援prompt_extend參數,可通過開啟thinking_mode提升出圖品質。
Q:模型體驗如何清空會話的內容?
A: 點擊控制台右上方清空当前对话。










