千问-文生图模型(Qwen-Image)是一款通用图像生成模型,支持多种艺术风格,尤其擅长 复杂文本渲染 。模型支持多行布局、段落级文本生成以及细粒度细节刻画,可实现复杂的图文混合布局设计。
快速入口:使用指南 | 在线体验(新加坡 | 北京) | 技术博客(更多效果展示) |
效果展示
输入提示词 | 输出图像 |
|---|---|
Healing-style hand-drawn poster featuring three puppies playing with a ball on lush green grass, adorned with decorative elements such as birds and stars. The main title “Come Play Ball!” is prominently displayed at the top in bold, blue cartoon font. Below it, the subtitle “Come [Show Off Your Skills]!” appears in green font. A speech bubble adds playful charm with the text: “Hehe, watch me amaze my little friends next!”At the bottom, supplementary text reads: “We get to play ball with our friends again!” The color palette centers on fresh greens and blues, accented with bright pink and yellow tones to highlight a cheerful, childlike atmosphere. | ![]() |
模型概览
| 模型名称 | 模型简介 | 输出图像规格 |
|---|---|---|
qwen-image-3.0-pro 推荐 | 千问图像生成与编辑3.0系列,同时支持文生图(T2I)和图生图/图像编辑(I2I)。3.0系列API调用请参阅千问-图像生成与编辑3.0。 | 图像分辨率:总像素需在512512至20482048之间。图像格式:png |
qwen-image-3.0 推荐兼顾质量与速度。 | ||
qwen-image-2.0-pro 推荐当前与qwen-image-2.0-pro-2026-04-22能力相同 | 千问图像生成与编辑模型Pro系列。文字渲染、真实质感、语义遵循能力更强。图像编辑请参考千问-图像编辑。 | 图像分辨率:支持自由设置宽高,输出图像总像素需在512512至20482048之间。默认分辨率为2048*2048。图像格式:png图像张数:1-6张 |
qwen-image-2.0-pro-2026-06-22 推荐 | ||
| qwen-image-2.0-pro-2026-04-22 | ||
| qwen-image-2.0-pro-2026-03-03 | ||
qwen-image-2.0 推荐当前与qwen-image-2.0-2026-03-03能力相同 | 千问图像生成与编辑模型加速版,兼顾效果与响应速度。图像编辑请参考千问-图像编辑。 | |
qwen-image-2.0-2026-03-03 推荐 | ||
qwen-image-max当前与qwen-image-max-2025-12-30能力相同 | 千问图像生成模型Max系列。真实感、自然度更强,AI合成痕迹更低。 | 图像分辨率:可选分辨率及对应宽高比例请参见size参数设置图像格式:png图像张数:固定1张 |
| qwen-image-max-2025-12-30 | ||
qwen-image-plus当前与qwen-image能力相同 | 千问图像生成模型Plus系列,擅长多样化艺术风格与文字渲染。 | |
| qwen-image-plus-2026-01-09 | ||
| qwen-image |
前提条件
在调用前,先获取与配置 API Key,再配置API Key到环境变量。如需通过SDK进行调用,请安装DashScope SDK。
同步接口(推荐)
HTTP调用
千问图像模型支持同步接口,一次请求即可获得结果,调用流程简单,推荐用于多数场景。
新加坡地域:POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation
北京地域:POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation
调用时请将{WorkspaceId}替换为真实的Workspace ID。
请求参数请求头(Headers)Content-Typestring(必选)请求内容类型。此参数必须设置为application/json。Authorizationstring(必选)请求身份认证。接口使用阿里云百炼API Key进行身份认证。示例值:Bearer sk-xxxx。请求体(Request Body)modelstring (必选)模型名称。示例值:qwen-image-2.0-pro。input object (必选)输入的基本信息。
属性 messages array (必选)请求内容数组。当前仅支持单轮对话,数组内有且只有一个元素。
属性 role string (必选)消息的角色。此参数必须设置为user。contentarray (必选)消息内容数组。
属性 text string(必选)正向提示词用于描述您期望生成的图像内容、风格和构图。支持中英文,qwen-image-2.0系列模型长度上限为 1300 Token,其他模型为 800 Token,超出部分将自动截断。注意:仅支持传入一个text,不传或传入多个将报错。object (可选)图像处理参数。
属性 negative_prompt string (可选)反向提示词,用于描述不希望在图像中出现的内容,对画面进行限制。支持中英文,长度不超过500个字符,超出部分将自动截断。示例值:低分辨率,低画质,肢体畸形,手指畸形,画面过饱和,蜡像感,人脸无细节,过度光滑,画面具有AI感。构图混乱。文字模糊,扭曲。size string (可选)输出图像的分辨率,格式为宽*高。qwen-image-2.0系列模型:输出图像总像素需在512*512至2048*2048之间,默认分辨率为2048*2048。推荐分辨率:
1664*928。可选的分辨率及其对应的图像宽高比例为:
integer (可选)输出图像的数量,默认值为1。对于qwen-image-2.0系列模型,可选择输出1-6张图片。对于qwen-image-max、qwen-image-plus系列模型,此参数固定为1,设置其他值将导致报错。prompt_extend bool (可选)是否开启 Prompt(提示词)智能改写功能。开启后模型将对正向提示词进行优化与润色。此功能不会修改反向提示词。
点击查看改写示例 当前仅异步接口返回实际提示词。原始提示词(orig_prompt):A sitting ginger cat with a joyful expression, looking lively, adorable, and incredibly lifelike.实际提示词(actual_prompt):Photorealistic wildlife portrait: A sitting ginger cat with lush, sun-kissed fur and a vibrant, joyful expression, eyes sparkling with curiosity and warmth. The cat's head is slightly tilted, ears perked forward, mouth gently open in a contented, lively pose—exuding adorable charm and incredible lifelike detail. Soft natural lighting enhances the texture of each individual whisker and fur strand, with subtle highlights on the muzzle and inner ears. Background: a softly blurred autumn garden at golden hour—warm tones of amber leaves, dappled sunlight filtering through trees, and faint hints of mossy stone steps. Composition emphasizes the cat as the central focal point, captured in sharp focus with shallow depth of field. Style: ultra-realistic photography, National Geographic-level detail, 8K resolution, Canon EOS R5, f/1.2 aperture, cinematic lighting, true-to-life color grading, minimal post-processing. No text or overlays. bool (可选)是否在图像右下角添加 "Qwen-Image" 水印。默认值为 false。水印样式:integer (可选)随机数种子,取值范围[0,2147483647]。使用相同的seed参数值可使生成内容保持相对稳定。若不提供,算法将自动使用随机数种子。注意:模型生成过程具有概率性,即使使用相同的seed,也不能保证每次生成结果完全一致。 |
|
响应参数outputobject任务输出信息。
属性 choices array模型生成的输出内容。此数组仅包含一个元素。
属性 finish_reason string任务停止原因,自然停止时为stop。message object模型返回的消息。
属性 role string消息的角色,固定为assistant。contentarray
属性 image string生成图像的 URL,图像格式为PNG。链接有效期为24小时,请及时下载并保存图像。object任务结果统计。使用qwen-image-2.0系列时无此返回值。
属性 TOTAL integer总的任务数。SUCCEEDED integer任务状态为成功的任务数。FAILED integer任务状态为失败的任务数。object输出信息统计。只对成功的结果计数。
属性 image_count integer模型生成图像的数量,当前固定为1。width integer模型生成图像的宽度(像素)。height integer模型生成图像的高度(像素)。string请求唯一标识。可用于请求明细溯源和问题排查。codestring请求失败的错误码。请求成功时不会返回此参数,详情请参见错误码。messagestring请求失败的详细信息。请求成功时不会返回此参数,详情请参见错误码。 |
图像URL仅保留24小时,超时后会被自动清除,请及时保存生成的图像。 |
DashScope SDK调用
DashScope SDK目前已支持Python和Java。
SDK与HTTP接口的参数名基本一致,参数结构根据语言特性进行封装。同步调用参数说明可参考HTTP调用。
- Python
- Java
异步接口
HTTP调用
调用流程分为两步:
- 创建任务获取任务ID:发送一个请求创建任务,该请求会返回任务ID(task_id)。
- 根据任务ID查询结果:使用task_id轮询任务状态,直到任务完成并获得图像URL。
步骤1:创建任务获取任务ID
新加坡地域:POST https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/services/aigc/text2image/image-synthesis
北京地域:POST https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/api/v1/services/aigc/text2image/image-synthesis
- 创建成功后,使用接口返回的
task_id查询结果,task_id 有效期为 24 小时。请勿重复创建任务,轮询获取即可。 - 新手指引请参见Postman。
请求参数请求头(Headers)Content-Typestring(必选)请求内容类型。此参数必须设置为application/json。Authorizationstring(必选)请求身份认证。接口使用阿里云百炼API Key进行身份认证。示例值:Bearer sk-xxxx。X-DashScope-Asyncstring(必选)异步处理配置参数。HTTP请求只支持异步,必须设置为enable。请求体(Request Body)modelstring (必选)模型名称。当前仅qwen-image-plus、qwen-image模型支持异步接口调用。示例值:qwen-image-plus。input object (必选)输入的基本信息,如提示词等。
属性 prompt string (必选)正向提示词,用来描述生成图像中期望包含的元素和视觉特点。支持中英文,长度不超过800个字符,每个汉字、字母、数字或符号计为一个字符,超出部分将自动截断。示例值:一只坐着的橘黄色的猫,表情愉悦,活泼可爱,逼真准确。negative_prompt string (可选)反向提示词,用于描述不希望在图像中出现的内容,对画面进行限制。支持中英文,长度不超过500个字符,超出部分将自动截断。示例值:低分辨率,低画质,肢体畸形,手指畸形,画面过饱和,蜡像感,人脸无细节,过度光滑,画面具有AI感。构图混乱。文字模糊,扭曲。object (可选)图像处理参数。
属性 size string (可选)输出图像的分辨率,格式为宽*高,默认分辨率为1664*928。可选的分辨率及其对应的图像宽高比例为:
integer (可选)生成图像的数量。此参数当前固定为1,设置其他值将导致报错。prompt_extend bool (可选)是否开启 Prompt(提示词)智能改写功能。开启后模型将对正向提示词进行优化与润色。此功能不会修改反向提示词。
点击查看改写示例 当前仅异步接口返回实际提示词。原始提示词(orig_prompt):A sitting ginger cat with a joyful expression, looking lively, adorable, and incredibly lifelike.实际提示词(actual_prompt):Photorealistic wildlife portrait: A sitting ginger cat with lush, sun-kissed fur and a vibrant, joyful expression, eyes sparkling with curiosity and warmth. The cat's head is slightly tilted, ears perked forward, mouth gently open in a contented, lively pose—exuding adorable charm and incredible lifelike detail. Soft natural lighting enhances the texture of each individual whisker and fur strand, with subtle highlights on the muzzle and inner ears. Background: a softly blurred autumn garden at golden hour—warm tones of amber leaves, dappled sunlight filtering through trees, and faint hints of mossy stone steps. Composition emphasizes the cat as the central focal point, captured in sharp focus with shallow depth of field. Style: ultra-realistic photography, National Geographic-level detail, 8K resolution, Canon EOS R5, f/1.2 aperture, cinematic lighting, true-to-life color grading, minimal post-processing. No text or overlays. bool (可选)是否在图像右下角添加 "Qwen-Image" 水印。默认值为 false。水印样式:integer (可选)随机数种子,取值范围[0,2147483647]。使用相同的seed参数值可使生成内容保持相对稳定。若不提供,算法将自动使用随机数种子。注意:模型生成过程具有概率性,即使使用相同的seed,也不能保证每次生成结果完全一致。 |
当前仅 qwen-image-plus、qwen-image模型支持异步接口调用。 |
响应参数outputobject任务输出信息。
属性 task_id string任务ID。查询有效期24小时。task_status string任务状态。
枚举值
string请求唯一标识。可用于请求明细溯源和问题排查。codestring请求失败的错误码。请求成功时不会返回此参数,详情请参见错误码。messagestring请求失败的详细信息。请求成功时不会返回此参数,详情请参见错误码。 |
请保存 task_id,用于查询任务状态与结果。 |
步骤2:根据任务ID查询结果
- 新加坡
- 华北2(北京)
GET https://{WorkspaceId}.ap-southeast-1.maas.aliyuncs.com/api/v1/tasks/{task_id}调用时请将{WorkspaceId}替换为真实的Workspace ID。- 轮询建议:图像生成过程耗时较长,建议采用轮询机制,并设置合理的查询间隔(如 10 秒)来获取结果。
- 任务状态流转:PENDING(排队中)→ RUNNING(处理中)→ SUCCEEDED(成功)/ FAILED(失败)。
- 结果链接:任务成功后返回图像链接,有效期为 24 小时。建议在获取链接后立即下载并转存至永久存储(如阿里云 OSS)。
请求参数请求头(Headers)Authorizationstring(必选)请求身份认证。接口使用阿里云百炼API Key进行身份认证。示例值:Bearer sk-xxxx。URL路径参数(Path parameters)task_idstring(必选)任务ID。 |
将 {task_id}完整替换为上一步接口返回的task_id的值。task_id查询有效期为24小时,并请将{WorkspaceId}替换为真实的业务空间ID。 |
响应参数outputobject任务输出信息。
属性 task_id string任务ID。查询有效期24小时。task_status string任务状态。
枚举值
string任务提交时间。时区为UTC+8,格式为 YYYY-MM-DD HH:mm:ss.SSS。scheduled_time string任务执行时间。时区为UTC+8,格式为 YYYY-MM-DD HH:mm:ss.SSS。end_time string任务完成时间。时区为UTC+8,格式为 YYYY-MM-DD HH:mm:ss.SSS。results array任务结果列表,包括图像URL、prompt、部分任务执行失败报错信息等。
属性 orig_prompt string原始输入的prompt,对应请求参数prompt。actual_prompt string开启 prompt 智能改写后,返回实际使用的优化后 prompt。若未开启该功能,则不返回此字段。url string模型生成图像的URL地址。有效期为24小时,请及时下载并保存图像。string请求失败的错误码。请求成功时不会返回此参数,详情请参见错误码。messagestring请求失败的详细信息。请求成功时不会返回此参数,详情请参见错误码。object输出信息统计。只对成功的结果计数。
属性 image_count integer模型生成图像的数量,当前固定为1。string请求唯一标识。可用于请求明细溯源和问题排查。 |
任务数据(如任务状态、图像URL等)仅保留24小时,超时后会被自动清除。请您务必及时保存生成的图像。 |
DashScope SDK调用
DashScope SDK目前已支持Python和Java。
SDK与HTTP接口的参数名基本一致,参数结构根据不同语言的SDK封装而定。异步调用参数说明可参考HTTP调用。
由于图像模型处理时间较长,底层服务采用异步方式。SDK在此基础上封装了两种调用模式:
- 同步调用(阻塞模式): SDK会自动等待任务完成,然后直接返回最终结果,调用体验与常规同步调用一致。
- 异步调用(非阻塞模式): 调用后将立即返回任务ID,需要用户根据该ID自行查询任务状态和最终结果。
Python SDK调用
- 同步调用
- 异步调用
请求示例
响应示例
url 有效期24小时,请及时下载图像。
Java SDK调用
- 同步调用
- 异步调用
请求示例
响应示例
url 有效期24小时,请及时下载图像。
结合 OpenAI Agents SDK 使用
千问-文生图(Qwen-Image)等图像生成模型通过 DashScope 原生接口调用,不支持 OpenAI 兼容(compatible-mode)模式,因此无法直接作为 OpenAI Agents SDK 中 Agent 的推理模型。
在 OpenAI Agents SDK 等智能体框架中,可将图像生成能力封装为工具(function tool),由支持 OpenAI 兼容模式的文本对话模型(如 qwen-plus)作为 Agent 的推理核心进行调度。示例如下:
运行前请先安装依赖:pip install openai-agents dashscope。
计费与限流
- 模型免费额度和计费单价请参见模型价格。
- 模型限流请参见千问(Qwen-Image)。
- 计费说明:按成功生成的 图像张数 计费。模型调用失败或处理错误不产生任何费用,也不消耗新人免费额度。
错误码
如果模型调用失败并返回报错信息,请参见错误码进行解决。
常见问题
Q:prompt_extend参数应该开启还是关闭?
A:如果希望图像内容更多样化,由模型补充细节,建议开启此选项(默认)。如果图像细节更可控,建议关闭此选项,并参考文生图Prompt指南进行优化,
Q:qwen-image、qwen-image-plus、qwen-image-max、qwen-image-2.0、qwen-image-edit 等模型的区别是什么?
A:
-
图像生成与编辑融合模型:同时支持文生图和图像编辑。
qwen-image-2.0-pro、qwen-image-2.0-pro-2026-04-22:当前两者能力相同,Pro系列具备更专业的文字渲染能力、更细腻的真实质感,细腻刻画写实场景,以及更强的语义遵循能力。仅支持同步接口。qwen-image-2.0、qwen-image-2.0-2026-03-03:当前两者能力相同,加速版有效实现了模型效果和性能的最佳平衡。仅支持同步接口。
-
文生图模型:根据文本描述生成图像。
qwen-image-max、qwen-image-max-2025-12-30:当前两者能力相同,相较于qwen-image-plus提升了生成图像的真实感与自然度,在人物质感、纹理细节和文字渲染等方面效果更佳。qwen-image、qwen-image-plus:当前两者能力相同,但qwen-image-plus的价格更优惠。qwen-image-plus-2026-01-09:千问图像生成的全新快照版模型,为qwen-image-max的蒸馏加速版,支持快速生成高质量图像。
-
图像编辑模型:
qwen-image-edit:根据输入的图像和文本指令,执行图生图、局部修改等操作,详情请参见千问-图像编辑。
