curl --location 'https://dashscope.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation' \
--header 'Content-Type: application/json' \
--header "Authorization: Bearer $DASHSCOPE_API_KEY" \
--data '{
"model": "qwen-image-3.0-pro",
"input": {
"messages": [
{
"role": "user",
"content": [
{
"text": "画面是一张竖幅户外人像摄影,整体从上到下呈现温暖的午后街景氛围。顶部左侧到上方大面积被深绿色藤蔓和橙色小花覆盖,花叶从建筑檐口自然垂落,受阳光照射的叶片呈黄绿色高光,阴影处则偏深绿,形成浓密而柔和的背景层次。左上至中上区域是一块深蓝色横向招牌,招牌表面较暗、略带磨砂质感,上面以白色哥特体大字写着 Il Messaggero,文字位于画面左侧偏上,部分被前景花叶轻微遮挡,字体高对比、带装饰性尖角和粗细变化。招牌下方是报刊亭或书报摊的玻璃展示窗,黑色金属框架将橱窗分隔成多个矩形区域,内部陈列着许多报纸、杂志和书刊封面,但大多因景深虚化和光线反射而难以辨读,形成浅色纸张与深色边框交错的背景纹理。画面右上方是强烈的逆光区域,阳光从街道尽头照入,背景建筑被虚化成米灰色块面,边缘柔和,呈现明显的浅景深效果。画面中部偏右是一名年轻成年女性的半身至膝上人像,她回头面向镜头微笑,身体略向右转,肩背朝向观者,姿态自然放松。她有长而浓密的黑色波浪卷发,发丝被逆光勾勒出金色轮廓光,发梢在右侧向外散开,显得轻盈蓬松。她肤色白皙,脸型柔和偏鹅蛋形,眉形细致,眼睛明亮,眼妆清透,睫毛明显,面部带有自然高光,唇部为柔和珊瑚红色,笑容露齿,表情亲切明朗。她佩戴小巧耳饰,身穿黑色细肩带露背连衣裙,面料颜色深黑、轮廓简洁,细肩带从肩部向背部延伸,背部线条清晰。画面下部偏左到中部,她双手抱着一束玫瑰花,花束体积较大,主要由橙色、杏色、粉色和浅桃色玫瑰组成,花瓣层层卷曲,边缘被阳光照亮,绿色叶片和长花茎从花束下方垂出,花束与黑色裙装形成鲜明色彩对比。右侧背景是一条被阳光照亮的城市街道,地面呈暖灰与金黄色调,远处建筑、街边设施和一个模糊的红色圆形交通标志位于右下远景,均因焦外虚化而只保留色块和轮廓。整张照片采用暖色胶片感处理,带有细腻颗粒、柔和对比和明显逆光边缘光,人物位于视觉焦点,背景报刊亭、花藤、街道和阳光共同营造出浪漫、明亮、都市漫步式的氛围。"
}
]
}
]
},
"parameters": {
"negative_prompt": "",
"prompt_extend": true,
"watermark": false,
"size": "2048*2048"
}
}'{
"output": {
"choices": [
{
"finish_reason": "stop",
"message": {
"content": [
{
"image": "https://dashscope-result-sh.oss-cn-shanghai.aliyuncs.com/xxx.png?Expires=xxx"
}
],
"role": "assistant"
}
}
]
},
"usage": {
"output_height": 2048,
"output_width": 2048,
"input_image_count": 0,
"input_image_type": "qima_input_2k",
"output_image_count": 1,
"output_image_type": "qima_output_2k"
},
"request_id": "d0250a3d-b07f-49e1-bdc8-6793f4929xxx"
}鉴权
千问AI平台 API Key。详见获取 API Key。
请求体
application/json模型名称。
包含消息数组的输入数据。
显示子属性
显示子属性
仅支持单轮对话。必须包含且只包含一条角色为 user 的消息。
图像生成参数。
显示子属性
显示子属性
描述不希望在图像中出现的内容。最多 500 个字符,超出部分自动截断。
输出分辨率,格式为 宽*高。
- qwen-image-3.0 系列:总像素在 512*512 到 2048*2048 之间,宽高比在 1:8 到 8:1 之间,不指定时由模型根据提示词自动推荐分辨率。
- qwen-image-2.0 系列:总像素在 512*512 到 2048*2048 之间,默认
2048*2048。推荐分辨率:2688*1536(16:9)、1536*2688(9:16)、2048*2048(1:1,默认值)、2368*1728(4:3)、1728*2368(3:4)。 - qwen-image-max、qwen-image-plus 系列:默认
1664*928。可选分辨率:1664*928(16:9,默认值)、1472*1104(4:3)、1328*1328(1:1)、1104*1472(3:4)、928*1664(9:16)。
生成图像数量。默认值:1。
- qwen-image-3.0 / qwen-image-2.0 系列:1-6 张。
- qwen-image-max/plus 系列:固定为 1 张。
启用提示词改写。true(默认):模型先优化提示词再生成;qwen-image-3.0 系列按 prompt_extend_mode 指定的方式改写。false:直接使用原始提示词。
提示词改写方式。仅 qwen-image-3.0 系列支持。
direct(默认):直接提示词增强(DPE),适用于大多数场景。agent:智能体提示词增强(APE),改写更精细,仅文生图支持。
在图像右下角添加 "Qwen-Image" 水印。默认值:false。
是否开启思考模式,默认值为 true。开启时,模型将增强推理能力以提升出图质量,但会增加生成耗时。仅在 prompt_extend=true 时生效,适用于 Direct T2I、Direct I2I 和 Agent T2I,I2I Agent 暂不支持。
随机数种子,范围为 [0, 2147483647],未传入时服务会随机选择种子。相同种子可产生更一致(但不完全相同)的结果。
响应
显示子属性
显示子属性
提示词改写状态,具体取值由请求是否开启改写以及改写执行结果决定。仅 qwen-image-3.0 系列返回此字段。
用量统计(仅统计成功结果)。字段随模型系列不同:qwen-image-3.0 系列返回 output_* / input_* 字段,其他系列返回 image_count / width / height。
显示子属性
显示子属性
最终输出图片的宽度(像素)。仅 qwen-image-3.0 系列返回。
最终输出图片的高度(像素)。仅 qwen-image-3.0 系列返回。
请求中输入图片的数量。文生图为 0,图像编辑按实际输入图片数返回。仅 qwen-image-3.0 系列返回。
输入图片计量档位,按输出分辨率像素面积判断:面积不大于 2,250,000 为 qima_input_1k,大于 2,250,000 为 qima_input_2k。仅 qwen-image-3.0 系列返回。
实际返回的输出图片数量。仅 qwen-image-3.0 系列返回。
输出图片计量档位,按输出分辨率像素面积判断:面积不大于 2,250,000 为 qima_output_1k,大于 2,250,000 为 qima_output_2k。仅 qwen-image-3.0 系列返回。
已生成的图像数量。qwen-image-3.0 系列不返回此字段,改用 output_image_count。
生成图像的宽度(像素)。qwen-image-3.0 系列不返回此字段,改用 output_width。
生成图像的高度(像素)。qwen-image-3.0 系列不返回此字段,改用 output_height。
唯一请求标识符,用于追踪和排查问题。