curl --location 'https://dashscope.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation' \
--header 'Content-Type: application/json' \
--header "Authorization: Bearer $DASHSCOPE_API_KEY" \
--data '{
"model": "wan2.7-image-pro",
"input": {
"messages": [
{
"role": "user",
"content": [
{
"text": "A serene mountain lake at sunrise, with mist rising from the water, surrounded by pine trees, photorealistic"
}
]
}
]
},
"parameters": {
"n": 1,
"size": "2K",
"watermark": false,
"thinking_mode": true
}
}'{
"output": {
"choices": [
{
"finish_reason": "stop",
"message": {
"content": [
{
"image": "https://dashscope-result.oss-cn-shanghai.aliyuncs.com/xxx.png?Expires=xxx",
"type": "image"
}
],
"role": "assistant"
}
}
],
"finished": true
},
"usage": {
"image_count": 1,
"input_tokens": 18790,
"output_tokens": 2,
"size": "2985*1405",
"total_tokens": 18792
},
"request_id": "a3f4befe-cacd-49c9-8298-xxxxxx"
}鉴权
千问 AI 平台 API Key。详见获取 API Key。
请求体
application/json模型名称。可选值:wan2.7-image-pro、wan2.7-image。
包含消息数组的输入数据。
显示子属性
显示子属性
请求内容数组。目前仅支持单轮对话,即只能传入一组 role 和 content 参数,不支持多轮对话。
显示子属性
显示子属性
消息角色。必须为 user。
消息内容数组。必须包含一个 text 对象和 0 到 9 个 image 对象。
使用多张图片时,在数组中放入多个 image 对象。图片顺序由数组位置决定。
显示子属性
显示子属性
用户输入的提示词。支持中英文。长度不超过 5000 个字符(每个中文字符、字母、数字或符号均计为一个字符,超出部分自动截断)。content 数组中必须包含且仅包含一个 text 对象。
输入图片,支持公开 URL(HTTP/HTTPS)或 Base64 编码字符串(data:{mime_type};base64,{data})。
图片约束:
- 格式:JPEG、JPG、PNG(不支持 Alpha 通道)、BMP、WEBP。
- 分辨率:宽和高各自在 240 到 8000 像素之间,宽高比在 [1:8, 8:1] 范围内。
- 文件大小:最大 20 MB。
- 数量:每次请求最多 9 张图片。
图像处理参数。
显示子属性
显示子属性
输出图像分辨率。支持两种指定方式,不可同时使用。
wan2.7-image-pro:
- 方式一(推荐):
1K、2K(默认)或4K。- 适用范围:文生图(无图片输入,且非图像集生成模式)支持 1K、2K 和 4K;其他场景仅支持 1K 和 2K。
- 总像素数:1K = 1024×1024,2K = 2048×2048,4K = 4096×4096。
- 宽高比:有图片输入时,输出图像按最后一张输入图片的宽高比缩放到对应分辨率;无图片输入时,输出为正方形。
- 方式二:以
width*height形式指定像素数,宽高比在 [1:8, 8:1] 范围内。- 文生图:总像素数在 [768×768, 4096×4096] 范围内。
- 其他场景:总像素数在 [768×768, 2048×2048] 范围内。
wan2.7-image:
- 方式一(推荐):
1K或2K(默认),不支持 4K。 - 方式二:以
width*height形式指定像素数。所有场景总像素数在 [768×768, 2048×2048] 范围内,宽高比在 [1:8, 8:1] 范围内。
输出图像的实际像素值可能与指定值略有差异。
生成图像的数量。
注意: n 的值直接影响费用。费用 = 单价 × 成功生成的图像数量。
- 未启用图像集模式(
enable_sequential=false):表示生成图像的数量,范围 1–4,默认为 4。 - 启用图像集模式(
enable_sequential=true):表示最多生成的图像数量,范围 1–12,默认为 12。实际数量由模型决定,不超过n。
控制图像生成模式。
false:默认值。true:启用图像集输出模式。
是否启用思考模式。默认为 true(启用)。仅在未启用图像集模式且无图片输入时生效。启用后,模型将增强推理能力以提升图像质量,但会增加生成时间。
交互式编辑的选区。
- 对应关系:列表长度必须与输入图片数量一致。若某张图片无需编辑,对应位置传入空列表
[]。 - 坐标格式:
[x1, y1, x2, y2](左上角 x、左上角 y、右下角 x、右下角 y),使用原始图片的绝对像素坐标,左上角为 (0, 0)。 - 限制:单张图片最多支持 2 个边界框。
自定义色彩主题。由颜色(hex)和比例(ratio)对象组成的数组,须包含 3 到 10 种颜色(推荐设置为 8 种)。仅在未启用图像集模式(enable_sequential=false)时可用。
[
{
"hex": "#C2D1E6",
"ratio": "60.00%"
},
{
"hex": "#636574",
"ratio": "25.00%"
},
{
"hex": "#CBD4E4",
"ratio": "15.00%"
}
]在图像右下角添加固定文字水印"AI Generated"。
随机数种子。有效范围:[0, 2147483647]。使用相同种子可生成相似结果。若不指定,算法将使用随机种子。注意:图像生成具有概率性,即使使用相同种子,结果也可能存在差异。
响应
唯一请求标识符。