n)或并发场景建议从 600 秒起配置,避免客户端提前断开连接。鉴权
千问AI平台 API Key。详见获取 API Key。
请求体
application/json模型名称。
正向提示词,描述期望生成或编辑的图像内容、风格和构图。支持中英文,推荐不超过 4500 Token,不能为空字符串。
输入图像的 URL 或 Base64 编码数据。不传为文生图(T2I);传入为图生图(I2I),qwen-image-3.0 系列支持 1-3 张,qwen-image-2.1-pro 支持 1-10 张。单张可传字符串,多张传字符串数组(数组顺序即图像顺序)。不能传 null 或空数组,否则返回 400。格式支持 JPG/JPEG/PNG/BMP/TIFF/WEBP/GIF,宽高建议 384-2048 像素,大小不超过 10MB。
支持的输入格式:
- 公网 URL:支持 HTTP 和 HTTPS 协议。
- Base64 编码:格式为
data:{MIME_type};base64,{base64_data}。
输出图像数量。字符串形式(如 "1")会返回 400,必须传整数。
输出分辨率,格式 宽x高(字母 x 分隔)。也可传 auto 由模型自动推荐。像素面积 512x512 至 2048x2048,宽高比 1:8 至 8:1。注意与 DashScope 协议的 * 分隔符不同,迁移时请修改。
反向提示词,描述不希望在画面中出现的内容。
随机数种子。未传入时服务随机选择;固定种子可使结果相对稳定。
是否开启提示词智能改写(建议开启)。开启后按 prompt_extend_mode 优化正向提示词。
提示词改写方式。direct:直接提示词增强(DPE),T2I/I2I 均支持;agent:智能体提示词增强(APE),仅 T2I,I2I 传入返回 400。
是否开启思考模式。开启时增强推理以提升出图质量,但增加耗时。仅在 prompt_extend=true 时生效,I2I Agent 暂不支持。
是否添加水印。
响应
响应创建时间的 Unix 时间戳(秒)。
生成结果列表。n 大于 1 时包含多个元素。
本次调用的资源使用情况,仅调用成功时返回。此处为图片输入/输出计量信息,不是 Token 用量。字段随模型系列不同:qwen-image-3.0 系列返回 output_* / input_* 字段,qwen-image-2.1-pro 返回 image_count / width / height。
错误信息,仅调用失败时返回。OpenAI 兼容模式不在响应体返回 request_id,请求唯一标识通过 HTTP 响应头 x-request-id 返回。使用 OpenAI Python SDK 时,成功可读 response._request_id,失败可从 APIStatusError.request_id 读取。