POST
/services/aigc/video-generation/video-synthesis
复制
curl --location 'https://dashscope.aliyuncs.com/api/v1/services/aigc/video-generation/video-synthesis' \
-H 'X-DashScope-Async: enable' \
-H "Authorization: Bearer $DASHSCOPE_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "wan3.0-video",
"input": {
"prompt": "一支高端智能眼镜产品广告,整体风格极简、未来感、时尚高级,光影克制,画面以黑色、银灰色、冰蓝色为主色调,局部点缀柔和白光与参数UI图形。开场在纯黑背景中,一副智能眼镜从黑暗中缓缓浮现,镜腿边缘掠过精致高光,镜框轮廓在冷冽边缘光下被勾勒出来,镜头超近距离掠过镜片、鼻托、转轴、镜腿与材质细节,展现金属与高性能复合材料的细腻质感,表面处理高级克制,线条轻薄流畅。随后产品在空中缓慢旋转,画面以极简动态图形同步展示核心参数信息。随后镜头快速收拢,所有零件精准回归组装成完整产品,切换到年轻模特佩戴展示,模特五官立体、气质自信,穿着简洁高级的都市时尚服装,在极简空间和城市光影环境中自然转头、抬手、行走、微笑,镜头从正面、侧面、斜后方展示眼镜佩戴状态,突出轻薄贴合、时尚轮廓与日常百搭属性。结尾在纯色背景中,产品悬浮定格,镜头缓慢推进到品牌logo和核心slogan,整体音乐极简电子氛围配合精准鼓点,节奏干净有力,画面质感高级、克制、纯粹,具有强烈品牌记忆点和国际化科技审美。",
"media": [
{
"type": "file",
"url": "https://help-static-aliyun-doc.aliyuncs.com/file-manage-files/zh-CN/20260806/ebapmr/glass.pptx"
}
]
},
"parameters": {
"resolution": "480P",
"ratio": "adaptive",
"duration": 10
}
}'复制
{
"request_id": "4909100c-7b5a-9f92-bfe5-xxxxxx",
"output": {
"task_id": "0385dc79-5ff8-4d82-bcb6-xxxxxx",
"task_status": "PENDING"
}
}鉴权
string
header
必填
千问AI平台 API Key。详见获取 API Key。
Header 参数
enum<string>
必填
必须设置为 enable,表示异步提交任务。缺少此请求头将报错:"current user api does not support synchronous calls"。
可选值:enable
请求体
application/jsonenum<string>
必填
模型名称。固定值:wan3.0-video。
可选值:wan3.0-video
示例:wan3.0-video
object
必填
输入的基本信息。prompt 和 media 必填其一。
显示子属性
显示子属性
string
文本提示词,用来描述期望生成的视频内容。和 media 必填其一。支持中英文,每个汉字/字母占一个字符,不超过 20000 个字符,超过部分会自动截断。在全能参考模式下,prompt 中可以用"图1""视频1"等指代 media 数组中对应顺序的媒体素材。
示例:一只小猫在月光下的屋顶上奔跑,城市的霓虹灯在远处闪烁,电影级画质,流畅运镜。
取值范围:length <= 20000
object[]
媒体素材数组,支持图像、视频、音频、文件和网页作为输入。和 prompt 必填其一。在参考生视频模式下,按照数组顺序定义 prompt 中素材引用的顺序(图和视频分别计数)。reference_xx/file/link 类型和 first_frame/last_frame 类型互斥,不能在同一请求中混用。
显示子属性
显示子属性
object
视频处理参数。
显示子属性
显示子属性
enum<string>
默认值"1080P"
生成视频的分辨率档位。
可选值:480P,720P,1080P
enum<string>
默认值"adaptive"
生成视频的宽高比。adaptive 表示根据输入媒体比例和意图自动推荐合适的长宽比。
可选值:adaptive,16:9,4:3,1:1,3:4,9:16
integer
默认值5
生成视频的时长,单位为秒。无视频输入时取值范围为 [2, 30] 的整数;有视频输入时输入视频总时长 + 输出视频时长不超过 30 秒。传 -1 时为智能时长模式,模型根据输入自动推荐合适时长。
boolean
默认值true
输出视频是否包含音频。true(默认):包含声音;false:不包含音轨。开关声音价格相同。
integer
随机种子,用于复现生成结果。
取值范围:0 <= x <= 2147483647
boolean
默认值false
是否添加水印标识。