将文本、图像和视频转换为统一语义空间中的数值向量,用于跨模态检索、相似度搜索和内容分类。
本 API 常见的错误码及排查方向如下。完整错误码请参见通用错误码。
开始前:获取 API Key,将其设置为环境变量,如需使用 SDK 请先安装 DashScope SDK。
请求地址
- HTTP:
POST https://maas.qianwenaiapi.com/api/v1/services/embeddings/multimodal-embedding/multimodal-embedding - SDK
base_http_api_url:https://maas.qianwenaiapi.com/api/v1
模型概览
| 模型 | 支持模态 | 向量维度 | 单张图片大小 |
|---|---|---|---|
| qwen3-vl-embedding | 文本、图像、视频 | 2560(默认)、2048、1536、1024、768、512、256 | 10 MB |
| qwen2.5-vl-embedding | 文本、图像、视频 | 2048、1024(默认)、768、512 | 5 MB |
| tongyi-embedding-vision-plus-2026-03-06 | 文本、图像、视频、多图 | 1152(默认)、1024、512、256、128、64 | 建议 5 MB,最大 10 MB |
| tongyi-embedding-vision-flash-2026-03-06 | 文本、图像、视频、多图 | 768(默认)、512、256、128、64 | 建议 5 MB,最大 10 MB |
| tongyi-embedding-vision-plus | 文本、图像、视频、多图 | 1152 | 3 MB |
| tongyi-embedding-vision-flash | 文本、图像、视频、多图 | 768 | 3 MB |
使用说明
- 图像输入:公网 URL 或 Base64 数据 URI(
data:image/{format};base64,{data})。 - 多图输入:使用
multi_images字段,值为图像 URL 列表,最多 8 张。 - 视频输入:必须为公网 URL。通过
parameters中的fps参数控制采样帧率(取值范围 [0, 1],默认 1.0)。
错误码
本 API 常见的错误码及排查方向如下。完整错误码请参见通用错误码。
| 错误码 | HTTP 状态码 | 触发条件 | 排查建议 |
|---|---|---|---|
InvalidApiKey | 401 | API Key 无效或已过期,返回 Invalid API-key provided. | 确认 Authorization 请求头为 Bearer sk-xxx 格式,且使用的是当前账号下有效的 API Key。 |
BadRequest.EmptyModel | 400 | 请求中缺少 model 字段,返回 Required parameter model missing from request. | 在请求体中补充 model 字段,取值使用本文模型列表中的模型名称。 |
InvalidParameter | 400 | model 取值不存在,返回 Model not exist. | 核对 model 拼写,确认使用了本文模型列表中的模型名称。 |
InvalidParameter | 400 | input.contents 缺失或为空数组,返回 input can not be empty: input.contents 或 contents input can not be empty: input.contents | 确认 input.contents 存在且为非空数组,数组中每个元素包含有效的 text、image 或 video 键。 |
InvalidParameter | 400 | dimension 取值不在所选模型支持的向量维度范围内。 | 按本文模型列表中该模型支持的向量维度取值;multimodal-embedding-v1 不支持 dimension 参数,固定为 1024 维。 |
InternalError.Algo | 500 | 请求体结构不完整或 input.contents 元素格式异常,导致服务端处理失败。 | 检查请求体结构,确认 input 及 input.contents 字段存在且元素格式符合本文请求参数说明;结构无误仍持续报错时,携带 request_id 联系技术支持。 |
鉴权
string
header
必填
千问AI平台 API Key。详见获取 API Key。