PDF文件通过VL模型解析
PDF理解功能使模型能够解析并理解PDF文档,提取文档中的文字与图片内容进行分析。您可以通过 OpenAI 兼容的 Chat Completions 接口或 DashScope 接口,以 URL 或 Base64 编码方式传入 PDF 文件。
qwen3.8-max
运行以下代码,向模型传入PDF文件。
获取千问AI平台 API Key并配置环境变量。
如果无法提供文件的URL地址,也可以将PDF文件以Base64编码字符串的形式传入。使用
文件输入通过content数组中的元素指定,OpenAI兼容协议使用
OpenAI兼容协议格式:
计费涉及以下方面:
如果调用失败,请参阅错误码。
暂不支持通过 Responses API 调用 PDF 理解功能。
支持的模型
qwen3.8-max
快速开始
运行以下代码,向模型传入PDF文件。
获取千问AI平台 API Key并配置环境变量。
- OpenAI 兼容
- DashScope
使用Base64输入
如果无法提供文件的URL地址,也可以将PDF文件以Base64编码字符串的形式传入。使用 file_data 时,filename 字段为必填项。
- OpenAI 兼容
- DashScope
Python
请求参数
文件输入通过content数组中的元素指定,OpenAI兼容协议使用 type: "file" 类型,DashScope协议使用包含 file_url/file_data 的元素。
协议中 URL 部分仅支持字符串输入,不支持 list(数组)形式。
| 参数 | 类型 | 是否必填 | 说明 |
|---|---|---|---|
file_url | string | 二选一必填 | 指定PDF文件的下载地址,和 file_data 二选一必填。 |
file_data | string | 二选一必填 | Base64格式的PDF文件输入,格式为 data:application/pdf;base64,xxx,和 file_url 二选一必填。 |
filename | string | 条件必填 | 文件名,使用 file_data 作为入参时必填。 |
file_format | string | 否 | 文件格式,可选参数,当前仅支持 pdf,默认 pdf。 |
限制说明
| 项目 | 限制 |
|---|---|
| 单文件大小限制 | 150MB |
| 单文档页数限制 | 500页 |
PDF解析可能比普通文本请求耗时更长,首包超时时间最长为300秒,建议使用流式输出方式实时获取结果,避免长时间等待。
计费说明
计费涉及以下方面:
- 模型调用费用:PDF文件解析出的文字与图片会计入模型的输入Token,按照模型的标准输入价格计费。
- 文档解析费用:按PDF文档解析的页数计费,0.02元/页。