跳转到主要内容
资料与数据处理

票据 / 文档识别归档

视觉理解读图,OCR 提取字段成 JSON 并给出归档文件名。

免责声明:本页展示内容均为 AI 模型生成,仅供参考,不构成任何效果承诺;实际产出效果与 Credits 消耗以平台用量统计为准。
本篇用一张真实发票(敏感字段已脱敏)跑通:把票据图丢给 qwen3.7-plus,一句话得到结构化 JSON 与按「日期_销售方_金额」规则生成的建议文件名,读图、提字段、命名归档一气呵成。 调用链:qwen3.7-plus(视觉理解,逐张 OCR + 结构化)→ 按字段重命名归档。

实测产出

以一张真实发票(敏感字段已脱敏)跑通,输出的 OCR 结构化结果:
脱敏发票
{"类型": "电子发票(普通发票)", "开票日期": "2026年01月20日", "销售方": "已脱敏", "金额": "28.87", "税额": "1.73", "价税合计": "30.60", "发票号码": "已脱敏"}
2026年01月20日_已脱敏_28.87

步骤:发票识别归档

把票据图片连同下面的指令发给 qwen3.7-plus
识别这张发票,提取为 JSON:{"类型":"","开票日期":"","销售方":"",
"金额":"","税额":"","价税合计":"","发票号码":""}。
图中被灰色块遮挡的字段(已脱敏),值填「已脱敏」,不要用可见残片拼凑。
然后按「日期_销售方_金额」格式给出建议文件名。只输出 JSON 和文件名两行。

说明

  • 消耗:本玩法涉及视觉理解(qwen3.7-plus 读图)。
  • 边界:图片本身会转成 tokens 计入输入,是这类任务的主要消耗来源,图片尺寸越大,通常消耗 Token 越多。
  • 脱敏:示例发票的企业名称、税号、发票号码、开票人均已脱敏处理。