视觉理解读图,OCR 提取字段成 JSON 并给出归档文件名。
说明
免责声明:本页展示内容均为 AI 模型生成,仅供参考,不构成任何效果承诺;实际产出效果与 Credits 消耗以控制台「用量详情」为准。本篇用一张真实发票(敏感字段已脱敏)跑通:把票据图丢给 qwen3.7-plus,一句话得到结构化 JSON 与按「日期_销售方_金额」规则生成的建议文件名,读图、提字段、命名归档一气呵成。
调用链:qwen3.7-plus(视觉理解,逐张 OCR + 结构化)→ 按字段重命名归档。
实测产出
以一张真实发票(敏感字段已脱敏)跑通,输出的 OCR 结构化结果:
{"类型": "电子发票(普通发票)", "开票日期": "2026年01月20日", "销售方": "已脱敏", "金额": "28.87", "税额": "1.73", "价税合计": "30.60", "发票号码": "已脱敏"}
2026年01月20日_已脱敏_28.87
步骤:发票识别归档
把票据图片连同下面的指令发给 qwen3.7-plus:
识别这张发票,提取为 JSON:{"类型":"","开票日期":"","销售方":"",
"金额":"","税额":"","价税合计":"","发票号码":""}。
图中被灰色块遮挡的字段(已脱敏),值填「已脱敏」,不要用可见残片拼凑。
然后按「日期_销售方_金额」格式给出建议文件名。只输出 JSON 和文件名两行。
说明
- 消耗:本玩法涉及视觉理解(
qwen3.7-plus读图)。 - 边界:图片本身会转成 tokens 计入输入,是这类任务的主要消耗来源,图片尺寸越大,通常消耗 Token 越多。
- 脱敏:示例发票的企业名称、税号、发票号码、开票人均已脱敏处理。
该文章对您有帮助吗?