案例12:截图OCR识别与文字提取
适用场景
需要从大量截图、扫描件中提取文字信息(如聊天记录截图、合同扫描件、发票照片)。
操作步骤
- 打开WorkBuddy,新建对话,切换至Craft模式
- 将截图/扫描件文件拖拽到输入框,或选择工作空间目录指向图片文件夹
- 输入OCR识别与文字提取指令
- AI自动对每张图片执行OCR识别
- 提取文字内容,按图片文件名分组整理
- 可选:进一步结构化提取(如从发票提取金额、日期、编号)
- 输出为Excel或Word文档
指令模板
对这批截图执行OCR文字识别,提取所有文字内容。按图片文件名分组输出识别结果。如果是发票/合同截图,进一步提取:金额、日期、编号、对方名称等关键字段,汇总到Excel表格。如果是聊天记录截图,提取对话内容和时间戳。
涉及 Skills / 专家 / 连接器
OCR识别能力、多模态处理、Excel生成Skill
注意事项与技巧
- 图片清晰度直接影响OCR准确率,模糊图片建议先放大增强
- 中文识别准确率通常高于手写体
- 可创建自建Skill"发票OCR提取器"专用于发票识别
效率提升
1小时→3分钟