WorkBuddy 实战蓝皮书
🏠 主页

案例12:截图OCR识别与文字提取

案例编号 12 · 效率提升 1小时→3分钟

适用场景

需要从大量截图、扫描件中提取文字信息(如聊天记录截图、合同扫描件、发票照片)。

操作步骤

  1. 打开WorkBuddy,新建对话,切换至Craft模式
  2. 将截图/扫描件文件拖拽到输入框,或选择工作空间目录指向图片文件夹
  3. 输入OCR识别与文字提取指令
  4. AI自动对每张图片执行OCR识别
  5. 提取文字内容,按图片文件名分组整理
  6. 可选:进一步结构化提取(如从发票提取金额、日期、编号)
  7. 输出为Excel或Word文档

指令模板

对这批截图执行OCR文字识别,提取所有文字内容。按图片文件名分组输出识别结果。如果是发票/合同截图,进一步提取:金额、日期、编号、对方名称等关键字段,汇总到Excel表格。如果是聊天记录截图,提取对话内容和时间戳。

涉及 Skills / 专家 / 连接器

OCR识别能力、多模态处理、Excel生成Skill

注意事项与技巧

  • 图片清晰度直接影响OCR准确率,模糊图片建议先放大增强
  • 中文识别准确率通常高于手写体
  • 可创建自建Skill"发票OCR提取器"专用于发票识别

效率提升

1小时→3分钟