试卷/习题能批量识别文字吗?
多张 试卷/习题 可以用批量 OCR 一次导入识别,可以添加文件上传,也可以拖拽文件到窗口,或用截图方式导入;结果能一键复制或导出 TXT。但 手写和公式识别弱,印刷正文较稳,批量出来的结果更要抽查关键字段。清晰度和字高不够的,批量也救不回,先把图拍清楚/扫到 300DPI 再上。
为什么会出现这个问题
这类问题没有万能的一键解,但按步骤排查,绝大多数情况十分钟内能搞定。
下面按先说结论、再给步骤、最后列注意点的顺序展开,着急的话可以直接看步骤部分。
具体怎么处理
- 批量 OCR 一次导入多张这一步别跳,前面省的事后面会加倍还。
- 结果抽查关键字段这
- 清晰度不够批量也没用这
注意这几点
- 竖排、手写体的识别率目前都不理想,重要内容建议人工录入
- 图片分辨率建议 300DPI 以上,字太小先放大再识别
- 识别英文和数字混排时留意全角半角,OCR 经常给出全角字符
本文涉及:试卷/习题识别、试卷/习题转文字、OCR、试卷/习题(试卷/习题 批量识别)。
小结
到这里问题应该已经解决了。这类操作做一次就有经验,下次再遇到同类需求可以直接套用同样的流程。
