批量图片 OCR 文字提取失败或结果异常?排错指南
排查批量图片 OCR 文字提取的扩展名、文件结构、依赖、编码、内存和结果误差,同时保留原文件。
先保留原文件
不要改后缀后覆盖源文件,也不要把网页预览当成唯一验收记录。复制一份小样本并记录文件大小、来源软件、版本、浏览器和完整错误提示。
这个格式最容易忽略的事实
例如 12 张按 page-01 到 page-12 命名的扫描页。开始前确认顺序,完成后抽查每页首尾句,再下载带文件名分隔符的汇总文本。
推荐排查顺序
- 使用页面示例或较小的已知正常文件,确认工具本身能够运行。
- 检查扩展名、文件签名、配套文件、远程 URL 和 CORS,排除下载到 HTML 错误页。
- 对照操作步骤重新提供输入:
- 选择少量图片并检查排序。
- 统一设置主要语言,删除模糊或无关页面。
- 开始后逐张等待并查看错误状态。
- 抽查每页后下载带文件名分隔的汇总文本。
- 关闭占内存的标签页并使用最新版 Chrome 或 Edge 重试。
- 仍异常时回到生成文件的专业软件重新导出,在目标系统复核。
常见问题与答案
可以处理多少张?
以页面显示的总大小限制为准;建议先用 5–20 张测试设备性能。
为什么顺序不对?
工具按选择后的列表顺序处理,请在开始前拖动或按文件名整理。
批量图片会上传吗?
文件在当前浏览器标签页中处理,不会为了运行该功能上传到 FreeTool 服务器。
不应绕过的限制
- 不是后台任务,关闭或刷新会中断
- 受浏览器内存和 CPU 限制,不适合数百页
- 不自动恢复复杂排版或表格结构
隐私处理
本地输入不会为了处理上传到 FreeTool;远程 IIIF/DZI URL 会由浏览器访问来源服务器。排错截图、OCR 文本、模型摘要和转换文件可能包含敏感或受版权保护内容,分享前应脱敏并确认权限。