批量PDF文字识别工具用于将扫描版 PDF、图片型文档和不可复制文字的资料批量转换为可检索内容。软件支持多文件与目录导入、下级目录扫描、原路径结构保留和指定页码范围,可选择多栏、单栏、自然段、逐行、连续文本等排版方式,并设置最低置信度、方向校正、表格识别、批次数量和同名处理。结果可导出 TXT、Word、JSON 或可搜索 PDF,适合合同与档案数字化、书刊资料整理、扫描报告检索和批量文档归档。
产品概述
扫描版 PDF 批量识别
批量提取图片型 PDF 中的正文和表格,让内容可编辑、可检索。
按页范围精准处理
可指定全部页面或自定义页码范围,减少不必要的等待与输出。
四类结果输出
按需要生成 TXT、Word、JSON 或带检索文字的 PDF。