要是您手里有不少带文字的图片需要批量识别,不妨先用极轻PDF(pdf.cn)将这些图片合成一个PDF,然后利用它的「OCR PDF」功能生成能搜索、可选中文字的PDF。不过要注意,目前该工具无法直接导出可编辑文档,识别结果还需人工校对一遍。
第一阶段:把多张图片合成PDF
步骤一:选择并上传多张图片
打开「图片转PDF」页面,点击「选择多个图片」上传需要识别的图片。上传前记得把方向不对的图片转正,删掉重复或者模糊的页面。

步骤二:核对图片顺序并开始转换
检查下图片的数量、文件名和排列顺序,确认没问题就点「开始转换」。这里的排列顺序直接影响合成后PDF的页序,别排错哦。

步骤三:下载合成的PDF
处理完成后点「下载」,先打开PDF看看图片完不完整、顺序对不对,没问题再进入OCR识别环节。

第二阶段:用OCR识别PDF文字
步骤一:上传扫描版PDF
进入「OCR PDF」页面,点击「选择PDF文件」,将刚才合成好的文档上传。请注意,单次任务仅能上传一个PDF文件。若文件过大,可先进行拆分,再分别进行识别。

步骤二:确认文件并开始OCR
核对好文件名、大小和状态后,点「开始转换」,等着系统完成文字识别就好。

步骤三:下载并校对识别结果
进度到100%之后点「下载」。打开结果文件试试能不能搜索或者选中文字,还要重点核对数字、表格、专有名词和模糊字符哦。
