前言

OCR图片转文字识别软件,完全离线。截屏/批量导入图片,支持多国语言、合并段落、竖排文字。可排除水印区域,提取干净的文本。基于 PaddleOCR 。

一、下载地址

下载链接: http://source/download 选择如下图红色框文件内容下载
在这里插入图片描述

二、安装步骤

1、解压后将Umi-OCR.exe发送到桌面快捷方式

在这里插入图片描述

2、点击桌面快捷方式

在这里插入图片描述

3、正常启用

在这里插入图片描述

三、使用步骤

1、以批量文档OCR识别为例,将图片型的pdf拖入到左侧

在这里插入图片描述

2、设置要转换的页数,默认是识别所有的,我这里选择特定页数(第4页),如下图,点击页数后会跳出弹出框进行设置

在这里插入图片描述

3、设置排版解析方案,我试了下,选择【单栏-总是换行】效果会更好,后续解析入库方便

在这里插入图片描述

4、点击【开始任务】,任务执行结束后查看记录

在这里插入图片描述

总结

其他功能页感兴趣的小伙伴可以自己研究下,目前这个只有window版本,有一定的局限性,我目前用的项目场景是,用vue做个按钮触发一个.bat的脚本,然后将文件批量上传到这里,接着将解析后的文件进行解析入库

点赞(0) 打赏

评论列表 共有 0 条评论

暂无评论

微信公众账号

微信扫一扫加关注

发表
评论
返回
顶部