大家好,我是 Java陈序员。
在日常工作中,我们经常需要提取截图、PDF、照片里的文字。但市面上大多在线 OCR 工具需要上传到服务端进行处理,私密截图、涉密合同存在隐私泄露风险。而且有些工具不仅收费,而且限制批量处理。
今天,给大家介绍一款开源免费的 OCR 文字识别工具,纯本地离线使用!
项目介绍
Umi-OCR —— 一款开源、免费的离线 OCR 软件,支持截屏、批量导入图片和 PDF 文档识别,可排除水印、页眉页脚,通知支持扫描、生成二维码,还内置多国语言库。
功能特色:
- 开箱即用:Windows 解压压缩包双击即可运行,Linux 提供启动脚本,无需配置 Python 和模型依赖
- 纯本地离线使用:所有图片、PDF 文件识别仅在本地处理,无需上传服务端,断网环境也能正常使用
- 多引擎高效识别:内置 PaddleOCR、RapidOCR 双引擎,可一键切换,支持多国文字识别
- 批量处理:可批量识别图片,并支持扫描 PDF 文档进行文字提取,同时支持识别二维码
- 开放调用:提供命令行、HTTP 接口,支持自动化脚本、二次开发集成
快速上手
Umi-OCR 的使用十分简单,只需要下载安装包解压即可使用。
1、打开下载地址
https://github.com/hiroi-sora/Umi-OCR/releases/
2、下载安装包并运行解压
说明:
.7z.exe为自解压包,可以用压缩软件打开,也可以在没有安装压缩软件的电脑上直接双击解压- Paddle 引擎插件版:性能好、速度快、占用率高、适合高配机器,不兼容奔腾、赛扬、凌动 CPU
- Rapid 引擎插件版:速度稍慢、内存占用低、适合低配机器,兼容性好
3、解压后,双击运行 Umi-OCR.exe 即可开始使用
功能体验
- 功能页
- 截图 OCR
- 批量 OCR
- 批量文档
- 二维码
- 全局设置
可以说,Umi-OCR 是一款真正意义上免费、纯净的离线开源 OCR 工具。不仅支持快捷键截图识别、批量图片文字提取,还能解析扫描 PDF 文档,最主要的是解压即用,无需额外配置,纯本地离线可用。快去下载试试吧~
项目地址:https://github.com/hiroi-sora/Umi-OCR
最后
推荐的开源项目已经收录到 GitHub 项目,欢迎 Star:
https://github.com/chenyl8848/great-open-source-project
或者访问网站,进行在线浏览:
https://chencoding.top:8090/#/
大家的点赞、收藏和评论都是对作者的支持,如文章对你有帮助还请点赞转发支持下,谢谢!