本地离线可用!一款开源免费的 OCR 文字识别工具!
大家好,我是 Java陈序员。
在日常工作中,我们经常需要提取截图、PDF、照片里的文字。但市面上大多在线 OCR 工具需要上传到服务端进行处理,私密截图、涉密合同存在隐私泄露风险。而且有些工具不仅收费,而且限制批量处理。
今天,给大家介绍一款开源免费的 OCR 文字识别工具,纯本地离线使用!
关注微信公众号:【Java陈序员】,获取开源项目分享、AI副业分享、超200本经典计算机电子书籍等。
项目介绍
Umi-OCR —— 一款开源、免费的离线 OCR 软件,支持截屏、批量导入图片和 PDF 文档识别,可排除水印、页眉页脚,通知支持扫描、生成二维码,还内置多国语言库。

功能特色:
- 开箱即用:Windows 解压压缩包双击即可运行,Linux 提供启动脚本,无需配置 Python 和模型依赖
- 纯本地离线使用:所有图片、PDF 文件识别仅在本地处理,无需上传服务端,断网环境也能正常使用
- 多引擎高效识别:内置 PaddleOCR、RapidOCR 双引擎,可一键切换,支持多国文字识别
- 批量处理:可批量识别图片,并支持扫描 PDF 文档进行文字提取,同时支持识别二维码
- 开放调用:提供命令行、HTTP 接口,支持自动化脚本、二次开发集成
快速上手
Umi-OCR 的使用十分简单,只需要下载安装包解压即可使用。
1、打开下载地址
https://github.com/hiroi-sora/Umi-OCR/releases/
2、下载安装包并运行解压

说明:
.7z.exe为自解压包,可以用压缩软件打开,也可以在没有安装压缩软件的电脑上直接双击解压- Paddle 引擎插件版:性能好、速度快、占用率高、适合高配机器,不兼容奔腾、赛扬、凌动 CPU
- Rapid 引擎插件版:速度稍慢、内存占用低、适合低配机器,兼容性好
3、解压后,双击运行 Umi-OCR.exe 即可开始使用
功能体验
- 功能页

- 截图 OCR


- 批量 OCR

- 批量文档

- 二维码

- 全局设置

可以说,Umi-OCR 是一款真正意义上免费、纯净的离线开源 OCR 工具。不仅支持快捷键截图识别、批量图片文字提取,还能解析扫描 PDF 文档,最主要的是解压即用,无需额外配置,纯本地离线可用。快去下载试试吧~
项目地址:https://github.com/hiroi-sora/Umi-OCR
最后
推荐的开源项目已经收录到 GitHub 项目,欢迎 Star:
https://github.com/chenyl8848/great-open-source-project
或者访问网站,进行在线浏览:
https://chencoding.top:8090/#/

我创建了一个开源项目交流群,方便大家在群里交流、讨论开源项目。
但是任何人在群里打任何广告,都会被 T 掉。
如果你对这个交流群感兴趣或者在使用开源项目中遇到问题,可以通过如下方式进群:
关注微信公众号:【Java陈序员】,回复【开源项目交流群】进群,或者通过公众号下方的菜单添加个人微信,并备注【开源项目交流群】,通过后拉你进群。
大家的点赞、收藏和评论都是对作者的支持,如文章对你有帮助还请点赞转发支持下,谢谢!
Umi-OCR —— 一款开源、免费的离线 OCR 软件,支持截屏、批量导入图片和 PDF 文档识别,可排除水印、页眉页脚,通知支持扫描、生成二维码,还内置多国语言库。
浙公网安备 33010602011771号