LiteOCR 文本识别模块功能说明
功能介绍
文本识别模块可快速提取图片中的文字内容,转换为可编辑、可复制的纯文本。适用于截图取字、图片文字整理、中英文混合内容提取等日常办公、学习场景,提供轻量化、高效率的离线文字识别能力。
1.功能定位
- 专注图片文字提取与内容整理场景
- 提供轻量化、高速度的文本识别,支持文字复制与文档导出
- 独立识别代码链路运行,不依赖其他模块,结构简洁、低耦合
2.核心能力
- 双模式识别:支持快捷截图识别、本地图片拖拽识别两种输入方式
- 灵活复制能力:识别结果按原始文本分行展示,支持逐行精准复制、一键全量复制
- Word文档导出:识别结果可一键导出为 .docx 格式文档,方便二次编辑与存档
- 实时状态反馈:展示当前识别模式、数据统计、图片分辨率、识别耗时等运行信息
3.输入与输出格式
- 输入类型:本地图片文件
- 支持图片格式:.png、.jpg、.jpeg、.bmp、.tif、.tiff、.webp
- 输出形式:按文本行结构化输出纯文本内容,支持直接复制使用或导出为 .docx 文档
4. 文本处理规则
当前版本仅做轻量化文本规范化处理,不进行全局去空格操作,最大程度保留原文排版:
- 英文驼峰单词自动断词:
OpticalCharacter→Optical Character - 英文逗号后自动补全空格:
Recognition,OCR→Recognition, OCR - 中文内容完全保留原样,不做额外断词、修正处理
5. Word导出规则与默认路径
- 点击「导出Word」按钮,即可将全部识别结果保存为标准 .docx 文档
- 默认优先保存至系统桌面路径
- 路径容错机制:桌面路径不可用时,自动回退至
~/Desktop,仍不可用则最终回退到系统用户主目录,保证导出功能稳定可用
6. 项目运行依赖
模块运行需配置对应Python依赖库,具体依赖项如下:
- OCR识别引擎:
rapidocr_onnxruntime或pytesseract(二者安装其一即可正常使用) - 图像处理依赖:
OpenCV、NumPy - Word导出依赖:
python-docx
7. 系统平台支持
- 全功能兼容 Windows、macOS 双平台
- 截图识别(Alt + W)、拖拽导入、文本复制、Word导出等核心功能,在双平台体验与能力完全一致
8.软件整体界面展示
轻量化桌面端 OCR 识别工具 LiteOCR,整体界面如下,集成文本识别、表格识别、图片转 Excel、摄像头实时识别四大核心功能:

本项目配套说明文档托管地址:【进入项目】

截图识别快捷键:alt+w
浙公网安备 33010602011771号