LiteOCR 文本识别模块功能说明

 

功能介绍

文本识别模块可快速提取图片中的文字内容,转换为可编辑、可复制的纯文本。适用于截图取字、图片文字整理、中英文混合内容提取等日常办公、学习场景,提供轻量化、高效率的离线文字识别能力。

1.功能定位

  • 专注图片文字提取与内容整理场景
  • 提供轻量化、高速度的文本识别,支持文字复制与文档导出
  • 独立识别代码链路运行,不依赖其他模块,结构简洁、低耦合

2.核心能力

  • 双模式识别:支持快捷截图识别、本地图片拖拽识别两种输入方式
  • 灵活复制能力:识别结果按原始文本分行展示,支持逐行精准复制、一键全量复制
  • Word文档导出:识别结果可一键导出为 .docx 格式文档,方便二次编辑与存档
  • 实时状态反馈:展示当前识别模式、数据统计、图片分辨率、识别耗时等运行信息

3.输入与输出格式

  • 输入类型:本地图片文件
  • 支持图片格式:.png、.jpg、.jpeg、.bmp、.tif、.tiff、.webp
  • 输出形式:按文本行结构化输出纯文本内容,支持直接复制使用或导出为 .docx 文档

4. 文本处理规则

当前版本仅做轻量化文本规范化处理,不进行全局去空格操作,最大程度保留原文排版:
  • 英文驼峰单词自动断词:OpticalCharacterOptical Character
  • 英文逗号后自动补全空格:Recognition,OCRRecognition, OCR
  • 中文内容完全保留原样,不做额外断词、修正处理

5. Word导出规则与默认路径

  • 点击「导出Word」按钮,即可将全部识别结果保存为标准 .docx 文档
  • 默认优先保存至系统桌面路径
  • 路径容错机制:桌面路径不可用时,自动回退至 ~/Desktop,仍不可用则最终回退到系统用户主目录,保证导出功能稳定可用

6. 项目运行依赖

模块运行需配置对应Python依赖库,具体依赖项如下:
  • OCR识别引擎:rapidocr_onnxruntimepytesseract(二者安装其一即可正常使用)
  • 图像处理依赖:OpenCVNumPy
  • Word导出依赖:python-docx

7. 系统平台支持

  • 全功能兼容 Windows、macOS 双平台
  • 截图识别(Alt + W)、拖拽导入、文本复制、Word导出等核心功能,在双平台体验与能力完全一致

8.软件整体界面展示

轻量化桌面端 OCR 识别工具 LiteOCR,整体界面如下,集成文本识别、表格识别、图片转 Excel、摄像头实时识别四大核心功能:

image

 本项目配套说明文档托管地址:【进入项目

posted @ 2026-08-03 19:05  初夏_雨露  阅读(4)  评论(0)    收藏  举报