python读图上文字的代码。linux

我完全按照AI给的思路进行。
1、安装工具
sudo apt update
sudo apt install -y tesseract-ocr tesseract-ocr-chi-sim xclip
验证:输tesseract --version,能看到版本号就说明装对了
这些分别是:OCR识别引擎、中文语言包、剪贴板读取工具,缺一个都用不了
后续代码其实不需要安装剪贴板读取工具。

2、建Python虚拟环境(避免污染系统Python,规范操作)

建专属项目文件夹,以后代码都放这

mkdir -p ~/ocr-tool && cd ~/ocr-tool

建虚拟环境

python3 -m venv .venv

激活虚拟环境(激活后终端前面会多出 (.venv) 的标志,很重要!)

source .venv/bin/activate

装Python依赖包

pip install pytesseract pillow pyperclip

3、写OCR代码
在VS Code里点「文件→新建文件」,保存为 ocr_clipboard.py,放到刚才的~/ocr-tool目录里
import pytesseract
from PIL import Image

def ocr_image_file():
# 直接读取桌面上的图片
img_path = "/home/kali/Desktop/test.png"
try:
img = Image.open(img_path)
# 识别文字
text = pytesseract.image_to_string(img, lang='chi_sim+eng')
print("✅ 识别成功!结果如下:")
print("-" * 30)
print(text.strip())
print("-" * 30)
except FileNotFoundError:
print(f"❌ 没找到图片,请确认 {img_path} 是否存在")

if name == 'main':
ocr_image_file()
保存后运行
python ./orc_clipboard.py

posted @ 2026-08-01 11:50  方才多有冒犯  阅读(2)  评论(0)    收藏  举报